Context: tokentelemetry#45 uncovers provider billing nuances around drain-priority that affect enforcement:
Anthropic (3-tier, no spillover):
- Subscription limits → interactive
claude, Cowork (separate, no spillover)
- Agent SDK credit ($20/mo Pro) →
claude -p, SDK, GitHub Actions (drains first)
- Usage credits / API key → pay-as-you-go (drains after SDK credit)
OpenAI/Codex (2-tier, OAuth covers both):
- ChatGPT subscription OAuth → Codex CLI (interactive) +
codex app-server (programmatic)
Gap in hermes-telemetry: Current budget model has single cost bucket → can't enforce per-bucket limits or route by task-type (interactive|programmatic).
Ask: Credit bucket model with drain_priority + task_type_routing so pre_tool_call gate can enforce per-bucket limits respecting drain order.
See tokentelemetry#45 comment for full details and possible collab opportunity there: VasiHemanth/tokentelemetry#45 (comment)
See also broader discussion on external power-cost config for local/subscription models: VasiHemanth/tokentelemetry#49
Context: tokentelemetry#45 uncovers provider billing nuances around drain-priority that affect enforcement:
Anthropic (3-tier, no spillover):
claude, Cowork (separate, no spillover)claude -p, SDK, GitHub Actions (drains first)OpenAI/Codex (2-tier, OAuth covers both):
codex app-server(programmatic)Gap in hermes-telemetry: Current budget model has single cost bucket → can't enforce per-bucket limits or route by task-type (
interactive|programmatic).Ask: Credit bucket model with
drain_priority+task_type_routingso pre_tool_call gate can enforce per-bucket limits respecting drain order.See tokentelemetry#45 comment for full details and possible collab opportunity there: VasiHemanth/tokentelemetry#45 (comment)
See also broader discussion on external power-cost config for local/subscription models: VasiHemanth/tokentelemetry#49