Open measurement infrastructure for AI agents. Our audit of 124 usage tools found 45+ verified billing bugs — 19 fixes landed upstream. Conformance fixtures for token accounting: PASS / FAIL / UNPROVABLE in CI.

agent-economy agent-evaluation agent-observability agentic-ai ai-agents ai-metrics claude-code codex developer-tools llm llm-agents mcp measurement metrics open-standard opentelemetry standards token-accounting token-usage usage-tracking
3 Open Issues Need Help Last updated: Sep 22, 2026

Open Issues Need Help

View All on GitHub

Open measurement infrastructure for AI agents. Our audit of 124 usage tools found 45+ verified billing bugs — 19 fixes landed upstream. Conformance fixtures for token accounting: PASS / FAIL / UNPROVABLE in CI.

Python
#agent-economy#agent-evaluation#agent-observability#agentic-ai#ai-agents#ai-metrics#claude-code#codex#developer-tools#llm#llm-agents#mcp#measurement#metrics#open-standard#opentelemetry#standards#token-accounting#token-usage#usage-tracking

Open measurement infrastructure for AI agents. Our audit of 124 usage tools found 45+ verified billing bugs — 19 fixes landed upstream. Conformance fixtures for token accounting: PASS / FAIL / UNPROVABLE in CI.

Python
#agent-economy#agent-evaluation#agent-observability#agentic-ai#ai-agents#ai-metrics#claude-code#codex#developer-tools#llm#llm-agents#mcp#measurement#metrics#open-standard#opentelemetry#standards#token-accounting#token-usage#usage-tracking

Open measurement infrastructure for AI agents. Our audit of 124 usage tools found 45+ verified billing bugs — 19 fixes landed upstream. Conformance fixtures for token accounting: PASS / FAIL / UNPROVABLE in CI.

Python
#agent-economy#agent-evaluation#agent-observability#agentic-ai#ai-agents#ai-metrics#claude-code#codex#developer-tools#llm#llm-agents#mcp#measurement#metrics#open-standard#opentelemetry#standards#token-accounting#token-usage#usage-tracking