ローカルでの呼び出し単位計測
プロキバイダが報告する使用量、価格の証跡、リクエストとレスポンスのメタデータ、ステータス、タイミング、リトライの証跡、およびプロキシが実際に確認した呼び出しに関する検出シグナルを計測します。
inferock-bench は、メータリングされた LLM API トラフィック向けのローカル診断プロキシです。リクエストを localhost 経由でルーティングし、呼び出しごとのイベントを記録し、それらのイベントを使用量、タイミング、失敗、請求関連シグナルを要約したレシートに変換します。
このプロジェクトは、AI 支出と請求整合性を呼び出し単位で確認する必要がある人向けです。README では、AI または LLM の請求を監査し、トークン使用量をローカルで確認し、失敗した API 呼び出しが請求された可能性があるかを調べるための手段として説明されています。
プロキバイダが報告する使用量、価格の証跡、リクエストとレスポンスのメタデータ、ステータス、タイミング、リトライの証跡、およびプロキシが実際に確認した呼び出しに関する検出シグナルを計測します。
課金や監査ログに影響しうる配信失敗を記録します。これには、請求済みの空出力、拒否、切り詰め、トークン再計数の不一致、重複リクエスト ID、キャッシュ割引リスクの証跡、プロバイダ障害によるリトライが含まれます。
各サーフェスに watched-clean、signal、not-openable を付与し、ユーザーがチェック未実施の箇所を、クリーンな結果と誤解しないようにします。
保存されたイベント記録から、同梱の @inferock/measure グレーディングコードと The Inferock Standard を使ってレシートを生成します。
プロバイダのキーはプロキシのワークフロー内にローカルで保持し、Inferock には送信しません。レシートも、ユーザーが共有しない限りローカルに残ります。
4 つの計測済みプロバイダ平面を対象としつつ、現時点ではまだ計測されていない他のサーフェスにも拡張できるようにしています。
何が請求され、何が失敗し、どのタイミングやリトライの証跡がリクエストに付随していたかを、呼び出し単位で記録したいときにプロキシを使います。
請求書の合計やダッシュボードの要約を頼る前に、自分のマシン経由でルーティングされたプロバイダ呼び出しのトークン使用量をローカルで確認するために使います。
失敗したリクエストが課金に影響した可能性がある場合、特に空出力、拒否、切り詰め、リトライ動作を含むケースで、レシート出力を使って調査します。
サーフェスが正常に監視されたか、シグナルが出たか、計測実行で開けなかったかを、カバレッジ状態ラベルで確認します。
プロバイダのキーや生の請求データを第三者に送るのではなく、自分の環境に保持できる証跡が必要なときに、ローカルの記録とレシートを使います。
ローカルの診断プロキシで、localhost 経由でルーティングされた呼び出しを計測し、記録されたイベントからレシートを生成します。README では、OpenAI、Anthropic、Gemini Developer API、固定 OpenRouter エンドポイント向けのローカル LLM コスト追跡プロキシとして説明されています。
README では、OpenAI、Anthropic、Gemini Developer API、固定 OpenRouter エンドポイントが計測対象のプロバイダ平面として挙げられています。また、OpenRouter の対象には meta-llama、deepseek、mistral、moonshot/kimi、z-ai/glm、qwen などの確認済みホストが含まれると記載されています。
このプロジェクトは、AI または LLM の請求を監査し、トークン使用量をローカルで計測し、失敗した API 呼び出しが課金に影響した可能性があるかを調べるのに役立つよう設計されています。特に、呼び出し単位のレシートと請求整合性の確認に重点があります。
このベンチマークはローカルのイベント記録を保存し、付属の @inferock/measure のグレーディングコードと The Inferock Standard を使ってレシートを生成します。README では、ユーザーが共有しない限りレシートはローカルに残ると強調されています。
いいえ。README では、ローカルプロキシをバイパスしたトラフィックの監査、見えない呼び出しにまたがるプロバイダ支出の上限管理、対応する請求書がない月次請求の説明はできないとしています。また、計測対象外の範囲は「拡張可能な設計」であり、現時点では計測されないとも述べています。
ByteAskは、C/C++向けのターミナル起点AIコーディングエージェント。リポジトリを編集し、コンパイラやデバッガ、サニタイザ、テストで変更を検証してから差分を表示。無料枠あり。
Manta AIは、URLからアプリの挙動を把握し、回帰を検出し、スクリプトやセレクタ管理なしでテストを生成できる自律型Webアプリテストツールです。
PromptScoutは、ChatGPT、Gemini、Google AI Overviews、Perplexityで自社や競合がどう言及されるかを追跡し、ソース分析とサイト監査を組み合わせて、次に直すべき内容・訴求・サイト対応を判断できます。
CreateOS Sandboxは、FirecrackerマイクロVM上でコードやエージェントのワークロードを実行できる分離型コンピュート環境です。SDK、CLI、MCPで制御可能。
Sleek Analyticsは、Cookieバナー不要で導入も簡単なプライバシー重視のWeb解析ツール。リアルタイム訪問者追跡、Core Web Vitals、収益アトリビューションに対応。
hobは、エージェントのセッション、ターミナル、履歴、後続作業を、既存のツールやプロバイダーに合わせて整理できる独立したコーディングエージェント向けワークスペース。ローカルでの制御を重視する開発者に最適。