Argmin AIは、ルール・ドキュメント・事例をもとに、リリース前に実行できるAI評価を作成。MLチームや独自コード不要で品質チェックを行いたい製品・エンジニア向け。
BaseRTはApple Silicon Mac向けのLLMランタイム。ローカルモデルを自分のデバイスで実行し、オンデバイス推論とローカルなコーディングエージェント運用に対応。
Kimi K3はMoonshot AIのコーディング、知識作業、推論向けフロンティアモデル。Kimi.com、Kimi Work、Kimi Code、Kimi APIで利用でき、100万トークンのコンテキストとネイティブ画像対応を備えています。
Zroは、EUインフラ上で動作し、OpenAI互換・Anthropic互換アクセスに対応したコーディングエージェント向けのプライベート推論エンドポイントです。リクエスト保持ゼロを求める開発者やチームに最適です。
derouter.ai は、Claude と GPT モデル向けの Web API。Anthropic と OpenAI の公式インターフェースに近い使い方で、固定の割引トークン料金を提供し、Claude Code、Codex CLI、GPT Image 2 にも対応。
SuperCompressは、LLM向けのクエリ対応コンテキスト圧縮ツールです。推論前に入力トークンを削減し、答えに重要な根拠を保持します。オープンソースで、CPUで動作し、ホスト型APIとPythonパッケージで利用できます。
Muse Spark 1.1は、Meta Superintelligence Labsのマルチモーダル推論モデル。エージェントタスク、コーディング、PC操作、画像・音声を含む理解に対応し、Meta Model APIで公開プレビュー提供中。
Aurikoは、複数のモデルプロバイダーを1回の統合で利用できるLLM推論ルーティングAPIです。キャッシュを考慮したコスト最適化、ルーティング制御、AIアプリの信頼性向上に対応します。
Opper AIは、300以上のモデルをOpenAI SDK互換APIで利用できるEUホストのAIゲートウェイ。ルーティング、可観測性、ガードレール、コンプライアンスも提供。
Constellation Gate AI は、AIエージェント向けのゲートウェイ。リクエストの検査、機密データのマスキング、改ざん検知型監査ログの記録、トークン使用量の削減に対応し、デスクトップツール、CLI、SDK設定をコード変更なしで利用できます。
LongCat-2.0は、1.6兆パラメータ規模で国内チップのみで学習されたLongCat AIのモデル発表です。価格ページの公開も確認できます。
TuneLLMは、ClaudeやGPT系の反復ワークフローを自社インフラ内で小型のファインチューニング済みモデルに変換する企業向けAI基盤です。低い推論コストで狭いLLMタスクの品質をベンチマーク可能にします。
Alvoff Inferenceは、音声認識・音声合成・埋め込み・チャット/コード生成向けのOpenAI互換API。base URLを切り替え、使い慣れたSDKのまま従量課金で利用できます。
RunInfra は、GPU のベンチマーク、対応ランタイムの最適化、管理 API の提供またはセルフホスト用のエクスポートで、オープンソースモデルを本番推論スタックへ変換します。
ClinePassは、Clineで厳選されたopen weightモデルを利用できる有料サブスク。Product Huntの初月プロモーション付きで、IDEやCLIの開発環境を手軽に始めたい開発者向け。
discode.aiは、複数モデルにプロンプトを振り分けるブラウザ型AIチャット。環境負荷、ローカルプライバシー、マルチモデル検証を制御できます。
Heronは、AIエージェントとLLM API向けの受動的オブザーバビリティツール。SDK変更やインパクトパスのプロキシなしで、ネットワーク通信からターンやツール呼び出し、LLM連携を復元します。
Oxlo.aiは、OpenAI互換のAI inference API。リクエストベースの月額課金で、アシスタントや文書ワークフローなど本番推論のコストを予測しやすくします。
Crewdle Chatは、GPT、Claude、Gemini、Grokを1つのチャットワークスペースに統合し、ビジネスチーム向けに提供します。Web検索、アップロード文書、トークン課金に対応し、1席ごとの料金はありません。
TruthAgentは、1つの質問を複数のAIモデルで比較し、合意点・相違点・信頼度を可視化するWebアプリです。無料枠に加え、より深い調査と意思決定支援向けのPro、Pro+プランも用意しています。