コンパクトな2Bクラスモデル
このモデルは、密なTransformerで2,516,756,480個のパラメータを持ち、はるかに大規模なモデルを必要としないアプリケーション向けに、コンパクトな選択肢を提供します。
MiniCPM5-2Bは、ローカルアシスタント、コーディングエージェント、ツール利用、長文テキスト処理、推論に対応するコンパクトな2Bクラス因果言語モデルです。オンデバイスやリソース制約環境向けに設計され、131,072トークンのネイティブコンテキスト長をサポートします。
MiniCPM5-2Bは、MiniCPM5シリーズの2Bクラス密な因果言語モデルです。標準のLlamaForCausalLMアーキテクチャを使用し、コンパクトなモデルが適するローカルアシスタント、コーディングエージェント、ツール利用ワークフロー、推論シナリオ向けに設計されています。
このモデルは、小規模な展開対象とネイティブ131,072トークンのコンテキスト長を組み合わせています。公開されている比較では、提示された評価セット全体で平均スコア53.9が報告されており、コード、数学、指示追従、知識、長文コンテキストタスク、ツール利用、エージェントワークフローにわたるテストが行われています。これらの結果は著者による比較セットを示すものであり、あらゆるアプリケーションでの性能を保証するものではありません。
このモデルは、密なTransformerで2,516,756,480個のパラメータを持ち、はるかに大規模なモデルを必要としないアプリケーション向けに、コンパクトな選択肢を提供します。
ネイティブコンテキスト長131,072トークンにより、長い文書、長時間の会話、その他の大規模なテキスト入力を扱うタスクに対応します。
このモデルは、ローカルアシスタント、オンデバイス展開、リソース制約環境向けに提示されており、ホスト型ワークフローだけでなく、ローカル実行を主要な対象としています。
公開されている評価表は、コード推論、数学、指示追従、一般知識、長文コンテキスト理解、ツール利用、エージェントタスクを対象としています。
最終チェックポイントは、教師ありファインチューニング、強化学習、OPDによる追加学習を受けたものと説明されています。また、プロジェクトではUltraDataファミリーの関連トレーニングデータセットも公開されています。
モデルディレクトリには、さまざまな展開環境向けにBF16、GGUF、MLX/4-bit、GPTQ/4-bit、DSpark、LiteRT-LMのバリアントが用意されています。
大規模なモデルを標準で選択せずに言語インタラクションを必要とするアプリケーションで、ローカル実行の会話アシスタントとして使用できます。原資料では、MiniCPM5-2Bをオンデバイスおよびローカル展開向けに明確に位置付けています。
コード推論やコーディングエージェントのタスクなど、コーディング指向のワークフローに適用できます。公開結果にはLiveCodeBench、LCB-Pro、OJBench、SciCode、ソフトウェアエンジニアリングエージェントの評価が含まれますが、アプリケーション固有の検証は引き続き必要です。
モデルの応答を外部ツールや構造化されたアクションと組み合わせるワークフローを構築できます。モデルカードのツール利用ベンチマークにはτ³-Bench、τ²-Bench、BFCL v4が含まれており、この想定ワークフローカテゴリを裏付ける材料となっています。
単一のモデルコンテキスト内で、長い文書、長時間の会話、その他の大規模なテキスト入力を処理できます。このシナリオに関連する公開機能は、131,072トークンのコンテキスト長です。
数学、一般知識、検索、汎用エージェントタスクを横断する対応が必要な、コンパクトな推論システムやエージェントシステムのプロトタイプを作成できます。モデルカードではこれらの領域にわたる評価が報告されていますが、実際の適性はタスクとランタイムによって異なります。
MiniCPM5-2Bは、標準のLlamaForCausalLMアーキテクチャに基づく因果言語モデルです。2,516,756,480個のパラメータ、42層、16個のクエリアテンションヘッド、2個のキー/バリューヘッドを持つ密なTransformerです。
このモデルは、ローカルアシスタント、コーディングエージェント、ツール利用ワークフロー、推論タスク、オンデバイス展開、およびコンパクトなモデルが適するその他のリソース制約環境向けに設計されています。
モデルカードには、ネイティブコンテキスト長として131,072トークンが記載されており、長文コンテキストの言語タスクや、比較的大きな入力を処理する必要があるワークフローに対応します。
記載されているモデルバリアントには、BF16の最終リリース、llama.cpp、Ollama、LM Studio向けのGGUF、Apple Silicon向けのMLX/4-bit、GPTQ/4-bit、推論高速化向けのDSparkドラフトモデル、LiteRT-LM版が含まれます。適切な選択は対象ランタイムによって異なります。
モデルカードでは、ライセンスはApache-2.0とされています。特定のプロジェクトに導入する前に、リポジトリのライセンスおよび付随する条件も確認してください。
CreateOS Sandboxは、FirecrackerマイクロVM上でコードやエージェントのワークロードを実行できる分離型コンピュート環境です。SDK、CLI、MCPで制御可能。
AakarDev AIは、AIプロバイダーのアクセス管理、プロジェクト別設定、ログ、分析を1つのダッシュボードで管理できるチーム向けツールです。BYOKに対応し、OpenAI、Google Gemini、Anthropic、Groq、Mistral AI、Perplexity AIをサポートします。
ByteAskは、C/C++向けのターミナル起点AIコーディングエージェント。リポジトリを編集し、コンパイラやデバッガ、サニタイザ、テストで変更を検証してから差分を表示。無料枠あり。
MeetStreamは、Zoom、Google Meet、Microsoft Teams、Webex向けの会議bot APIです。開発者向けに、会議の録画・配信・分析をプログラムで行え、従量課金制と$5の無料クレジットで始められます。
Codex Plugins は、再利用可能なスキル、アプリ連携、MCPサーバーを Codex app や Codex CLI で使えるワークフローにまとめます。接続サービスの作業や共有チームワークフローを拡張できます。
hobは、エージェントのセッション、ターミナル、履歴、後続作業を、既存のツールやプロバイダーに合わせて整理できる独立したコーディングエージェント向けワークスペース。ローカルでの制御を重視する開発者に最適。