Agentic video understanding 是 Gemini 的影片分析模式,協助開發者更精準地檢視影片、降低 token 用量;可透過 Gemini API 在 Google AI Studio 與 Gemini Enterprise Agent Platform 使用。
Experiential Labs 是開源 AI 閘道,透過單一相容 OpenAI 的端點路由託管供應商、自有金鑰與 GPU,並提供存取控制、歸因、預算、模型路由與快取智慧層。
Gemini 3.8 Flash 和 3.8 Flash Cyber 是 Google Gemini 模型,專為代理式程式設計、多步驟推理與資安防禦打造;Cyber 僅透過 Fairwind Program 提供可信任防禦者使用。
Anthropic 的 Claude Fable 5.1 適用於程式設計、知識工作與長時間問題解決;Claude Mythos 5.1 為更高安全防護版本,僅限受信任存取計畫。此次更新亦帶來企業級防護、強化隱私,以及一般工作負載較低的預估 token 計費價格。
TrustedRouter 是相容 OpenAI 的 AI 路由器,透過單一 API 存取數百個模型,提供可驗證的隱私、供應商故障切換與 BYOK,適合開發者和團隊遷移工作流程或強化正式環境流量控管。
oMLX 是一款基於 MLX 的原生 macOS 推論伺服器,專為 Apple Silicon Mac 上執行本地模型而設,支援 SSD 快取、持續批次處理,以及相容 OpenAI/Anthropic 的端點,適用於 Claude Code、OpenClaw、Cursor 等工具。
Revalvo 是一款瀏覽器版、local-first 的 LLM 評測工作台,可跨多模型執行提示、評分結果、管理版本並批次測試資料集,無須註冊即可在瀏覽器中比較輸出。
GLM-5.3-Flash 是 Z.ai 原生多模態模型,適用於程式開發、agentic 工作流程與視覺任務,透過 Z.ai API 與 coding plan 提供,主打更低推理成本與優於 GLM-5.2 的表現。
IQ Routing 是模型路由閘道,將每個請求送往同時符合品質門檻的最低成本模型層級,適用於以 OpenAI、Anthropic 或 Google 端點運作的聊天機器人、RAG 流程、agent 迴圈與金融工作負載。
Speko 是語音 AI 路由器,可依語言基準測試語音模型,並透過單一 API 路由 STT、LLM 與 TTS,另提供封裝式基礎架構與企業合約方案。
Local 是一款在你的 Mac 上執行 AI 的 macOS App,支援對話、寫程式與會議工作流程全程在裝置上運作,並可依 Mac 晶片與記憶體推薦模型,也能透過你的 API key 存取雲端模型。
Router by Ramp 是一款 AI 路由產品,提供單一 endpoint 與單一帳單,讓團隊存取多個模型;可降低推論成本,並依效能需求選擇模型。
NobodyWho 是一款裝置端推理引擎,可在本機高效執行 LLM,無需 API 金鑰或雲端呼叫。支援多種應用框架,並可從 Hugging Face 或直接 URL 載入 GGUF 模型。
Grok 4.6 是 xAI 最新的 Grok 模型,適合長時間代理工作、程式開發、研究與互動或視覺專案草擬,支援 Cursor、Grok Build、API 與合作平台,並提供免費與付費方案。
Gemini 3.7 Flash 是 Google 的 Flash 系列 AI 模型,適用於程式開發、agent 工作流程、網頁開發與文件密集型知識工作,供開發者、企業與符合資格的 Gemini app 訂閱者使用。
Statewave 是一款開源 AI agents 與 LLM 應用記憶 runtime,可儲存具來源可追溯的結構化持久上下文,讓系統跨 session 回想先前事件。
Cohesor 是專為 agents 設計的 AI gateway 與 control plane,能從單一端點路由請求、壓縮 tokens、代理 MCP 工具呼叫並套用政策,協助團隊降低模型支出並提升可視性,無需重寫相容 Anthropic 或 OpenAI 的用戶端。
Unsloth 是一款免費、開源的桌面應用程式,可在本機硬體上執行與訓練 AI 模型,支援 macOS、Windows、Linux 與 WSL,並提供模型下載、代理連線、媒體生成與私密研究。
Soup CLI 是一款可在自有硬體上進行 LLM 微調與後訓練的命令列工具,支援低 VRAM 的 layer streaming,並提供資料檢查、設定產生、偏好最佳化與 checkpoint gating。
What's my local AI? 是一款瀏覽器版工具,可在本機偵測硬體,並推薦可搭配 Ollama 或 LM Studio 執行的 AI 模型,適合想在不上傳機器資料下挑選本地模型的使用者。