更长时间运行的任务表现
更大的基础模型,以及针对可能需要数小时完成的困难任务进行的更长时间强化学习训练。
Grok 4.7 是 xAI 推出的软件开发与知识工作 AI 模型。它面向需要持续推理的任务,包括较长时间的编码工作、文档和演示文稿创建,以及办公、法律、临床、电气工程和网络安全等专业工作流。
与 Grok 4.6 相比,该模型采用更大的基础模型,针对更困难的任务进行了更长时间的强化学习训练,并改进了对扩展上下文和自我检查的处理能力。它可通过多个开发和编码环境使用,包括 Cursor、Grok Build、Grok API、第三方编码 harness、模型路由器和云平台。来源列出的起始价格为每百万输入 token 2 美元、每百万输出 token 6 美元,此外还提供输出速度提高一倍、价格也提高一倍的快速版本。
更大的基础模型,以及针对可能需要数小时完成的困难任务进行的更长时间强化学习训练。
旨在更仔细地检查自身工作,支持在完成前需要审查中间结果的工作流。
改进了对更长上下文的管理,这对于长时间编码会话和多步骤知识工作任务具有重要意义。
原生理解 Grok Bot harness,支持对话任务和一般知识工作。
在软件工程、电气工程、办公工作、法律工作、临床推理和网络安全相关任务上进行基准测试,但不同基准的结果有所差异。
全新的安全防护体系,重点提升拒答能力和越狱抵抗能力。来源报告称,其在 LatchBio 生物安全基准测试中的得分为 62.4%,在 HackerBench v0.3 中仅允许 3.3% 的高风险双重用途提示通过,同时强调支持合法的安全工作。
用于长时间运行的软件工程任务;在这类任务中,更长的上下文和更审慎的工作检查有助于维持跨步骤的连续性。
应用于准备专业文档和演示文稿等持续数小时的办公工作。来源报告称,在 GDPval 和 AA Briefcase 基准测试中,该模型相比 Grok 4.6 有所改进。
作为通用模型,用于法律、临床和电气工程任务中的专业分析。已发布的基准测试涵盖这些领域,但结果因任务而异。
用于防御性网络安全研究和合法的安全工作。该模型旨在提供有用的网络安全能力,同时拒绝高风险或恶意的双重用途请求。
根据任务是探索性、对话式还是集成到开发者工具中,通过 Grok Build、Cursor 或连接 API 的编码工作流访问。
Grok 4.7 可在 Cursor 和 Grok Build 中使用,也可以通过 Grok API、第三方编码 harness、模型路由器和云平台访问。源页面还提供了创建 API 密钥和阅读 xAI 文档的链接。
Grok 4.7 可在 Grok Build 中免费试用。来源未说明该访问权限的限制或条件。
列出的起始价格为每百万输入 token 2 美元、每百万输出 token 6 美元。快速版本的输出速度是两倍,价格也为两倍;来源未提供更多方案或使用限制。
Grok 4.7 面向编码和知识工作,包括长时间运行的软件任务、文档和演示文稿创建、办公工作、电气工程、法律工作、临床推理和网络安全工作。基准测试结果表明,模型表现会因任务而异,因此应根据具体工作流的要求对模型进行评估。
该模型可以通过 Grok Bot harness 工作,并被描述为更擅长验证自身工作和管理更长的上下文。来源未具体说明文件格式、输出架构、协作控制或部署要求。
ByteAsk 是面向 C 和 C++ 的终端优先 AI 编码 agent,可直接编辑仓库,并在展示 diff 前用真实编译器、调试器、sanitizers 和测试验证修改。提供免费版与付费方案。
Ghost 是一款基于终端的 AI 助手,可在命令行中聊天、生成代码并运行任务。内置免费模型,支持 Linux、macOS 和 Windows,且为开源项目。
Vi3ecode 是面向 AI 编程代理的持续开发环境,保留项目上下文、终端、Git、记忆、流程、评审与沟通,围绕你正在使用的 agent 协同工作。
Lucid Train 是一款本地优先的 AI 编码工具,可将仓库代码生成架构图,并把图作为编码代理的规格说明。支持桌面应用与轻量 Rust CLI,可运行本地模型或使用自有 API key。
MeetStream 是一款适用于 Zoom、Google Meet、Microsoft Teams 和 Webex 的会议 bot API,帮助开发者以按量计费方式程序化录制、直播和分析会议,注册即送 $5 试用额度。
CreateOS Sandbox 是基于 Firecracker 微型虚拟机的隔离计算环境,用于运行代码和 agent 工作负载,支持私有网络、SDK、CLI 和 MCP 程序化控制。