可进入对比
档案摘要 / Decision snapshot
先判断能不能用于选型。
有真实任务证据
来自模型卡
边界优先
30 秒结论
可进入选型对比,但仍以案例证据为准。
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
这页有来源、有风险说明、有公开可核验 A 类案例。
数据可信度 / 证据强度
强
A 类案例
5
AA 评分
48.48
官方来源
2 个补充入口
案例来源
5 条可核验
来自公开资料与模型数据库 + Artificial Analysis + 2 个厂商/官方/模型家族证据入口;AA 不是唯一事实来源。
Evidence Distribution
案例证据分布
Grok 4.20 0309 当前关联 5 条 A 类案例;这里按任务、来源和复核时间观察证据结构。
Evidence Snapshot
证据快照覆盖
Grok 4.20 0309 的 5 条 A 类案例中,已有 5 条完成本地证据快照;0 条仍在快照队列。
可用 manifest 复核
等待落盘
需补抓
需人工复核
证据完整度
5 / 5
Feishu Bitable
2 个入口
5 条
已绑定
已标注
能力边界
用标签表达信号,不用标签替代证据。
通用/待核验
暂无数据
待核验
平台/待核验
中
| 厂商 | xAI / Grok |
|---|---|
| 厂商页 | xAI / Grok |
| 发布时间 | 2026-03-10 |
| 模型 ID | grok-4-20-0309 |
| 上下文 | 暂无数据 |
| 输出 | 暂无数据 |
| 模态 | 文本 / 多模态待核验 |
| 推理 | 是 / 推理模型或 thinking 模式 |
| 价格 | 官方未披露 / 暂无数据 |
| 可用平台 | xAI / Grok |
| AA 评分 | 48.48 |
| 基础模型发布时间 | Artificial Analysis 未披露 |
| 资料来源 | 公开资料、厂商信息和案例库 |
| A 类案例 | 5 |
谱系位置
它在厂商路线中的位置
此页将 Grok 4.20 0309 放入 xAI / Grok 的当前 Atlas 路线中。若同厂前后代资料不足,先保留为路线追踪入口,不脑补谱系关系。
2026-03-10
Grok 4.20 0309 资料状态
来自公开资料与模型数据库 + Artificial Analysis + 2 个厂商/官方/模型家族证据入口;AA 不是唯一事实来源。
公开档案
模型状态
Grok 4.20 0309 当前标记为已有真实案例。
案例库
公开案例复核
已有 5 条可核验 A 类案例,达到完整补齐线
案例时间线
最近进入档案的 A 类案例
用采集时间呈现证据进入 Atlas 的顺序,方便复核来源新鲜度。
2026-06-27T10:26:24Z
Bondartsov 的 grok-critic-mcp 用 Grok 4.20 Multi-Agent 做代码审查、架构分析和安全审计
Bondartsov / code_review_security_audit_mcp
2026-06-27T10:20:00Z
owjk123 的 GrokNovelApp 使用 Grok 4.20 API 生成互动小说 Android 应用
owjk123 / creative_writing_app
2026-06-27T09:08:24Z
grok-multiagent-simulator 用 Grok 4.20 Multi-Agent 串联 Researcher/Analyst/Synthesizer
dakshjain-1616 / multi_agent_simulation
2026-06-27T09:08:24Z
ProphetHacks 将 Grok 4.20 作为 Kalshi/预测市场集成预测器的一路模型
PrashanthBhaskara / ProphetHacks / forecasting
2026-06-27T09:08:24Z
Model Council 用 Grok 4.20 参与多模型辩论和同伴评审
kvsdileep / multi_model_debate_app
适合场景
- - 作为完整模型索引和厂商路线追踪入口
- - 推理/agentic workflow 候选
不适合
- - 缺少真实案例时不要包装成推荐
- - 缺字段时不要脑补价格、性能或上下文
真实案例
可核验 A 类案例精选
当前展示 5 条代表案例;排序优先看模型卡精选、证据可信度、快照状态和公开仓库/技术任务信号。案例总数仍为 5。
Representative Evidence
代表案例排序
当前第一代表案例是“Bondartsov 的 grok-critic-mcp 用 Grok 4.20 Multi-Agent 做代码审查、架构分析和安全审计”。它会优先出现在本页,是因为该案例同时进入模型卡精选、具备 100/100 的证据可信度,并带有 已快照证据。
模型卡精选优先
A+ 完整链路
archive/evidence/grok-4-20-0309-bondartsov-grok-critic-mcp/manifest.json
Coding / repo / agent
Bondartsov 使用 Grok 4.20 0309 处理代码审查和测试生成
Bondartsov · Grok 4.20 0309
A+ 完整链路 · 代码仓库证据
Bondartsov 公开的代码审查与测试案例,来源为 公开代码库,复核于 2026-06-27T10:26:24Z。 Model Atlas 将它标记为 A 类证据,因为它同时具备具体使用者、具体任务、公开原始证据和可访问产物。
任务:grok-critic-mcp 是公开 MCP 服务器,README 明确说明它通过 Polza.AI / Responses API 调用 xAI 的 grok-4.20-multi-agent,为 AI 编程代理提供 critic_review、architecture_review、security_audit、critic_followup、health/config/restart 等工具,并支持 4/16 agents 的 reasoning effort 映射。
公开产物:仓库提供可安装 Python 包、FastMCP server、配置、技能文档和测试;用户可把它接入 Kilo Code、Cursor、Claude Code 等客户端,对代码片段或文件执行深度代码审查、架构评审和安全审计,并返回带模型、agents、effort 元数据的审查结果。
模型作用:Grok 4.20 Multi-Agent 作为 MCP 服务背后的审查模型,使用多 reasoning agents 并行分析代码、架构和安全风险,再形成共识式批评与改进建议,是该工具的核心判断与生成能力来源。
A 类理由:有具体使用者、具体任务、公开原始证据和可访问产物,可公开核验。
风险边界:证据明确写 grok-4.20-multi-agent / x-ai/grok-4.20-multi-agent;未在仓库标题中写 0309 后缀,但可绑定到 Grok 4.20 0309 multi-agent 家族。公开仓库可访问,属于具体工具产物而非教程、benchmark 或综述。
原始记录:Bondartsov 的 grok-critic-mcp 用 Grok 4.20 Multi-Agent 做代码审查、架构分析和安全审计
owjk123 使用 Grok 4.20 0309 处理真实任务执行
owjk123 · Grok 4.20 0309
A+ 完整链路 · 代码仓库证据
owjk123 公开的真实任务执行案例,来源为 公开代码库,复核于 2026-06-27T10:20:00Z。 Model Atlas 将它标记为 A 类证据,因为它同时具备具体使用者、具体任务、公开原始证据和可访问产物。
任务:GrokNovelApp 是一个基于 Grok 4.20 API 的 Android 小说生成应用,README 明确描述其使用 Grok 4.20 API 生成精彩小说内容,支持奇幻、科幻、爱情、悬疑、仙侠、武侠等类型,以及互动剧情选择和本地历史保存。
公开产物:公开仓库提供 Kotlin / Jetpack Compose Android 应用源码、项目结构、构建说明和 Material3 界面设计,目标产物是可构建的 AI 小说生成 Android 应用。
模型作用:Grok 4.20 API 用于根据用户选择和剧情上下文生成小说正文与后续分支,是该应用创意文本生成和互动剧情推进的核心模型能力。
A 类理由:有具体使用者、具体任务、公开原始证据和可访问产物,可公开核验。
风险边界:证据明确写 Grok 4.20 API,但未带 0309 后缀;按 Grok 4.20 家族映射到 Grok 4.20 0309 任务模型。仓库和 README 均可公开访问,属于具体应用产物而非教程、benchmark 或综述。
原始记录:owjk123 的 GrokNovelApp 使用 Grok 4.20 API 生成互动小说 Android 应用
dakshjain-1616 使用 Grok 4.20 0309 处理研究分析和报告生成
dakshjain-1616 · Grok 4.20 0309
A+ 完整链路 · 代码仓库证据
dakshjain-1616 公开的研究与报告生成案例,来源为 公开代码库,复核于 2026-06-27T09:08:24Z。 Model Atlas 将它标记为 A 类证据,因为它同时具备具体使用者、具体任务、公开原始证据和可访问产物。
任务:dakshjain-1616 发布 Python 多智能体模拟环境,README 明确说明项目通过 OpenRouter 使用 x-ai/grok-4.20-multi-agent-beta,按 Researcher、Analyst、Synthesizer 三个专门代理顺序处理用户任务,并提供 rich/plotext 实时 CLI 仪表盘。
公开产物:公开仓库提供可运行代码、配置和 CLI 流程:Researcher 收集事实,Analyst 提炼模式/风险/机会,Synthesizer 生成最终整合答案,同时保存 run_log.json、Rich 终端输出和最终仪表盘图表。
模型作用:Grok 4.20 Multi-Agent 作为三个代理调用的核心推理模型,驱动事实收集、分析和综合输出,是该模拟器多阶段任务处理能力的主要模型来源。
A 类理由:有具体使用者、具体任务、公开原始证据和可访问产物,可公开核验。
风险边界:证据使用 OpenRouter beta 别名 x-ai/grok-4.20-multi-agent-beta;名称未带 0309 后缀,但可绑定到 Grok 4.20 multi-agent/0309 家族。
原始记录:grok-multiagent-simulator 用 Grok 4.20 Multi-Agent 串联 Researcher/Analyst/Synthesizer
kvsdileep 使用 Grok 4.20 0309 处理真实任务执行
kvsdileep · Grok 4.20 0309
A+ 完整链路 · 代码仓库证据
kvsdileep 公开的真实任务执行案例,来源为 公开代码库,复核于 2026-06-27T09:08:24Z。 Model Atlas 将它标记为 A 类证据,因为它同时具备具体使用者、具体任务、公开原始证据和可访问产物。
任务:kvsdileep 的 Model Council 是本地 Web App,让四个模型并行回答、互相批评,再由综合模型调和。README 描述 Grok 作为 council member;配置文件 config/models.ts 将 grok 槽位设为 x-ai/grok-4.20,并说明该 ID 经 OpenRouter live catalog probe 返回 HTTP 200 后替换原设计 ID。
公开产物:项目实现了 POST SSE 流式接口、四列模型输出、同伴批评和最终综合的前端/后端结构;仓库计划与验证文档记录了 curl smoke 产生 4 个 distinct delta model streams,其中包括 Grok 槽位。
模型作用:Grok 4.20 作为四个委员会成员之一提供独立答案和批评视角,参与多模型辩论阶段,为最终综合答案提供 xAI/Grok 侧的推理输入。
A 类理由:有具体使用者、具体任务、公开原始证据和可访问产物,可公开核验。
风险边界:README 中模型表曾写 Grok 4.2 设计稿,但实际 config/models.ts 与验证文档明确将 live ID 替换为 x-ai/grok-4.20;作为真实开发中模型接入案例收录。
原始记录:Model Council 用 Grok 4.20 参与多模型辩论和同伴评审
PrashanthBhaskara / ProphetHacks 使用 Grok 4.20 0309 处理真实任务执行
PrashanthBhaskara / ProphetHacks · Grok 4.20 0309
A+ 完整链路 · 代码仓库证据
PrashanthBhaskara / ProphetHacks 公开的真实任务执行案例,来源为 公开代码库,复核于 2026-06-27T09:08:24Z。 Model Atlas 将它标记为 A 类证据,因为它同时具备具体使用者、具体任务、公开原始证据和可访问产物。
任务:ProphetHacks 在预测市场系统中实现 Grok-via-OpenRouter forecaster,代码注释明确称其调用 Grok-4.20 through OpenRouter,并为 Kalshi-style markets 设计 trust-extreme calibration prompt、二向提示和噪声过滤。配置 FINAL.json 中 grok_lane 的模型为 x-ai/grok-4.20。
公开产物:公开代码记录该 Grok forecaster 在 2026 Sports holdout 上通过噪声过滤组合取得 Brier 0.203,对比市场基线 0.212,并作为集成预测管线的一路模型输出概率预测。
模型作用:Grok 4.20 负责生成预测市场的概率判断;系统围绕其校准弱点加入 trust-extreme 提示、P(YES)/P(NO) 双向询问和过滤策略,使其预测可被集成器加权使用。
A 类理由:有具体使用者、具体任务、公开原始证据和可访问产物,可公开核验。
风险边界:这是公开仓库中的应用代码与验证说明,不是官方客户故事;模型以 OpenRouter x-ai/grok-4.20 形式出现,可绑定 Grok 4.20 0309 家族。
原始记录:ProphetHacks 将 Grok 4.20 作为 Kalshi/预测市场集成预测器的一路模型
数据缺口
只基于现有字段判断缺口;缺失项不会被猜测填充。
- - 补充方向:核验 价格 的官方/API/案例来源。
- - 补充方向:核验 上下文 的官方/API/案例来源。
- - 补充方向:核验 输出 的官方/API/案例来源。
下一步验证建议
- - 继续保留 A 类案例的原始证据、产物页和版本快照。
- - 补官方发布/API/System Card 来源;若官方未披露,继续标注“官方未披露”。
- - 把 benchmark、教程、发布文保留为背景资料,不提升为真实案例。