DATA CUT 2026-07-27 116 活跃模型 680 A 类案例

模型档案

Grok 4.20 0309

Grok 4.20 0309 已有可核验 A 类案例,可优先进入选型对比。

已有真实案例

档案摘要 / Decision snapshot

先判断能不能用于选型。

证据完整度 100%
公开状态 已有真实案例

可进入对比

案例覆盖 5 条 A 类

有真实任务证据

主要适用 作为完整模型索引和厂商路线追踪入口

来自模型卡

谨慎场景 缺少真实案例时不要包装成推荐

边界优先

30 秒结论

可进入选型对比,但仍以案例证据为准。

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

这页有来源、有风险说明、有公开可核验 A 类案例。

数据可信度 / 证据强度

已有真实案例

A 类案例

5

AA 评分

48.48

官方来源

2 个补充入口

案例来源

5 条可核验

来自公开资料与模型数据库 + Artificial Analysis + 2 个厂商/官方/模型家族证据入口;AA 不是唯一事实来源。

Evidence Distribution

案例证据分布

Grok 4.20 0309 当前关联 5 条 A 类案例;这里按任务、来源和复核时间观察证据结构。

A CASES 5 5 selected

Evidence Snapshot

证据快照覆盖

Grok 4.20 0309 的 5 条 A 类案例中,已有 5 条完成本地证据快照;0 条仍在快照队列。

SNAPSHOT 100%
已快照 5

可用 manifest 复核

待快照 0

等待落盘

部分快照 0

需补抓

需关注 0

需人工复核

证据完整度

5 / 5

模型卡 OK

Feishu Bitable

官方/厂商来源 OK

2 个入口

A 类案例 OK

5 条

公开产物 OK

已绑定

风险备注 OK

已标注

能力边界

用标签表达信号,不用标签替代证据。

查看证据方法
Coding Agent

通用/待核验

长上下文

暂无数据

研究任务

待核验

开放生态

平台/待核验

生命周期风险

厂商xAI / Grok
厂商页xAI / Grok
发布时间2026-03-10
模型 IDgrok-4-20-0309
上下文暂无数据
输出暂无数据
模态文本 / 多模态待核验
推理是 / 推理模型或 thinking 模式
价格官方未披露 / 暂无数据
可用平台xAI / Grok
AA 评分48.48
基础模型发布时间Artificial Analysis 未披露
资料来源公开资料、厂商信息和案例库
A 类案例5

谱系位置

它在厂商路线中的位置

此页将 Grok 4.20 0309 放入 xAI / Grok 的当前 Atlas 路线中。若同厂前后代资料不足,先保留为路线追踪入口,不脑补谱系关系。

2026-03-10

Grok 4.20 0309 资料状态

来自公开资料与模型数据库 + Artificial Analysis + 2 个厂商/官方/模型家族证据入口;AA 不是唯一事实来源。

公开档案

模型状态

Grok 4.20 0309 当前标记为已有真实案例。

案例库

公开案例复核

已有 5 条可核验 A 类案例,达到完整补齐线

案例时间线

最近进入档案的 A 类案例

用采集时间呈现证据进入 Atlas 的顺序,方便复核来源新鲜度。

适合场景

  • - 作为完整模型索引和厂商路线追踪入口
  • - 推理/agentic workflow 候选

不适合

  • - 缺少真实案例时不要包装成推荐
  • - 缺字段时不要脑补价格、性能或上下文

真实案例

可核验 A 类案例精选

当前展示 5 条代表案例;排序优先看模型卡精选、证据可信度、快照状态和公开仓库/技术任务信号。案例总数仍为 5。

Representative Evidence

代表案例排序

当前第一代表案例是“Bondartsov 的 grok-critic-mcp 用 Grok 4.20 Multi-Agent 做代码审查、架构分析和安全审计”。它会优先出现在本页,是因为该案例同时进入模型卡精选、具备 100/100 的证据可信度,并带有 已快照证据。

打开第一代表案例
排序池 5 条

模型卡精选优先

证据可信度 100/100

A+ 完整链路

快照状态 已快照

archive/evidence/grok-4-20-0309-bondartsov-grok-critic-mcp/manifest.json

技术信号 命中

Coding / repo / agent

Bondartsov 使用 Grok 4.20 0309 处理代码审查和测试生成

Bondartsov · Grok 4.20 0309

A
厂商:xAI / Grok 模型:Grok 4.20 0309 来源平台:GitHub 最后复核:2026-06-27T10:26:24Z 证据快照:已快照 · 2 / 2 个证据目标 归档说明:已完成快照:2 / 2 个证据目标,可用本地 manifest 复核证据指纹。
证据可信度 100/100

A+ 完整链路 · 代码仓库证据

原始证据1 个公开产物复核通过代码仓库证据

Bondartsov 公开的代码审查与测试案例,来源为 公开代码库,复核于 2026-06-27T10:26:24Z。 Model Atlas 将它标记为 A 类证据,因为它同时具备具体使用者、具体任务、公开原始证据和可访问产物。

任务:grok-critic-mcp 是公开 MCP 服务器,README 明确说明它通过 Polza.AI / Responses API 调用 xAI 的 grok-4.20-multi-agent,为 AI 编程代理提供 critic_review、architecture_review、security_audit、critic_followup、health/config/restart 等工具,并支持 4/16 agents 的 reasoning effort 映射。

公开产物:仓库提供可安装 Python 包、FastMCP server、配置、技能文档和测试;用户可把它接入 Kilo Code、Cursor、Claude Code 等客户端,对代码片段或文件执行深度代码审查、架构评审和安全审计,并返回带模型、agents、effort 元数据的审查结果。

模型作用:Grok 4.20 Multi-Agent 作为 MCP 服务背后的审查模型,使用多 reasoning agents 并行分析代码、架构和安全风险,再形成共识式批评与改进建议,是该工具的核心判断与生成能力来源。

A 类理由:有具体使用者、具体任务、公开原始证据和可访问产物,可公开核验。

风险边界:证据明确写 grok-4.20-multi-agent / x-ai/grok-4.20-multi-agent;未在仓库标题中写 0309 后缀,但可绑定到 Grok 4.20 0309 multi-agent 家族。公开仓库可访问,属于具体工具产物而非教程、benchmark 或综述。

原始记录:Bondartsov 的 grok-critic-mcp 用 Grok 4.20 Multi-Agent 做代码审查、架构分析和安全审计

已有真实案例 代码审查与测试公开代码库A 类可核验real_case auto_approved 进入模型卡精选

owjk123 使用 Grok 4.20 0309 处理真实任务执行

owjk123 · Grok 4.20 0309

A
厂商:xAI / Grok 模型:Grok 4.20 0309 来源平台:GitHub 最后复核:2026-06-27T10:20:00Z 证据快照:已快照 · 2 / 2 个证据目标 归档说明:已完成快照:2 / 2 个证据目标,可用本地 manifest 复核证据指纹。
证据可信度 100/100

A+ 完整链路 · 代码仓库证据

原始证据1 个公开产物复核通过代码仓库证据

owjk123 公开的真实任务执行案例,来源为 公开代码库,复核于 2026-06-27T10:20:00Z。 Model Atlas 将它标记为 A 类证据,因为它同时具备具体使用者、具体任务、公开原始证据和可访问产物。

任务:GrokNovelApp 是一个基于 Grok 4.20 API 的 Android 小说生成应用,README 明确描述其使用 Grok 4.20 API 生成精彩小说内容,支持奇幻、科幻、爱情、悬疑、仙侠、武侠等类型,以及互动剧情选择和本地历史保存。

公开产物:公开仓库提供 Kotlin / Jetpack Compose Android 应用源码、项目结构、构建说明和 Material3 界面设计,目标产物是可构建的 AI 小说生成 Android 应用。

模型作用:Grok 4.20 API 用于根据用户选择和剧情上下文生成小说正文与后续分支,是该应用创意文本生成和互动剧情推进的核心模型能力。

A 类理由:有具体使用者、具体任务、公开原始证据和可访问产物,可公开核验。

风险边界:证据明确写 Grok 4.20 API,但未带 0309 后缀;按 Grok 4.20 家族映射到 Grok 4.20 0309 任务模型。仓库和 README 均可公开访问,属于具体应用产物而非教程、benchmark 或综述。

原始记录:owjk123 的 GrokNovelApp 使用 Grok 4.20 API 生成互动小说 Android 应用

已有真实案例 真实任务执行公开代码库A 类可核验real_case auto_approved 进入模型卡精选

dakshjain-1616 使用 Grok 4.20 0309 处理研究分析和报告生成

dakshjain-1616 · Grok 4.20 0309

A
厂商:xAI / Grok 模型:Grok 4.20 0309 来源平台:GitHub 最后复核:2026-06-27T09:08:24Z 证据快照:已快照 · 2 / 2 个证据目标 归档说明:已完成快照:2 / 2 个证据目标,可用本地 manifest 复核证据指纹。
证据可信度 100/100

A+ 完整链路 · 代码仓库证据

原始证据1 个公开产物复核通过代码仓库证据

dakshjain-1616 公开的研究与报告生成案例,来源为 公开代码库,复核于 2026-06-27T09:08:24Z。 Model Atlas 将它标记为 A 类证据,因为它同时具备具体使用者、具体任务、公开原始证据和可访问产物。

任务:dakshjain-1616 发布 Python 多智能体模拟环境,README 明确说明项目通过 OpenRouter 使用 x-ai/grok-4.20-multi-agent-beta,按 Researcher、Analyst、Synthesizer 三个专门代理顺序处理用户任务,并提供 rich/plotext 实时 CLI 仪表盘。

公开产物:公开仓库提供可运行代码、配置和 CLI 流程:Researcher 收集事实,Analyst 提炼模式/风险/机会,Synthesizer 生成最终整合答案,同时保存 run_log.json、Rich 终端输出和最终仪表盘图表。

模型作用:Grok 4.20 Multi-Agent 作为三个代理调用的核心推理模型,驱动事实收集、分析和综合输出,是该模拟器多阶段任务处理能力的主要模型来源。

A 类理由:有具体使用者、具体任务、公开原始证据和可访问产物,可公开核验。

风险边界:证据使用 OpenRouter beta 别名 x-ai/grok-4.20-multi-agent-beta;名称未带 0309 后缀,但可绑定到 Grok 4.20 multi-agent/0309 家族。

原始记录:grok-multiagent-simulator 用 Grok 4.20 Multi-Agent 串联 Researcher/Analyst/Synthesizer

已有真实案例 研究与报告生成公开代码库A 类可核验real_case auto_approved 进入模型卡精选

kvsdileep 使用 Grok 4.20 0309 处理真实任务执行

kvsdileep · Grok 4.20 0309

A
厂商:xAI / Grok 模型:Grok 4.20 0309 来源平台:GitHub 最后复核:2026-06-27T09:08:24Z 证据快照:已快照 · 2 / 2 个证据目标 归档说明:已完成快照:2 / 2 个证据目标,可用本地 manifest 复核证据指纹。
证据可信度 100/100

A+ 完整链路 · 代码仓库证据

原始证据1 个公开产物复核通过代码仓库证据

kvsdileep 公开的真实任务执行案例,来源为 公开代码库,复核于 2026-06-27T09:08:24Z。 Model Atlas 将它标记为 A 类证据,因为它同时具备具体使用者、具体任务、公开原始证据和可访问产物。

任务:kvsdileep 的 Model Council 是本地 Web App,让四个模型并行回答、互相批评,再由综合模型调和。README 描述 Grok 作为 council member;配置文件 config/models.ts 将 grok 槽位设为 x-ai/grok-4.20,并说明该 ID 经 OpenRouter live catalog probe 返回 HTTP 200 后替换原设计 ID。

公开产物:项目实现了 POST SSE 流式接口、四列模型输出、同伴批评和最终综合的前端/后端结构;仓库计划与验证文档记录了 curl smoke 产生 4 个 distinct delta model streams,其中包括 Grok 槽位。

模型作用:Grok 4.20 作为四个委员会成员之一提供独立答案和批评视角,参与多模型辩论阶段,为最终综合答案提供 xAI/Grok 侧的推理输入。

A 类理由:有具体使用者、具体任务、公开原始证据和可访问产物,可公开核验。

风险边界:README 中模型表曾写 Grok 4.2 设计稿,但实际 config/models.ts 与验证文档明确将 live ID 替换为 x-ai/grok-4.20;作为真实开发中模型接入案例收录。

原始记录:Model Council 用 Grok 4.20 参与多模型辩论和同伴评审

已有真实案例 真实任务执行公开代码库A 类可核验real_case auto_approved 进入模型卡精选

PrashanthBhaskara / ProphetHacks 使用 Grok 4.20 0309 处理真实任务执行

PrashanthBhaskara / ProphetHacks · Grok 4.20 0309

A
厂商:xAI / Grok 模型:Grok 4.20 0309 来源平台:GitHub 最后复核:2026-06-27T09:08:24Z 证据快照:已快照 · 2 / 2 个证据目标 归档说明:已完成快照:2 / 2 个证据目标,可用本地 manifest 复核证据指纹。
证据可信度 100/100

A+ 完整链路 · 代码仓库证据

原始证据1 个公开产物复核通过代码仓库证据

PrashanthBhaskara / ProphetHacks 公开的真实任务执行案例,来源为 公开代码库,复核于 2026-06-27T09:08:24Z。 Model Atlas 将它标记为 A 类证据,因为它同时具备具体使用者、具体任务、公开原始证据和可访问产物。

任务:ProphetHacks 在预测市场系统中实现 Grok-via-OpenRouter forecaster,代码注释明确称其调用 Grok-4.20 through OpenRouter,并为 Kalshi-style markets 设计 trust-extreme calibration prompt、二向提示和噪声过滤。配置 FINAL.json 中 grok_lane 的模型为 x-ai/grok-4.20。

公开产物:公开代码记录该 Grok forecaster 在 2026 Sports holdout 上通过噪声过滤组合取得 Brier 0.203,对比市场基线 0.212,并作为集成预测管线的一路模型输出概率预测。

模型作用:Grok 4.20 负责生成预测市场的概率判断;系统围绕其校准弱点加入 trust-extreme 提示、P(YES)/P(NO) 双向询问和过滤策略,使其预测可被集成器加权使用。

A 类理由:有具体使用者、具体任务、公开原始证据和可访问产物,可公开核验。

风险边界:这是公开仓库中的应用代码与验证说明,不是官方客户故事;模型以 OpenRouter x-ai/grok-4.20 形式出现,可绑定 Grok 4.20 0309 家族。

原始记录:ProphetHacks 将 Grok 4.20 作为 Kalshi/预测市场集成预测器的一路模型

已有真实案例 真实任务执行公开代码库A 类可核验real_case auto_approved 进入模型卡精选

数据缺口

只基于现有字段判断缺口;缺失项不会被猜测填充。

价格:待补公开资料 上下文:待补公开资料 输出:待补公开资料 官方/家族来源:已有 发布时间:已有 可用平台:已有 A 类案例:已有
  • - 补充方向:核验 价格 的官方/API/案例来源。
  • - 补充方向:核验 上下文 的官方/API/案例来源。
  • - 补充方向:核验 输出 的官方/API/案例来源。

下一步验证建议

  • - 继续保留 A 类案例的原始证据、产物页和版本快照。
  • - 补官方发布/API/System Card 来源;若官方未披露,继续标注“官方未披露”。
  • - 把 benchmark、教程、发布文保留为背景资料,不提升为真实案例。