DATA CUT 2026-07-27 116 活跃模型 680 A 类案例

模型档案

GPT-5.5 (xhigh)

GPT-5.5 (xhigh) 已有可核验 A 类案例,可优先进入选型对比。

已有真实案例

档案摘要 / Decision snapshot

先判断能不能用于选型。

证据完整度 100%
公开状态 已有真实案例

可进入对比

案例覆盖 5 条 A 类

有真实任务证据

主要适用 作为完整模型索引和厂商路线追踪入口

来自模型卡

谨慎场景 缺少真实案例时不要包装成推荐

边界优先

30 秒结论

可进入选型对比,但仍以案例证据为准。

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

这页有来源、有风险说明、有公开可核验 A 类案例。

数据可信度 / 证据强度

已有真实案例

A 类案例

5

AA 评分

60.24

官方来源

2 个补充入口

案例来源

5 条可核验

来自公开资料与模型数据库 + Artificial Analysis + 2 个厂商/官方/模型家族证据入口;AA 不是唯一事实来源。

Evidence Distribution

案例证据分布

GPT-5.5 (xhigh) 当前关联 5 条 A 类案例;这里按任务、来源和复核时间观察证据结构。

A CASES 5 5 selected

Evidence Snapshot

证据快照覆盖

GPT-5.5 (xhigh) 的 5 条 A 类案例中,已有 5 条完成本地证据快照;0 条仍在快照队列。

SNAPSHOT 100%
已快照 5

可用 manifest 复核

待快照 0

等待落盘

部分快照 0

需补抓

需关注 0

需人工复核

证据完整度

5 / 5

模型卡 OK

Feishu Bitable

官方/厂商来源 OK

2 个入口

A 类案例 OK

5 条

公开产物 OK

已绑定

风险备注 OK

已标注

能力边界

用标签表达信号,不用标签替代证据。

查看证据方法
Coding Agent

通用/待核验

长上下文

暂无数据

研究任务

待核验

开放生态

平台/待核验

生命周期风险

厂商OpenAI
厂商页OpenAI
发布时间2026-04-23
模型 IDgpt-5-5-xhigh
上下文暂无数据
输出暂无数据
模态文本 / 多模态待核验
推理是 / 推理模型或 thinking 模式
价格官方未披露 / 暂无数据
可用平台OpenAI
AA 评分60.24
基础模型发布时间Artificial Analysis 未披露
资料来源公开资料、厂商信息和案例库
A 类案例5

谱系位置

它在厂商路线中的位置

此页将 GPT-5.5 (xhigh) 放入 OpenAI 的当前 Atlas 路线中。若同厂前后代资料不足,先保留为路线追踪入口,不脑补谱系关系。

2026-04-23

GPT-5.5 (xhigh) 资料状态

来自公开资料与模型数据库 + Artificial Analysis + 2 个厂商/官方/模型家族证据入口;AA 不是唯一事实来源。

公开档案

模型状态

GPT-5.5 (xhigh) 当前标记为已有真实案例。

案例库

公开案例复核

已有 5 条可核验 A 类案例,达到完整补齐线

案例时间线

最近进入档案的 A 类案例

用采集时间呈现证据进入 Atlas 的顺序,方便复核来源新鲜度。

适合场景

  • - 作为完整模型索引和厂商路线追踪入口
  • - 推理/agentic workflow 候选

不适合

  • - 缺少真实案例时不要包装成推荐
  • - 缺字段时不要脑补价格、性能或上下文

真实案例

可核验 A 类案例精选

当前展示 5 条代表案例;排序优先看模型卡精选、证据可信度、快照状态和公开仓库/技术任务信号。案例总数仍为 5。

Representative Evidence

代表案例排序

当前第一代表案例是“5dmgmt 用 GPT-5.5 xhigh/Codex CLI 审计 Claude Code 产出的文档与代码库”。它会优先出现在本页,是因为该案例同时进入模型卡精选、具备 100/100 的证据可信度,并带有 已快照证据。

打开第一代表案例
排序池 5 条

模型卡精选优先

证据可信度 100/100

A+ 完整链路

快照状态 已快照

archive/evidence/gpt-5-5-xhigh-5dmgmt-claude-codex-audit-toolkit/manifest.json

技术信号 命中

Coding / repo / agent

5dmgmt 使用 GPT-5.5 (xhigh) 处理软件工程任务执行

5dmgmt · GPT-5.5 (xhigh)

A
厂商:OpenAI 模型:GPT-5.5 (xhigh) 来源平台:GitHub 最后复核:2026-06-27T09:39:02Z 证据快照:已快照 · 2 / 2 个证据目标 归档说明:已完成快照:2 / 2 个证据目标,可用本地 manifest 复核证据指纹。
证据可信度 100/100

A+ 完整链路 · 代码仓库证据

原始证据1 个公开产物复核通过代码仓库证据

5dmgmt 公开的代码代理与软件工程案例,来源为 公开代码库,复核于 2026-06-27T09:39:02Z。 Model Atlas 将它标记为 A 类证据,因为它同时具备具体使用者、具体任务、公开原始证据和可访问产物。

任务:5dmgmt 的 claude-codex-audit-toolkit 公开描述了一套 Claude Code + Codex CLI 审计循环:Claude Code 起草教材、审计 runbook 或实现代码后,由 Codex CLI 使用 GPT-5.5 xhigh 进行独立第三方审计,逐轮输出 finding、反映修复并用收敛判定决定继续、scope cut 或 ALL PASS。

公开产物:公开仓库提供 docs/01-08、examples、五月雨防止提示、环境 lint 清单、收敛判定准则和运行模板;overview 明确记录该方法已在 Workshop Course 1 runbook、SIFT Phase C runbook、video-subtitler 代码管线等 3 个内部案例中实走验证,分别达到 4 轮 scope cut、13 轮 ALL PASS、5 轮代码管线审计等结果。

模型作用:GPT-5.5 (xhigh) 作为 Codex CLI 的审计模型,负责从独立视角检查 Claude Code 产物的缺陷、环境陷阱、scope creep、收敛状态和代码/文档质量,并生成可逐轮处理的审计 findings 与结论。

A 类理由:有具体使用者、具体任务、公开原始证据和可访问产物,可公开核验。

风险边界:证据来自公开 GitHub 文档和仓库;案例记录了 5dmgmt 内部实走案例与工具包产物,但未公开完整逐轮原始 Codex 会话日志。

原始记录:5dmgmt 用 GPT-5.5 xhigh/Codex CLI 审计 Claude Code 产出的文档与代码库

已有真实案例 代码代理与软件工程公开代码库A 类可核验real_case auto_approved 进入模型卡精选

frahlg 使用 GPT-5.5 (xhigh) 处理软件工程任务执行

frahlg · GPT-5.5 (xhigh)

A
厂商:OpenAI 模型:GPT-5.5 (xhigh) 来源平台:GitHub 最后复核:2026-06-27T09:14:00Z 证据快照:已快照 · 2 / 2 个证据目标 归档说明:已完成快照:2 / 2 个证据目标,可用本地 manifest 复核证据指纹。
证据可信度 100/100

A+ 完整链路 · 代码仓库证据

原始证据1 个公开产物复核通过代码仓库证据

frahlg 公开的代码代理与软件工程案例,来源为 公开代码库,复核于 2026-06-27T09:14:00Z。 Model Atlas 将它标记为 A 类证据,因为它同时具备具体使用者、具体任务、公开原始证据和可访问产物。

任务:Fusion 是一个 Claude Code skill,把高风险问题并行发送给多个前沿模型,由 GPT-5.5 (xhigh) 作为其中一个 blind panelist 进行独立推理,再由 Opus 4.8 汇总裁决。

公开产物:公开仓库提供了可安装的 Fusion skill、README 流程图和 assets/fusion-demo.gif 演示,用于输出带 verdict、consensus、contradictions、blind spots 与 audit trail 的最终答案。

模型作用:GPT-5.5 (xhigh) 在 panel 阶段提供独立推理路径和候选答案,贡献多模型分歧与互证信号,帮助最终答案避免单模型盲区。

A 类理由:有具体使用者、具体任务、公开原始证据和可访问产物,可公开核验。

风险边界:证据来自项目 README;它说明模型在工具中的设计用途和演示产物,但不提供生产使用指标。

原始记录:Fusion 用 GPT-5.5 xhigh 作为盲审 panelist 生成可审计答案

已有真实案例 代码代理与软件工程公开代码库A 类可核验real_case auto_approved 进入模型卡精选

kirillshsh 使用 GPT-5.5 (xhigh) 处理软件工程任务执行

kirillshsh · GPT-5.5 (xhigh)

A
厂商:OpenAI 模型:GPT-5.5 (xhigh) 来源平台:GitHub 最后复核:2026-06-27T09:14:00Z 证据快照:已快照 · 2 / 2 个证据目标 归档说明:已完成快照:2 / 2 个证据目标,可用本地 manifest 复核证据指纹。
证据可信度 100/100

A+ 完整链路 · 代码仓库证据

原始证据1 个公开产物复核通过代码仓库证据

kirillshsh 公开的代码代理与软件工程案例,来源为 公开代码库,复核于 2026-06-27T09:14:00Z。 Model Atlas 将它标记为 A 类证据,因为它同时具备具体使用者、具体任务、公开原始证据和可访问产物。

任务:shimplify 是全局 Codex skill,用三个专门的 GPT-5.5 xhigh Codex subagents 检查已能运行但存在 AI-generated clutter 的代码,包括重复 helper、膨胀参数、无必要抽象、重复检查和低效热路径。

公开产物:公开仓库提供 npm/脚本安装方式、reuse/quality/efficiency 三类 agent 配置,以及在当前分支应用 compact fixes 的工作流说明。

模型作用:GPT-5.5 (xhigh) 分别承担 reuse、quality、efficiency 三个只读 reviewer 角色,提出可执行的复用、简化和性能改进发现,再由主 Codex agent 聚合并应用。

A 类理由:有具体使用者、具体任务、公开原始证据和可访问产物,可公开核验。

风险边界:README 公开说明模型角色和产物;没有公开量化的缺陷修复成功率。

原始记录:shimplify 用三个 GPT-5.5 xhigh Codex 子代理清理 AI 代码冗余

已有真实案例 代码代理与软件工程公开代码库A 类可核验real_case auto_approved 进入模型卡精选

phiraml 使用 GPT-5.5 (xhigh) 处理软件工程任务执行

phiraml · GPT-5.5 (xhigh)

A
厂商:OpenAI 模型:GPT-5.5 (xhigh) 来源平台:GitHub 最后复核:2026-06-27T09:14:00Z 证据快照:已快照 · 2 / 2 个证据目标 归档说明:已完成快照:2 / 2 个证据目标,可用本地 manifest 复核证据指纹。
证据可信度 100/100

A+ 完整链路 · 代码仓库证据

原始证据1 个公开产物复核通过代码仓库证据

phiraml 公开的代码代理与软件工程案例,来源为 公开代码库,复核于 2026-06-27T09:14:00Z。 Model Atlas 将它标记为 A 类证据,因为它同时具备具体使用者、具体任务、公开原始证据和可访问产物。

任务:claude-codex-judge 是 Claude Code skill,README 明确说明它使用 OpenAI codex CLI 的 gpt-5.5、xhigh reasoning,作为独立只读 judging agent 审查 Claude 的 plans、designs、diffs 和 decisions。

公开产物:公开仓库包含 .claude/skills/codex-judge/SKILL.md、codex-judge.sh wrapper 和使用示例;输出 verdict、关键修复建议,并支持跨轮 session continuity。

模型作用:GPT-5.5 (xhigh) 负责读取代码库上下文并提出反驳、风险和判断结论,为 Claude 的计划或 diff 提供第二模型审查。

A 类理由:有具体使用者、具体任务、公开原始证据和可访问产物,可公开核验。

风险边界:证据来自项目 README 和公开脚本;案例是开源工具而非客户生产故事。

原始记录:claude-codex-judge 用 GPT-5.5 xhigh 作为只读判断代理

已有真实案例 代码代理与软件工程公开代码库A 类可核验real_case auto_approved 进入模型卡精选

Sol3Coder 使用 GPT-5.5 (xhigh) 处理智能体流程编排

Sol3Coder · GPT-5.5 (xhigh)

A
厂商:OpenAI 模型:GPT-5.5 (xhigh) 来源平台:GitHub 最后复核:2026-06-27T09:14:00Z 证据快照:已快照 · 2 / 2 个证据目标 归档说明:已完成快照:2 / 2 个证据目标,可用本地 manifest 复核证据指纹。
证据可信度 100/100

A+ 完整链路 · 代码仓库证据

原始证据1 个公开产物复核通过代码仓库证据

Sol3Coder 公开的智能体工作流案例,来源为 公开代码库,复核于 2026-06-27T09:14:00Z。 Model Atlas 将它标记为 A 类证据,因为它同时具备具体使用者、具体任务、公开原始证据和可访问产物。

任务:该仓库公开了面向 MISRA C++:2023 的通用 AI agent skill,用于 C++ review、新代码指导和启发式 safety gate checks;README 明确写明该 skill was created by GPT-5.5 with xhigh reasoning effort。

公开产物:公开产物包含 .agents/skills/misra-cpp-2023/SKILL.md、review workflow、coding guidance、rule index、scan_cpp_misra.py 启发式扫描器和 unittest 验证入口。

模型作用:GPT-5.5 (xhigh) 负责生成该 MISRA C++:2023 agent skill 的结构、审查流程、指导文档与辅助扫描脚本。

A 类理由:有具体使用者、具体任务、公开原始证据和可访问产物,可公开核验。

风险边界:项目注明 scanner 不是认证 MISRA checker,且因版权限制不包含原始 MISRA PDF;证据充分绑定模型创建产物,但不是生产客户案例。

原始记录:MISRA C++:2023 Agent Skill 由 GPT-5.5 xhigh 创建用于 C++ 安全审查

已有真实案例 智能体工作流公开代码库A 类可核验real_case auto_approved 进入模型卡精选

数据缺口

只基于现有字段判断缺口;缺失项不会被猜测填充。

价格:待补公开资料 上下文:待补公开资料 输出:待补公开资料 官方/家族来源:已有 发布时间:已有 可用平台:已有 A 类案例:已有
  • - 补充方向:核验 价格 的官方/API/案例来源。
  • - 补充方向:核验 上下文 的官方/API/案例来源。
  • - 补充方向:核验 输出 的官方/API/案例来源。

下一步验证建议

  • - 继续保留 A 类案例的原始证据、产物页和版本快照。
  • - 补官方发布/API/System Card 来源;若官方未披露,继续标注“官方未披露”。
  • - 把 benchmark、教程、发布文保留为背景资料,不提升为真实案例。