DATA CUT 2026-07-27 116 活跃模型 680 A 类案例

模型档案

o3-pro

o3-pro 已有可核验 A 类案例,可优先进入选型对比。

已有真实案例

档案摘要 / Decision snapshot

先判断能不能用于选型。

证据完整度 100%
公开状态 已有真实案例

可进入对比

案例覆盖 5 条 A 类

有真实任务证据

主要适用 作为完整模型索引和厂商路线追踪入口

来自模型卡

谨慎场景 缺少真实案例时不要包装成推荐

边界优先

30 秒结论

可进入选型对比,但仍以案例证据为准。

来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。

这页有来源、有风险说明、有公开可核验 A 类案例。

数据可信度 / 证据强度

已有真实案例

A 类案例

5

AA 评分

40.69

官方来源

2 个补充入口

案例来源

5 条可核验

来自公开资料与模型数据库 + Artificial Analysis + 2 个厂商/官方/模型家族证据入口;AA 不是唯一事实来源。

Evidence Distribution

案例证据分布

o3-pro 当前关联 5 条 A 类案例;这里按任务、来源和复核时间观察证据结构。

A CASES 5 5 selected

Evidence Snapshot

证据快照覆盖

o3-pro 的 5 条 A 类案例中,已有 2 条完成本地证据快照;3 条仍在快照队列。

SNAPSHOT 40%
已快照 2

可用 manifest 复核

待快照 3

等待落盘

部分快照 0

需补抓

需关注 0

需人工复核

证据完整度

5 / 5

模型卡 OK

Feishu Bitable

官方/厂商来源 OK

2 个入口

A 类案例 OK

5 条

公开产物 OK

已绑定

风险备注 OK

已标注

能力边界

用标签表达信号,不用标签替代证据。

查看证据方法
Coding Agent

通用/待核验

长上下文

暂无数据

研究任务

待核验

开放生态

平台/待核验

生命周期风险

厂商OpenAI
厂商页OpenAI
发布时间2025-06-10
模型 IDo3-pro
上下文暂无数据
输出暂无数据
模态文本 / 多模态待核验
推理是 / 推理模型或 thinking 模式
价格官方未披露 / 暂无数据
可用平台OpenAI
AA 评分40.69
基础模型发布时间Jun 1, 2024
资料来源公开资料、厂商信息和案例库
A 类案例5

谱系位置

它在厂商路线中的位置

此页将 o3-pro 放入 OpenAI 的当前 Atlas 路线中。若同厂前后代资料不足,先保留为路线追踪入口,不脑补谱系关系。

2025-06-10

o3-pro 资料状态

来自公开资料与模型数据库 + Artificial Analysis + 2 个厂商/官方/模型家族证据入口;AA 不是唯一事实来源。

公开档案

模型状态

o3-pro 当前标记为已有真实案例。

案例库

公开案例复核

已有 5 条可核验 A 类案例,达到完整补齐线

案例时间线

最近进入档案的 A 类案例

用采集时间呈现证据进入 Atlas 的顺序,方便复核来源新鲜度。

适合场景

  • - 作为完整模型索引和厂商路线追踪入口
  • - 推理/agentic workflow 候选

不适合

  • - 缺少真实案例时不要包装成推荐
  • - 缺字段时不要脑补价格、性能或上下文

真实案例

可核验 A 类案例精选

当前展示 5 条代表案例;排序优先看模型卡精选、证据可信度、快照状态和公开仓库/技术任务信号。案例总数仍为 5。

Representative Evidence

代表案例排序

当前第一代表案例是“Developer builds Open WebUI plugin for o3-pro reasoning model access with cost tracking”。它会优先出现在本页,是因为该案例同时进入模型卡精选、具备 100/100 的证据可信度,并带有 已快照证据。

打开第一代表案例
排序池 5 条

模型卡精选优先

证据可信度 100/100

A+ 完整链路

快照状态 已快照

archive/evidence/o3-pro-openwebui-plugin-karanb192/manifest.json

技术信号 命中

Coding / repo / agent

karanb192 (independent developer) 使用 o3-pro 处理真实任务执行

karanb192 (independent developer) · o3-pro

A
厂商:OpenAI 模型:o3-pro 来源平台:github 最后复核:2026-06-26T22:55:00Z 证据快照:已快照 · 2 / 2 个证据目标 归档说明:已完成快照:2 / 2 个证据目标,可用本地 manifest 复核证据指纹。
证据可信度 100/100

A+ 完整链路 · 代码仓库证据

原始证据1 个公开产物复核通过代码仓库证据

karanb192 (independent developer) 公开的真实任务执行案例,来源为 公开代码库,复核于 2026-06-26T22:55:00Z。 Model Atlas 将它标记为 A 类证据,因为它同时具备具体使用者、具体任务、公开原始证据和可访问产物。

任务:这是一个围绕真实任务执行的真实任务,公开材料可以回溯到具体使用者和具体产物。 原始资料写作:Developer karanb192 built and published an Open WebUI function/plugin that integrates OpenAI o3-pro reasoning models into the Open Web UI platform, providing comprehensive per-message token usage tracking, cumulative co…

公开产物:公开材料提供公开代码、README 或项目配置,可用于核验任务结果、项目形态和模型绑定关系。 原始资料写作:Published open-source plugin (11 stars, 8 forks) on GitHub and the Open Web UI marketplace at openwebui.com/f/karanb192/o3pro_o1pro_support. The plugin enables o3-pro usage in Open Web UI with real-time cost tracking sh…

模型作用:o3-pro 在该案例中承担真实任务执行相关的生成、分析、编排或实现角色。 原始资料写作:o3-pro is the primary reasoning model integrated by the plugin. The plugin was specifically designed around o3-pro's unique characteristics: its Responses API requirement (not standard chat/completions), its $20/$80 per…

A 类理由:有具体使用者、具体任务、公开原始证据和可访问产物,可公开核验。

风险边界:当前判断基于公开材料;若产物下线、仓库变更或模型参与比例仅来自作者自述,需要在引用前重新复核。 原始资料写作:This is a tool/integration case rather than a direct task-solving case. The developer built the plugin to enable o3-pro access rather than using o3-pro to solve a specific domain problem. However, the plugin is actively…

原始记录:Developer builds Open WebUI plugin for o3-pro reasoning model access with cost tracking

已有真实案例 真实任务执行公开代码库A 类可核验real_case auto_approved 进入模型卡精选

AIYLT 使用 o3-pro 处理金融和商业分析

AIYLT · o3-pro

A
厂商:OpenAI 模型:o3-pro 来源平台:github 最后复核:2026-06-26T22:30:00Z 证据快照:已快照 · 2 / 2 个证据目标 归档说明:已完成快照:2 / 2 个证据目标,可用本地 manifest 复核证据指纹。
证据可信度 100/100

A+ 完整链路 · 代码仓库证据

原始证据1 个公开产物复核通过代码仓库证据

AIYLT 公开的金融与商业分析案例,来源为 公开代码库,复核于 2026-06-26T22:30:00Z。 Model Atlas 将它标记为 A 类证据,因为它同时具备具体使用者、具体任务、公开原始证据和可访问产物。

任务:AIYLT 使用 OpenAI o3-2025-04-16 模型(即 o3-pro)构建了一套完整的美股日内交易智能策略系统。系统包含 11 个专业策略模块(Oracle、Helios、Chronos、TerraFilter、Minerva、AlphaForge、Fenrir、Hermes、Aegis、Cerberus、EchoLog),按优先级协同工作,集成了 Polygon.io Level-2 实时数据,目标命中率 ≥80%。

公开产物:系统实现了完整的从数据获取到策略决策到 GitHub 自动推送的全流程自动化。11 个模块分别负责市场扫描、策略评分、环境过滤、行为验证、基本面分析、暗池资金检测、新闻事件分析、风险控制、异常防护和策略回测。代码仓库包含完整的 Python 实现,包括主执行程序 run_o3_pro.py、Polygon API 客户端、GitHub 推送模块和所有策略模块。

模型作用:o3-pro 在此系统中作为核心推理引擎,负责所有策略模块的决策推理。系统设计严格要求使用 o3-pro 模型(绝不降级),利用其深度推理能力进行多维度股票分析和交易决策,包括整合 11 个模块的分析结果进行最终的 Oracle 决策。

A 类理由:有具体使用者、具体任务、公开原始证据和可访问产物,可公开核验。

风险边界:该案例来自 GitHub 公开仓库,代码完整可验证。仓库 stars 为 0,可能是较新的个人项目。o3-pro 在此作为 API 调用模型使用(通过 openai Python SDK),非 ChatGPT 界面使用。系统声称目标命中率 ≥80%,但无独立回测结果验证。模型版本绑定为 o3-2025-04-16。

原始记录:AIYLT 构建基于 o3-pro 的美股智能交易策略系统

已有真实案例 金融与商业分析公开代码库A 类可核验real_case auto_approved 进入模型卡精选

Roboflow (authored by James Gallagh… 使用 o3-pro 处理代码审查和测试生成

Roboflow (authored by James Gallagher) · o3-pro

A
厂商:OpenAI 模型:o3-pro 来源平台:blog 最后复核:2026-06-26T14:00:00Z 证据快照:待快照 · 0 / 2 个证据目标 归档说明:已列入归档队列,等待抓取 2 个证据目标。
证据可信度 99/100

A+ 完整链路 · 官方/客户故事

原始证据1 个公开产物复核通过官方/客户故事

Roboflow (authored by James Gallagher) 公开的代码审查与测试案例,来源为 博客记录,复核于 2026-06-26T14:00:00Z。 Model Atlas 将它标记为 A 类证据,因为它同时具备具体使用者、具体任务、公开原始证据和可访问产物。

任务:这是一个围绕代码审查和测试生成的真实任务,公开材料可以回溯到具体使用者和具体产物。 原始资料写作:Roboflow, a computer vision platform company, evaluated OpenAI o3-pro across multiple vision use cases including industrial defect detection, object counting in complex scenes, and Visual Question Answering (VQA) to ass…

公开产物:公开材料提供原始证据链接和可访问产物,可用于核验任务结果、项目形态和模型绑定关系。 原始资料写作:Roboflow published detailed evaluation results showing o3-pro's performance on defect detection, object counting, and VQA tasks, with comparisons to other frontier models. The article demonstrates o3-pro's strengths and…

模型作用:o3-pro 在该案例中承担代码审查和测试生成相关的生成、分析、编排或实现角色。 原始资料写作:o3-pro provided multimodal reasoning capability that enabled complex visual analysis tasks including defect detection, counting, and question answering about images. The evaluation showed it as a competitive option for …

A 类理由:有具体使用者、具体任务、公开原始证据和可访问产物,可公开核验。

风险边界:当前判断基于公开材料;若产物下线、仓库变更或模型参与比例仅来自作者自述,需要在引用前重新复核。 原始资料写作:The article is a review/evaluation by Roboflow rather than a deployment story. Roboflow is a real company with a published product. Article last modified 2026-06-23, indicating ongoing updates. Content behind Cloudflare…

原始记录:Roboflow evaluates o3-pro for industrial computer vision tasks

已有真实案例 代码审查与测试博客记录A 类可核验real_case auto_approved 进入模型卡精选

Raindrop.ai (Ben Hylak, co-founder … 使用 o3-pro 处理真实任务执行

Raindrop.ai (Ben Hylak, co-founder & Alexis Gauba, co-founder) · o3-pro

A
厂商:OpenAI 模型:o3-pro 来源平台:latent.space 最后复核:2026-06-26T22:30:00Z 证据快照:待快照 · 0 / 2 个证据目标 归档说明:已列入归档队列,等待抓取 2 个证据目标。
证据可信度 97/100

A 高可信 · 社区公开记录

原始证据1 个公开产物复核通过社区公开记录

Raindrop.ai (Ben Hylak, co-founder & Alexis Gauba, co-founder) 公开的真实任务执行案例,来源为 latent.space,复核于 2026-06-26T22:30:00Z。 Model Atlas 将它标记为 A 类证据,因为它同时具备具体使用者、具体任务、公开原始证据和可访问产物。

任务:Raindrop.ai 联合创始人 Ben Hylak 和 Alexis Gauba 将公司历史上的所有规划会议记录、目标文档和语音备忘录汇总后,交给 o3-pro 进行深度分析,要求生成一份包含目标指标、时间表、优先级排序和明确裁减建议的完整战略规划。

公开产物:o3-pro 生成了极其具体且可执行的战略计划,包含精确的目标指标、时间线、优先级排序和明确的取舍建议。Ben Hylak 在文中表示:'The plan o3 Pro gave us was specific and rooted enough that it actually changed how we are thinking about our future.'(o3 Pro 给出的计划足够具体和扎实,真正改变了我们对未来的思考方式。)

模型作用:o3-pro 在此任务中的核心贡献是其超长上下文处理能力和深度推理能力。它能够消化大量异构历史数据(会议记录、目标、语音备忘录),并生成结构化的战略分析,这是 o3 基础模型无法达到的深度。文章指出 o3-pro 'smarter, much smarter'(聪明得多),但需要大量上下文输入才能发挥优势。

A 类理由:有具体使用者、具体任务、公开原始证据和可访问产物,可公开核验。

风险边界:该案例来自 Latent Space 博客的一篇早期评测文章,作者 Ben Hylak 是 Raindrop.ai 联合创始人,属于第一方叙述。Raindrop.ai 是一家真实的 AI Agent 监控公司(https://www.raindrop.ai),有 Fortune 100 客户和 857 GitHub stars。案例描述了具体的使用场景和可验证的结果,但未提供 o3-pro 生成的具体规划文档作为独立 artifact。

原始记录:Raindrop.ai 使用 o3-pro 进行公司战略规划

已有真实案例 真实任务执行latent.spaceA 类可核验real_case auto_approved 进入模型卡精选

Simon Willison (developer, Datasett… 使用 o3-pro 处理真实任务执行

Simon Willison (developer, Datasette creator) · o3-pro

A
厂商:OpenAI 模型:o3-pro 来源平台:blog 最后复核:2026-06-26T14:00:00Z 证据快照:待快照 · 0 / 2 个证据目标 归档说明:已列入归档队列,等待抓取 2 个证据目标。
证据可信度 97/100

A 高可信 · 社区公开记录

原始证据1 个公开产物复核通过社区公开记录

Simon Willison (developer, Datasette creator) 公开的真实任务执行案例,来源为 博客记录,复核于 2026-06-26T14:00:00Z。 Model Atlas 将它标记为 A 类证据,因为它同时具备具体使用者、具体任务、公开原始证据和可访问产物。

任务:这是一个围绕真实任务执行的真实任务,公开材料可以回溯到具体使用者和具体产物。 原始资料写作:Simon Willison tested o3-pro on launch day by using his llm-openai-plugin to generate an SVG of a pelican riding a bicycle via the command line. He also noted that o3-pro works best when combined with tools and tracked …

公开产物:公开材料提供原始证据链接和可访问产物,可用于核验任务结果、项目形态和模型绑定关系。 原始资料写作:o3-pro successfully generated the SVG of a pelican riding a bicycle, though it took 124 seconds. Willison noted o3-pro is priced at $20/M input tokens and $80/M output tokens (10x o3 after its 80% price drop). He highli…

模型作用:o3-pro 在该案例中承担真实任务执行相关的生成、分析、编排或实现角色。 原始资料写作:o3-pro demonstrated its reasoning capability for code generation tasks, producing functional SVG output. The latency (124 seconds for a single SVG) highlighted the compute-intensive nature of the model. Willison's integ…

A 类理由:有具体使用者、具体任务、公开原始证据和可访问产物,可公开核验。

风险边界:当前判断基于公开材料;若产物下线、仓库变更或模型参与比例仅来自作者自述,需要在引用前重新复核。 原始资料写作:This is a developer testing/demo scenario rather than a production deployment. However, Simon Willison is a highly credible, named developer with a public track record. The blog post is freely accessible and documents s…

原始记录:Simon Willison uses o3-pro via llm CLI for SVG generation

已有真实案例 真实任务执行博客记录A 类可核验real_case auto_approved 进入模型卡精选

数据缺口

只基于现有字段判断缺口;缺失项不会被猜测填充。

价格:待补公开资料 上下文:待补公开资料 输出:待补公开资料 官方/家族来源:已有 发布时间:已有 可用平台:已有 A 类案例:已有
  • - 补充方向:核验 价格 的官方/API/案例来源。
  • - 补充方向:核验 上下文 的官方/API/案例来源。
  • - 补充方向:核验 输出 的官方/API/案例来源。

下一步验证建议

  • - 继续保留 A 类案例的原始证据、产物页和版本快照。
  • - 补官方发布/API/System Card 来源;若官方未披露,继续标注“官方未披露”。
  • - 把 benchmark、教程、发布文保留为背景资料,不提升为真实案例。