Qwen Chat 14B
Qwen / Alibaba
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
模型索引
搜索模型名或厂商名;按真实案例、公开资料状态和场景信号筛选。缺字段保持“暂无数据 / 官方未披露”,不猜测。
当前显示 134 / 134 个模型。 快捷筛选:全部模型。 当前 116 个模型有可核验 A 类案例。
Qwen / Alibaba
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Qwen / Alibaba
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Qwen / Alibaba
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Qwen / Alibaba
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Qwen / Alibaba
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Qwen / Alibaba
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Qwen / Alibaba
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Qwen / Alibaba
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Qwen / Alibaba
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Qwen / Alibaba
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Qwen / Alibaba
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Qwen / Alibaba
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Qwen / Alibaba
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Qwen / Alibaba
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Qwen / Alibaba
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Qwen / Alibaba
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Qwen / Alibaba
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Anthropic / Claude
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Anthropic / Claude
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Anthropic / Claude
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Anthropic / Claude
完整样板模型:已有官方来源、风险说明和可核验 A 类案例。
Anthropic / Claude
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Anthropic / Claude
完整样板模型:已有官方来源、风险说明和可核验 A 类案例。
Anthropic / Claude
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Anthropic / Claude
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Anthropic / Claude
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Anthropic / Claude
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Anthropic / Claude
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Anthropic / Claude
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
DeepSeek
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
DeepSeek
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
DeepSeek
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
DeepSeek
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
DeepSeek
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
DeepSeek
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
DeepSeek
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
DeepSeek
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
DeepSeek
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
DeepSeek
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
DeepSeek
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
DeepSeek
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
DeepSeek
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Google / Gemini
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Google / Gemini
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Google / Gemini
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Google / Gemini
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Google / Gemini
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Google / Gemini
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Google / Gemini
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Google / Gemini
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Google / Gemini
完整样板模型:已有官方来源、风险说明和可核验 A 类案例。
Google / Gemini
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Google / Gemini
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Kimi / Moonshot AI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Kimi / Moonshot AI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Kimi / Moonshot AI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Kimi / Moonshot AI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Kimi / Moonshot AI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
MBZUAI IFM / K2
归档 / 暂停研究节点:保留详情入口,但不作为主动推荐。
MBZUAI IFM / K2
归档 / 暂停研究节点:保留详情入口,但不作为主动推荐。
Meta / Llama
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Meta / Llama
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Meta / Llama
完整样板模型:已有官方来源、风险说明和可核验 A 类案例。
Meta / Llama
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Meta / Llama
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
MiniMax
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
MiniMax
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
MiniMax
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
MiniMax
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
MiniMax
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
OpenAI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
OpenAI
完整样板模型:已有官方来源、风险说明和可核验 A 类案例。
OpenAI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
OpenAI
完整样板模型:已有官方来源、风险说明和可核验 A 类案例。
OpenAI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
OpenAI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
OpenAI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
OpenAI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
OpenAI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
OpenAI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
OpenAI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
OpenAI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
OpenAI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
OpenAI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
OpenAI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
OpenAI
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Upstage / Solar
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Upstage / Solar
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Upstage / Solar
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Upstage / Solar
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Xiaomi / MiMo
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Xiaomi / MiMo
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Xiaomi / MiMo
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Z AI / GLM
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Z AI / GLM
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Z AI / GLM
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Z AI / GLM
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Z AI / GLM
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
xAI / Grok
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
xAI / Grok
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
xAI / Grok
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
xAI / Grok
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
xAI / Grok
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
xAI / Grok
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
xAI / Grok
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
xAI / Grok
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
StepFun / Step
来自公开模型资料库,并已补厂商/官方/模型家族证据;当前站内暂无可核验 A 类案例。
Anthropic / Claude
完整样板模型:已有官方来源、风险说明和可核验 A 类案例。
Anthropic / Claude
完整样板模型:已有官方来源、风险说明和可核验 A 类案例。
Anthropic / Claude
完整样板模型:已有官方来源、风险说明和可核验 A 类案例。
Anthropic / Claude
来自厂商页骨架的补充模型;缺失字段以“暂无数据 / 官方未披露”展示。
ByteDance Seed
Seed-2.1-Pro-Preview 在 Arena AI 平台公开试用,为正式版发布前的预览版本。
ByteDance Seed
Seed2.1 Pro 专注于真实生产力场景的复杂任务执行,在通用智能体、代码工程、多模态理解和视频理解等方面达到前沿水平。
ByteDance Seed
Seed2.1 Turbo 保留了多模态和 GUI 能力,适合产品级高频调用场景。
ByteDance Seed
来自厂商页骨架的补充模型;缺失字段以“暂无数据 / 官方未披露”展示。
ByteDance Seed
来自厂商页骨架的补充模型;缺失字段以“暂无数据 / 官方未披露”展示。
ByteDance Seed
来自厂商页骨架的补充模型;缺失字段以“暂无数据 / 官方未披露”展示。
ByteDance Seed
来自厂商页骨架的补充模型;缺失字段以“暂无数据 / 官方未披露”展示。
ByteDance Seed
Seed2.0 Pro 在搜索、研究、真实世界任务和多模态视频方面表现突出。
ByteDance Seed
Seed2.0 Lite 是字节跳动 Seed 团队于 2026 年 2 月发布的通用智能体模型系列中的轻量级版本,平衡输出质量与响应速度,定位为通用生产级模型;2026 年 4 月底升级为首个支持全模态理解(视频、图像、音频)的 Seed 基础模型。
Sakana AI
Fugu Ultra 是 Sakana AI 于 2026 年 6 月发布的多智能体编排模型。它本身是一个经过训练的语言模型,能够自主协调多个顶级 LLM(包括递归调用自身)来处理复杂的多步骤任务。用户只需调用单一 OpenAI 兼容 API 端点,Fugu Ultra 会自动进行模型选择、任务委派、验证和综合。在 SWE Bench Pro(73.7)、Terminal Bench 2.1(82.1)、LiveCodeBench(93.2)等 benchmark 上超越 Opus 4.8、Gemini 3.1 Pro 和 GPT-5.5。
ByteDance Seed
Seed2.0 Mini 是 Seed2.0 系列中最小的通用 Agent 模型,优化推理吞吐和部署密度,适用于高并发和批量生成场景。支持文本+图像+视频多模态理解。编程能力突出(SWE-Bench Pro 54.4%,Vibe Coding 57.4%),但在深度推理和 Agent 能力上弱于 Pro。
Sakana AI
Fugu 是 Sakana AI 于 2026 年 6 月发布的多智能体编排模型标准版,通过动态协调多个顶级 LLM 在保持低延迟的同时实现强性能,定位为日常工作的默认选择。基于 ICLR 2026 论文 Trinity 和 Conductor 的研究成果。
Anthropic / Claude
Claude Sonnet 5 是 Anthropic 于 2026 年 6 月 30 日发布的 Sonnet 级别模型,在 agentic 编程、工具调用和专业任务方面大幅超越 Sonnet 4.6,性能接近 Opus 4.8。
Thinking Machines Lab
Inkling 是 Thinking Machines Lab 于 2026 年 7 月 15 日发布的开源权重多模态模型,采用 975B 总参数/41B 激活参数的 MoE 架构,支持文本、图像和音频输入,1M tokens 上下文,Apache 2.0 许可证。
Kimi / Moonshot AI
Moonshot AI于2026年7月发布的旗舰大语言模型,2.8万亿参数,1M token上下文,原生支持文本+图像+视频理解,始终开启思考模式,面向长程编程与知识工作,全球首个开源3万亿级别模型。
xAI / Grok
Grok 4.5 是 xAI 于 2026 年 7 月 8 日发布的旗舰级推理模型,支持 500K 上下文、文本+图像+文件输入,可配置 high/medium/low 三档推理强度。Artificial Analysis Intelligence Index 53.8(第 9/187),Coding Index 72.4,Fullstack Agent Elo 1302。定价 $2/$6 per 1M tokens。
Sakana AI
Fugu-Cyber 是 Sakana AI 于 2026 年 7 月 21 日发布的面向网络安全的多智能体编排模型,在 CyberGym(86.9%)和 CTI-REALM(72.1%)基准测试中达到前沿水平。
Gemini 3.5 Flash-Lite 是 Google DeepMind 于 2026 年 7 月发布的 Gemini 3 系列 GA 模型,基于 Gemini 3.1 Flash-Lite,1M 上下文 64K 输出,输入 $0.30/1M tokens 输出 $2.50/1M tokens,支持文本/图像/视频/音频/PDF 多模态输入,定位高吞吐量低成本智能体任务。
Anthropic
Claude Haiku 4.5 是 Anthropic 于 2025 年 10 月 15 日发布的最快、最具成本效益的小型模型,在编码、计算机使用和代理任务上匹配 Sonnet 4 的性能,同时成本仅为三分之一、速度超过两倍。SWE-bench Verified 73.3%,输入 $1/M tokens,输出 $5/M tokens。
Gemini 3.6 Flash 提供 1M 上下文、64K 输出、多模态输入、工具调用与计算机操作预览。
Gemini 3.5 Flash Cyber 用于高频发现、验证和修复软件漏洞,目前通过 CodeMender 受限试点部署。
Meta
Muse Spark 1.1 提供 1M 上下文、工具调用、计算机操作、代码与并行子智能体能力。
OpenAI
GPT-Live-1 是 OpenAI 于 2026-07-08 发布的全双工语音模型,采用连续交互架构,支持实时打断与自然对话,深度任务委派给 GPT-5.5 处理。目前通过 ChatGPT 应用提供,API 即将开放。
矩阵
矩阵用于快速扫描高分模型,完整筛选请以上方模型索引为准。
| 模型 | Coding Agent 适配 | 长上下文 | 研究 | 开放 / 平台 | 生命周期风险 | A 类案例 |
|---|---|---|---|---|---|---|
| GPT-5.5 (xhigh) OpenAI | 通用/待核验 | 暂无数据 | 待核验 | 平台/待核验 | 中 | 5 |
| Claude Opus 4.7 (max) Anthropic / Claude | 通用/待核验 | 暂无数据 | 待核验 | 平台/待核验 | 中 | 5 |
| Gemini 3.1 Pro Preview Google / Gemini | 通用/待核验 | 暂无数据 | 待核验 | 平台/待核验 | 中 | 5 |
| GPT-5.4 (xhigh) OpenAI | 通用/待核验 | 暂无数据 | 待核验 | 平台/待核验 | 中 | 5 |
| Qwen3.7 Max Qwen / Alibaba | 通用/待核验 | 暂无数据 | 待核验 | 开放/混合信号 | 中 | 5 |
| Kimi K2.6 Kimi / Moonshot AI | 通用/待核验 | 暂无数据 | 待核验 | 平台/待核验 | 中 | 6 |
| MiMo-V2.5-Pro Xiaomi / MiMo | 通用/待核验 | 暂无数据 | 待核验 | 平台/待核验 | 中 | 5 |
| GPT-5.3 Codex (xhigh) OpenAI | 通用/待核验 | 暂无数据 | 待核验 | 平台/待核验 | 中 | 5 |
| Grok 4.3 (high) xAI / Grok | 通用/待核验 | 暂无数据 | 待核验 | 平台/待核验 | 中 | 8 |
| Claude Opus 4.6 (max) Anthropic / Claude | 通用/待核验 | 暂无数据 | 待核验 | 平台/待核验 | 中 | 5 |
| Muse Spark Meta / Llama | 通用/待核验 | 暂无数据 | 待核验 | 开放/混合信号 | 中 | 5 |
| Qwen3.6 Max Preview Qwen / Alibaba | 通用/待核验 | 暂无数据 | 待核验 | 开放/混合信号 | 中 | 7 |
| DeepSeek V4 Pro (Max) DeepSeek | 通用/待核验 | 暂无数据 | 待核验 | 开放/混合信号 | 中 | 7 |
| GLM-5.1 Z AI / GLM | 通用/待核验 | 暂无数据 | 待核验 | 平台/待核验 | 中 | 10 |
| GPT-5.2 (xhigh) OpenAI | 通用/待核验 | 暂无数据 | 待核验 | 平台/待核验 | 中 | 5 |
| Muse Spark 1.1 Meta | 待核验 | 暂无数据 | 待核验 | 待核验 | 中 | 0 |
| Qwen3.6 Plus Qwen / Alibaba | 通用/待核验 | 暂无数据 | 待核验 | 开放/混合信号 | 中 | 5 |
| GLM-5 Z AI / GLM | 通用/待核验 | 暂无数据 | 待核验 | 平台/待核验 | 中 | 5 |
| Claude Opus 4.5 Anthropic / Claude | 通用/待核验 | 暂无数据 | 待核验 | 平台/待核验 | 中 | 5 |
| MiniMax-M2.7 MiniMax | 通用/待核验 | 暂无数据 | 待核验 | 平台/待核验 | 中 | 5 |