Chinese Brief
中文案例导读
Clerveu 公开的代码代理与软件工程案例,来源为 公开代码库,复核于 2026-06-27T09:36:14Z。 Model Atlas 将它标记为 A 类证据,因为它同时具备具体使用者、具体任务、公开原始证据和可访问产物。 Model Atlas 不把 benchmark、教程、发布说明或集合页包装成真实案例。
CASE EVIDENCE / A RECORD
Clerveu 公开的代码代理与软件工程案例,来源为 公开代码库,复核于 2026-06-27T09:36:14Z。
原始记录:Clerveu 用 Qwen3.5-397B-A17B 构建视频转文本分析流水线
Chinese Brief
Clerveu 公开的代码代理与软件工程案例,来源为 公开代码库,复核于 2026-06-27T09:36:14Z。 Model Atlas 将它标记为 A 类证据,因为它同时具备具体使用者、具体任务、公开原始证据和可访问产物。 Model Atlas 不把 benchmark、教程、发布说明或集合页包装成真实案例。
任务
公开仓库 vidtest 提供一个视频转文本分析流水线:从 Source/ 选择视频,抽取/下载字幕,将视频切成 30 秒、720p、2fps 的片段,通过 OpenRouter 调用 Qwen3.5-397B-A17B vision model 为每个片段生成约 200 词视觉描述,再把字幕和视觉描述合并为带 [DIALOGUE] 与 [VISUAL DESCRIPTION] 的分析文件;配套 vlc_remote.py 支持 VLC 时间戳/截图交互。
README 明确写明该项目使用 OpenRouter 的 Qwen3.5-397B-A17B vision model,并列出 7 步 pipeline、输出目录 descriptions/ 与 results/、OPENROUTER_MODEL = qwen/qwen3.5-397b-a17b;仓库中的 analyze.py 也公开包含 OPENROUTER_MODEL 常量、send_to_qwen() 调用和将模型描述写入结果文件的逻辑。
Qwen3.5 397B A17B 是该流水线的核心视觉语言模型,负责读取视频片段与匹配字幕并生成结构化视觉描述;OpenRouter 提供 API 路由,项目脚本负责视频切片、字幕处理、结果合并和可选 Claude Code 后处理。
证据来自公开 GitHub 仓库 README 与源码自述,未独立验证其实际运行规模或生产部署;但 exact model slug、使用者、任务流程和可访问 artifact 均明确。