DATA CUT 2026-07-27 116 活跃模型 680 A 类案例

CASE EVIDENCE / A RECORD

applex250 使用 GLM-4.7 处理文档理解和结构化处理

applex250 公开的文档理解与处理案例,来源为 公开代码库,复核于 2026-06-26T23:55:00Z。

原始记录:mtrans: 基于 GLM-4.7 的英文学术文献 Markdown 翻译工具

A

Chinese Brief

中文案例导读

applex250 公开的文档理解与处理案例,来源为 公开代码库,复核于 2026-06-26T23:55:00Z。 Model Atlas 将它标记为 A 类证据,因为它同时具备具体使用者、具体任务、公开原始证据和可访问产物。 Model Atlas 不把 benchmark、教程、发布说明或集合页包装成真实案例。

厂商Z AI / GLM
模型GLM-4.7
任务类型文档理解与处理
审核状态auto_approved

任务

真实任务背景

使用智谱 GLM-4.7 构建英文学术文献 Markdown 翻译工具,支持 PDF/Word/PPT/图片等多格式输入(通过 MinerU 转换为 Markdown),智能分段、并发翻译、术语一致性保持、表格/公式/代码块过滤与保留,以及 Web 可视化界面。

文档理解与处理公开代码库A 类可核验real_case
公开产物

完整的翻译工具,支持命令行和 Web 界面(拖拽上传、任务队列、实时日志),输出高质量中文学术文献 Markdown。过滤特殊元素后翻译可节省 50%+ Token 消耗。v2.1 版本集成 MinerU API 支持多格式直接翻译。

模型作用

GLM-4.7 是翻译流水线的核心 LLM,负责将英文学术文本翻译为中文,同时保持术语一致性和学术语言准确性。智能分段后并发调用 GLM-4.7 API 进行翻译。

风险边界

项目为个人开源项目;.env 示例中默认使用 glm-4 而非 glm-4.7,但 README 和项目描述明确标注基于 GLM-4.7。