DATA CUT 2026-07-27 116 活跃模型 680 A 类案例

CASE EVIDENCE / A RECORD

chaoluond 使用 Llama 2 Chat 7B 处理真实任务执行

chaoluond 公开的真实任务执行案例,来源为 公开代码库,复核于 2026-06-27T08:30:31Z。

原始记录:chaoluond 基于 Llama 2 7B Chat 微调 Safety LLaMA 做聊天安全评估

A

Chinese Brief

中文案例导读

chaoluond 公开的真实任务执行案例,来源为 公开代码库,复核于 2026-06-27T08:30:31Z。 Model Atlas 将它标记为 A 类证据,因为它同时具备具体使用者、具体任务、公开原始证据和可访问产物。 Model Atlas 不把 benchmark、教程、发布说明或集合页包装成真实案例。

厂商Meta / Llama
模型Llama 2 Chat 7B
任务类型真实任务执行
审核状态auto_approved

任务

真实任务背景

训练一个独立模型监控和评估 AI 聊天机器人的回复是否安全,作为类似 OpenAI moderation endpoint 的开源替代方案。

真实任务执行公开代码库A 类可核验real_case
公开产物

公开仓库发布 Safety LLaMA 项目说明、方法论、训练/评估资源和相关代码,用于检测聊天响应中的不安全内容。

模型作用

README 明确写明 Safety LLaMA 是使用 Anthropic red-team harmless 数据集微调得到的 7B-chat LLaMA2 模型,Llama 2 Chat 7B 是安全判别模型的基础。

风险边界

属于开源安全研究/工具案例;README 有具体任务和模型绑定,但不是商业客户故事。