Chinese Brief
中文案例导读
re-cinq 公开的医疗与生命科学案例,来源为 公开代码库,复核于 2026-06-26T23:20:00Z。 Model Atlas 将它标记为 A 类证据,因为它同时具备具体使用者、具体任务、公开原始证据和可访问产物。 Model Atlas 不把 benchmark、教程、发布说明或集合页包装成真实案例。
CASE EVIDENCE / A RECORD
re-cinq 公开的医疗与生命科学案例,来源为 公开代码库,复核于 2026-06-26T23:20:00Z。
原始记录:Self-hosted MiniMax M2.5 inference server on NVIDIA DGX Spark with OpenAI-compatible API
Chinese Brief
re-cinq 公开的医疗与生命科学案例,来源为 公开代码库,复核于 2026-06-26T23:20:00Z。 Model Atlas 将它标记为 A 类证据,因为它同时具备具体使用者、具体任务、公开原始证据和可访问产物。 Model Atlas 不把 benchmark、教程、发布说明或集合页包装成真实案例。
任务
这是一个围绕医疗和生命科学分析的真实任务,公开材料可以回溯到具体使用者和具体产物。 原始资料写作:Dockerized self-hosted inference server running MiniMax M2.5 (230B params, 10B active MoE) locally on NVIDIA DGX Spark (GB10 Grace Blackwell, 128GB unified memory). Uses llama.cpp with Q3_K_XL quantization (~101GB), ful…
公开材料提供公开代码、README 或项目配置,可用于核验任务结果、项目形态和模型绑定关系。 原始资料写作:Working Docker Compose deployment: single-command start (docker compose up -d), health check endpoint, OpenAI-compatible API. Tested with curl: model responds to chat completions requests with full reasoning capability.
MiniMax-M2.5 在该案例中承担医疗和生命科学分析相关的生成、分析、编排或实现角色。 原始资料写作:MiniMax M2.5 provides the full reasoning backbone for the locally-hosted inference server. The MoE architecture (230B total, 10B active) enables efficient local deployment on consumer/prosumer hardware while maintaining…
当前判断基于公开材料;若产物下线、仓库变更或模型参与比例仅来自作者自述,需要在引用前重新复核。 原始资料写作:12 stars. Requires NVIDIA DGX Spark hardware (GB10 Grace Blackwell). Uses Unsloth GGUF quantization (UD-Q3_K_XL). Model download ~101GB. Not a 'use case' in the application sense but a verified deployment/configuration …