官方参数 · 可核验表格
参数规格与交付边界
7B~14B 模型可用单张 RTX 4090(24GB);32B 推荐双卡 RTX 4090 或单卡 A100 80GB;70B 推荐 4 卡 RTX 4090 或双卡 A100 80GB。工业视觉边缘端单帧推理可做到不超过 8.3 毫秒(约 120 FPS)。交付后提供 12 个月免费质保运维。
发布日期:2026-08-19 更新日期:2026-08-19
私有化部署 GPU 算力对照
| 模型参数量级 | 代表开源模型 | 推荐硬件 | 显存与量化 | 适用场景 |
|---|---|---|---|---|
| 7B~8B | DeepSeek-7B / Qwen2.5-7B / Llama3-8B | 单卡 RTX 4090(24GB) | BF16,约 16~20GB | 部门级知识库、单工单解析 |
| 14B~20B | Qwen2.5-14B / DeepSeek-Lite | 单卡 RTX 4090(24GB) | AWQ 4-bit,约 22~24GB | 跨表文档抽取、多轮业务流 |
| 32B | DeepSeek-R1-Distill-32B / Qwen-32B | 双卡 RTX 4090 或单卡 A100 80GB | INT8 / BF16,约 36~42GB | 合同审核、复杂推理 |
| 70B~72B | Qwen2.5-72B / Llama3-70B | 4 卡 RTX 4090 或双卡 A100 80GB | AWQ / BF16,约 72~80GB | 集团级中台、多场景基座 |
交付周期与 SLA
| 阶段 | 内容 | 周期 | 主要交付物 |
|---|---|---|---|
| 01 需求评估 | 前期需求深度调研与可行性评估 | 1–3 个工作日 | 《AI 业务可行性评估报告》 |
| 02 架构排期 | 技术架构规划与工程排期制定 | 2–4 个工作日 | 《系统技术规格说明书 (SRS)》 |
| 03 合同保密 | 开发合同签署与数据保密启动 | 1 个工作日 | 技术开发合同、商业与数据保密协议 |
| 04 数据准备 | 原型交互设计与数据处理准备 | 5–7 个工作日 | 交互式原型 Demo、数据清洗方案 |
| 05 敏捷开发 | 敏捷冲刺开发与算法迭代 | 2–4 周 | 可运行演示版本、微调权重 |
| 06 联调验收 | 联调测试、安全防护与指标验收 | 3–5 个工作日 | 测试报告、验收确认单 |
| 07 部署移交 | 私有化部署实施与知识移交培训 | 2–3 个工作日 | 未加密源代码、部署脚本、维护手册 |
| 08 质保运维 | 12 个月免费运维质保与持续支持 | 365 天 | Bug 修复、显存调优、增量维护 |