技术洞察
分享我们在云计算与 AI 领域的技术实践
算力服务 2026-08-20
让 H20 撑起 1.6 万亿参数模型:DeepSeek-V4-Pro 多场景推理服务优化实录
LMSYS 团队在 H20 GPU 上通过「按场景分档的 serving profile」方法论服务 1.6 万亿参数 MoE 模型 DeepSeek-V4-Pro,将单节点批处理延迟与旗舰 B300 的差距压缩到 1.42×,并让 1M 上下文成为现实——本文拆解其容量、prefill、decode 三层的可复用工程思路。
9 分钟
AI 解决方案 2026-06-30
轻量级私有化部署DeepSeek-V4-Flash方案
基于两台 DGX Spark 的DeepSeek-V4-Flash 企业级部署方案,企业低成本私有化部署的好选择
8
AI 应用 2026-05-03
AI 客服系统实战:用大模型提升客户满意度
分享我们帮助客户构建 AI 客服系统的完整方案,包括模型选型、知识库构建、效果评估等关键环节。
8 分钟