DeepSeek 是什么?
DeepSeek(深度求索)是由幻方量化旗下 AI 实验室开发的大语言模型系列。公司总部位于中国杭州,专注于研发高性能、低成本的大模型,以开源策略和极致性价比迅速在全球 AI 社区崭露头角。
核心模型
DeepSeek-V3(2024):671B 参数的 MoE 模型,采用创新的 Multi-token Prediction 训练策略,在多项基准测试上媲美 GPT-4 和 Claude 3.5,但训练成本仅约 557 万美元,是同等能力模型的十分之一。
DeepSeek-R1(2025):强化推理模型,在数学、编程和科学推理任务上达到业界顶尖水平,采用 RLVR(基于规则验证的强化学习)训练方法。
核心优势
极致性价比:DeepSeek 的 API 定价远低于 OpenAI 和 Anthropic,仅为 GPT-4 的几十分之一。开源策略:模型权重完全开源,支持本地部署和二次开发。中文优化:中文理解和生成能力优秀,特别适合中国用户和企业场景。