DeepSeek获74亿美元融资 梁文锋自投30亿美元并计划团队翻倍
DeepSeek 融资后启动大规模招人,梁文锋自掏 30 亿美元押注 AGI,并计划适配华为芯片对抗英伟达依赖。
DeepSeek 完成 74 亿美元融资,创始人梁文锋个人出资 30 亿美元,占总额五分之二。资金将用于团队翻倍、适配华为芯片。梁文锋表示战略不变:继续开源、保持低价、专注 AGI。此前他看到 Anthropic 的 Claude 通过大量算力训练出超强能力,意识到必须储备弹药。
正文摘录
The Information 最新消息曝光:梁文锋看到 Claude Mythos 通过海量算力和数据训练出超强能力,意识到 DeepSeek 不储备弹药根本没法打下去了。 Anthropic 今年 4 月发布第一个预览,DeepSeek 融资传闻也是 4 月中旬第一次传出。 DeepSeek 三百人团队要翻倍 融资完成后,DeepSeek 本周四罕见地发了一则公开声明: 所有部门招人 “至少翻倍” ,覆盖 AI 系统开发、基础设施、产品开发和深度学习研究。 其中负责把模型转化为自主 AI 智能体的核心部门 Harness 团队,已经进入每天面试的状态。 该团队负责人崔添翼今年 3 月从 Jane Street 跳槽加入,本月早些时候在 X 上透露了这一节奏。 与此同时,DeepSeek 正在加紧适配国产芯片,梁文锋相信华为芯片几年内就能追上英伟达的水平,DeepSeek 应该率先完成适配。 DeepSeek 的训练和部署系统是围绕英伟达 CUDA 软件搭建的,工程师必须重写底层软件才能让模型在华为芯片上高效运行。 这直接导致 DeepSeek 长达 15 个月没有发布任何新一代模型,在其他顶级实验室两三个月就发一次新模型的时代,这个空窗期格外扎眼。 这也让 DeepSeek 错过了去年下半年 Anthropic Claude Code 掀起的编程工具热潮。 但梁文锋在路演中对投资人说,编程工具和 AI 聊天机器人一样,都只是 AI 进化中的临时产物,如果重注押在这些短期产品上,会偏离通往 AGI 的终极目标。 2023 年他确实见过投资人,但当他告诉对方 DeepSeek 只做深度研究和科学探索、没有任何商业化或产品路线图时,投资人纷纷打了退堂鼓。 这次 74 亿美元的融资中,梁文锋自己写了最大的一张支票:200 亿人民币(约 30 亿美元),占总额的五分之二。