查看: 45207| 回复: 95
跳转到指定楼层
上一主题 下一主题
收起左侧

[职场感言] Meta陷入恐慌?内部爆料:在疯狂分析复制DeepSeek,高预算难以解释

   
🔗
匿名用户-FV3PZ  | 添加认证 | 2025-1-24 21:10:56 |倒序浏览
. 1point 3acres
DeepSeek 开源大模型的阳谋,切切实实震撼着美国 AI 公司。.--


最先陷入恐慌的,似乎是同样推崇开源的 Meta。

.--
最近,有 Meta 员工在美国匿名职场社区 teamblind 上面发布了一个帖子。帖子提到,国内 AI 创业公司 DeepSeek 最近的一系列动作让 Meta 的生成式 AI 团队陷入了恐慌,因为在前者的低成本高歌猛进下,后者无法解释自己的超高预算的合理性。. From 1point 3acres bbs


原文如下:
这一切始于 DeepSeek-V3,它在基准测试中就已经让 Llama 4 落后。更糟糕的是那个「拥有 550 万训练预算的不知名中国公司」。. Waral dи,
工程师们正在疯狂地分析 DeepSeek,试图从中复制任何可能的东西。这一点都不夸张。
管理层担心如何证明庞大的生成式 AI 组织的成本是合理的。当生成式 AI 组织中的每个「领导」的薪资都比训练整个 DeepSeek-V3 的成本还要高,而我们有好几十个这样的「领导」时,他们要如何面对高层?
DeepSeek-R1 让情况变得更加可怕。虽然我不能透露机密信息,但这些很快就会公开。
这本应该是一个以工程为重点的小型组织,但是因为很多人想要参与进来分一杯羹,人为地膨胀了组织的招聘规模,结果每个人都成了输家。

原贴链接:https://www.teamblind.com/post/Meta-genai-org-in-panic-mode-KccnF41n


帖子中提到的 DeepSeek-V3 和 DeepSeek-R1 分别发布于 2024 年 12 月 26 日和 2025 年 1 月 20 日。


其中,DeepSeek-V3 在发布时提到,该模型在多项评测成绩超越了 Qwen2.5-72B 和 Llama-3.1-405B 等其他开源模型,并在性能上和世界顶尖的闭源模型 GPT-4o 以及 Claude-3.5-Sonnet 不分伯仲。


不过,更引人关注的是,这个参数量高达 671B 的大型语言模型训练成本仅 558 万美元。具体来说,它的预训练过程竟然只用了 266.4 万 H800 GPU Hours,再加上上下文扩展与后训练的训练,总共也只有 278.8 H800 GPU Hours。相较之下,Meta 的 Llama 3 系列模型的计算预算则多达 3930 万 H100 GPU Hours—— 如此计算量足可训练 DeepSeek-V3 至少 15 次。





而最近发布的 DeepSeek-R1 性能更猛 —— 在数学、代码、自然语言推理等任务上,它的性能比肩 OpenAI o1 正式版。而且模型在发布的同时,权重同步开源。很多人惊呼,原来 DeepSeek 才是真正的 OpenAI。UC Berkeley 教授 Alex Dimakis 则认为, DeepSeek 现在已经处于领先位置,美国公司可能需要迎头赶上了。
. .и




看到这里,我们不难理解为何 Meta 的团队会陷入恐慌。如果今年推出的 Llama 4 没有点硬本事,他们「开源之光」的地位岌岌可危。


有人指出,其实该慌的不止 Meta,OpenAI、谷歌、Anthropic 又何尝没有受到挑战。「这是一件好事,我们可以实时看到公开竞争对创新的影响。」

-baidu 1point3acres



还有人担心起了英伟达的股价,表示「如果 DeeSeek 的创新是真的,那 AI 公司是否真的需要那么多显卡?」





不过,也有人质疑,DeepSeek 究竟是靠创新还是靠蒸馏 OpenAI 的模型取胜?有人回复说,这可以从他们的发布的技术报告中找到答案。
. 1point 3acres




目前,我们还无法确定帖子的真实性。

. Χ
不知道 Meta 后续将如何回应,即将到来的 Llama 4 又会达到怎样的性能。

本帖子中包含更多资源

您需要 登录 才可以下载或查看附件。没有帐号?注册账号

x

评分

参与人数 1大米 +1 收起 理由
rh443453518 + 1 赞一个

查看全部评分


上一篇:面试bq的时候,没听清sorry了两次算red flag吗?
下一篇:如何在简历中体现现在的level (L3/4/5)如果role title不是很明显的话
地里匿名用户
推荐
匿名用户-TGZQJ  | 添加认证 | 2025-1-25 08:41:33
本帖最后由 匿名 于 2025-1-24 16:43 编辑

DeepSeek  才是真正实现了 “Open AI” 的初衷,所有仓库开源。R1 性能比肩 ChatGPT-O1。而且 Token 收费全网性价比最高。可谓是 AI 大模型之光了。
回复

使用道具 举报

地里匿名用户
推荐
匿名用户-SRHPE  | 添加认证 | 2025-1-25 05:59:10
greendayacdc 发表于 2025-1-24 13:17
我就在genai,我们从来都没听过,没有panic

. 1point 3 acres没有太过panic我可以理解,毕竟都是开源,大不了调转枪头抄呗。

但要是到现在连deepseek都没听过,那genai就要成下一个RL了。
回复

使用道具 举报

地里匿名用户
推荐
匿名用户-1LGVJ  | 添加认证 | 2025-1-25 08:56:07 来自APP
DeepSeek 的成功,也证明了美国大厂那种一味地堆 AI 芯片烧钱的做法方向错了。也对英伟达未来的 AI 芯片生意一定程度上利空了。
回复

使用道具 举报

🔗
UC小王子 2025-1-25 05:13:58 | 只看该作者
全局:
yujianchuan 发表于 2025-1-24 13:11
感觉DeepSeek雇了很多水军到处吹,X上全是类似帖子,之前地里还有一个帖子全是匿名,感觉广告规模之大很诡 ...

试了一下确实不错 虽然都是蒸馏的 但这个性能如果真的只用了5M的成本来训练那简直人类之光了
回复

使用道具 举报

全局:
我就在genai,我们从来都没听过,没有panic
回复

使用道具 举报

🔗
海拔2纳米 2025-1-25 05:20:38 | 只看该作者
全局:
恐慌到不至于,加把劲应对是真的。我看到了一个DeepSeek warroom的post
回复

使用道具 举报

地里匿名用户
🔗
匿名用户-J56BX  | 添加认证 | 2025-1-25 05:36:24
deepseek是很屌
. 1point3acres
但是我不相信他们没有针对性的从openai/claude里面拖数据,当然能拿到数据也是本事。meta应该是不敢的,会被法务给直接毙掉

What you cannot do. You may not use our Services for any illegal, harmful, or abusive activity. For example, you may not:

Use our Services in a way that infringes, misappropriates or violates anyone’s rights.

Modify, copy, lease, sell or distribute any of our Services.

Attempt to or assist anyone to reverse engineer, decompile or discover the source code or underlying components of our Services, including our models, algorithms, or systems (except to the extent this restriction is prohibited by applicable law).

Automatically or programmatically extract data or Output (defined below).
. Waral dи,
Represent that Output was human-generated when it was not.

Interfere with or disrupt our Services, including circumvent any rate limits or restrictions or bypass any protective measures or safety mitigations we put on our Services.

Use Output to develop models that compete with OpenAI.. Waral dи,


不过altman自己也说了,你干的成你就干的成,所以🤷,毕竟美国法律只管美国公司,deepseek它管不着
回复

使用道具 举报

🔗
Jaywolf 2025-1-25 05:41:12 | 只看该作者
全局:
好事啊,一下子把GAI成本打下来了。有竞争才有进步,Meta的竞争力是强大的infra
回复

使用道具 举报

🔗
Jaywolf 2025-1-25 05:51:55 | 只看该作者
全局:
匿名用户 发表于 2025-1-24 13:42
这个逻辑和中国制造一直都是一致的,
便宜,但永远无法比原版更好。

很难说,中国的tictok和小红书不是更好吗?
回复

使用道具 举报

🔗
waywayger 2025-1-25 05:57:32 | 只看该作者
全局:
Meta码农的中文真不错。。。
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 注册账号
职场达人
  • ↑ 本版用于讨论职场各种干货话题,闲聊请去🔗聊聊或者🔗匿名版
  • ❌ 本版严禁水贴,引战,发布广告,拉群,贴个人联系方式,扣分无警告
  • ☑ 求职、面经等去 🔗北美求职和 🔗回国求职大区,刷题和学习请去 🔗终身学习大区
  • ☑ 请去专版发布 🔗内推, 🔗招聘信息,和讨论 🔗创业内容
  • ☑ PIP / DevList/ Need Support 等话题也已开设 🔗专版

本版积分规则

>
快速回复 返回顶部 返回列表