Meta推迟新AI模型发布 性能未达竞争对手水平
据纽约时报报道,Meta内部代号为"Avocado"的新一代前沿AI模型因性能未达预期,发布时间从本月推迟至至少5月。知情人士透露,该模型在推理、编码和写作能力的内部测试中表现优于Meta此前的AI模型及谷歌去年3月发布的Gemini 2.5,但未能达到去年11月推出的Gemini 3.0水平,同时落后于OpenAI和Anthropic的领先模型。
扎克伯格去年7月曾承诺新模型将在"一年左右"推出。Meta今年资本支出预算高达1350亿美元,几乎是去年720亿美元的两倍。
据悉,Meta AI部门领导层还曾讨论临时授权使用谷歌Gemini来驱动其AI产品,但尚未做出决定。该模型由去年加入Meta担任首席AI官的Scale AI创始人Alexandr Wang领导的TBD Lab团队开发。
地里匿名用户BGAYR
大跃进能有好结果吗?
地里匿名用户U23RO
每日一问 小汪还没MM吗
地里匿名用户HWNBI
居然能超过gemini 2.5,已经超预期了,全员GE🐶
地里匿名用户LYBZ9
开源模型中国已经全面领先了。Meta做这个有什么意义。
Amberwood
推迟有什么用,别人啥也不干,等着你追上来?
地里匿名用户2BOLY
大家是不是觉得Claude Opus 4.6和Gemini 3这样的模型是可以一年时间从0做出来的……
地里匿名用户JTWYB
@匿名用户 他们可是拿了10m+ 一年的,不然呢。
给他们3年时间可以啊,每年包裹也除以3可以吗
我们特么拿他们的零头还得给他们做牛做马,结果出来个这。
- 来自MSL 牛马
在他们10M 面前,有区别吗。我是前者。
给他们3年时间可以啊,每年包裹也除以3可以吗
我们特么拿他们的零头还得给他们做牛做马,结果出来个这。
- 来自MSL 牛马
补充内容
MSL 是有大包,比如E6 牛马700-900K, MSL E6(并不是所有,其实也很少)能拿个1.2M到接近2M。在他们10M 面前,有区别吗。我是前者。
地里匿名用户2BOLY
@匿名用户 Anthropic和GDM的主力一年远不止10m呢
地里匿名用户ICDIB
正常吧。Google 也是搞了好几年,Gemini 性能才追上来;而且当时Google 要追的模型性能按现在的标准性能也不强
微信用户_jugklip
@匿名用户 开源又不赚钱,做自己赚钱的,有助于股价和利润
地里匿名用户JTWYB
@匿名用户 我说是最低的那些,TBD 也分内圈和外圈。内圈多少我不敢猜。
地里匿名用户RQG83
这话说的, 咋得也比我大亚麻的强。 你见过谁用亚麻的nova?就这个德行, 办公楼的大电视上还循环播放AI业绩呢
地里匿名用户O0UNA
这不叫be?!太sb的公司文化
地里匿名用户QYMQP
不行了就是不行了,天天天价挖人博眼球,啥也没搞出来,还把科学家撵走了,
- meta继续下看200
- meta继续下看200
地里匿名用户9EZPD
扎总的心真是碎了,要钱有钱,要卡有卡,咋就整不出来呢,郁闷。。。
大伙说说到底是管理层的问题,还是技术上工程师的问题,
大伙说说到底是管理层的问题,还是技术上工程师的问题,
地里匿名用户ZMNJ4
我擦 明天问问老板是不是真的
-- MSL 牛马 B
-- MSL 牛马 B
地里匿名用户G6HWK
"该模型在推理、编码和写作能力的内部测试中表现优于Meta此前的AI模型及谷歌去年3月发布的Gemini 2.5"
这是高级黑吗?如果不优于以前的模型和1年前的其他厂商模型,那不就是笑话。
问题是花这么多钱,招所谓顶级人才,出来个这。推迟到5月也是一点戏没有的。TBD要不要一起MS
这是高级黑吗?如果不优于以前的模型和1年前的其他厂商模型,那不就是笑话。
问题是花这么多钱,招所谓顶级人才,出来个这。推迟到5月也是一点戏没有的。TBD要不要一起MS
樱桃与芭蕉
纯技术讨论:之前说是在蒸馏,蒸馏最先进的模型也会差这么远吗?是因为无法logit蒸馏吗?
chrisZhu
感觉扎总进入玄学怪圈了 就是做不出来.. 砸钱也没用?
地里匿名用户0GIVQ
如果普通牛马launch delay成这样可以主动去刷题了吧 没人觉得这玩意儿简单 但是很难想象这是在这么大资源倾斜的情况下
miaoxingwuzhu
@匿名用户 当然是管理层的问题
只要对大模型训练略有了解,就知道让Alexandr Wang主管Meta的AI模型研发是多么离谱的决定
只要对大模型训练略有了解,就知道让Alexandr Wang主管Meta的AI模型研发是多么离谱的决定
地里匿名用户HGWZJ
以🦑的尿性真比gemini 2.5好就偷着乐吧,我猜大概率overfit个比2.5好的benchmark去manage小扎说争取赶上gemini 3再拿出来,实际上现在拿出来遛遛别不如llama3
地里匿名用户G6HWK
@樱桃与芭蕉 不是蒸馏吧,好像是参考了几个open source模型。蒸馏也不能蒸馏chatgpt, gemini, 最多蒸馏一下旧版的qwen,这不顶事的。
下次不要吃米粉
真达到2.5其实挺不错的了。
地里匿名用户FTPTS
@匿名用户 10m是tbd小兵的钱,100m每年的都有好几个,还有四年上1b的
地里匿名用户IXLMH
个人感觉,Meta 除了那个捞钱的广告系统,剩下的模型相关的产品都提不起来
地里匿名用户4TVA4
@匿名用户 如果是2.5 不是2.5 pro那就尴尬了
地里匿名用户4TVA4
@樱桃与芭蕉 现在各家的防护已经做起来了。 没那么好蒸了。 而且他在美国, 他敢蒸,别人就敢告。 美国公司拿中国不出海的公司没办法,还拿美国公司没办法吗? 他顶多能蒸馏下开源的千问
地里匿名用户4TVA4
@匿名用户 只能比2.5强那就很丢人, 要推出,至少要拿出2.5 pro的水平
地里匿名用户K4K44
@匿名用户 MSL 的牛马也是大佬呀。 其他部门的人是你这个 MSL 牛马的零头。
freetofree
@匿名用户 时间对每个人都是公平的,不管给你多少钱,你也不会一天多于24小时。别人花几年的时间做的东西被你6,7个月就超过。除非你是偷的东西然后改进。
freetofree
@匿名用户 meta问题就出在养了一堆废物刷paper的科学家,屁都没做出来,结果导致严重落后。科学家早就该走人,否则meta也不会到这个地步。
地里匿名用户URX7M
meta也是作,不知道还能作几年
地里匿名用户PM7MO
@chrisZhu 本身文化追求短平快,很难搞长裙项目吧
HugoJ
的确不如Gemini 3 , 所以一直没有装,还不如国内的的一些Ai 模型。
mingxinguke
lol. give you 10 wifes to make a baby in 1 month.
地里匿名用户W99AR
@匿名用户 三年没PSC。 他MM概率比你低多了,无限趋近于0
地里匿名用户IAQFZ
@freetofree 你没看到本质,meta就是出在小扎权利太大,手下全是马屁精,他说什么都是对的。说真话的结果就是得不到重用、边缘化,跟着上层们一起玩虚的就有reward,久而久之大家都知道怎么玩了,尤其是没有底线、廉耻感、责任感的一批烙印。大部分国人的性格看到屎一般是屏住呼吸配合一下,有些烙印可以做到一边吃一边说好吃,所以最后上去的都是这帮小人
地里匿名用户QYMQP
其实就是critical thinking, 华人的教育背景基本都是配合大佬,也不敢挑战,受限表达能力,也不想多讲,加班给你怼出来我拿个包裹就行了。
但长期来看,这样的公司很依赖小扎,错了会被手下的马屁精move fast给继续放大错误。烙印也这样,而且更离谱。
最近苹果不是说他们的决策都是吵架吵出来的吗?不怕你挑战,可以硬刚,这样出来的结论才是深思熟虑的。
但长期来看,这样的公司很依赖小扎,错了会被手下的马屁精move fast给继续放大错误。烙印也这样,而且更离谱。
最近苹果不是说他们的决策都是吵架吵出来的吗?不怕你挑战,可以硬刚,这样出来的结论才是深思熟虑的。
hustchenwenhu
新闻估计是瞎写的
freetofree
@匿名用户 你不要把一切都搞成印度人,中国人之类的种族问题。商业问题,谁能带来营收,谁就能长远
微信用户_p5w1v
好好用大模型赚钱就够了
把小王干掉股价翻翻
把小王干掉股价翻翻
地里匿名用户L168Y
@匿名用户 不能透露太多,但是这个比较基本准确,比2.5好一些.比3差一截
地里匿名用户7JXZX
对于买它妹们来说,做出来就是拿巨包,做不出来就是拿大包
地里匿名用户U23RO
@匿名用户 哈哈 我MM概率肯定比他小 因为我不在鱿鱼厂😂 就是看个热闹而已
地里匿名用户WVJL3
meta那种环境,里面的人根本没下限的。什么事做不出来?
地里匿名用户IAQFZ
@freetofree 难道不是么?印度人什么时候靠自己的本事弄出一家顶级企业了?他们有出过能带创造出TT,Nvidia,台积电这种顶级公司的人?
他们不就是擅长爬梯子混高层么,行业好他们就跟着喝汤,行业不好他们吃干抹净换下家,营收好不好跟他们有半毛钱关系?把这行业里的烙印都给放假了估计还能少出点sev
他们不就是擅长爬梯子混高层么,行业好他们就跟着喝汤,行业不好他们吃干抹净换下家,营收好不好跟他们有半毛钱关系?把这行业里的烙印都给放假了估计还能少出点sev
地里匿名用户JTWYB
一个威权体制的公司,领导做错了决定,就只能一路走到黑。之前当然做过对的决定。这就是这个公司的尿性。
海朝云
@匿名用户 anthropic的OG拿的多是跟着公司的估值成长起来的。他们值得的
地里匿名用户G6HWK
@匿名用户 到5月推出的时候说不定gemini 3.5都有了,你做不到SOTA, 就没有意义(至少短期内)。回头qwen开源的都比你这个好,你没地方搁脸。
地里匿名用户LDLP0
2.5 pro挺可以了
我觉得某种意义上可以算working了
唯一的问题是,o和a已经开始飞了,如果他们搞左脚踩右脚,那么meta就赶不上了
我觉得某种意义上可以算working了
唯一的问题是,o和a已经开始飞了,如果他们搞左脚踩右脚,那么meta就赶不上了
地里匿名用户LDLP0
@匿名用户 gemini 3.0讲真也一般
刷分很牛,但是干活儿很不行
刷分很牛,但是干活儿很不行
地里匿名用户HHJOY
不意外,不然庞若鸣干嘛跑了。再待下去就要MM了
地里匿名用户ASSCB
@匿名用户 确实,现在真正能干活的只有oa两家的模型
地里匿名用户QFJBD
https://www.reuters.com/business ... s-mount-2026-03-14/
Exclusive: Meta planning sweeping layoffs as AI costs mount今天上午有个帖子说🦑厂要继续裁员,还被一堆人嘲讽和让管理员拉黑。。。这不就来了吗
hustchenwenhu
@匿名用户 TBD根本没有psc
地里匿名用户G6HWK
@hustchenwenhu 小札是绝对没有耐心让你拿好几年的高薪而没有好的产出的。
没有PSC不等于没有评价你工作的方法。这就像所谓无限假期,你可以无限请假,但是活放在这,deadline放在这,老板对你的评价放在这,你自己看着办。而且合同里估计也没有写META不能TERMINATE你,美国的合同应该是可以双向终止的。它让你走,给你个台阶自己滚,否则,直接TERMINATE你就完了。
没有PSC不等于没有评价你工作的方法。这就像所谓无限假期,你可以无限请假,但是活放在这,deadline放在这,老板对你的评价放在这,你自己看着办。而且合同里估计也没有写META不能TERMINATE你,美国的合同应该是可以双向终止的。它让你走,给你个台阶自己滚,否则,直接TERMINATE你就完了。
地里匿名用户XYJ1B
@匿名用户 兄弟说出了广大MSL牛马心声
地里匿名用户JTWYB
Llama4出来的时候就是对标Gemini 2.5, 花天价搞一年还是 just beat 2.5,搞了个寂寞?没和Gemini 3对齐就是巨大的失败。

