304永利集团官网入口-接连两位大咖出走,谷歌到底出了什么BUG?
首页财产ai正文 接连两位年夜咖出走,google到底出了甚么BUG? 不到一周google两位重量级员工去职,其模子与产物失队,全栈上风再也不,构造架构杂乱,只重评测,AI Agent 营业待改良。 2026-06-22 09:37 ·微信公家号:字母榜 作者 苗正 编纂 王靖 作者 苗正 编纂 王靖 AI投资人解读· 伯克希尔连续增持google股票,2026年第一季度持仓增长224%,6月又定向增发100亿美元。google曾经有全栈上风,硬件有TPU芯片,还有有DeepMind和浩繁进口产物。 · 模子及产物失队,构造架构杂乱,相干能力拆分,各构造KPI及报告请示线自力,致使资源华侈。过在迷信benchmark,轻忽使命交付现实需求。 总结:google虽有投资亮点,但今朝成长面对困境,需解决构造架谈判产物实用性问题,存眷其后续成长计谋和可否改善近况,再评估投资价值。内容由AI天生,仅供参考
不到一个星期,接连两位重量级员工都脱离了google。
前有Google DeepMind工程副总裁诺姆·沙泽尔(Noam Shazeer),后有AlphaFold焦点卖力人约翰·江珀(John Jumper)。
讲真的,我很难不思疑google此刻“出BUG”了。
从Gemini 3问世,到此刻都已往泰半年了,google还有是只有不同不年夜的Gemini 3.1。你再看看Anthropic这边,半年前还有只是Opus 4.5,此刻Fable 5都停用一个多星期了。
不只是模子失队,产物也随着失队。如今险些所有的AI公司都于发力AI Agent,OpenAI有Codex,Anthropic有Claude Code。
Fable 5加持下的Claude Code,此刻都能自立修bug,主动轮回跑测试直到全绿,还有能从设计稿直接天生出产代码,末了封装成完备的软件。
而google这边,只有一个拿不脱手的Antigravity 2.0,不仅效果糟糕糕,利用体验也一言难尽,网上对于这个产物只有一片骂声。
说到这里就不能不提一件事,伯克希尔从2025年就最先建仓google,到了2026年第 一季度,伯克希尔把google的持仓又加了224%。
2026年6月1日,伯克希尔以定向增发的方式向google母公司Alphabet再投了100亿美元。
莫非这回巴菲特真的看走眼了?
google的全栈上风怎么没了?
2025年11月18日,google发布了Gemini 3。皮查伊亲自出来站台,说这是google“最智能的模子”,拥有全世界最顶 尖的推理能力,多模态理解,还有有代码天生能力。
在是于统一天,google还有放出了别的两样工具:一个是Google Antigravity,号称“agent-first”的开发平台;一个是Nano Banana Pro,它是google此前爆火的文生图模子Nano Banana的威力增强版。
其时的google有多吓人?这么说吧,于google这场产物发布会竣事后两个星期,奥特曼向OpenAI内部发出“Code Red(红色警报)”备忘录,称ChatGPT的产物体验与质量上风正于被google快速追近,是以全公司暂停所有其他营业,集结全员投入到ChatGPT傍边。
奥特曼担忧的不只是这三个产物,而是google的全栈上风。
于硬件上,google有自研的TPU芯片。google从2015年就最先做TPU,到今天已经经到了第七代Ironwood,一颗芯片顶已往四颗的算力,液冷散热,一个pod塞进去9216颗芯片,提供42.5 ExaFlops的算力。
及英伟达那种通用的GPU差别,TPU是专门为AI推理使命举行过优化的,成本低,并且机能更好。
再往上一层是DeepMind。
2023年4月,google把Google Brain及DeepMind归并成为了一个单元。此前,这两家虽然是统一家公司,但持久以来是两套系统、两套文化,Brain偏产物及贸易化,DeepMind偏持久研究。
归并以后,哈萨比斯同一带队,杰夫·迪恩(Jeff Dean)退居首席科学家。也就是说,google的“摆布脑”合一了。
继承往上,还有有一层许多人轻易纰漏的工具:进口。google不是只有模子,它有Chrome、Android、YouTube、Google Maps、Gmail、Google Workspace、Google Search。
这些工具加起来,日活几十亿。全球没有任何一家AI公司拥有这个量级的用户。它能经由过程进口去铺产物,再用这些成熟的产物拿到用户反馈,加速整个产物的开发迭代。
好比用户于哪一步退出了,哪一种能力被重复挪用,哪些天生成果被用户改失了或者者直接抛却了,哪些功效形成为了留存,哪些场景呈现年夜量报错及投诉。

就拿Nano Banana来讲。
这个产物虽然体量很是小,可是它实在是经由过程google的全栈,拥有本身一个完备飞轮。
Nano Banana方才于LM Arena一类的盲测情况里走红后,google做的第 一件事就是把它马上上线到Gemini App、AI Studio、Gemini API傍边,甚至连专门面向企业的VertexAI也没放过。
用户不仅能经由过程各类产物感触感染Nano Banana,google还有能用这些产物网络反馈,这也就是为何Nano Banana产物迭代速率那末快,碾压GPT-4o的作图能力。
那为何到此刻,google的全栈上风没了呢?
文生图是一个低危害、短链路、成果马上可见的产物。
用户输入一句话,几十秒后获得一张图,不满足就重来,满足就分享。它不需要持久影象,也不需要挪用东西权限,更不需要为一次过错负担实际后果。
可是Agent纷歧样。它不是“给用户一个成果”,它是要完全驻扎进用户的事情情况,连续读取上下文、挪用东西、履行操作,并对于末了的成果卖力。
Nano Banana的乐成其实不能彻底复刻到Agent了。
当产物需要跨模子、权限、履行情况、企业体系及持久责任时,google那套原本强盛的全栈能力,最先显露出协调不起来的问题。
google真实的病是构造架构太杂乱
假如你去翻google的开发者产物线,你会发明一个很诡异的征象。google同时有好几个东西,都于帮你用AI写代码,产物功效险些都堆叠了。
Gemini CLI,一个号令行东西,可以查代码库、天生运用、主动履行繁杂流程,2025年末随Gemini 3一路推出。到了2026年6月,google发了个通知布告:Gemini CLI行将被Antigravity CLI代替。
Jules,一个异步编码Agent,Google Labs出品,定位是主动帮你修bug、写测试、提Pull Request。它不需要你盯着看,你把使命扔给它,它本身克隆堆栈、写代码、开PR,干完了通知你。
Code Assist,Google Cloud旗下的企业级编程助手,装于VS Code及JetBrains里用,收费22.8到54美元一个用户一个月。Firebase Studio,阅读器里的全栈开发事情台,内置了Gemini,也能帮你天生代码。
然后是永远扶不上墙的Antigravity,前文也提到了,2026年5月I/O年夜会上又发了个2.0版本,分了桌面App、CLI、SDK、Managed Agents、企业层五块。
它们都于做统一件,但它们是差别团队做的,有差别的品牌名,有差别的进口,有差别的收费模式,甚至有的于互相替换。
这类环境底子就不叫产物线富厚,这叫华侈算力。
这件事的泉源实在是于构造架构层面。
google的AI Agent相干能力,被拆分于至少几个互不统属的构造手里。每一个构造有本身的KPI,自力的报告请示线。
好比Google DeepMind,它管的是模子于benchmark上的分数能不克不及压过GPT及Claude。DeepMind的乐成是“咱们做出了最强的模子”。
它底子不体贴用户于Antigravity里完成一个真实项目的乐成率是几多。
到了Google Labs部分,它尽管这个工具酷不酷,能不克不及于社交媒体上激发会商。
Google Labs的产物有CC(Gmail里的AI助理)、Project Genie(无穷世界天生)、Pomelli(AI营销东西)、Opal(天然语言做小运用),以和Jules。
试验跑完了,热渡过去了,团队可能去做下一个试验了,它不会对于产物举行持久维护。
Google Cloud及Vertex AI管的是模子能不克不及经由过程API挪用,企业能不克不及采购,权限及合规有无笼罩,Agent能不克不及部署到出产情况。
Antigravity更惨,它是从Google DeepMind内里走出来的,此刻归Google Labs维护。可是又必需接入Google Cloud的权限、部署及合规系统。
以是谁也不会对于它卖力,就这么摆烂。
你可能会问了,那到皮查伊这关可怎么办?
DeepMind说,咱们的模子又刷榜了。Labs说,Jules于社交收集上又有10万转发了。然后Google Cloud何处说,Agent Engine又签了几多个企业客户。Gemini App说,这个月的DAU稳住了。Search说,AI Overviews用户破20亿。
各人的饭碗都保住了,却末了留给Antigravity一地鸡毛。
但没有人能回覆一个最简朴的问题:一个开发者,今天应该用google的哪个东西来完成他的事情?假如他此刻用的是Codex或者者Claude Code,google预备用哪一个产物把他抢过来?
评测赢了,不等在使命真的交付了
google此刻所有的叙事都只缭绕着评分,但此刻各人早就不迷信benchmark了,能交付使命的才是好模子。
模子于benchmark上分数高,好比它推理题能答对于,代码能天生,图象能看懂,多轮对于话能连结联贯。
这些测试凡是是于受控情况下举行的。单轮或者有限轮次,输入输出洁净,不需要操作外部东西,不需要治理权限,不需要永劫间连续运行。
掉败了的体现是甚么?谜底不合错误。最坏的成果,就是重来一遍。
可是到了使命交付这块,模子的价值变了。
用户把一个真正的事情扔给AI,到末了拿到了一个能用的成果,中间的链条实在长短常长的。
甚么叫“真正的事情”?是“这个项目的付出模块有个bug,请定位、修复、测试、提交PR”。它触及多个步调,可能要花几十分钟甚至几个小时,中间需要挪用Git、终端、阅读器、文件体系、API,每一一步都有掉败的可能。
掉败了的体现是甚么?不是谜底不合错误,而是代码改坏了、权限控不住了、流程卡死了、情况崩了、用户不知道从哪里恢复。
我举个例子。
假定一个模子于单步判定上的准确率已经经有95%,看起来很强;但一个真实开发使命若需要持续完成20个要害步调,全数不堕落的几率只有0.95^20,约等在36%。
哪怕单步准确率晋升到98%,20步全程顺遂完成的几率也只有约67%。
以是Agent产物真实的护城河,不是把benchmark再刷高两分,而是给过错恢复、状况生存、权限确认、人工接受、回滚及成果验证做出靠得住机制。
可是Antigravity都2.0了,还有是没有近似且完备的机制。
你去读Gemini 3的官方博文,皮查伊亲自写的开首,后面随着的全是benchmark对于比表。
可是你此刻假如去看OpenAI及Anthropic关在新模子的官方博文,内里全都是各类客户对于模子的评价。
不是说benchmark没用。benchmark固然有效,它是一个尺子。但若一个Agent产物的全数叙事都缭绕benchmark睁开,那就申明这个模子确凿干不了活。
google不成能抛却AI Agent,由于这个板块真的太赚钱了,不信你看看友商们就懂了。
2026年2月,OpenAI的Codex,自力桌面App上线后首周下载量跨越100万。仅仅过了两个月,Codex周活用户就到达了400万
Claude Code就更不消说了,Anthropic于2月份的融资质料中就表示,该产物的年化收入已经经冲破了20亿美元。
Antigravity 2.0发了一个多月了,此刻打开它的官网,你会发明还有是没有企业版的订价。
Claude Code可以经由过程Claude Team按人头付费,Codex可以走GPT Business或者者ChatGPT Enterprise,一样是按人头收费。
到了google这里,企业要是想用Antigravity 2.0,你只能走Gemini Enterprise Agent,它会赠予你一些额度让你特长上玩玩,其实不能像OpenAI及Anthropic那样,把它酿成一个收费的产物。
以是我猜沙泽尔及江珀脱离google,年夜概也是由于对于这家公司掉望了。
【本文由投资界互助伙伴微信公家号:字母榜授权发布,本平台仅提供信息存储办事。】【免责声明】:本文不组成任何投资建议。市场有危害,投资需审慎。若有任何疑难,请接洽(editor@zero2ipo.com.cn)投资界处置惩罚。
-304永利集团官网入口




