304永利集团官网入口-余家辉交卷,Meta MSL连发图像/视频模型
首页财产ai正文 余家辉交卷,Meta MSL连发图象/视频模子 继4月发布Muse Spark后,MSL迎来第二次模子更新,Muse Image发布,Muse Video预览。本文先容了Muse Image怪异的创作功效,还有先容了相干团队环境。 2026-07-08 09:58 ·微信公家号:量子位 闻乐 闻乐 AI投资人解读· Muse Image包办Arena文生图等三项第二,Muse Video挤进文生视频排行榜第一梯队。同时提到Muse Image创作流程怪异,能多角度优化画面的能力,与Muse Spark可深度联动,一样平常利用撑持多参考图象合成等Muse Video与Muse Image同底座练习,有高视觉保真度等上风,但音画同步等有待改良。 · 隐私问题是潜于危害,虽然Meta有响应方案,但仍可能激发用户担心。 总结:Meta的Muse Image及Muse Video于图象与视频天生范畴体现亮眼,具有技能上风与立异模式,有投资潜力。不外隐私问题需存眷,后续可联合市场反馈和技能改良进度综合评估。
继本年4月发布Muse Spark以后,MSL迎来了建立以来第二次模子更新:
由余家辉带队打造的图象模子Muse Image正式发布,视频模子Muse Video同步开启预览。
从榜单体现上看,Muse Image包办Arena文生图、单图编纂、多图编纂三项第二,压过googleNano Banana,卡于OpenAI GPT Image 2死后。

Muse Video则来到文生视频排行榜第三,排于googleGemini Omni Flash、字节Seedance 2.0以后,挤进第 一梯队。

对于在已经经寂静了一段时间的Meta天生式AI来讲,这算患上上一次相称高调的回归。
Muse Image走的途径及市道上通例文生图东西不太同样。
收到你的需求后,它不会急着直接出图,而是会先拆解梳理完备创作思绪。
遇到单靠模子脑补说禁绝的内容,会自动挪用配套东西辅助,好比让它画「今天纽约时代广场的样子」,它是真的会上彀调取最新素材。

碰到图表、公式这种需要精准数值出现的画面,还有能自立写代码运算。

甚至画出来的二维码都是真实可用的。
整张丹青完以后,它会完备复盘一遍画面细节,发明不协调、有缝隙之处就迭代修改,直到画面逻辑、细节都过关才交付制品。
Meta把这套流程叫做Agentic Image Generation。
意思是这可不只是一个图象天生东西,Muse Image就是Agent。
Meta团队于测试里还有发明一个纪律:
留给模子的推理思索时间越足够,终极画面质感越好。图片质量会沿着一条靠近log-linear的曲线连续上升。

几个月前上线的Muse Spark年夜语言模子,也能及Muse Image深度联动,同享整套东西链路协同完成繁杂创作。
好比建造小型互动游戏,两套模子可以分工协作,一边编写网页交互代码,一边天生配套视觉素材,终极输出动员态GIF、内嵌图片的完备网页,创作界限跳出纯真出一张静态图片。
一样平常利用上,Muse Image撑持多参考图象合成。
你可以上传一张本身的照片、一张喜欢的风光照、一张参考穿搭,让它把你放进风光里穿戴那套衣服。
最神奇的是,提醒词可以图文混着来,好比:
画一张「这小我私家.jpg」穿戴「这个衣服.jpg」坐于「这里.jpg」的图片。
编纂功效也于线,多轮修改不会越改越离谱。
还有有最狠的一招,可以@你的Instagram挚友。
你可以于提醒词里@一名Instagram公然账号的挚友,Muse Image会拉取对于方公然发布的照片。
或者者@小商品商家,快速出同气势派头营销图。
还有内置专属个性化创作模板,无需跳转,可直接于Instagram端一键挪用,适配一样平常社交配图。
Meta管这叫Native Social Context,把社交图谱上进了图象模子里。
固然,隐私问题绕不外去。Meta的方案是:任何Instagram用户可以于设置里opt-out,禁止他人用本身的公然照片做AI二创。
并且所有AI天生的图片都带Content Seal隐形水印,裁剪、压缩、截图都去不失。
Muse Video方面,官方给的信息还有未几。
跟Muse Image同底座练习,高视觉保真度、原生撑持音频、提醒词理解及时间一致性有竞争力。
还有需要改良的是音画同步及高速体育场景的物理正确性,将于将来几个月推出。
MSL视觉团队也有不少华人面貌。
好比MSL首席科学家、Muse全系列底层总卖力人赵晟佳,清华本科、斯坦福博士。
2022年卒业后直接插手OpenAI,全程介入了从初代ChatGPT到o3的预练习。
2025年6月插手Meta,7月,扎克伯格正式公布其出任MSL首席科学家,现掌管Muse全系列底层基座技能线路。
Meta MSL的多模态卖力人余家辉,中科年夜少年班身世,UIUC博士。
他于google时就是Gemini多模态视觉结合卖力人,2023年10月插手OpenAI后担当感知团队卖力人(Perception team lead),介入了从GPT-4o到o4-mini,以和“基在图象的思索”研究结果。
2025年6月与赵晟佳一路插手Meta,此次发布的Muse Image及Muse Video,恰是由他卖力的团队推进研发。
【本文由投资界互助伙伴微信公家号:量子位授权发布,本平台仅提供信息存储办事。】【免责声明】:本文不组成任何投资建议。市场有危害,投资需审慎。若有任何疑难,请接洽(editor@zero2ipo.com.cn)投资界处置惩罚。
-304永利集团官网入口




