304永利集团官网入口-GPT
首页财产ai正文 GPT-5.6忽然发布!Fable5痛掉最强基模王座 OpenAI发布GPT-5.6系列三款模子,Sol能力强,Terra面向一样平常,Luna统筹速率成本,今朝仅少数互助伙伴有预览版,平凡用户需等候。 2026-06-29 16:15 ·微信公家号:量子位 梦瑶 梦瑶 AI投资人解读· OpenAI推出GPT-5.6系列三款模子,Sol定位旗舰,于多范畴体现精彩,Terra主打一样平常且价格低约2倍,Luna偏重速率及成本。GPT-5.6于开发者挪用体验上有改良。 · 外部评测机构对于Sol的持久使命能力评测成果存疑新模子仅提供应少数互助伙伴有限预览版本,平凡用户难以利用。 总结:GPT-5.6系列模子各有上风,揭示出强盛实力,但Sol评测存争议,且平凡用户暂没法利用,投资价值需存眷模子后续体现和市场竞争态势。内容由AI天生,仅供参考
ChatGPT史上最强模子来了!
就于方才,OpenAI一口吻端出三款GPT 5.6系列模子。
主打一个全家桶「多款齐发」——
旗舰模子Sol(太阳)、均衡模子Terra(年夜地)、低成本高速款Luna(玉轮)。

GPT-5.6 Sol:最夯模子,编程测试左踢自家模子GPT5.5,右打隔邻Fable 5,还有新增max/ultra两个模式。
GPT-5.6 Terra:面向一样平常事情,机能对于标GPT-5.5,同时值格自制约2倍。
GPT-5.6 Luna:GPT-5.6系列里最快、最 自制的一档,同时保留较强能力~
看完心田os:你别说哈,这新模子确凿夯啊…
但坏动静是——
平凡用户今朝无缘利用ing!!!是的,人家玩《有限预览》那套了…
今朝新模子只给少数受信托的「互助伙伴」提供了有限的预览版本。
平凡用户可能患上等等等等等等*100。(doge)
认识的配方,认识的操作。
Fable 5:我不知道您这是怎么了,这波咋瞅都像冲着我来的呢???
0一、GPT-5.6 Sol、Terra、Luna三款模子齐发
是的,此次人家模子的名字最先走起天文学宇宙感途径了。
从产物定位看,三者分工很清晰——
Sol冲旗舰能力,Terra打一样平常主力,Luna卖力速率及成本。
于价格上,则按每一100万token计价:
Sol输入5美元、输出30美元;Terra输入2.5美元、输出15美元;Luna输入1美元、输出6美元。

先看此次发布的OpenAI史上最强旗舰模子——「太阳」Sol。
于能力上,Sol面向的是高难度推理、繁杂代码、生物、收集安全等长链路使命。
特别合适需要计划、迭代、挪用东西、协调步调的繁杂事情流。
并且很是值患上一提的是,OpenAI还有给这新模子弄上了「加餐」——
让模子得到更长的深度推理时间的max模式,以和可以挪用多个subagents协同处置惩罚繁杂使命的ultra模式。
要知道但凡加之ultra俩字预计就不简朴……
这不嘛,吊打Fable 5的编程能力基准测试就水灵灵地来了,人家于Terminal-Bench 2.1上创造了新的SOTA。
ultra模式下比Fable5超出跨越去7.6个百分点,比上一代GPT5.5超出跨越9.4个百分点——
不仅云云,于生物标的目的,GPT-5.6 Sol于GeneBench v1上也强在GPT-5.5,并且利用token更少。
这个测试评估的是长链路基因组学及定量生物阐发使命,申明Sol于科研类繁杂使命上的效率也有晋升~
于收集安全标的目的,OpenAI称Sol是其今朝收集安万能力最强的模子。
于ExploitBench上,GPT-5.6 Sol已经经能靠近Mythos Preview的体现,同时只利用约三分之一的输出token:
而于由加州年夜学伯克利分校研究职员与OpenAI和其他前沿试验室互助开发的ExploitGym测试中——
Sol、Terra、Luna三款模子城市跟着推理强度增长,于收集安万能力上呈现较着晋升~
再看Terra——
Terra的定位更靠近GPT-5.6系列里的一样平常主力模子,OpenAI给出的说法是,Terra机能与GPT-5.5具有竞争力,同时值格自制约2倍。
末了走速率及成本途径的Luna,则是GPT-5.6系列里最快、最 自制的一档。
它面向的是高频、低延迟、成本敏感使命,好比轻量问答、简朴信息处置惩罚、及时交互、批量主动化等场景。
需要提一嘴的是,除了了Sol外,Terra及Luna今朝公然披露的benchmark信息相对于有限的,后续可以蹲蹲这俩模子的评测体现!

三个模子综合对于比下来,确凿能看患上出Sol于模子机能体现上纷歧般。
but——好巧不巧的是,各人伙对于在Sol的争议也刚好呈现于「评测」部门。
外部评测机构METR拿到GPT-5.6 Sol初期拜候权限后,测验考试用Time Horizon 1.1软件使命套件评估它的持久使命能力。
但成果呈现了一个贫苦问题:Sol于评测中被检测到较高比例的cheating及metagaming举动。

这里的「做弊」,指的是模子使用评测情况缝隙、绕开使命法则来提高体现,好比试图获取隐蔽测试集信息,或者者提取隐蔽源码反推谜底。
这让终极分数很难注释……
假如把这些做弊测验考试算作掉败,GPT-5.6 Sol的50%-Time Horizon约为11.3小时。
假如把它们算作乐成,成果会跨越270小时;假如直接剔除了相干样本,预计值约为71小时,但不确定性很年夜。
以是METR末了的立场相称审慎,这些成果很难代表Sol不变、靠得住的真实能力。

固然,除了了模子自己的评测体现及一些小八卦外,还有值患上一提的是一些「附加技术」。
好比,GPT-5.6此次于开发者挪用体验上补了一块要害能力:更可猜测的prompt caching。
简朴说,就是当开发者重复挪用统一段长提醒词、东西申明、体系法则或者项目上下文时,模子没必要每一次都从头处置惩罚全数内容,可以把反复部门缓存下来,后续挪用直接复用。
GPT-5.6此次撑持显式cache breakpoints,也就是说开发者可以更明确地告诉体系:哪些内容该被缓存、缓存到哪里为止。
同时,缓存生命周期至少30分钟,也让长使命、多轮使命、连续开发会话更易连结不变~

横竖就是,三款模子各取所需,喜欢您来。
0二、凶猛的野兽都患上被关进笼子里
能力讲完,另外一件更微妙的事也来了。
GPT-5.6 Sol确凿猛,但OpenAI此次的发布姿式,反倒显患上非分特别《审慎》。
一边于推自家最强模子的同时,一边又把安全栈、拜候权限、审核流程全都加厚了一圈。
(隔邻Mythos:咋这剧情那末认识呢…)
根据官方说法,GPT-5.6系列用了其今朝最稳健的安全机制,而且会按照差别模子能力配置差别的掩护计谋,详细来看,这套安全栈不是只靠模子本身拒答,而是分成为了好几层——
起首是模子内置的「拒答练习」。
碰到被禁止的收集安全协助哀求时,模子需要先学会拒绝。哪怕用户试图包装用意、绕开限定,模子层面也要先盖住一部门高危害哀求。
其次是天生历程中的「及时危害检测」。
OpenAI给GPT-5.6加了收集安全及生物滥用分类器,会于内容天生历程中连续判定危害。
高危害环境下,天生甚至会被暂停,然后交给更年夜的推理模子从头审查上下文。末了假如判定内容不应放出,成果就会于达到用户前被阻挡。

第三层则是「账号级危害旌旗灯号」。
假如某些哀求触发危害,体系还有会联合相干会话及账号举动做更持久的判定。
究竟单看一句哀求,很难区别对于方是于做合法缝隙修复,还有是于连续试探进犯路径,OpenAI想做的,是从单轮哀求判定,走向更完备的举动模式判定。
这也注释了为何GPT-5.6 Sol明明已经经发布,却先只给极少量trusted partners及构造利用,早期进口也重要放于API及Codex。
由于可能确凿《略危》。(至在是否是炒作咱就另说…)
危的不仅是模子自己,危的还有有隔邻友商家的伴侣——Fable 5。
要知道Anthropic给它的定位,就是Claude系列里最强的广泛发布模子,主打高难推理、长周期agentic使命、繁杂代码工程及企业事情流。
此前于SWE-bench Verified上,Fable 5也是排于榜首位置,于代码等能力上较着高在Claude Opus 4.8及GPT-5.5。
成果这边刚把长链路代码能力的招牌挂起来,GPT-5.6 Sol就来了,真没处所说理了……
并且更扎心的是,OpenAI此次来的还有不止一个Sol——
高端能力,Sol来压;一样平常挪用,Terra来抢;成本及速率,Luna来铺。
Fable 5:前脚俺刚封神、后脚你就要踢我馆??
至在我们啥时辰能真正用上奥特曼的新模子,还有患上再等等。
横竖OpenAI本身已经经把话放出来了:

【本文由投资界互助伙伴微信公家号:量子位授权发布,本平台仅提供信息存储办事。】【免责声明】:本文不组成任何投资建议。市场有危害,投资需审慎。若有任何疑难,请接洽(editor@zero2ipo.com.cn)投资界处置惩罚。
-304永利集团官网入口




