安特罗皮克于10日同时推出了两款超高性能的人工智能(AI)模型,分别是“克劳德·佩布尔5”和“克劳德·米托斯5”。这两款模型的推出,给OpenAI和谷歌的下一代模型路线图带来了压力。
安特罗皮克当天新设立了“米托斯系列”,在现有的顶级模型群体“奥普斯”之上增加了新的性能层级。佩布尔5和米托斯5共享相同的基础模型,但在访问控制上存在差异。安特罗皮克认为,这些模型在网络安全和生物学领域的能力水平可能在公开发布时带来潜在风险,因此采取了双重发布方式。
佩布尔5配备了安全分类器,能够将与网络安全和生物学相关的查询绕过奥普斯4.8进行公开发布。而米托斯5则是解除安全保护的版本,仅限于与其“项目玻璃翼”合作的网络防御机构和基础设施提供商使用。安特罗皮克首次将其曾引起全球关注的米托斯模型推向商用服务阶段。两款模型在规格上支持100万标记的上下文窗口,最大输出为128,000标记。定价方面,输入100万标记为10美元,输出100万标记为50美元,价格是奥普斯4.8的两倍。
基准性能方面,佩布尔5在软件工程领域的代表性指标SWE-Bench Pro中达到了80.3%,远超奥普斯4.8的69.2%、GPT-5.5的58.6%和杰米奈3.1 Pro的54.2%。在更高难度的前沿代码钻石集上,佩布尔5以29.3%的成绩超过了奥普斯4.8(13.4%)的两倍。在知识工作评估指标GDPval-AA中,佩布尔5以1932分位居第一。安特罗皮克的核心说明是:“任务越长越复杂,与竞争模型的差距越大。”
此次发布使OpenAI和谷歌的路线图压力显现。OpenAI在4月23日将原定于发布的GPT-6代号“斯帕德”模型改为发布GPT-5.5,实际上推迟了GPT-6的时间表,转而以中间版本应对市场。然而,GPT-5.5在SWE-Bench Pro中的性能比佩布尔5低了21.7个百分点。目前尚未公布GPT-6的正式发布时间。
谷歌同样面临压力。上个月19日,谷歌在I/O大会上发布了杰米奈3.5闪电版,并正在进行杰米奈全能的逐步发布,但业内普遍认为杰米奈全能的性能仅达到GPT-5.5水平,无法与米托斯系列相提并论。
IPO资金竞争也是一个变数。安特罗皮克和OpenAI均在推进上市,而安特罗皮克此次超高性能模型的发布预计将有利于吸引投资者的关注。
业内普遍认为,佩布尔5和米托斯5的推出不仅是模型性能的更新,更是重新设定了AI行业的基准。安特罗皮克在奥普斯之上创建米托斯系列的新层级,迫使竞争对手重新审视其路线图。
※ 本报道经人工智能(AI)系统翻译与编辑。


