AI早报 | 2026年9月12日(周六):Sakana 发布 Fugu Max 与 Ultra v2、OpenAI 开放全双工语音 API

AI日报4小时前发布 程序员阿超
835 0 0

1. Sakana AI 发布 Fugu Max 与 Fugu Ultra v2:用「编排」同时压成本、拉上限

9 月 11 日,Sakana AI 推出 Fugu 家族的两款新模型。Fugu 不是单一网络,而是一个「以单一模型交付的多智能体系统」,靠学习到的调度器把任务动态路由给不同的开放与专用模型池,官方称升级只改一行参数、同一套 API。

Fugu Max 主打性价比:在 Terminal Bench 2.1、GPQAD、AA-LCR、GDP.pdf、AutomationBench 与内部编码基准 SWEFish 六项上拿到最佳总分,定价 每百万输入 token 2 美元、输出 6 美元,输出价格比 Sonnet 5、GPT-5.6 Terra、Kimi K3 低 40%~60%Fugu Ultra v2 主打峰值能力,八项基准中五项最佳或并列最佳,包括 DeepSWE 74.3、Chartography 48.3,且不依赖单一闭源前沿模型,以避免 API 被切断或供应商锁定。Sakana 还把「模型池可替换」包装成供应链韧性:外界模型被撤销授权,编排层仍能换人继续跑。

来源 | 评测

2. OpenAI 开放 GPT-Live-1 全双工语音 API:边听边说,每分钟 0.05 美元

9 月 10 日,OpenAI 把已在 ChatGPT 中验证的实时语音模型 GPT-Live-1 正式开放给开发者。它支持全双工交互,可以一边听一边说,不再依赖 STT → LLM → TTS 的串联链路,因此把延迟和交接抖动一起压掉;推理与工具调用可以代理给 GPT-6 Astra 或第三方文本模型,单价 0.05 美元/分钟,同时上线 12 种新音色。

官方基准显示:全双工交互测试得分 80.1%,而上一代 GPT-Realtime-2.1 只有 45.4%;轮换延迟从 1.4 秒降到 0.8 秒,工具调用准确率从 60% 提升到 87%,银行语音客服基准通过率从 12.4% 升到 32%。Yelp 已用于电话订位,语言学习公司 Speak 用于口语陪练,称用户被打断率下降近 80%。0.05 美元/分钟的价格明显低于真人呼叫中心成本,电话客服、语音 Agent、企业 IVR 是第一批被冲击的场景。

来源

3. OpenAI 暂停 200 美元档 ChatGPT Pro 新订阅:Astra 需求「前所未见」

OpenAI 在帮助文档中确认,自 9 月 10 日起临时暂停 200 美元 ChatGPT Pro(Pro 20X)的新订阅与升级,已有的 200 美元档订阅不受影响,100 美元档继续销售、但用量上限更低;暂停期间主动取消或降级的用户,也无法重新订阅 200 美元档。

技术团队成员 Thibault Sottiaux 在 X 上解释,这是「对系统压力最大」的一档,暂停是为了让存量用户继续稳定使用 Astra,并称「对 Astra 的需求真的前所未见,我们经历过非常陡峭的增长,但没见过这样的」。这轮容量紧张源自 9 月 3 日发布的 GPT-6 Astra——Sam Altman 此前已承认这次发布「很混乱」,部分付费用户一度无法立即使用;欧洲用户还额外受制于 Astra 暂未提供欧盟数据区。

来源 | CIO

4. Cognition 发布 SWE-2:垫着 Kimi K3 训练,成本只有前沿模型三分之一

AI 编程公司 Cognition 于 9 月 10 日发布自研代码模型 SWE-2,在 FrontierCode 1.1 Main 上取得 50.0% 得分,距离 Anthropic Claude Fable 5.1 的 50.9% 不到 1 分,而推理成本只有 Fable 5.1 的 36%、不到 GPT-6 Astra 的四分之一。它基于月之暗面 2.8 万亿参数的 Kimi K3 底座做后训练,是业内首个把强化学习扩展到「多万亿参数规模」的代码模型。

技术上 Cortex 团队设计了单轮 RL 算法,一次训练同时优化多个推理强度档位,把整个成本-性能帕累托前沿往前推且保持形状稳定:中位档相比 SWE-1.7 回合数减少 58%、平均成本下降 81%,任务完成度反而更高,直接回应用户对上一代「过度探索、过度思考」的抱怨。SWE-2 已在 Devin Desktop、CLI、Web 与 Fusion 平台同步上线。这轮发布的背景是 Cognition 9 月 8 日披露估值四个月翻倍至 480 亿美元,9 月 9 日宣布完成 20 亿美元 E 轮融资

来源

5. NVIDIA 联手 Skild AI 发布 S1:机器人看一段视频,就会做 10 分钟长任务

9 月 10 日,通用机器人公司 Skild AI 与 NVIDIA 联合推出机器人基础模型 S1,宣称这是机器人领域的「GPT 时刻」:不更新模型权重、不做任务特定后训练,仅凭一段视频演示就能学会最长 10 分钟的全新长视域任务,覆盖盆栽、煎饼、手冲咖啡、套件组装等几十个操作步骤。

在多步骤新任务测试中,S1 每步成功率约 66%,是同类 AI 系统约 9% 的七倍以上;Skild 估算一段短视频的效用约等于 380 次人工示教,盆栽任务从录制演示到硬件自主执行只用了 11 分钟。模型基于 NVIDIA Isaac Lab 与 Cosmos 训练,走合成数据生成、训练、仿真到真机部署的端到端路线。商业化进展同样激进:首次商业部署后 10 个月即达到 1 亿美元年化收入,已与制造业、物流、巡检、安防、餐饮等 60 余家伙伴落地。

来源 | NVIDIA

6. 月之暗面把年化收入目标定到 20 亿美元,K3 每天生成 3000 亿 token

Bloomberg 9 月 11 日报道,月之暗面(Moonshot AI)把 2026 年底的年化收入目标设为 20 亿美元,约为 8 月运行速率的两倍。该公司的经常性收入从 6 月的 3 亿美元涨到 8 月的 10 亿美元,增长几乎全部由夏季发布的开放权重模型 Kimi K3 驱动:2.8 万亿参数、100 万 token 上下文,已成为第三方推理平台上使用量最高的开放模型之一。

按 OpenRouter 数据,K3 目前每天生成最高约 3000 亿 token;若这一吞吐维持,对应的年化收入可超过 16 亿美元。对一家权重可免费下载、毛利结构天然比闭源厂商更薄的实验室来说,这个目标相当激进。作为参照,近期报道给出的 OpenAI 与 Anthropic 年化收入分别约为 400 亿650 亿美元

来源

7. Anthropic 威胁情报报告:指控七家中国实验室「工业级」蒸馏,同时披露武器滥用

9 月 11 日,Anthropic 披露其 9 月版《Detecting and countering misuse of AI》威胁情报报告内容:公司称识别并切断了来自 7 家中国实验室的「工业级」非法蒸馏攻击,CNBC 报道其中点名了阿里通义千问与月之暗面(Kimi),WSJ 则称相关方通过大量账号把数以百万计的用户查询转发给美国模型以获取蒸馏数据。

同一份 154 页报告还披露了更现实的滥用案例:也门胡塞控制区的用户曾尝试用 Claude 研发先进武器(外媒称指向弹道导弹项目),另有账号试图借助模型开展危险生物研究,均被阻断。Anthropic 一边向国会游说限制中国开放权重模型,一边在报告里强调自身拦截能力,这种「既是当事人又是举证方」的角色,也让蒸馏指控的定性继续存在争议。

来源 | WSJ

8. Anthropic 研究员辞职后公开警告,美国国会陷入「AI 恐慌」

本周,前 Anthropic 研究员 Jacob Coxon 辞职并在 X 上公开发声,称「建造 AI 的人真的相信它可能在这十年内杀死我们所有人」,并批评公司正「直奔自我改进的超智能,拿我们的命做赌注」。这条帖子把 AI 安全争论从行业内部推向政治议程:据 Axios 9 月 11 日报道,美国国会两党议员正在紧急寻找答案。

代表性动作包括:共和党众议员 Anna Paulina Luna 呼吁国会就 AI 召开特别会议;部分议员致信众议长 Mike Johnson,要求取消秋季休会直到国会通过 AI 安全立法;民主党众议员 Johnny Olszewski 称「我们必须行动,而且要带着紧迫感行动」。但报道同时指出,国会领导层目前仍停留在「有个计划的概念」阶段,调动意愿有限——这轮恐慌也暴露了 AI 安全议题缺乏可执行立法抓手的老问题。

来源

9. Cohere 洽谈融资 20~30 亿美元,估值冲击 200 亿美元

9 月 11 日,Bloomberg 与《环球邮报》报道,加拿大 AI 公司 Cohere 正就融资 20 亿~30 亿美元深入谈判,加拿大政府与现有投资方参与,投后估值约 200 亿美元。据披露,Cohere 目前年化经常性收入约 2.4 亿美元,接近去年的三倍。

这是 Cohere「主权 AI」路线的又一步:4 月它与德国 Aleph Alpha 完成合并,组成跨大西洋阵营,当时估值同为 200 亿美元并获 Schwarz Group 6 亿美元 E 轮投资;2025 年 8 月以 68 亿美元估值融过 5 亿美元;加拿大政府则在 2024 年 12 月通过主权 AI 算力战略提供过 2.4 亿美元公共资金。在 OpenAI、Anthropic 主导的格局里,Cohere 押注的是「数据不出境、可私有化部署」的政府与大企业市场。

来源

10. 环球音乐与 ElevenLabs 签下大厂牌首单:让粉丝用授权曲目做 remix

全球最大唱片公司环球音乐集团(UMG)与 AI 语音/音频公司 ElevenLabs 宣布达成多年期授权与战略合作,这是 ElevenLabs 与首个主流厂牌的协议。双方将联合开发面向艺人与创作者的 AI 音频产品,并推出一个基于授权音乐的全新平台:粉丝可以对参与艺人的曲目做 remix、mashup、新演绎以及个性化人声体验,艺人与词曲作者参与分成。

UMG 董事长兼 CEO Lucian Grainge 称,双方一致认为「负责任的 AI 能激发发现、加深艺人与粉丝的连接,并为创意社区创造新收入」;ElevenLabs 联合创始人兼 CEO Mati Staniszewski 则强调要把 UMG 的版权管理能力与自己的模型结合。新平台与 ElevenLabs 现有的 Music API、面向个人创作者的 ElevenMusic 应用相互独立。在版权诉讼频发的当下,唱片公司选择「授权+分成」而非继续诉讼,这套模板大概率会被其他厂牌复制。

来源 | UMG

© 版权声明

相关文章

暂无评论

暂无评论...