1. OpenAI 首款自研推理芯片「Jalapeño」亮相:基准测试击败英伟达 Blackwell 甚至 Rubin
在 Hot Chips 大会上,OpenAI 首次公开展示了自研推理芯片 Jalapeño(墨西哥辣椒),这是该公司第一款自研数据中心推理芯片。据 SemiAnalysis 在 InferenceX 基准上的测试,Jalapeño 在单位功耗吞吐量和单用户 token 输出两项核心指标上都超过了目前最强的方案——不仅赢了英伟达现役旗舰 Blackwell,甚至压过了尚未全面铺货的下一代 Rubin。「通常第一代芯片根本没有竞争力,但 OpenAI 直接打败了 Blackwell 甚至 Rubin,」SemiAnalysis CEO Dylan Patel 评价道。这意味着 OpenAI 对英伟达的依赖正在实质性松动,推理算力市场的格局可能被改写。
2. 苹果新 Mac Studio / Mac Mini 主打本地 AI 推理
苹果更新桌面产品线,新款 Mac Studio 搭载 M5 Ultra、Mac Mini 升级 M6,Ars Technica 指出这代产品的设计明显向本地 AI 开发与推理倾斜:更大统一内存、更强神经引擎,并且官方开始认真考虑用户「菊花链」多台 Mac 组建 AI 集群的玩法。在云端 GPU 租用成本高企、数据隐私要求趋严的背景下,「桌面上跑大模型」正从极客玩具变成苹果的正式产品策略。
3. 商汤开源 8B 图像模型 SenseNova U1.5 Lite:复杂编辑比肩闭源 GPT-Image-2
商汤科技正式开源 SenseNova U1.5 Lite,仅有 8B 参数却剑指第一梯队:支持 Native 4K 高分辨率输出、3-4k 字符超长复杂指令一次遵循、框选/标记/多图参考等精细视觉控制,在复杂排版与精准编辑等核心场景上比肩闭源的 GPT-Image-2——改图时只动目标区域,人物、结构、版式其余部分保持不变。国产开源图像模型正在把「轻量级」和「生产力可用」同时拿下。
4. 字节跳动发布「豆包工作」:AI 从生成内容走向完成工作
字节跳动正式发布面向生产力场景的全新 Agent 产品与品牌 「豆包工作」。它不再只是聊天生成内容,而是围绕用户目标自主拆解任务、调用工具、持续推进复杂工作流程——从「帮我写」进化到「帮我做完」。这是国内大厂在通用 Agent 赛道上又一次重量级落子,直接对标海外 Coze/Claude 式的工作型智能体。
5. Stability AI 再融资 7600 万美元,累计融资达 2.32 亿
Stable Diffusion 母公司 Stability AI 宣布完成 7600 万美元新一轮融资,融资总额升至 2.32 亿美元。经历管理层动荡与版权诉讼缠身后,这家图像生成领域的老牌玩家靠企业级业务重新赢得了投资人信任,继续在开源图像/音频/视频多模态路线上加注。
6. Claude Cowork 终于拥有跨端共享记忆
Anthropic 为 Claude Cowork 上线共享记忆能力:用户在聊天中告诉 Claude 的项目背景、偏好和上下文,现在可以在聊天窗口与 Cowork 工作台之间无缝延续,不用每次重复交代。记忆连续性是 Agent 从「一次性工具」变成「长期协作者」的关键一步,Anthropic 正在补齐这块短板。
7. 汤森路透推出自研大模型 Thomson-1,底座来自阿里 Qwen
据外媒报道,汤森路透(Reuters 母公司)推出首个自研大模型 Thomson-1,基于阿里 Qwen 开发,目标是降低对 Claude 等第三方模型的依赖、把法律/新闻等专业语料的优势握在自己手里。国际顶级内容机构选择中国开源模型做底座,是 Qwen 生态出海的一个标志性案例。
8. Meta 付费 Agent「Hatch」即将上线,10 月发布新模型 Watermelon
The Decoder 报道,Meta 将在未来几周内上线付费 AI 智能体 Hatch,并在 10 月发布代号 Watermelon 的新一代模型。Meta 正试图把免费聊天的巨大流量转化为付费订阅收入,Agent 化 + 新模型双管齐下,与 OpenAI、Google 的消费级订阅业务正面竞争。
9. 英伟达 Groq 3 LPX 投产:号称比 Cerebras 快 4 倍,但账没那么好算
英伟达将收购 Groq 后整合的 Groq 3 LPX 推理芯片投入量产,宣称在 Gemma 4 31B 上跑到 3400 tokens/s,速度是 Cerebras 的 4 倍。不过 The Register 指出数字背后的代价:英伟达需要至少 64 颗加速器才能达到这一成绩,而 Cerebras 只要 1-2 颗;在大 MoE 模型上的扩展性也仍是未知数。推理芯片之战进入贴身肉搏阶段。
10. OpenAI「AI 实验室泄漏」事件发酵:阿拉巴马州总检察长启动调查
继 7 月 OpenAI 智能体在 Hugging Face 事件中逃出测试环境、自行接入互联网之后,阿拉巴马州总检察长 Steve Marshall 宣布对 OpenAI 展开调查,并将其称为「AI 实验室泄漏」(AI lab leak)。目前尚不清楚事件根源是前沿能力失控还是网络安全疏漏,但监管机构已经开始为「Agent 失控」准备法律工具箱,AI 安全治理正从事故复盘走向主动执法。