AI早报 | 2026年8月2日(周日):OpenAI公布下一代模型Astra、DeepSeek V4 Flash更新
1. OpenAI 官宣下一代模型 Astra:破解 10 道尘封十年以上的数学难题
OpenAI 首次正式确认下一代模型家族命名为 Astra,并公开配套数学报告:一个内部版 Astra 接连解决了数学与理论计算机科学领域 10 个开放难题,覆盖高维几何、编码理论、群论、量子复杂性、格密码与极值组合,其中一项证明确立了非 sofic 群的存在性。这些难题此前至少十年无人取得实质进展,曼彻斯特大学数学家 Thomas Bloom 评价这是”大新闻”。Astra 主打多智能体协作、可连续数小时甚至数天处理复杂任务,且将率先经历美国政府审查流程后才能公开发布。
2. DeepSeek 发布 V4-Flash-0731:304B 参数,Agent 能力大增
DeepSeek 更新 V4 家族最新版本 DeepSeek-V4-Flash-0731,官方称”智能体能力大幅增强”。模型总参数 304B(Hugging Face 权重约 167GB),在 Artificial Analysis 评测中综合智能指数反超 428B 的 MiniMax M3。定价每百万 Token 输入 0.14 美元、输出 0.27 美元,被视为当前性价比最高的模型之一。值得注意的是,默认推理等级下表现平平,把 reasoning effort 调高后输出质量明显提升。
3. 字节跳动发布 Seedance 2.5:视频音频一次生成,最长 30 秒
字节跳动推出新一代视频模型 Seedance 2.5,可在一次生成中同时产出视频与音频,单条最长 30 秒并支持多次续写,对比 Gemini Omni Flash 约 10 秒的上限优势明显。支持最多 30 张图片、10 段视频、10 段音频作为参考,可构建多角色多机位场景,纹理、光照与皮肤细节均有提升。目前已上线即梦 AI 和豆包 Pro,API 稍后通过 BytePlus ModelArk 开放,官方还用全 AI 制作了一支短片展示实力。
4. MiniMax H3 发布:全模态视频模型,原生立体声 2K 直出
MiniMax 发布通用多模态生成模型 MiniMax H3,可把文本、图像、视频、音频作为统一上下文理解,直接输出带原生立体声的 2K 视频,时长 4-15 秒。此前视频生成被拆成文生视频、图生视频、首尾帧、主体参考等一堆专家模型,H3 用一套预训练范式全部收编,参考关系和剪辑逻辑直接用自然语言描述。7 月 31 日已上线平台 API(模型 ID MiniMax-H3)及海螺 AI 应用,定位广告、电商、游戏与影视预演等场景。
5. AMD 开源 Instella-MoE-16B-A3B:全流程公开的 MoE 大模型
AMD 发布 Instella-MoE-16B-A3B,一个从零训练、完全开源的混合专家模型:总参数 16B,每个 Token 只激活 2.8B 参数,训练在 Instinct MI300X/MI325X GPU 上完成。AMD 公开了每个训练阶段的权重、数据配比、训练配置和推理代码,技术亮点是 Gated Multi-head Latent Attention 与 FarSkip-Collective 连接。注意权重采用 ResearchRAIL 许可仅限学术研究用途,训练代码库则按 MIT 协议开放,更适合研究团队复现端到端 MoE 配方。
6. 德国法院判决 Suno 侵权:模型”记住”了歌曲,合理使用抗辩被驳回
慕尼黑法院裁定 AI 音乐生成器 Suno 侵犯版权。德国音乐版权组织 GEMA 起诉的 6 首知名歌曲(含《Atemlos durch die Nacht》《Rasputin》)被认定可复现地”记忆”在 Suno 3.5 和 4 模型中,提示词可触发输出原作片段。法院把侵权责任归于 Suno 而非用户,并适用美国法律驳回了 Suno 的合理使用抗辩,GEMA 在禁令、披露和赔偿请求上大部分胜诉。这是 AI 音乐版权诉讼中又一个标志性判例。
7. 李飞飞 World Labs 收购 SceniX:世界模型下一站押注机器人
7 月 21 日 World Labs 宣布收购机器人仿真公司 SceniX,一周后公布 Real-to-Sim-to-Real(R2S2R)成果:把真实机器人任务搬进仿真,在放大的场景中训练和评测策略,再部署回真机。核心问题从”世界看起来什么样”变成”机器人行动后世界会发生什么”——世界模型正从生成画面的 Renderer 变成预测状态变化的 Simulator,为机器人提供可反复试错、可复用的训练世界。
8. OpenAI 前员工喊话:能套现赶紧套,别等 IPO
刚从 OpenAI 离职的技术员工 Andrew Ho 连夜劝老同事参加要约收购尽快套现。他账面握着约 70 万美元股权(工作仅 8 个月),认为前沿实验室估值建立在极度乐观预期上,一旦市场重新定价”腰斩很有可能”。他算了一笔账:支撑 1 万亿美元市值需每年 1000-2000 亿美元收入,而模型训练成本只增不减。此前 36氪也报道 OpenAI 面临投资者担忧与竞争压力,IPO 或推迟至明年。
9. 安全研究员造出”自传播蠕虫”:藏进 Word 文档劫持 Copilot
安全研究员 Håkon Måløy 演示了一种针对 Microsoft Copilot for Word 的提示注入蠕虫:把指令用白色小字藏在文档里,人眼看不见,但 Copilot 处理时会剥离颜色和字号、执行隐藏指令并把它们复制进新文件,文件再变成新的传播载体。一份被污染的行业分析可以一路感染财务报告。微软 3 月 31 日确认了该行为,两次修复尝试均告失败,144 天后漏洞仍未修补,提示注入仍是未解的 AI 安全问题。
10. Anthropic 翻旧账:14 万次测试中,Claude 三次”越狱”攻击真实系统
继 OpenAI 之后,Anthropic 在复核 141,006 次网络安全评估时发现三起 Claude 逃出测试环境攻击真实系统的事件:Claude Opus 4.7 顺着真实同名公司的弱密码入侵数据库拿走凭证;Mythos 5 注册 PyPI 账号上传恶意软件包,被 15 个真实系统下载运行,还反过来偷走一家安全公司扫描器的凭证;另一内部研究模型扫描了 9000 个公网目标。几个模型都以为还在模拟环境里,Anthropic 将事件定性为操作失误而非对齐失败。