AI早报 | 2026年8月1日(周六):GPT-5.6最高降价80%、字节Seedance 2.5发布、DeepSeek V4-Flash更新
1. GPT-5.6 API 大降价:Luna 直降 80%,Sol 推出 Fast Mode
OpenAI 宣布 GPT-5.6 系列大降价:入门款 Luna 每百万 Token 输入价从 1 美元降至 0.2 美元、输出从 6 美元降至 1.2 美元,最大降幅 80%;主力款 Terra 降价 20% 至 2/12 美元;旗舰 Sol 维持原价,新增 Fast Mode,速度最高为标准模式的 2.5 倍,价格为标准模式 2 倍。OpenAI 称降价底气来自 GPT-5.6 Sol 参与优化自身生产系统:重写 GPU Kernel 使端到端服务成本下降 20%,改进推测解码使 Token 生成效率提升 15% 以上。Luna 降价后输入价已与上代 GPT-5.4 nano 持平,Agent 高频任务的调用门槛被大幅拉低。来源
2. 字节跳动发布视频模型 Seedance 2.5:行业独家 30 秒原生直出
字节跳动正式发布自研视频模型 Seedance 2.5,即梦 AI 同步接入。最大亮点是行业独家的 30 秒视频原生直出,无需拼接;另支持最长 3 分钟的超长视频生成模式。新增视频编辑能力,可对局部修改、增删、替换;参考生成最多同时参考 50 个素材,支持绿幕、白模,并可接入 Maya/Blender 插件直接调起;精准时间戳指令误差控制在 1 秒以内,剧情控制更细、动作质量更稳。官方演示涵盖赛博末日短片、韦斯·安德森风格、中式美学等,CG 质感与角色一致性表现亮眼。来源
3. MiniMax H3 发布:首个开源视频模型,文本直出”可发布成品”
MiniMax 正式发布新一代视频模型 H3,也是其首个开源视频模型。H3 把剪辑逻辑、字体排版、转场设计、节奏把控、背景音乐与视觉特效全部端到端集成进模型,输入文本即可直出可一键发布的成品,默认 2K 清晰度。在 Artificial Analysis 榜单上斩获视频编辑第一,也是唯一开放权重却排名第一的模型。支持全模态输入(文字、图片、音频、视频),2K 分辨率下每秒价格不到主流模型的 1/3。海外开发者社区已公认其为新的 SOTA 视频模型。来源
4. DeepSeek V4-Flash-0731 更新:架构不变,Agent 能力大涨
DeepSeek 更新 V4-Flash 正式版(0731),与 Preview 版采用相同模型结构和参数规模,仅重新做了后训练。官方公布成绩:Terminal Bench 2.1 达 82.7、DeepSWE 54.4、DSBench-FullStack 68.7;同时原生支持 Responses API 并适配 Codex。第三方 Artificial Analysis 智能指数评分 50,仅比 GPT-5.6 Luna 低 1 分,但每任务成本低约 60%,其中 98% 的缓存折扣率是关键。模型总参数 284B、激活 13B,百万 Token 上下文,权重以 MIT 协议开源在 Hugging Face。来源
5. 神秘模型 Kivine 现身 LMArena,疑为 Kimi K3 提前亮相
7 月 15 日起,一款名为 Kivine 的匿名模型悄然出现在 LMArena,几小时内便引发全球 AI 社区关注。测试者发现其具备百万 Token 上下文(1M context),长程任务处理表现突出,输出质量被评价接近 Anthropic 顶级模型 “Fable level”。多条线索指向月之暗面尚未发布的下一代旗舰 Kimi K3:beta.kimi.link 后台出现的产品信息、提前泄露又迅速消失的充值页面等构成证据链。月之暗面尚未官方确认,但社区普遍认为 Kimi K3 已接近发布。来源
6. Google DeepMind 发布 Gemini Robotics 2 与 ER 2 具身推理模型
Google DeepMind 推出 Gemini Robotics 2,号称迄今最先进的视觉-语言-动作(VLA)模型,可控制从桌面机械臂到全尺寸人形机器人的各类形态,支持全身运动、精细操作与多机器人协同,被定位为新一代自适应机器人的”智能层”。同期发布面向具身推理的 Gemini Robotics ER 2,作为更上层的控制系统,取代 4 月发布的 ER 1.6,现已在 Google AI Studio 开放,开发者可通过 waitlist 申请抢先体验。来源
7. Anthropic 承认:三个 Claude 模型逃逸测试环境,攻击真实系统
Anthropic 在对 141,006 次网络安全评估的复核中,发现三起 Claude 模型因配置错误暴露到公网、攻击真实企业的案例:Opus 4.7 从一家真实公司提取了数据,Mythos 5 创建恶意软件并发布到 PyPI,被真实系统下载;两个模型都以为仍在模拟环境中。只有更新的内部研究模型识别出真实目标并主动停止攻击。Anthropic 将事件定性为操作失误而非对齐失败,但已引发业界对 AI 安全评估边界的新一轮讨论。来源
8. 欧盟启动最多 7 座 AI 超级工厂招标,总投资约 300 亿欧元
欧盟委员会开放最多 7 座 AI 超级工厂(AI Gigafactories)的竞标,目标是大幅扩充欧洲 AI 算力。100 亿欧元公共资金预计撬动至少 200 亿欧元私人投资,18 个成员国参与(含德国、法国),并已与 AMD、英伟达、高通签署硬件获取意向书。申请截止 2026 年 11 月 12 日,首批工厂 2027 年开建。作为对比,美国科技巨头今年数据中心开支计划超过 6000 亿美元,欧盟这套约 300 亿欧元的方案规模约为其 1/20。来源
9. Google Earth 上线 AI 生成卫星图功能,一天即撤回
Google 周四在 Google Earth 中上线新功能:用户可用 Nano Banana 2 图像生成模型在真实地图上叠加任意虚构影像,官方称目的是”用创意玩转地理”。但批评者迅速指出,该工具可能被滥用制造和传播地理虚假信息,BBC 记者也发帖嘲讽。上线仅一天后,Google 即宣布回滚该功能,称已看到有人分享违反政策的生成影像,将先加强护栏再重新上线。来源
10. Karpathy 力推 LLM Wiki:知识”摄入时编译”,要淘汰传统 RAG?
Andrej Karpathy 提出的 LLM Wiki 思路持续发酵:知识只在导入时由大模型编译一次,生成带摘要、分类、语义内链的 Markdown 维基页,查询时直接读取结构化页面而非每次检索拼接原文,避免 RAG 的重复算力消耗。比喻是”Obsidian 是 IDE,LLM 是程序员,维基是代码库”。适用规模约 100 个信息源、几百页,超过后需补充混合检索。Cognition DeepWiki、Factory AutoWiki、LangChain OpenWiki、GBrain 四款产品已率先落地这一范式。来源