AI早报 | 2026年9月21日(周一):阶跃Step 5 Preview冲进AA开源前三、阿里开源7B图像模型Qwen-Image-2.1

AI日报56分钟前发布 程序员阿超
286 0 0

1. 阶跃星辰发布 Step 5 Preview:600B 稀疏 MoE,单任务成本只有 Claude Opus 5 的 1/8

9 月 20 日,阶跃星辰发布新一代旗舰基座模型 Step 5 Preview,主攻 AI 编程、软件工程、专业知识工作与金融场景。在 Artificial Analysis 的 AA 综合智能指数上,它跻身全球开源模型前三;官方强调的一个数字是单任务成本仅为 Claude Opus 5 的 1/8,模型将于 10 月 15 日正式开源

结构上,Step 5 Preview 采用稀疏 MoE 架构,总参数 600B、激活参数仅 27B,支持 100 万 Token 上下文窗口,原生支持文本与视觉输入。阶跃对这条路线的解释是:过去 Scaling 是用更多算力换更强智能,但随着模型变大、Agent 任务变复杂,算力成本同步飙升,下一阶段的关键是提升”算力转化为智能”的效率。从 Step 3.5 Flash、Step 3.7 Flash 到 Step 5 Preview,三代基座模型都在追这个方向。

来源

2. 阿里开源 Qwen-Image-2.1:7B 参数图像模型,原生支持透明图层与十张参考图

阿里 Qwen 团队开源 Qwen-Image-2.1,一个可生成与编辑图像的开源权重模型。其中负责视觉生成的部分只有 70 亿参数,Qwen 声称它在其自有基准上超过多数闭源模型(独立基准尚待验证),并且能在 RTX 3090 这类消费级显卡上运行。

功能上,模型原生生成和编辑 RGBA 透明图,可以在透明图层上分离物体或改文字;一次最多吃进 10 张参考图,用于合成合影、虚拟试穿或房间设计;局部修改靠圈选、蒙版或涂抹标记来引导。Qwen 表示架构改动与 KV cache 复用让推理变快,多参考图场景提升更明显。模型已在 Hugging Face、GitHub 与魔搭上线并附 demo,但研究许可禁止商用,企业需另行申请授权。

来源

3. Qwen3.8-LiveTranslate 发布:60 语种实时同传,平均滞后压到 2.3 秒

Qwen 发布新一代实时同传模型 Qwen3.8-LiveTranslate:一边听现场语音(可选视频帧),一边在说话人还没讲完时就输出译文与语音。核心变化是新的 Interleave 架构,官方给出的代价指标是 LAAL(长度自适应平均滞后)从 2.8 秒降到 2.3 秒,约减少 18%——这个指标衡量译文平均落后原文多远,同时避免奖励那些靠”多生成废话”稀释滞后的系统。

除了延迟,这次补上了三项能力:实时说话人分离(多人对话中区分说话人,并用更稳定的声音克隆保留各自音色,API 提供 always 模式在每个回复前重新克隆);双语同步显示(原文转写与译文同屏,API 里原文转写作为独立事件流);长上下文消歧(用对话历史解析人名与术语)。模型已在阿里云百炼与 QwenCloud 以 qwen3.8-livetranslate-flash-realtime 上线,走 WebSocket。

来源

4. 中国电信开源 Xing4.0-29B-A4B:一张 3090 跑起来的全栈国产代码智能体

中国电信 AI 开源 Xing4.0-29B-A4B,一款全栈国产化的轻量级代码智能体模型,目标是数据不能出域、算力不富裕、但长文档要读业务要办的那批企业。它采用 MoE 架构,290 亿总参数、每次推理只激活约 40 亿,4-bit 量化后一张 RTX 3090 就能运行

能力侧,模型原生支持 256K 上下文并可扩展到 512K,官方给的例子是把 200 页投标文件放在本地,约 20 分钟完成技术、商务、价格三个方向的初评并逐条给出评分依据,数据全程不出企业环境。整条链路也做了国产适配:基于华为昇腾 910C 算力训练,使用国产 MindSpore/MindFormers 框架,推理部署端完成昇腾适配验证。模型已在 GitHub、Hugging Face、Gitee、魔搭、魔乐开源并支持 API 调用,发稿时已冲进 Hugging Face 模型趋势榜第四

来源

5. 剪映打通 AI 生视频与剪辑:新 Hub 让生成结果直接进入多轨道时间线

在抖音创作者大会上,剪映发布 剪映 Hub,把 AI 视频生成和 AI 剪辑接成一条流水线——原先在无限画布里生成完要下载导出再进剪辑软件,现在点一下就直接跳进剪映的多轨道剪辑界面。

PC 端大致分三层:Hub 负责前期策划与生成(用 Seedream 5.0 Pro 生图、Seedance 2.5 生视频,支持资产管理、生成分镜提示词、一键预览成片);剪映助手 Agent 负责时间线操作(首批计划上线 20 余个官方 Skill,后续引入外部 Skill,可处理剪口播、做解说、字幕纠错、批量成片);AI 后编辑则做局部修改,包括 AI 智能延长、局部重绘、超清画质、AI 补帧、调色、人声分离等。手机端更偏轻量:随拍成片可丢几张照片加一句话生成约 15 秒竖屏 Vlog,创作助手、剪辑助手与营销助手都能用说的方式操作;字节系即梦、小云雀等平台素材通过剪映账号登录后可一键导入。

来源

6. Runway 想把视频生成变成”实时直播”:边描述边出画面,误差自己纠

Runway 公开了实时视频生成的研究进展:不再是输入 prompt 等几秒到几分钟拿到成片、不满意从头再来,而是流式生成——你一边描述,画面一边更新,最小化”首帧时间”。这套思路 3 月曾以 Runway Characters 提出,底座是公司 2025 年 12 月发布的通用世界模型 GWM-1,构建在 Gen-4.5 之上,逐帧生成,接受镜头运动、机器人指令或音频作为控制信号;几周前展示的 Solaris 还用它逐帧生成可交互界面。

难点很实际:文本模型可以在句子中间自我纠正,视频模型每一帧都建立在前一帧上,小误差会累积成严重畸变。Runway 的对策是用模型自己的输出训练它,让它学会修正偏离而不是放大偏离;每个新片段都以此前所有生成帧为上下文。成本逻辑也摆了出来——更快的模型占用更少的 GPU 时间,”给定质量下的单位产出成本”决定哪些应用在经济上成立,即时生成会把这条门槛往下推。

来源

7. Anthropic 也推迟 IPO:从 10 月挪到 11 月,投资者预期估值约 2 万亿美元

据 The Information 与《华尔街日报》,Anthropic 把 IPO 从原定的 10 月推迟到 11 月(最早 10 月底,更可能是 11 月),此前 OpenAI 已把自己的 IPO 推到 2027 年。Anthropic 顾问给出的理由是想在上市前先交出强劲的三季度业绩——不过这个解释并不完全自洽,若二季度数据已足够支撑上市,三季度强业绩更像是给上市后的股价加码。

市场预期依然夸张:投资者预计估值约 2 万亿美元、募资规模最高 1000 亿美元,两项都将打破 SpaceX 6 月 IPO 创下的纪录。财务侧,《The Information》的数据显示 Anthropic 收入从 2026 年一季度的约 47 亿美元涨到二季度的 超 115 亿美元,翻了一倍多;同期算力基础设施开支从 34 亿美元升到 56 亿美元,只涨了 65%。推迟的潜在原因还包括成本压力、OpenAI 竞争、利率上行,以及测试中暴露出的未投保网络安全风险。

来源

8. 特朗普宣布组建”AI Force”并设”AI 沙皇”,主张不给 AI 加新监管

特朗普在 Truth Social 上继续押注”不加管制地发展 AI”:他把针对 AI 和数据中心的批评描述为左翼攻击,类比俄罗斯叙事与气候变化议题。他宣布仿照太空军组建一支 “AI Force”,并表示很快会任命一名 “AI 沙皇”,只有”高智商”的候选人够格。

他的说法包括:AI 可能达到美国经济产出的 25%,美国必须保持对中国大陆的领先;对可能出现的滥用,他倾向用现有刑法与民法处理,而不是出台可能拖慢增长的新监管。这番表态的背景是,美国多地社区因用水、能源消耗、环境与电价上涨正在抵制新建数据中心,对 AI 导致失业的担忧也在上升;同时 AI 实验室负责人与数学家刚警告过,按当前速度发展 AI 可能构成人类生存风险。同一周,Anthropic CEO Dario Amodei 发布”给前沿技术定节奏”的减速计划,英伟达 CEO 黄仁勋公开附和特朗普、称 AI 反弹是一场骗局——行业内部对”要不要慢下来”的分歧正摆到台面上。

来源 | TechCrunch

9. Epoch AI 调查:美国”几乎每天用 AI”的人半年从 8% 涨到 19%

研究机构 Epoch AI 与民调公司 Ipsos 的两轮代表性调查显示,几乎每天使用 AI 的美国成年人比例,从 2026 年 3 月的 8% 涨到 8 月的 19%(口径是”七天里至少六天使用”),翻了一倍多;同时每周只用一天的轻度用户从 17% 降到 10%,使用频率在向高频一端迁移。

两轮样本分别是 2017 人和 1016 人,均随机抽取并按美国人口加权。Epoch AI 提示结果并非完全可比:3 月问的是”总体上使用 AI 的频率”,8 月则是按每个服务分别询问、再取最高频,这个口径差异可能让 8 月的数字低估真实使用量。

来源

10. 三星明年 HBM4 产量要翻倍以上,HBM 产能扩到每月 25 万片

据韩国半导体业界消息,三星电子明年将把 HBM4 家族产量提高一倍以上,覆盖第六代 HBM4 与第七代 HBM4E,HBM 整体产能将扩大到每月 25 万片晶圆,其中第六、七代产品合计占到产量的 80%

扩产的一个先行指标是玻璃载板(glass carrier)——在 HBM DRAM 晶圆减薄、钻孔时贴在背面防止弯曲开裂的玻璃支撑件。三星对玻璃载板的外包清洗量将从此前计划的 2 万片/月提高到明年的 5 万片/月,而去年这个数字只有 1 万片/月,等于两年里涨了 5 倍。载板用量一路上行,反映的正是高堆叠层数 HBM 对薄片工艺依赖的加深。

来源

© 版权声明

相关文章

暂无评论

暂无评论...