#视频生成
这个主题在过往早报中的出现记录。深度条目直达研究报告,其余条目回到当日 edition。
- 产品上新2026-08-08 · 周六重要度 4/5深度报告 →
Seedance 2.5 API上线火山方舟
火山引擎于8月7日宣布Seedance 2.5 API上线。30秒单段视频和最多50个参考素材是7月31日已公布的模型能力;当天增量是服务状态从“近期上线”变为可用。
- API上线把视频模型从产品入口推进到可编排的开发接口,但公开文档仍缺模型ID、价格和海外区域清单。
- 报道必须把既有能力与当天交付状态分开,避免把30秒误写成再次提高。
- 产品上新2026-08-02 · 周日重要度 2/5
官方单源|Grok称Imagine Video 1.5新增原生1080p
Grok 官方 X 称,上月发布的 Imagine Video 1.5 本次新增文生视频、图像与语音参考及原生 1080p。非 X 页面未提供可核对日期。
- 新增能力覆盖生成入口、参考条件和输出分辨率,但当前主要证据仍是官方推文。
- 访问范围、价格和真实输出质量尚未形成可比较口径。
- 研究论文2026-07-11 · 周六重要度 4/5深度报告 →
待验证|Vidu S1:实时语音控制把视频生成推向交互模式
Vidu S1 进入 Hugging Face Papers;论文称可用语音实时控制数字角色,42 FPS 仍属团队自测口径。
- 这条线索的意义不是又一个视频模型,而是交互范式变化。
- 视频生成从离线 prompt 出片,转向可持续、可打断、可语音控制的 live session。
- 研究论文2026-07-10 · 周五重要度 3/5
待验证|Vidu S1 论文进入 HF Daily Papers 头部
HF Papers 收录 Vidu S1: A Real-Time Interactive Video Generation Model,生成时热度为 97。论文 arXiv 日期为 2026-07-03,本期按待验证论文信号处理。
- 视频模型的下一步不只是更长和更清晰,而是能否在用户反馈中实时修改。
- Vidu S1 仍需等待项目页、代码或第三方复现,但它把视频生成竞争推向交互延迟。
- 模型发布2026-07-03 · 周五重要度 4/5深度报告 →
Gemini Omni Flash 在 Designarena Video Arena 以 Elo 1404 登顶:Google 视频生成自 Veo 以来累计跃升 7 位,Omni 统一架构首次把多模态塞进 Flash 档
Google DeepMind 的 Gemini Omni Flash 在 Designarena(原 LMArena)Video Arena 拿下了 Elo 1404 的榜首位置,领先第二名 BytePlus Global 的 Seedance 2.0 Mini 整整 101 Elo——Designarena 官方称这是 Video Arena 历史上最大单次跃升之一。Google 在视频生成榜上的累计排名自 Veo 系列上线以来合计 跃升了 7 位。与 Veo 时代「专模专用」(Veo 做视频、Gemini 做文本)不同,Omni Flash 是 Google DeepMind 第一个明确以「视频生成 + 多模态统一」为产品定位的 Flash 档模型——也就是说,Google 在 2026 年中把视频生成从「独立产品线」拉回到「和文本/图像/音频同一根模型栈」。这次登顶的可信度来自 Designarena 沿用的盲评投票机制(社区用户对两个匿名模型输出投票,模型名不公开),所以 Elo 1404 是用户偏好的直接结果,不是 Google 自评。
- Gemini Omni Flash 登顶 Video Arena 的真正信号是「Google 视频生成从追赶者变领跑者」的临界点
- 自 Veo 2/3 以来,Google 一直被 Runway Gen-4、BytePlus Seedance、Kuaishou Kling 等中国/美国视频生成专精厂商压着,Omni Flash 这次 101 Elo 的领先优势是 Video Arena 史上最大单次跃升之一,等于 Google 一次性甩开第二名 7 位。
- 模型发布2026-06-27 · 周六
阿里 Wan2.7-Video 进 Video Arena 图生视频第 5
阿里 Wan2.7-Video I2V 以 1434 分进入 Video Arena 图生视频榜第 5,头对头领先 Grok Imagine Video 及全部 Google Veo-3.1 变体;支持文本/图像/音频/视频多模态控制与角色定制。
- 视频生成是中国实验室少数能稳定跻身前沿榜的赛道,Wan 与 Kling、海螺同列印证了"国产在多模态上追平更快"的判断,与 GLM-5.2 登顶代码榜同源
- 闭源前沿的护城河在多模态侧塌得更快。