实测 Seedance 2.5 与可灵 VIDEO 3.0:谁能无痛当上视频导演
雷峰网用两组 15 秒任务实测 Seedance 2.5 与可灵 VIDEO 3.0:一组让小龙虾主持人科普 OpenClaw 2.0,一组基于《赴山海》参考帧改写雪中殉情结局。
雷峰网用两组 15 秒任务实测 Seedance 2.5 与可灵 VIDEO 3.0:一组让小龙虾主持人科普 OpenClaw 2.0,一组基于《赴山海》参考帧改写雪中殉情结局。
爱诗科技 PixVerse R2 已全量上线,用户可在网页端体验动作指令与互动影游交互。文章通过实机体验与 HAR 网络记录分析发现,一次会话中八轮 Prompt 共享同一内容流,约 119.5 秒生成窗口内记录到 3355 条 action_frame,发送间隔中位数约 29.944 毫秒。
雷峰网用三组原创图生视频任务对比了 HiDream-O1-Video-1.0、Seedance 2.5 和 MiniMax H3,考察意图规划、时间因果与音画对应。
Instagram 周三宣布为旗下剪辑应用 Edits 推出 AI 视频助手,可结合账号的粉丝数、播放量、留存、点赞、分享等指标,以及评论、平台热门内容和受众偏好,给出个性化反馈并识别长期表现规律。该助手侧重数据分析而非代做创意,使用量有上限,可通过 Meta One 订阅解锁更多额度。Meta 今年 6 月已预览该功能,YouTube 上周也表示正在开发类似的对话式视频剪辑工具。
AI制作的漫剧正在改变影视生产链条,横店剧组数量明显减少,多位微短剧演员公开表示接不到戏。DataEye报告显示,国内AI漫剧2025年市场规模为168亿元,2026年1-5月已达220亿元,预计全年达400亿元;2026年第二季度仿真人剧在AI漫剧中占比已达七成。
NVIDIA 发布 Metropolis Blueprint for Video Search and Summarization(VSS)3.3,用于降低视觉 AI 智能体的构建与运行成本。该蓝图及其智能体技能把视频接入、流处理、事件检测、检索、摘要与报告整合为可维护的系统,支持在生产规模下理解视频。
在 Amazon SageMaker AI 上,同一 AWS vLLM-Omni DLC 镜像可部署两个端点:实时端点运行 FLUX.2-klein-4B 生成图像,异步端点运行 Wan2.1-VACE-1.3B 生成图像条件视频。
Steam 在测试版客户端为 Remote Play 加入开源开发者 Hans-Kristian Arntzen 专为家庭串流设计的 Pyrowave 编解码器,其延迟显著低于常规方案,但 Valve 称带宽占用是其他串流编解码器的 5-10 倍。
Google Research 发布 AI video co-director 多智能体框架,在 Gemini 和 Veo 之上规划多镜头叙事的视觉连续性,并原生继承 SynthID 水印等安全机制。
推荐理由:Google 把长视频生成拆成规划、分镜、自回归合成与闭环修正四套框架,读者可了解多智能体如何抑制角色漂移与语义漂移。
Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,在 Gemini 3.8 Live 基础上加入近实时视频生成,让对话模型具备能听、能看、能说的动态视觉形象,并已在 Gemini Enterprise 上线。
推荐理由:Gemini 3.8 Live 新增实时视频形象能力,读者可了解多模态对话在企业场景中的形态变化。
@therealcornpop 在 TikTok 上指出,用 AI 写 TikTok 和 YouTube 脚本很容易被识破,不只是"不是 X,而是 Y"、三段式和破碎断句这类 AI 腔调,更在于内容缺少明确的声音与观点。
Google 发布 Gemini 3.7 Flash,距 3.6 Flash 仅三周,主打编程与智能体,每百万 token 价格为首发 3.6 Flash 的一半。
Google DeepMind 发布 Gemini Omni 1.1 Flash,通过 Gemini API 在 Google AI Studio 提供面向开发者的生成视频能力。
推荐理由:原文列出场景延长、首尾帧插值与 4K 放大等具体能力及 API 入口,可据此判断生成视频工作流的可控性变化。
Google DeepMind 与 A24 宣布达成首个研究型合作伙伴关系,双方将围绕多个项目展开深度研发协作,让 A24 的创作者参与塑造新技术。Google 同时已对 A24 进行投资。该合作初期聚焦于打通前沿技术与下一代娱乐之间的鸿沟,具体目标与技术产出将随时间演进。
Google DeepMind 发布 Nano Banana 2 Lite 和 Gemini Omni Flash 两款模型。
推荐理由:两款新模型给出了延迟、价格与可用入口,读者可据此判断图像与视频生成工作流的成本变化。