一个小站的自留地
MiniMax 发布全模态生成模型 H3 MiniMax 于 2026 年 7 月 31 日正式发布全模态生成模型 MiniMax H3,目前已通过 API 提供服务。H3 支持对文本、图像、视频和音频组成的多模态上下文进行统一理解,可输出带原生双声道音频的视频,官方称其在指令遵循、文字与品牌信息呈现、视频到视频动作迁移等方面表现突出。 H3 可生成 4 至 15 秒视频,参考生成模式最多输入 9 张图片、3 段视频和 3 段音频,提示词上限为 7000 字符。2K 视频基础价格为每秒 0.13 美元,768P…
阿里发布新一代视频生成模型 Wan 3.0Wan 3.0 重点提升了长视频生成、镜头语言、角色真实感以及人物与场景一致性。
模型支持稳定生成最长 30 秒的视频内容,可完成一镜到底、连续叙事和多镜头表达,减少长视频生成过程中常见的剧情断裂、角色变化和场景跳跃问题。
在镜头表现方面,Wan 3.0 支持更丰富的运镜和蒙太奇叙事,可根据提示词生成推镜、跟拍、镜头切换等影视化效果,让视频节奏和故事张力更加完整。
人物表现也是此次升级的重点。模型进一步改善了角色表情、肢体动作和情绪表达,使人物表演更加自然,同时增强角色、服装、道具和背景场景在连续画面中的一致性。
(综合媒体报道)