D-ID 支持用一张人脸照片生成会说话的数字人,覆盖 120 多种语言,并提供视频翻译、声音克隆与可实时对话的 Visual Agents,成片时长上限为 5 分钟。
Synthesia 面向企业培训场景提供 240 多个数字人与 160 多种语言,支持用一张照片生成个人数字分身,还能把已有视频一键翻译成 140 多种语言并保持口型同步。
一款面向出镜内容的 AI 视频平台:Avatar V 数字分身只需 15 秒素材,Video Agent 一句话出成片,视频翻译带唇形同步并覆盖 175 种以上语言。
通义万相 Wan2.2 用双专家 MoE 把总参数扩到 27B、每步只激活 14B,5B 的 TI2V 模型以 720P 24fps 输出并能跑在消费级显卡上。
Google DeepMind 的视频模型 Veo 3.1 把音效、环境声与对白纳入同一次生成,输出支持 1080p 与 4K 分辨率,并提供场景延伸、首尾帧、运镜控制与对象增删等创作能力。
PixVerse 的 V6 模型能在同一次生成里产出 15 秒 1080p 视频,自带多镜头逻辑与对白、音效、环境音等原生音频,还支持在生成前先定 16:9 或 9:16 等画幅。
Vidu 把实时能力放进 S2:S2-Avatar 支持实时语音对话与复杂动作控制、输出 720P+,S2-Editing 支持风格渲染、角色替换、背景替换与虚拟换衣。
海螺视频主推的 MiniMax H3 能把文本、图像、视频与音频放进同一段上下文,生成带原生立体声的视频,最长 15 秒、2K 分辨率,官方称其 2K 每秒价格不到主流模型的三分之一。
可灵 AI 把视频、图片与音效生成收进同一个创作台:Kling 3.0 系列原生支持音频,官方称已通过 3.0 模型上线原生 4K 视频生成,API 按秒计费。
Luma 把自己定位成「你的创意伙伴」:Ray 3.2 视频模型支持单条 16 个关键帧、原生 HDR 与 16 位 EXR 导出,配合 AI Agent 从概念走到成片。
Pika 把自己定位成「把想法变成视频」的 AI 创作平台:图生视频、一键搞怪特效、AI Agent 与 API 会员都在同一个站点,免费档每月 80 个积分。
Runway 把 AI 视频生成、图像编辑与后期制作收进同一个云端工作台,免费版送 125 个一次性积分可直接上手试用,付费方案从每月 12 美元起,支持随时取消。
Figma 是设计、代码与 AI 汇合的在线协作画布:用提示词直接生成原型与网页,AI 智能体在同一空间协作,免费版每天提供 150 个 AI 积分(每月上限 500 个)。
Canva 可画是 Canva 的中国版在线设计协作平台,2013 年诞生于澳大利亚、2018 年进入中国,把 AI 生成、海量模板与版权素材、团队协作放进同一个编辑器。
百度智能云 AI 作画是百度智能云基于文心大模型的文生图服务,已正式商用,接入文心一格能力,支持文生图、参考图作画与文本驱动图像编辑,面向开发者提供 API 调用服务。