-
本地跑一个文生视频模型:CogVideoX 代码与 2B 模型都是 Apache 2.0
想在本地跑文生视频?CogVideoX 提供 2B 与 5B 多个版本,代码与 2B 模型均为 Apache 2.0 许可,支持 diffusers 与量化推理。
-
剪映:把智能抠像、AI 补帧与音色克隆,全塞进同一个剪辑器里
剪映专业版在 Windows 上提供 AI 剪辑能力,新增支持 NVIDIA RTX 50 系 GPU 硬件加速与 4:2:2 硬件编解码,三编码器导出速度提升 1.5 倍。
-
D-ID:一张照片就能开口说话,还能把视频翻成 120 多种语言
D-ID 支持用一张人脸照片生成会说话的数字人,覆盖 120 多种语言,并提供视频翻译、声音克隆与可实时对话的 Visual Agents,成片时长上限为 5 分钟。
-
Synthesia:一张照片生成数字分身,培训视频一键翻成 140 多种语言
Synthesia 面向企业培训场景提供 240 多个数字人与 160 多种语言,支持用一张照片生成个人数字分身,还能把已有视频一键翻译成 140 多种语言并保持口型同步。
-
数字人总在换脸?HeyGen Avatar V 让同一个你在 175 种语言里保持一致
一款面向出镜内容的 AI 视频平台:Avatar V 数字分身只需 15 秒素材,Video Agent 一句话出成片,视频翻译带唇形同步并覆盖 175 种以上语言。
-
PixVerse:V6 支持 15 秒 1080p 与原生音频,官方页显示榜单 ELO 为 1,343
PixVerse 的 V6 模型能在同一次生成里产出 15 秒 1080p 视频,自带多镜头逻辑与对白、音效、环境音等原生音频,还支持在生成前先定 16:9 或 9:16 等画幅。
-
Vidu:Q3 支持音视频同步输出,对话、旁白、音效与音乐四类音轨一次生成
Vidu 把实时能力放进 S2:S2-Avatar 支持实时语音对话与复杂动作控制、输出 720P+,S2-Editing 支持风格渲染、角色替换、背景替换与虚拟换衣。
-
海螺视频:官方称 H3 的 2K 单价不到主流模型三分之一
海螺视频主推的 MiniMax H3 能把文本、图像、视频与音频放进同一段上下文,生成带原生立体声的视频,最长 15 秒、2K 分辨率,官方称其 2K 每秒价格不到主流模型的三分之一。
-
可灵 AI:Kling 3.0 系列原生支持音频,官方称已上线原生 4K 视频生成
可灵 AI 把视频、图片与音效生成收进同一个创作台:Kling 3.0 系列原生支持音频,官方称已通过 3.0 模型上线原生 4K 视频生成,API 按秒计费。
-
Luma:Ray 3.2 支持单条 16 个关键帧的 AI 视频平台
Luma 把自己定位成「你的创意伙伴」:Ray 3.2 视频模型支持单条 16 个关键帧、原生 HDR 与 16 位 EXR 导出,配合 AI Agent 从概念走到成片。
-
Pika:图生视频与一键特效都在一个平台,免费档每月 80 积分
Pika 把自己定位成「把想法变成视频」的 AI 创作平台:图生视频、一键搞怪特效、AI Agent 与 API 会员都在同一个站点,免费档每月 80 个积分。
-
豆包:写稿、翻译、生图、做视频,PC 和浏览器里都在的免费助手
豆包的电脑版把对话、写作、PPT 生成、图像与视频生成收进同一个输入框,桌面悬浮球随手呼出,浏览器插件负责划词翻译。基础功能免费,Windows、macOS 与网页版三端的聊天记录互通。
-
第 1 / 1 页