Subanana

Subanana

Subanana是一个 AI 字幕和转写工具,支持95种以上语言,对粤语和中英混说的识别是它的强项,这在同类工具里不多见。上传录音或视频,几分钟就能拿到字幕、逐字稿和翻译,可以导出SRT、VTT、FCPXML,也能直接烧录进视频并自定义样式。 它这次主推的是实时字幕:演讲、课堂、直播时实时出字幕,观众可以各自选语言看翻译。另外还有会议记录功能,支持Google Meet、Zoom、Teams,可以选择不派机器人入会。适合做视频内容的创作者、网课讲师和需要多语种会议记录的团队,粤语用户会更有感。有免费试用,官方称已有20多万用户。
000
PikpikGo

PikpikGo

PikpikGo 把多家主流生成模型放进了一张无限画布里。目前可选的包括 Seedance、Sora、Veo、Wan、Vidu、Runway、GPT Image、Nano Banana 这一批,图像和视频都覆盖。 画布这个形态解决的是创作流程的问题。传统做法是每个模型开一个网页,生成的素材散在各处;这里可以把一整个项目的参考图、中间稿和成片摆在同一个空间里对比,选中某一张继续往下生成。对做分镜、做多版本比稿的人来说,省的是来回切换和归档的时间。 直连各家官方接口,所以出图质量跟在原厂做基本一致,差别在于计费统一走站内额度。免费可以试,进阶能力需要订阅会员。 缺点是模型一多,参数体系不统一,刚上手需要一点时间摸清哪个模型擅长什么。
000
AdAnt AI

AdAnt AI

AdAnt是一个做社交短视频广告的 AI 创意代理。给它一个商品链接或一条参考爆款视频,它会拆解这类视频为什么有效,推荐开头钩子、模板和数字人风格,然后批量生成可编辑的广告变体,适配TikTok、Instagram Reels和YouTube Shorts。整个过程是对话式的,可以边聊创意方向边改。 它的卖点是 复刻已经被验证过的爆款格式 ,而不是从零瞎生成,投放团队用来批量出变体做A/B测试,效率会高不少。适合跨境电商卖家、DTC品牌和代投放机构。生成的视频仍要人工把关商品信息和各平台广告规范,数字人口播的自然度因素材而异。按套餐付费,有试用。
000
AIReel

AIReel

AI Reel 是一个把多家视频模型聚到一起的生成平台,站内可选 Sora、Veo、Wan、Vidu、Runway 等,主打零经验也能做出成片。 流程比较直白:上传一张图或者写一段描述,选模型,生成,然后下载。它还提供把生成片段串起来的能力,适合做短视频和广告素材这类不需要复杂剪辑的内容。 这类聚合平台的价值主要在两点,一是不用逐个注册海外账号,二是同一个需求可以换几个模型跑一遍再挑。想清楚这两点是不是你的痛点,基本就知道值不值得用。 对画面可控性要求很高的专业创作,还是得回到各家自己的工作台去调参数。平台有免费额度,超出后按次或按套餐付费。
000
Narrative

Narrative

Narrative 是一款 AI 优先的视频剪辑器。把素材导进去,用大白话说出你要什么样的成片,比如“剪成 15 秒短视频,只留不错的几段,高潮加速,结尾加字幕卡”,它会自动挑片段、搭好时间线,交回一版完整草稿。 草稿不是一次性的黑盒成品,时间线、素材、字幕、音频、转场都能再打开手动改,也可以继续用对话让它调整。另外支持自定义动态图形,以及上传参考视频来模仿其剪辑风格。 有免费版可以上手,还有 iOS App。适合做短视频、Vlog 和社媒内容,又不想花时间学专业剪辑软件的创作者。
000
CreatorHat

CreatorHat

CreatorHat 是一款运行在 Safari 里的 YouTube 运营工具,专门给用 Mac 做视频的创作者。 主要功能有四块:找出播放量明显高于所在频道平均水平的“爆款异常视频”,作为选题参考;研究 YouTube 搜索关键词;跟踪自己视频的搜索排名;以及在上传视频时,根据转写内容给出更好的标题建议。标题生成用的是设备本地的 AI ,内容不会上传到云端。 价格是每年 29.99 美元,在 Mac App Store 下载。适合想靠搜索流量涨粉的 YouTube 创作者,尤其是习惯用 Safari、不想装 Chrome 插件的人。
000
Lumiko

Lumiko

Lumiko是个Chrome录屏扩展,较的卖点是自动变焦:它分析你的鼠标轨迹和点击位置,自己生成平滑的推近和平移,不用手打关键帧。 做产品演示、教程、缺陷复现视频的人应该懂这个痛点——整屏录下来字太小看不清,手动剪又得一段段加缩放。Lumiko把这一步自动化了,出片接近有运镜的效果。 其余几项围着同一类活儿配:摄像头小窗是圆形的,可拖动可缩放,和屏幕画面同步;智能模糊自动糊掉画面里的API密钥、邮箱这类敏感信息,省得录完才发现漏了;内置编辑器能裁剪、切分、重排片段,导出支持4K、1080p和720p,官方强调没有渲染排队。 装在浏览器里的好处是不占系统资源、也不用装本体软件,代价是只能录网页内容。基础功能免费,从Chrome应用商店装上就能用。
000
Cutrix

Cutrix

Cutrix做的是视频翻译,一条视频进去,出来的是换了语言、配好音、带好字幕的成片,不是只给你一份译文稿。 支持50多种语言,中英日韩越泰印尼俄德法这些常用的都在。素材来源比较松:本地文件可以传,也可以直接贴YouTube、TikTok、X、Bilibili、抖音、Google Drive的链接让它自己去抓。 产品把力气压在两处。一是音色克隆,译后的配音尽量贴合原片说话人的音色和情绪,而不是换成一把标准播音腔;二是唇形同步,让画面里的嘴型跟上新语言。这两项做到位,短剧、广告、动画、游戏这类出海内容才算真能用,官网也正是按这四个场景摆的样例。 流程就上传、翻译、导出三步,网页端操作不装软件。官方另外提供了一个能装进OpenClaw的技能包,方便把翻译和配音接进自己的流水线批量跑。有免费额度可以先试,长期用按套餐付费。对做多语言分发的团队来说,它省掉的是 翻译—配音—对轴 这条链上最费人的那段。
000
Hookest

Hookest

Hookest 是一个短视频“开头”素材库,专门收集 TikTok、Instagram Reels 和 YouTube Shorts 上爆款视频的前几秒,也就是常说的 hook,并且每天跟踪更新,按汽车、时尚、美食、旅行、音乐、运动等类目分好,能搜索、能看表现数据。 做内容的人用它主要干两件事:看自己这个赛道里什么样的开头最能让人停下来,以及盯竞品最近在用什么套路。 它和 AI 的结合点在 MCP 和 API:收藏的 hook 可以直接带进 Claude、ChatGPT、Gemini 里,让 AI 帮你拆结构、改成适合自己的脚本。网站上还有几个免费的 hook 生成小工具。有免费档,完整功能需要付费,价格见官网。
000
Sonilo

Sonilo

Sonilo 是一个 AI 配乐和音效平台,最方便的用法是直接上传视频:它会先理解画面内容,再生成时长刚好对得上的背景音乐和音效,省掉了找曲、剪曲、对节拍的功夫。也支持纯文字描述生成音乐和音效。 新加了多语言配音和口型同步重渲染。给 Premiere Pro、Unity、Godot、Roblox 都做了插件,也开放了 API。官方强调训练数据来自 Shutterstock 授权曲库,商用版权比较清楚,这对要交付商单的团队挺关键。 免费版每两周 2000 积分,不能商用;Creator 4.99 美元/月,Pro 11.99 美元/月起含商用授权,Premium 23.99 美元/月,年付大约六折。适合视频创作者、独立游戏开发和影视后期团队。
000
SocialGPT

SocialGPT

SocialGPT 是一个用聊天来剪视频的在线工具。素材传上去之后,不用去拖时间线,直接打字告诉它“开头剪短一点”“这里加个字幕”“配一段轻快的音乐”,它就照着改。 字幕会自动生成并做好样式,B-roll、背景音乐和音效也能按画面内容自动匹配。想自己动手的,时间线手动编辑也保留着,还能按时间戳精确改某一段; AI 改过的地方随时可以撤销,不怕越改越乱。 比较适合不会用专业剪辑软件、又要经常出短视频的人,比如小老板、知识博主、健身教练。刚在 Product Hunt 上线,发布期有一个月免费,正式价格官网上还没写清楚。
000
Async

Async

Async 是一套对话式的 AI 视频创作工具,新出的 Bumblebee 编辑器可以用聊天的方式,把原始素材和 AI 生成的镜头剪成一条成片。 粗剪精剪它能自动做,口癖、停顿、重复的地方会被去掉;可以按音乐节拍卡点,用“M a gic Dust”一键增强人声音质;B-roll、配音、配乐、字幕都能生成,还能从长视频里自动切出适合发社媒的短片段。内置了产品广告、演示、讲解、MV、房产展示等模板,都是专业剪辑师做的,也能把你自己的剪辑风格存下来复用。 公司前身是播客工具 Podcastle。可以免费开始,Pro 按月或按年订阅,含生成积分。
000
ArcLoop

ArcLoop

ArcLoop 是一个 AI 漫剧生成平台,核心概念叫“IP World”:角色、场景、画风和各类素材都沉淀在同一个项目里,跨剧集长期复用,适合要连续更新的系列内容。 智能体可以根据一句话生成剧本大纲和分集方向,自动出分镜和镜头卡;用 @角色名 调用资产,用视觉参考锁住画风,防止越画越跑偏,然后生成视频,在线剪辑、配音、配乐。风格有 3D-CG、Q 版、新海诚风、真人等,模型可选 Seedream 5.0、Seedance 2.0。 创始人秦路是字节跳动前数据科学负责人。目前走候补名单和邀请码,价格没公开。
000
PixVerse R2

PixVerse R2

PixVerse R2 是爱诗科技 PixVerse 推出的实时世界模型。和普通 AI 视频“一次生成几秒片段”不同,它生成的是持续演化的音画世界:在生成过程中可以随时输入文字、图片、音频或操作指令,画面会即时响应,并记住之前发生过什么。 官方把它定位成交互式视频媒体,玩法更接近“走进一个能被你改写的场景”,适合做互动叙事、实验短片和游戏化内容的创作者尝鲜。 目前通过 PixVerse World 网页体验,功能和额度以官网为准。实时生成对网络要求较高,画面精度也不及离线渲染的视频模型。
000
1…192021