订阅

全部文章

浏览 waoo.ai 已发布的全部文章。

Captions:公司改名 Mirage、Studio 又并回来了,真正剪视频的入口还是这个 App

Captions:公司改名 Mirage、Studio 又并回来了,真正剪视频的入口还是这个 App

第一次搜索 Captions,很容易被几个名字绕晕:公司官网叫 Mirage,旧网页产品叫 Mirage Studio,模型和 API 也挂 Mirage,手机里的剪辑 App 却仍叫 Captions。先说结论:如果你只是想把一段口播快速剪成能发的短视频,或者不拍真人、直接用 AI 生成一条成片,当前最直接的普通用户入口还是 Captions。
AI 导航
Hedra:它早就不只会让照片开口了,现在更像一位能把创意做完的多模型制作助理

Hedra:它早就不只会让照片开口了,现在更像一位能把创意做完的多模型制作助理

很多人记住 Hedra,是因为它能把一张人像和一段声音变成会说话的视频。现在再打开官网,产品已经换了重心:你可以把商品图、品牌资料、网页、灵感和一句目标放进同一个 Space,让 Agent 先研究和拆任务,再调用视频、图片、音频模型做成一组可继续修改的素材。口播仍然是它的强项,但已经不再是全部。
AI 导航
PixVerse:先别急着选 V6、C1 还是 R1,先想清楚你要的是一条视频,还是一个会继续回应的世界

PixVerse:先别急着选 V6、C1 还是 R1,先想清楚你要的是一条视频,还是一个会继续回应的世界

PixVerse 现在的入口比早期复杂得多:网页版、手机 App、中国区“拍我AI”、模板、Agent、API、CLI,还有 V6、C1、R1 和一批外部模型。普通人不需要先背这些名字。最简单的判断是:想交付一条可以下载、剪辑和发布的视频,就从 PixVerse 的常规创作流程开始;只有当画面必须在运行中持续回应观众或玩家时,才需要研究 R1 这种实时世界模型。
AI 导航
LTX:先写分镜,还是先买显卡?网页工作室、API 和本地视频编辑器其实是三条路

LTX:先写分镜,还是先买显卡?网页工作室、API 和本地视频编辑器其实是三条路

搜 LTX 时,你会同时看到 LTX Studio、LTX-2、API、Desktop、ComfyUI 和一堆模型版本,很容易以为这是几家公司或几款互不相干的工具。其实它们都围绕同一套 AI 视频引擎展开。普通创作者可以直接在网页里写分镜、管素材和剪时间线;开发者可以调 API;愿意自己维护显卡和模型的人,还能把它搬到本地。先选使用路线,比先背模型名更重要。
AI 导航
Higgsfield:别先挑模型,先决定你要自己控镜头,还是让智能体把整条流程排完

Higgsfield:别先挑模型,先决定你要自己控镜头,还是让智能体把整条流程排完

第一次打开 Higgsfield,很容易被菜单吓到:图片、视频、音频、Cinema Studio、广告、角色、Canvas、Apps、Supercomputer,还有一长串会不断更新的模型。其实不用把它们当成十几款不同工具。Higgsfield 更像一间共用素材库的 AI 影像工作室——你既可以亲自选模型、调镜头,也可以把完整任务交给 Supercomputer,让它先拆步骤、报成本,再等你确认执
AI 导航
OpenArt:模型很多不是重点,重点是把一张图继续做成角色、视频和完整故事

OpenArt:模型很多不是重点,重点是把一张图继续做成角色、视频和完整故事

如果只是想生成一张图,OpenArt 会显得有点“入口过多”:图片、视频、角色、世界、音频、故事、Director,还有一长排会持续变化的模型。换个角度就容易理解了——它真正想解决的不是让你多开一个生图网页,而是把参考图、角色、场景、声音和视频留在同一个工作区里,上一环的结果能直接接着往下做。
AI 导航
FLUX:先决定是在网页试图、接 API,还是把模型权重搬回自己的服务器

FLUX:先决定是在网页试图、接 API,还是把模型权重搬回自己的服务器

FLUX 常被写成一个生图模型,其实普通人真正会遇到的是三条完全不同的路:在浏览器里试图、用 API 接进自己的产品,或者下载开放权重自己部署。它们看起来都叫 FLUX,账单、数据流向、代码门槛和许可证却不是一回事。先选使用方式,再看模型名字,往往比研究一长串版本号更省时间。
AI 导航
Magnific(原 Freepik):工具越多,越要先想清楚这份素材最后交到哪里

Magnific(原 Freepik):工具越多,越要先想清楚这份素材最后交到哪里

很多人记得 Freepik 是找图片和矢量素材的网站,但它在 2026 年已经整体改名为 Magnific,并把生图、视频、音频、增强、编辑、协作画布和库存素材放进同一平台。入口变多以后,真正省事的不是把每个模型都试一遍,而是先决定这份素材最后要用于草稿、社交发布、客户交付还是产品上线。
AI 导航
Leonardo.Ai:模型多到挑花眼时,先把一张图从草稿做成能用

Leonardo.Ai:模型多到挑花眼时,先把一张图从草稿做成能用

第一次打开 Leonardo.Ai,最容易卡住的不是不会写提示词,而是模型菜单里既有它自己的 Lucid,也有 GPT Image、Nano Banana、FLUX、Seedream 等一长串名字。其实普通人没必要先把每个模型都研究一遍:先用 Auto 或较快模式把方向跑出来,挑中一张,再继续改图、放大或做成视频,才是这套工具真正省时间的地方。
AI 导航
Meta曝超级感知眼镜:全天录音拍照,隐私灯可能不亮

Meta曝超级感知眼镜:全天录音拍照,隐私灯可能不亮

据《金融时报》报道,Meta正在测试代号Aperol和Bellini的原型眼镜,具备“超级感知”模式,可持续录制音频并每隔几秒拍照。用户可事后询问AI关于所见所闻的问题。但报道称Meta可能不在该模式下点亮录制指示灯,引发隐私争议。目前该产品仍为原型阶段,未公布发布时间。
硬件情报
Ideogram:海报出图只是第一步,字写错了还得能继续改

Ideogram:海报出图只是第一步,字写错了还得能继续改

用 AI 做海报最让人泄气的时刻,不是它不会画,而是画面已经很好看,标题却多了一个字母;你只想改一句文案,它又把人物、颜色和构图全部重做。Ideogram 一开始就把图片里的文字当成重点,现在又把局部改图、扩图、透明背景和文字层接到生成之后。它真正想解决的,不只是‘能不能出图’,而是这张图能不能继续修到可用。
AI 导航

相关分类

返回顶部