没高额融资的公司,如何切入市场?
AI 视频这两年不缺声量,但聚光灯几乎都打在头部身上。真正被反复拿出来说的商业化数字,来来去去还是「可灵」、「Higgsfield」等几个披露过亿级美元 ARR 的名字。热闹是头部的,赛道里大部分产品还在为“能不能赚到钱”发愁。
也正因如此,当我们从业内人士处听到,一款专注欧美市场的 AI 视频 Agent 产品「DeeVid AI」,上线才一年半,注册用户达 3000 万,ARR 也做到数千万美元量级,多少有些意外。这家公司此前并不起眼,没有大额融资的高光时刻,也很少出现在赛道的公开讨论里。
这家没什么名气的创企,如何悄悄挤进了通常只属于头部的营收量级?带着这个疑问,我们把「DeeVid AI」从头到尾用了一遍。
一、我一个“外行”,
一次做出了还不错的视频
先说体验。
打开「DeeVid AI」的网站,最显眼的就是一个对话框,没有堆砌的模型列表,也不是复杂的工作流画布。图片、音频、视频,都在这一个框里生成,用户也可以使用 Agent 模式完成创作,在对话框里创建和引用 Skill,@添加参考资料等等。

我们以完全小白的角度,给了一个相对模糊的需求“蜡笔画风格的保温杯介绍视频”,也只上传了一张风格参考图,并顺手选了官方的“Product Demo”Skill。
由于选择了“逐步确认”的指令模式,Agent 没有直接开工,先抛回来几个选择题:要不要多场景、逐一展示卖点、要不要从痛点切入。确认之后,Agent 生成了一段文字版的分镜脚本,把 15 秒拆成 3 到 4 个场景,供用户确认。我们没提任何修改,直接出片。
从基础要求来看,视频多分镜主体、风格均保持一致,没有硬伤。15 秒的视频忠实还原了分镜,横移、推近、拉远三种镜头都用上,“蜡笔风格”那种粗颗粒的线条、色块不均的笔触也都在。整个过程,我们没写一句像样的提示词,也没有反复抽卡。
使用「DeeVid AI」,最大的感受是“省心”。没有在画布上拉节点搞工作流、甚至没有绝大多数产品都必然存在的环节,选模型。而初步产出也没有太多的 bug,给后续迭代和出片一个比较好的基础。
对应产品设计、与其他产品对比,省心背后的低门槛,主要来自两点。
第一点,能看出「DeeVid AI」团队的理念,用 Agent 负责理解需求、判断方向、把一句模糊的话拆解成一套具体方案,返回关键节点让用户确认细节。最特别的是在执行上,主要由Agent 自己直接去调度合适的模型,没有走大多数产品的惯用思路,将模型选择权留给用户。团队在有意识地区分,用户该做哪些选择、不该做哪些选择, 这大概率是团队对用户行为洞察后的某种选择。

举个例子,我们在测试里对分镜做过好几轮修改,比如要求加一帧保温杯正面特写、指定镜头角度和文字位置,输出结果都遵循了要求。精准响应,背后需要靠精准的模型调度,改这一处该调用哪个模型、用什么指令和参数重新生成,才能既贴合新指令,又不破坏已经确认过的风格。
第二点,Skill 做流程上的约束,在某类视频的创作中,会有一套工作规范,例如营销广告几秒放钩子、是否从痛点切入等,这可能也是作为小白,什么都不懂的情况下,感觉输出还可以的一个原因。


「DeeVid AI」支持自己编写 Skill,
也可以一键将与 AI 的交互内容保存为 Skill
凭借这两点,低门槛与不稳定的矛盾一定程度的化解了。对应团队工程化和产品设计的选择,以及我们的使用感受,其用户画像也逐渐清晰。
二、高 ARR 的答案,藏在目标人群身上
「DeeVid AI」的核心场景,从子工具到首页的灵感案例,几乎都指向同一个方向:Marketing Video,营销视频。面对的更多可能是中小电商卖家,或者一个或几个人的营销团队。他们每天要面对社媒和广告位对素材近乎无止境的“胃口”,一条广告跑几天数据就疲了,得换;一个平台的爆款样式,换个平台又得重做。
素材是刚需,而且是高频刚需。
而中小团队,具备专业创作能力的人才稀缺。之前在我们与某些 AI 视频团队、以及中小品牌商家交流时,两边交流得出了同一个观察:“中小商家有需求,但是要求是模糊的,大概知道想要个什么样的效果,说不清楚具体要求。”Agent 可以靠自然语言交互、工程化最小化用户选择、Skill 加入行业规范约束,来回应痛点。
在我们测试的期间,「DeeVid AI」上线了新一个功能,体现了团队对用户需求的进一步挖掘。

对于中小电商卖家、营销团队来说“表达模糊需求,用 Agent 来承接”的路径已然不错。但实际应用中,爆款素材轮动迅速,很多时候没人能说清视频火起来的原因。针对说不清需求,只想复刻爆款的用户,「DeeVid AI」新上线“爆款复刻”功能,用户只需要上传一段影片的链接,AI 就可以生成符合用户需求又保留原视频精髓的新视频,供用户快速发布。

“爆款复刻”功能的工作流
体验上,用户需要先上传一段视频的链接,并选择最吸引人的段落,然后由 AI 找出所选视频的钩子、节奏、视觉语言与内容精髓等要点,用户再在工作流中上传风格、主体参考图,描述自身需求,AI 直接给出成片。
笔者也测试了一下,从效果来看,「DeeVid AI」的指令遵循仍然在线,笔者上传了跟上文测评相同的风格参考,AI 确实将原视频的写实风格变成了插画风格,还基本保持了猫咪和水杯两个主体的稳定、且与原视频、参考图一致,只是在个别分镜中略有瑕疵,整条做下来不到 15 分钟,比从零做出一条广告快得多。

笔者生成视频的工作流
「Deevid AI」爆款复刻功能将创意分析与设计,分镜设计,素材生成,剪辑整个工作流全部打通,做到了真正的结果交付,目前是这个领域的第一家。这个功能也和前面提到的产品哲学相符,用户只需要关注需求和结果,其他事情交给「Deevid AI」。
写在最后
AI 视频赛道很多产品仍把接入模型能力作为卖点,用户需要自己挑、自己试错;「DeeVid AI」则是“场景为先”,不让用户选模型,用户只需要根据需求判断结果是否符合要求。
而“场景为先”成立的前提是,背后一整套原子能力的整合——图像、音频、视频生成,加上画布、编辑器、翻译、数字人这些工具,都被收进了同一个 Agent 的能力池里。也正因为能力足够全,才能将用户的需求,用对应的模型或原子能力接住,而 Skill 要做的,就是在这一整套能力池里,针对具体场景做定向调用和约束。
文章来自于微信公众号 “白鲸出海”,作者 “白鲸出海”