☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

字节跳动旗下AI视频生成工具即梦AI,长期稳居行业头部地位。这不仅得益于其持续迭代的大模型能力,更依托于字节生态内强大的流量分发体系——先后接入豆包、CapCut等平台后,用户活跃度与内容产出量始终领跑全行业。随着Seedance 2.0版本正式上线,即梦AI再次迎来新一轮增长拐点。
然而,在即梦AI持续收割市场份额之际,两款由前字节高管创立的新锐AI视频产品正悄然崛起,引发广泛关注。
2025年6月面世的“拍我AI”,隶属于爱诗科技,其创始人兼CEO王长虎曾担任字节跳动AI Lab视觉技术负责人,主导构建了抖音与TikTok的底层视觉技术架构。爱诗科技于2026年7月完成C轮整体融资,累计融资额达29.8亿元,投资方包括阿里巴巴(多轮领投)、鼎晖投资、中国儒意、三七互娱等。
另一款产品LiblibTV则于2026年3月发布,背后是演语科技。其创始人陈冕曾任剪映与CapCut全球商业化负责人,也是字节内部晋升最快的4-1级高管之一。2026年6月,演语科技宣布完成近3亿美元B+轮融资,估值突破20亿美元,创下国内AI应用领域融资新高。本轮融资由GraniteAsia、腾讯、顺为资本联合领投,HTInvestment、时代资本跟投,高榕资本、蚂蚁集团等原有股东亦参与追加投资。
两款产品甫一亮相便备受资本与市场双重青睐,不禁令人思索:这些脱胎于字节体系的新生力量,能否真正挑战甚至撼动昔日“母厂”?当老东家遇上亲手带出的嫡系干将,“徒弟”们是否真能以奇制胜?
自研模型 vs 种子模型:一场底层能力的较量
尽管同属AI视频生成赛道,拍我AI与LiblibTV却选择了截然不同的技术路径。LiblibTV本质上是一个模型聚合平台,目前主要调用字节的Seedance系列模型,同时兼容快手可灵(Kling)等第三方大模型,依靠精细化工作流设计与多样化skill组合提升输出质量;而拍我AI则坚持走自研路线,核心模型为Pixverse,虽近期也接入Seedance 2.0作为补充选项,但研发重心仍聚焦于自有模型迭代升级。
归根结底,这场竞争本质是Seedance与新兴自研大模型之间的正面交锋。
Tech星球对二者展开实测:在LiblibTV中启用其原生Seedance 2.0模型,在拍我AI中使用爱诗科技自研Pixverse V6模型,统一输入相同提示词,对比其在提示词理解能力、画面一致性及动态逻辑性等方面的综合表现。
首轮测试指令为:“生成一段动漫风格视频,展现马斯克在美加墨世界杯现场观赛”。
拍我AI首版输出中,人物身形过于纤瘦,下颌线条异常突出,与马斯克本人特征偏差明显;背景亦缺乏世界杯元素,整体氛围更接近电竞场馆而非足球赛场。
随后追加提示词:“将场景替换为典型世界杯赛场,并加入进球瞬间”。第二版场景识别准确,但人物位置出现严重错位——进球时刻人物突然跃入球场中央,动作反应滞后,节奏与剧情脱节。
第三次尝试整合前后提示词重新生成,场景与运动轨迹基本合理,但人物面部已完全失真,服装变为夹克,既不符人物日常着装习惯,也不契合赛事环境;人物位置仍存在突兀切换问题,稳定性堪忧。
反观LiblibTV输出结果:人物建模高度还原马斯克外貌特征,身着球衣贴合场景设定,表情变化自然匹配情节推进,仅在局部细节如手持旗帜与手套质感上略显生硬,镜头调度也稍显单一。
再次追加“加入进球动作”的指令后,情节逻辑依然保持连贯。
第二轮测试指令为:“机器人在舞台上跳芭蕾舞”。
拍我AI未能有效识别“舞台”这一关键要素,画面缺乏明确空间标识;LiblibTV则完整呈现舞台布景、灯光及纵深结构,专业感更强。
综合体验来看,Pixverse V6在画面丰富度与细节刻画上具有一定优势,但对提示词敏感度较低,易遗漏关键要素或生成违和内容,需反复优化描述才能逼近理想效果;Seedance 2.0则在指令执行完整性与叙事逻辑性上更为可靠,但在纹理精度、光影层次等微观维度仍有提升空间。
在模型调用机制方面,拍我AI仅支持单一模型选择,操作极简,零门槛适配大众用户;LiblibTV则提供多模型协同能力,从skill选取、提示词输入、工作流编排到节点编辑,全流程清晰可控,更适合进阶创作者。
就内置模板与skill设计而言,拍我AI侧重竖屏短视频创意类模板,契合当下主流内容消费习惯;LiblibTV则偏向长视频制作场景,skill功能深度与专业上限更高。
能否翻越字节这座高峰?
虽然两位创始人均出身字节,但迥异的职业履历塑造了差异化的创业逻辑:王长虎的技术基因决定了爱诗科技以模型自研为核心战略;陈冕深耕剪映多年,天然更擅长用户增长与商业化落地。
当前,爱诗科技主力产品仅有“拍我AI”及其海外版Pixverse,全球用户超1.5亿,覆盖177个国家和地区,但月活稳定在1500万左右,年营收逾4000万美元。
演语科技则构建起多元产品矩阵,涵盖LiblibAI、星流 / Lovart、LiblibTV等多个应用。其中LiblibAI累计用户突破3000万,年化营收超3亿美元;Lovart上线仅5个月,年化已达8000万美元;LiblibTV上线首日注册用户破10万,两个月内月收入激增超13倍。
拍我AI的核心竞争力在于技术自主权——从底层模型到上层应用全部自控,对外部依赖度低,抗风险能力较强。尽管当前模型性能尚未全面超越Seedance,但关键技术已掌握在自己手中。
挑战同样来自模型本身。若想与即梦AI正面抗衡,必须跨越技术鸿沟。现阶段Pixverse与Seedance之间仍存在明显代际差距,追赶之路注定漫长。
LiblibTV的优势则集中于成本控制。2026年4月起,即梦AI因算力紧张连续三次涨价,视频生成成本飙升近6倍。在此背景下,同样可调用Seedance 2.0的LiblibTV,迅速成为众多AI视频从业者的“性价比之选”。其至尊版年费11999元,每月赠送66000积分;即梦AI超级会员年费30576元,每月仅提供54600积分,价格差距显著。不过,LiblibTV低价策略主要依赖持续补贴支撑,难以长期维系。
作为模型聚合平台,LiblibTV在基础技术层面高度绑定上游大模型供给。一旦Seedance等核心模型发生重大调整或政策变动,将直接冲击其产品稳定性与商业可持续性。相较之下,即梦AI背靠字节自有大模型体系,在技术纵深与资源保障上具备天然护城河,抗压能力与发展潜力更为坚实。
对于陈冕与王长虎而言,字节仍是横亘眼前的一座高峰。但胜负尚未落定——AI视频生成市场仍在高速扩容,行业远未进入存量博弈阶段,正处于红利释放期。留给后来者的窗口期依然宽广,一切可能,皆待发生。
本文来自微信公众号 “新言财经”(ID:tech621),作者:张宁洢,36氪经授权发布。










