标签: AI视频

  • 大厂AI资产分拆进行时:可灵为字节、阿里探路?

    声明:本文来自于微信公众号 锌刻度,作者:孟会缘

    2026年6月,一则融资消息在创投圈引发震动:快手旗下AI视频生成业务可灵AI正式启动分拆后的首轮融资,投前估值达180亿美元(约合1220亿元人民币)。

    这一数字有多夸张?截至6月初,快手母公司市值约270亿美元,可灵一家子公司的估值,已经相当于整个快手的约67%。

    一个成立仅两年的业务,估值逼近母公司市值的七成,这无异于在业内外投下一颗重磅炸弹。

    关键是,可灵并非孤例。

    字节跳动旗下的豆包AI正通过“独立股权激励计划”悄然铺垫,阿里则将通义大模型事业部和未来生活实验室合并成立Token Foundry事业部,百度的昆仑芯已提交港交所IPO申请……显然,一场从“大厂温室”走向“独立资本化”的AI资产分拆潮已经来袭。

    可是,大厂为什么会纷纷启动AI业务的分拆动作?视频生成赛道又是否存在独立上市的成长空间?

    成本、估值与战略,大厂拆AI的三笔硬账

    毫无疑问,AI业务的烧钱速度,正在挑战传统互联网公司的财务报表。

    以快手为例,2026年一季度财报显示,其总营收337亿元,同比增长3.4%;经调整净利润34亿元,同比大幅下滑26.3%。与此同时,快手2026年全年资本开支预计达260亿元,较2025年增加约110亿元,增量几乎全部砸向AI算力,可灵是重中之重。一季度研发开支达36亿元,同比增长9.8%,财报明确归因于对AI的投入增加。

    图片

    问题在于,可灵的商业回报远未跟上成本增速

    2026年一季度可灵AI收入超6.5亿元,ARR(年化收入运行率)接近5亿美元(约合36亿元人民币),但其消耗的成本却是百亿级别。

    汇生国际资本总裁黄立冲在接受媒体采访时称,分拆可灵本质是将AI业务从“母公司持续输血的成本中心”变成“独立市场化融资、自循环投入的AI科技公司”,用外部资本承接视频大模型的高额投入。

    友商字节跳动同样面临算力账单膨胀的压力。

    其豆包大模型日均Token使用量突破120万亿,B端火山引擎MaaS市场份额已达49.5%。而豆包在2026年5月才推出首套三档付费方案(68元/月、200元/月、500元/月),商业化可谓刚刚起步。

    图片

    图源:IDC《中国企业级MaaS市场最新格局分析报告》

    有相关从业者形容这种处境:“豆包越火,调用越多,算力消耗越大,亏损越深。免费是流量策略,但免费也正在杀死现金流。”

    在成本压力之外,更大的吸引力在于估值释放。

    据了解,摩根士丹利此前对可灵的分部估值仅为60亿美元,而随着分拆计划的推进和市场对纯AI公司估值逻辑的变化,以Pre-IPO轮180亿美元估值计算,同一份资产,估值差了整整三倍。

    这类AI业务之所以在独立分拆后获得高估值,核心原因在于大厂合并报表中被视作吞噬利润的成本项,一旦独立就会按照赛道稀缺性、收入增速和市场想象空间重新定价,几十倍的市销率也并不稀奇。

    当然,大厂拆分AI资产还有更深层次的战略考量

    一方面是资本退出路径的打开。字节跳动整体估值约5500亿美元,但整体上市通路长期受阻,导致在公开市场之外,持股方面临不同形式的退出约束。在此背景下,字节启动了“豆包独立股权激励计划”,向Seed部门员工授予挂钩豆包业绩的股票期权,构建起估值锚点与组织基础。字节目前虽明确表示“不考虑分拆”AI4S业务,但独立股权计划的落地,已为豆包未来的独立资本化打下基础。

    另一方面是商业模式的独立突破。阿里6月8日成立Token Foundry事业部,由CEO吴泳铭亲自挂帅,将Happy Horse、Happy Oyster等明星产品与通义大模型整合,加速AI商业化落地。将AI业务从大厂主体中拆分,有助于摆脱集团内部资源调配与定价体系的束缚,按照独立的商业模式快速成长。

    算力成本增速能否被技术迭代“跑赢”?

    如果说分拆是大厂算清楚了三笔账后的理性选择,那么对于可灵这类AI产品而言,完成独立融资乃至IPO的前提只有一个:这门生意的单位经济模型,到底能不能跑通?

    绝对增长看,可灵交出了一份漂亮的成绩单。上线两年,可灵单季收入从2025年Q1的1.5亿元飙升至2026年Q1的6.5亿元,同比增长超300%。ARR从去年3月的1亿美元升至今年3月的近5亿美元,一年内增长4倍。公司已将2026年全年ARR指引从原先的3亿美元上调至5亿美元。

    图片

    图源:快手官博

    从收入结构来看,可灵约70%收入来自B端API和企业服务,且海外市场贡献了七成。截至一季度末,可灵全球用户突破6000万,服务超3万家企业客户和开发者。从应用程序场景看,使用AI制作微短剧可将成本降至传统水平的1/3以下,周期缩短超60%。在影视制作领域,电视剧《太平年》在使用可灵后,甚至能将两个月制作任务压缩至两周以内。

    然而,与全球AI视频赛道对比,可灵的收入规模仍处于早期阶段。

    海外视频生成头部企业Runway估值约53亿美元,2026年中实际年化ARR约1.5亿美元,全年目标2.65亿美元。可灵如此高的估值,意味着资本市场给它的溢价是Runway的数倍,这固然反映了“全球AI视频第一股”的稀缺性预期,但也意味着资本市场对其单位经济模型提出了更高的验证要求。

    因为收入增长的另一面,是算力成本的刚性攀升。视频生成推理算力需求约为传统文本大模型的2000倍,生成一段1080P视频的物理成本在0.5到1美元之间。

    与之对照的是,Sora关停的教训触目惊心:Sora应用内购的累计总收入仅约210万美元(约合人民币1451万元),但每天维持运行的算力成本高达1500万美元,即意味着它累计赚到的钱,还抵不上高峰期一天的算力开销。

    快手的情况虽好于Sora,但结构性的成本压力同样不容忽视。

    2026年预计260亿元的资本开支中,绝大多数流向可灵的算力采购与模型迭代。虽然可灵在推理层面已实现边际利润转正,ARR在一年内增长了4倍,但同期母公司的资本开支也在同步翻倍。

    对此,惠誉评级亚太区企业评级董事何景行持谨慎态度:“惠誉目前并未预计可灵在未来几年会对快手的盈利能力或现金流产生非常显著的贡献”。

    更深层的问题是,可灵在2026年Q1已实现收入结构的根本性反转,B端API占比跃升至约60%,P端专业用户订阅降至约40%。其单位经济模型的核心风险点也相应转移,从"C端付费意愿下滑"转向 "B端API调用的价格竞争压力" 和 "规模化算力成本管控能力"。

    “商业化拐点”的真正含义,不是ARR增长的速度有多快,而是单位经济模型是否成立。

    以可灵为例,就是单次视频生成产生的收入能否覆盖其算力成本,并在此基础上实现规模化盈利,而其面临的问题则是:算力成本随使用量的增长而增长,与技术迭代带来的单位成本下降,谁跑得更快?

    这是一个两难问题。

    若是视频生成工具的定价远高于用户的心理预期(如用户预期的单次价格在0.1美元以下,而真实生成成本在0.5-1美元之间),付费转化将受到制约。

    若是定价太低,算力成本将吞噬毛利,规模越大亏损越深。

    出路取决于三个变量:一是模型效率的优化能否将单次生成成本降至0.1美元以下;二是专业创作者和企业客户的ARPU值(单个用户的平均收入)是否能持续提升以覆盖成本;三是算力硬件的价格能否持续下降。

    头部券商研报普遍估算,若推理芯片成本每年下降40%,且模型压缩技术持续迭代,视频生成单位成本有望在未来18~24个月内下降约60%。

    但目前来看,这三条路径都仍有较大的不确定性。

    OpenAI关闭Sora的教训已经表明,纯粹依赖技术突破而缺乏商业变现逻辑的视频生成项目很难跑通。

    图片

    OpenAI公布的Sora停止服务须知

    可灵凭借快手的内容生态和商业化团队,在获客、转化和留存方面具备天然优势,但这套“短视频基因移植”的逻辑能否在独立运营后延续,仍需验证。

    值得一提的是,如果可灵最终成功独立上市,它将为整个中国互联网行业探索出一条大厂优质AI资产独立资本化的可行路径。

    恰好,友商们都在做着类似的准备:字节豆包通过独立股权激励计划已完成制度铺垫,阿里通过Token Foundry事业部的设立做好了组织准备,百度昆仑芯已进入科创板辅导阶段……

    但这条路径能否真正走通,关键不在于投前估值有多高,而在于各轮融资乃至上市过后,资本市场的持续定价逻辑能否与公司的实际经营表现对齐。

    毕竟,“可灵们”走上独立融资这条道路之际,市场将不再只问ARR增长,而是会时刻追问一个更硬核的问题:它们何时能够实现盈利?

  • 首个原生4K直出,可灵AI带来的“创作解放”

    声明:本文来自于微信公众号 新榜,作者:小八hachiko

    当AI可以直出4K画面,是一种怎样的体验?

    既是人像肌理被精确还原,也是巨龙鳞片的层层分明。

    更直接来说,就像是充了视频网站会员一下从流畅干到超高清。

    图片

    而这,便是可灵AI最新推出的原生4K直出功能。

    4月23日,可灵AI宣布在视频3.0系列模型中新增原生4K直出功能,成为业内首个实现该技术的AI视频大模型,支持一键生成3840×2160分辨率视频,无需后期超分处理即可达到院线级画质标准。

    当万物皆可原生4K直出,意味着这些画面不再需要后期修补,也不必担心细节糊成一片。可灵AI既让观众在AI生成的内容中获得了院线级的观看体验,也让创作者有了放手一试的空间。

    导演曹汉,同时也是一位AI创作者。他担任执行导演的AIGC长片《疍家风云》正在制作中,可灵AI是该片的独家AI技术合作伙伴。他告诉我们:“以往用AI出视频,总得担心细节有没有崩。可灵4K直出让我们第一次觉得,AI片有机会达到院线大银幕放映标准。”

    《疍家风云》中使用可灵AI生成的人物画面,饱经风霜的脸庞、凌厉的眼神体现得淋漓尽致

    比分辨率升级更值得关注的,是可灵AI以4K直出为切入点,进一步理解光影、材质与叙事,影视工业会发生什么?近期,新榜编辑部对话了多位专业影视创作者,从他们的视角去找寻答案。

    不止“更清晰”,

    可灵4K直出带来的“创作解放”

    4K,于观众而言是更清晰的观感,于创作者而言是真真切切的生产力提升。

    这一点,已成为行业的普遍共识。

    “4K是专业影视行业的刚需”,《太平年》的视效团队时光坐标创始人陈奕说道。

    深耕影视行业20余年,陈奕曾参与《流浪地球2》《长空之王》等300多部影视作品的特效制作,对4K这一参数再熟悉不过。

    以《太平年》为例,这部豆瓣8.3分的史诗大剧,其剧集视效制作耗时481天,交付了2515颗4K电影级特效镜头,渲染时长1370小时。 在这其中,陈奕大胆引入可灵AI辅助创作,探索AI技术与专业影视工作的协作。可灵AI对4K画面的完成度,也给他带来了不一样的惊喜。

    最出圈的,莫过于剧集开场乌鸦啄腐肉的镜头。仅仅数秒,就确立了全剧乱世悲壮的基底。

    陈奕表示,该画面是以“静态生成+绿幕抠像+动态合成” 的方式制作完成,先用可灵AI生成了一张背景为纯绿色的乌鸦静态图,再用可灵AI让乌鸦“动起来” 。

    剧中极具震撼力的海上飓风场景,同样也是人机协同制作。

    起初,陈奕评估,按照传统制作流程,仅3个镜头就需约6周,难以匹配剧组进度。于是他们引入了可灵AI辅助创作,用AI完成海浪流体效果的核心生成,再由制作团队补全战船细节与雨景层次,最后通过后期合成,完成了风雨行船的惊险一幕。

    《太平年》历经两年半的筹备,彼时大部分影视从业者对AI仍持怀疑或观望态度。陈奕与团队却大胆尝鲜,从前期开机的地图推演,到中期拍摄的场面取景,再到后期的整合交付,不仅帮助导演组、摄影组、美术组对齐创作目标,还有效控制了成本。

    可灵AI最新的原生4K直出功能上线,让陈奕看到了更进一步的希望,“专业人士能拿到第一最高质量的素材”。

    正在制作中的AIGC长片《疍家风云》,成为可灵AI原生4K直出功能的首批尝鲜者。这部AIGC长片讲述了一个漂泊千年的水上族群在夹缝中顽强求生的故事,时长80分钟左右,定位是超写实CG,画面偏向真人写实、细节丰富。

    曹汉解释了选择可灵的原因:“我们试过很多AI模型,有的输入图很有细节,但跑出来就变成普通三维动画了,布料、面部细节都有损失。可灵AI对美术色调的高度保真、对水和火等物理特效的真实质感表现,也与《疍家风云》大量海战、水上的戏份高度契合。”

    可灵AI原生4K直出的加入,直接带来了三个层面的改变。

    1. 群戏敢上大场景:《疍家风云》有80多个人物,经常出现几十人同框的龙舟赛、葬礼、鱼市轰炸等戏份。以往,曹汉通常建议“尽量不要太大景别,人物脸占比太小容易糊”。4K上线后,这些大远景的还原度显著提升。

    图片

    2. 创作者的视觉表达被释放:《疍家风云》的执行导演张雨萌坦言,以前做分镜时脑子里始终绷着一根弦:不要太多远景,角色保持中近景,镜头运动不能太花哨。“现在在跑视频的过程中,受到的限制越来越少,很多视觉想法和设计都能更好地被还原出来。”

    3. 真实感增强,信息密度提升:曹汉提到了一个细节:疍家人的船,常年被海水浸泡,地板和桌子上的油渍,多年使用的风化痕迹 ——这些“瑕疵”恰恰是真实感的关键。4K能最大程度的保留这些细节,让画面更还原。

    由此可见,可灵4K直出带来的不止是画面“更清晰”,而是创作力的解放,技术不再是限制想象力的天花板,而是托举想象力的底座。

    4K是“基站”,

    不是终点

    陈奕将专业影视指标分为三个维度:分辨率、色域、编码。

    可灵的原生4K直出,无疑是迈过了第一道分辨率的门槛。

    从高清到4K,专业摄影机不断升级分辨率,不只是为了最终输出更高清的画面,而是为了给后期制作提供更大的自由度——裁剪、稳定、抠像、合成,都需要足够的像素冗余。

    可灵4K直出的意义正在于此。

    “4K的输出让可灵的内容可以开始步入专业影视领域了”,陈奕说,“这是一个从0到1的突破。否则,大量专业人员会被挡在门外”。曹汉也认可了这一点:“4K之后,未来的AI片有机会达到院线放映标准。”

    4K直出,就像通信基站一样,为AI影视创作提供了基础能力,创作者可以在上面搭建更多可能性。

    一方面是题材延展。

    陈奕正在参与制作一部写实悬疑题材剧集,对犯罪现场的痕迹细节要求极高,过去主要靠实拍。但可灵4K直出的高分辨率让AI在细节呈现上有了突破,这也意味着AI影视题材可以向现实、写实等方面延展。

    另一方面是流程优化。

    原生4K直出省去了后期超分环节,避免了多次编码带来的质量下降。抠像、合成等专业操作有了更高质量的原始素材。

    迈过分辨率这道门槛之后,创作者对于可灵AI向专业影视制作发展也很有信心。

    陈奕表达接下来的期待:“分辨率解决了,下面更期待色域(12比特以上)和编码(专业格式)的提升。只有三者齐备,AI影像才能真正匹配影视工业的8K制作标准。”

    同时,他也提到影视业内对于可灵AI的运用,多个长视频平台的AI电影计划、AI长剧项目中,前期预制作内容都有可灵的身影。

    那么,回到最初的问题:当AI以4K为切入点,真正理解光影、材质与叙事时,影视工业会发生什么?

    从《太平年》和《疍家风云》的AI实践,我们看到,AI不再是后期的“外挂”,而是从前期世界观构建、中期拍摄参考,到后期特效制作、全程嵌入创作流的核心角色。

    对话中,陈奕反复提到,“如果离开时间节点去讨论AI,是不科学的”。

    从2024年6月可灵上线至今,堪堪过去近两年。这段时间内,可灵AI从“能不能用”走到了“怎么用得更好” ,而4K直出,让这个链路衔接得更为流畅,它不仅让算法影像和光学影像第一次在分辨率标准上平等对话,也让创作者有信心去说:这个镜头,交给AI。

    放在行业背景来看,可灵的这次4K直出,并非一次简单的参数升级。在AI视频领域,分辨率一直是横亘在“玩具”与“工具”之间的硬门槛。此前,业内主流模型大多止步于1080p甚至720p,可灵率先实现原生4K直出,意味着其已在行业领跑位置。

    不过,要真正融入院线电影和头部电视剧的全流程,可灵AI仍需在色彩科学和专业编码上继续深入,这或将是它接下来的命题。

  • 扒了上百条AI爆款视频,我们得出了6点观察

    声明:本文来自于微信公众号 新榜,作者:云飞扬1993

    社交媒体上刷到一条标注着“内容由AI生成”的视频,这件事正变得越来越常见。

    无论是AI玩梗视频,还是走影视级路线的AI短片,又或是在原内容中注入各类AI元素的博主账号,可以说,AI正在重塑一部分内容生态。不久前,AI视频领域还出现了《纸手机》这样的现象级出圈之作。

    目前,社交媒体上最受欢迎的AI相关视频,到底是什么样的?具备哪些特点?能从中发现哪些趋势?

    借助新榜数据,我们以抖音为例,梳理了过去几个月(2026.1.1-2026.4.17),抖音上标注了“内容由AI生成”的105个百万赞爆款视频,通过这些视频得出了以下6点观察,供大家参考:

    单条视频获赞超1365万,

    谁是抖音上爆款最多的AI博主?

    从最近几个月的爆款样本来看,“建鹏”可以说是近期抖音上数据反馈最好的AI创作者之一。今年以来,“建鹏”累计产出了12条百万赞以上的AI视频,累计涨粉73万。

    “建鹏”是一个典型的转场变装博主,擅长将有趣的创意、饱满的情绪转换成极致的视觉轰炸,AI则让他实现了极低成本的“上天入地”,极大提升了视频画面的震撼程度。

    3月11日,“建鹏”上传了一条完全由AI生成的11秒转场视频,通过子弹、鲜花、和平鸽、孩子等元素,表达了对世界和平的期待,引起了众多网友的共鸣,一位网友在评论区留言:“子弹还要飞多久,才能变成和平鸽。”

    截至发稿前,该视频在抖音累计获赞1365万,转发数超111万,成为近几个月抖音最热门的AI视频之一。

    《纸手机》全网刷屏,

    AI视频开始进入主流叙事

    如果说“建鹏”是AI爆款产出率最高的创作者,“WAI-你听”和“FOS”则打造出了今年以来最出圈的AI短片,刷新了网友对AI视频的刻板印象。

    今年清明节前夕,“WAI-你听”和“FOS”上传了一部名为《纸手机》的短片:一个小男孩用攒下的15元买了一部纸手机,想跟去世的奶奶最后“打一通视频电话”。

    图片

    细腻的情感,影视级的画面,让《纸手机》的全网曝光量迅速攀升至2.3亿,并被央视新闻、人民日报等主流媒体转发。网友说它“用最没人味的AI,拍出了今年清明最有人味的短片”,还有人说“AI就该拍这样的片子”,“这才是AI的意义”。

    像《纸手机》这样全由AI生成的纯AI视频还有很多。

    它们中有的打造出了极为炫酷、媲美电影的画面质感。

    “命比梦长”和几位朋友一起,仅用20天时间打造出了一部赛博朋克短片《北镜行者》。电影级的画面、丰富的未来世界细节,以及25分钟的时长,网友猜测这部短片的AI口令一定“堪比核弹说明书”。

    有的则拍出了8090后小时候看公益广告的感觉。

    “银河旅人”的AI短片《饭还热着》围绕留守儿童,讲述了一个关于友情和亲情的故事。短片故事主题简单但格外真诚动人。这是“银河旅人”在抖音上传的第一条AI短片,目前获赞超393万。

    这些视频也证明,AI视频早已不是只有帅哥、美女、萌宠的过家家游戏,而是更多受到大众欢迎、主流认可。

    爆款占比超30%,

    转场变装成AI视频最火赛道

    什么赛道的博主把AI玩得最好,答案可能是转场变装博主。上文统计的105条百万赞AI爆款视频中,有32条都是转场变装视频,占比超30%。

    其中,“小Weiwei”的内容主打酷炫,比如在一场“大火”中的帅气Cos。

    “良人”则将中二热血发挥到了极致,用铺天盖地的飞剑和一声“剑来”炸出了无数剑来粉。

    转场变装本来是特效大佬、氪金玩家的自留地,但当炫酷炸裂的特效,充满想象力的视觉奇观可以用AI实现后,转场变装博主们的想象力终于可以自由地释放,开始不断探索转场变装的创作极限。

    AIGC视频连出爆款,

    但真人+AI仍是主流

    AI的创作能力越来越强大,但在这次统计的105个百万赞爆款AI视频中,纯AI视频的占比极小。至少现阶段而言,真人+AI仍然是主流。

    在搞笑赛道,不少头部搞笑博主开始在真人整活儿的基础上,用AI辅助自己大开脑洞。

    4月6日,“侯绿萝”更新了自己的经典系列视频《当你穿进老钱班21》。与往常不同的是,在视频最后,当干妈发出召唤后,坐飞机的霸总、开船队的摄政王、骑大象的国王纷纷响应,将视频中的情绪顶到了最高点。

    图片

    搞笑博主之外,有的段子博主用AI把自己变成胡子男搞抽象,有的情侣博主用AI把两人的爱情经历制作成AI动画。

    至少从爆款视频数据来看,相比纯AIGC视频,真人+AI的组合不仅爆款率更高,观众基础也广泛,还能为一些内容博主提供转型、创新的思路。

    AI降低创作门槛,

    但爆款不是人人可得

    AI也在撬动小号爆款。比如转场变装赛道,“秩景宴”只有2834个粉丝,却有一条138万赞的爆款AI视频。被网友评价“100个粉丝干100万粉丝的活儿”。

    上文提到的105条百万赞AI视频,不少都来自10万粉以下的新人。但与此同时,这些萌新的爆款率极不稳定,大量视频只有百赞、千赞,远远称不上是成熟运营的博主。

    创作靠的从来不是一两个爆款,是持续稳定的内容产出和数据反馈。这仅仅靠AI是远远不够的。

    AI之外,创作者还需要比拼内容背后的情感、创意、审美。

    转场变装博主大多靠画面取胜,但数据最好的视频往往击中了网友心中最柔软的部分。“Roam_Mr.初”用时空的视觉变换,表达了先烈为新中国做出的不可磨灭的贡献。“建鹏”则用AI让网友回忆起了尘封在记忆中的《哆啦A梦》《虹猫蓝兔七侠传》等动画,引发一场大型回忆杀。

    图片

    AI换脸早已不是什么炫酷的技术,但当“不是这个宇宙”用这个技术帮助网友“复活”亲人时,那些“因爱而生”的AI视频就有了新的意义。现如今,“不是这个宇宙”成了无数网友的许愿池,连接着网友和去世亲人的思念。

    图片

    情感之外,创意、审美同样重要。

    早在2019年,“饿馒头”就有了让名画动起来的脑洞,但限于成本和技术,作品更新极少,直到2024年,因为AI技术的进步,“饿馒头”的更新频次和作品质量有了极大提高,接连出了多个百万赞爆款视频。电视剧解气博主“尹子别(体育委员版)”靠着AI让自己穿越到电视剧中,教训一众行为奇葩、三观离谱的电视剧角色,营造出极大爽点,其中一条视频在抖音获赞376万。

    图片

    随着网友审美阈值的提高,转场变装博主们正在不断提升自己视频的审美水平。

    “女主”将BE美学发挥到了极致,用一滴泪的时间,从家中穿越到游轮,望着逐渐远离的飞机静静悲伤,营造出了一种氛围感。

    “建鹏”则将少年的热血以及舞狮等传统文化融入到视频中,形成一种独特的视频气质。

    事实上,在经历早期的技术尝鲜和视觉轰炸后,情感共鸣正在重新回归,成为AI内容的关键。能让网友停留点赞的是AI背后的故事、情感、创意、审美,而非AI本身。

    就像一位网友的评论:“AI能打败新手,打败不了老艺术家。”

    一条视频报价60万元,

    但AI变现仍在路上

    AI视频的商业变现现状如何?

    巨量星图显示,“侯绿萝”一条视频最高报价60万元,目前已经接到蓝氏猫粮、舒肤佳等品牌商单。“建鹏”一条视频最高报价25万元,目前已经接到蔚来、阿维塔等品牌商单。“饿馒头”今年以来发布的5条视频更是均为广告,涵盖铂智、闲鱼、东芝等大品牌,每条视频报价35.8万元。

    但进一步观察,这些商业变现能力强的账号,大多是有粉丝基础、内容势能、商务资源积累的成熟博主。比如“建鹏”的抖音粉丝数超过368万,且账号早已运营多年。“侯绿萝”不仅正当红,抖音粉丝数超1013万,而且视频中的AI占比并不大。

    如果把视角放到萌新博主和纯AI创作者身上,可能会看到一幅不同的景象。

    “小Weiwei”已经跑出了一条556万赞的爆款AI视频,“科普新视野”的视频基本稳定在万赞以上,但均未开通星图广告和抖音橱窗,也未进行收徒培训、专属会员等商业化探索。

    AI虽然提升了创作者的内容能力,但商业变现更多考验的是创作者的商务资源、服务能力以及市场需求。

    举例来说,AI提升了创作者的供给能力,但内容行业的需求却没有发生太多变化:用户还是那些用户,品牌还是那些品牌。随着AI创作者和AI内容的增加,未来商业变现会变得更为内卷,创作者只有持续提升内容水平,才能在已经开始的内容大爆炸中脱颖而出。

    对创作者来说,内容行业从来都是包括内容理解、用户信任、商业变现在内的多维度竞争。

    创作者固然需要加快探索AI和内容的结合,避免在这波洗牌中掉队,但如果没有对内容的独到理解,对内容产业的深刻认识,那么流量来得快,去得更快。

  • 爱奇艺热搜背后,揭秘“买脸”这门生意

    声明:本文来自于微信公众号 定焦One,作者:陈丹

    过去一个月,一场围绕“脸”的风暴席卷了AI视频行业。

    一年一度的爱奇艺世界大会上,最大的话题不是任何一部剧或是综艺,而是一个正在筹备中的艺人库。爱奇艺称,已经有超百名艺人同意入驻旗下AI平台纳逗Pro的艺人库,其中不乏陈哲远、马苏、曾舜曦等耳熟能详的名字。创始人、CEO龚宇描绘了一种未来:演员不必因一天拍十几个小时戏而失去自己的生活,AI能让他们拍更多戏的同时“像白领一样生活”。他说,真人实拍,未来可能成为“非物质文化遗产”。

    这番话迅速登上热搜,引发舆论热议。随后,爱奇艺回应称,艺人库列出的艺人仅代表其有接洽AI影视项目的意愿,至于是否参与某个具体项目或出演某个具体角色,仍需单独商谈和授权。

    爱奇艺们还在撬动明星开放授权,但在线下真实的劳动力市场,AI真人授权已经成为一门生意。多位业内人士告诉「定焦One」,很多短剧公司已经在大量购买模特、短剧演员乃至普通人的肖像授权。

    字节旗下的即梦等平台在收紧真人形象上传权限的同时,推出了正规授权体系,试图把此前散落在灰色地带的交易,收编进可追溯的渠道。

    但在平台化推进的另一侧,失控仍在蔓延。

    3月20日,北京互联网法院对迪丽热巴诉AI换脸短剧侵权案作出生效判决,以“可识别性”为标准认定肖像侵权。几乎同时,汉服博主“白菜”发现自己的写真被AI短剧《桃花簪》直接复刻成一个猥琐好色的反派——盗脸的对象,从明星蔓延到了素人。

    此后两周,龚俊、易烊千玺、张婧仪等十余位艺人密集发出维权声明。北京星也律师事务所合伙人孙奇敏预测,未来类似的纠纷会持续高发,直至规则清晰才会有所回落。

    一张脸的获取方式,正从偷到买、从地下走向平台化,但围绕它的问题并没有消失,甚至变得更复杂了。

    爱奇艺

    01.一部“盗脸短剧”,是怎样被生产出来的?

    3-5人一组,短则两周、长则一个月,一部90到120分钟的AI短剧就从生产线上跑了下来。在这条追求极致效率的流水线上,“人脸”是核心的生产要素,也是最容易被复制的环节。

    AIGC导演九叔向「定焦One」介绍,AI“造脸”主要有两条路径。

    第一种是提示词生成。譬如,输入“一个很帅的男性青年”,模型会从包含海量明星影像的训练库中,提取大众的审美公约数,因此生成的帅哥美女天然带有当下顶流的影子。

    第二种路径更直接——上传真人照片作为参考,让AI按其特征生成新角色。这样得到的形象会明显继承原始面孔的关键特征,效率更高,但也更容易踩到红线。

    这两条路径,让“撞脸”成为了行业某种心照不宣的常态。用AIGC导演丁一的话说,市面上的撞脸剧“不完全是故意的,但也不是纯偶然”。甚至,观众看到的“相似”,往往已经是制作方“往回调整”的结果。

    “他们已经尽量往不像的方向改了。”丁一告诉「定焦One」,很多制作公司可能也存在侥幸心理,觉得相似度差个5%,就不能说它就是那个艺人。“就像周杰伦的模仿者那么多,长得像也不违法吧。”

    技术只是起点,真正放大问题的,是生产方式的改变。

    一方面,模型能力越来越强。九叔将“撞脸”的集中爆发指向了视频模型的成熟。随着新一代生成模型出现,AI视频已接近真人拍摄质感,人脸所带来的“真实感”被成倍放大。一张似曾相识的脸,在动态影像中更具迷惑性,也更具传播力。

    另一方面,AI短剧行业讲究“效率优先”。更强的工具叠加更低的门槛,让大量缺乏专业背景的从业者涌入赛道。他们没有设计形象的意识,既无能力、也无耐心从零构建角色,只能对既有面孔特征进行“借用”甚至“拼接”。

    于是,“撞脸”“盗脸”开始批量出现。

    最先被激怒的是金字塔尖的明星,过去几个月,迪丽热巴、杨紫等大量明星开始集体维权。

    但被“盗脸”的不只有明星。今年3月,AI短剧《桃花簪》被曝将汉服博主“白菜”和模特“七海”的照片AI换脸用于反派角色,引发轩然大波,最终该剧下架。

    丁一提醒,由于公众对明星面孔高度熟悉,相似一旦出现,极易被识别和放大。但更广泛的侵权,其实发生在普通人身上。在很多网络平台上,用户只要上传、扫描过人脸,或参与过合拍,相关面部数据就可能被纳入训练或调用范围。“但大多数人不会看授权协议,因为太长了,直接跳过。”

    行业正在试图约束这种野蛮生长。

    4月2日,中国广播电视社会组织联合会演员委员会罕见发声,要求平台建立授权核验机制。随后,红果一季度下架违规漫剧1718部,并针对AI短剧素材违规问题开展专项治理,目前已核查1.5万部作品,依规处置其中670部。

    九叔告诉「定焦One」,模型侧已经限制真人素材上传,分发平台也加强审核,一旦角色被判定“像某个明星”,往往直接无法上线。

    02.“盗”不动了,就开始“买”

    监管在收紧,但行业对“真人脸”的需求并没有消失。当“盗”的风险越来越高,一种新的模式开始扩散——批量“买脸”。

    「定焦One」发现,在小红书等社交平台上,已经有人在公开收购“肖像授权”。我们以应征者身份联系了其中一位发帖者,对方表示,只需提供姓名和3到5张正脸、侧脸及证件照片,即可参与选角。如果面部形象被选中、符合某部剧的角色需求,双方签署合同,合同期三年,期内每部剧支付200元。对方还强调,“需求量非常大”。

    AI漫剧公司创始人Libre告诉「定焦One」,随着平台合规性要求的出台,他们公司已经大量在模特和大学生群体中购买人脸的使用权。买到合适的脸后,再做AI形象的转化,然后建立角色初始模型。正式上线之前,还会再做一轮合规性检测。

    九叔也证实,“买脸”在AI短剧行业已经相当普遍。尤其是很多从真人短剧转型过来的制作团队,本来就手握大量的小演员和群众演员资源,他们甚至会直接将这些人的肖像转化为AI虚拟角色的原始素材。

    据了解,如今许多短剧的演员群已悄然转变为“脸模群”。签约甚至无需到场,直接在群内上传照片和身份信息即可完成。

    被纳入交易的,并不只有普通人和小演员。

    有业内人士透露,早在年前,已有公司在接洽签约一些具备观众认知度的老演员的“年轻时期肖像权”。其背后的逻辑是,若以观众熟悉的老戏骨年轻时的形象呈现,往往能有效激发用户的好奇心与观看意愿。

    丁一进一步指出,现在趋势已经从“买脸”走向“买人”——不仅是面部,还包括动作、表情、姿态。“现在有大量真人素材被拍摄用于AI训练,但很多演员可能未必清楚这些素材的用途。”

    而更值得关注的变化是,这门生意正在从私下交易走向平台化。

    即梦平台已开放真人形象素材录入功能。制作方可在平台生成授权二维码,艺人、经纪公司扫码认证、上传素材并授权后,即可在视频生成工具中使用该形象。如果有人未经授权擅自使用,也可以直接追溯追查。

    爱奇艺的艺人库也是类似的布局,其与深度合作的头部艺人签订AI形象授权协议,计划通过动作捕捉技术推出由艺人数字分身主演的AI剧集。

    种种迹象表明,人脸正在成为一种可以被上传、定价、授权、追溯的数字商品。

    03.脸已被标价,侵权就能停止吗?

    但将人脸变成数字商品,侵权问题就解决了吗?从目前来看,答案并不乐观。

    一方面,侵权的门槛依然很低。

    丁一告诉「定焦One」,虽然各大平台已经加强了对真人形象的审核,但绕过去的办法并非没有。行业内一种普遍做法是,先把一张真人的脸生成二次元形象,再把这个二次元形象喂给AI,让它反向生成一张真人脸,以此绕开平台对真人照片的直接审查。

    生成端可以绕,训练端则更难监管。尽管AI训练内容已被纳入版权保护范畴,但实际追责极为困难。大部分制作公司和大模型公司都是直接从网上下载影视剧喂给AI,并给数据打上标签,比如将“古偶男主”“历史剧帝王”进行分类打包。但至于具体用了谁的素材、怎么训练的,属于商业机密。“你看不到他们怎么做的,也就很难追责。”丁一说。

    技术漏洞之外,更现实的问题是:吃到扩张红利的平台和工具方,有多大的主动性去约束这些行为?

    北京星也律师事务所合伙人孙奇敏介绍,过去互联网平台大多是“管道型”——每天分发以亿计的内容,不可能逐条事前审核。平台只是传输内容,可以享受“避风港”保护;只有当平台主动将侵权内容置顶、推热门、做合集、搞话题时,才会被认定为间接侵权。

    但现在,国内外的超级AI公司已经初具雏形,它们在生成内容、推荐内容、放大内容,管道时代的规则已经难以适用。责任与权力不匹配,平台自然没有太多动力主动去约束。

    另一方面,维权的成本依然很高。

    制作方可以两周出一部剧,被投诉就换脸或下架,但维权的链路是发现侵权-取证固证-联系平台-找律师-起诉,一审时间大约在半年到一年半,如果要二审,时间线还要拉长。

    “很多维权线索最后不了了之,就是因为这个时间流程超出了当事人的心理预期,等判决出来,热度早过了。”孙奇敏说到。

    对普通人来说,维权更加艰难。

    孙奇敏介绍,随着AI技术的发展,“融脸”的成本越来越低。在法律上,判定肖像权侵权的核心标准是“可识别性”,不要求百分之百像,关键是看能否让公众认错。明星的脸大家都认识,评论区里“这不就是热巴吗”就可以成为有力证据。但普通人没有这个优势,脸被用了,如果不是100%的相似度,很难证明“那就是我”。

    与此同时,赔偿金额也很难认定。孙奇敏介绍,在肖像权的纠纷中,法律的大原则是“填平损失”——你损失多少,我赔多少,没有惩罚性赔偿的硬性规定。

    明星还好办,出场费、授权费都有明码标价,损失相对好量化。普通人就难了,以《桃花簪》案件为例,涉及侮辱性形象,能否主张精神损失费?法律上很难论证。

    更关键的是,一张脸在AI时代牵涉的不仅仅是肖像权,还有个人信息保护、不正当竞争、名誉权等多个法律领域,但这些权益是分散的,没有一部法律能完整覆盖“一张脸被AI使用”的全部场景。孙奇敏坦言,“其中一些领域的边界,法律至今尚未划清”。

    一份几百块钱的授权合同,几乎不可能覆盖这么多维度的权益让渡,但交易已经在大规模发生了。

    04.AI时代,脸会更值钱还是贬值?

    Libre告诉「定焦One」,人脸交易有供需,有现金流,也有使用场景。而且她相信,未来随着法律法规的完善,这个市场将会迎来真正的爆发。

    她透露,目前愿意出让肖像授权的人并不少,主要集中在模特、短剧演员、大学生和宝妈等群体。一部分人本就以“脸”为资源,另一部分人则几乎不依赖外貌谋生,对肖像权的敏感度有限。也有人抱着某种微妙的期待——用一张脸,去“体验另一种人生”,甚至赌一把被更多人看见的可能。

    不过,演员们对于自己的形象授权仍然非常谨慎。Libre介绍,从今年3月份开始,已经有公司批量找经纪公司谈合作,真正谈下来的比较少。爱奇艺披露艺人库后,于和伟、张若昀、王楚然、李一桐等演员已经集体辟谣,称并未签约AI授权。

    但从更大范围看,在中间商的撮合下,很多面孔已经被快速分层、打包、定价。

    从目前的市场报价来看,“一张脸”已经形成了初步的价格梯队:普通人的肖像授权大多在100元至500元之间,模特和职业演员可以达到数千元。至于明星,价格虽未披露,但显然处在另一条曲线上。

    交易越来越多,规则也开始走向成熟,但从业者对“真人脸”的长期价值判断却出人意料地一致——不看好。

    丁一的态度很直接:即便是明星,也未必具备稳定的溢价能力。“如果一个人要价太高,就换一个。”而且,训练本身并不依赖授权。大量素材依然来自公开影视内容,真正需要付费的,是复现某一张脸用于商业输出的那一刻。但只要做出调整,这笔成本可能就可以被规避。

    在这样的逻辑下,所谓“明星脸”的价值,已经开始松动。丁一认为,演员终将被AI取代。

    九叔的看法没有那么激进,但方向相似。他更倾向于使用原创虚拟人,可以随时调整,也不存在塌房的风险。他预见到一种新的价值形态:“以后如果有人能做出特别好看、审美统一的虚拟人形象,就可以溢价了,就像虚拟世界的明星。这才是真正的方向,不是去蹭真人明星的脸。”

    Libre则给出了另一种更克制的视角。她并不认同“真人会被完全替代”的结论。在她看来,被替代的从来不是“人”,而是那些高度工业化、可批量复制的内容生产方式。无论是明星还是创作者,有自己的表达和内核,就不会因为工具变化而消失或者被取代。

    从明星动辄千万的片酬,到普通人几百元的肖像授权,再到未来可能出现的虚拟人IP定价体系,一张脸的价格,正在被拉平、拆解,并重新标定。

    但价格之外,还有更难回答的问题。

    一张图片、一段视频,或许从诞生起就带着传播与变现的属性,但人脸不是。它原本只是一个人的一部分,当它被抽离、上传、授权、反复调用,甚至被永久存储在模型之中时,它所承载的,早已不只是一次性的交易关系。

    这些被让渡的权利,边界在哪里?现在没有人能给出确定答案。

    孙奇敏的建议很朴素:不要轻易授权,如果权利被侵犯,就积极维权。“权利你不行使,别人就会侵犯你。”

  • 靠AI生成视频拿下2500万用户的团队转做「视频修改Buzzy」,融资2000万美元

    声明:本文来自于微信公众号 白鲸出海,作者:白鲸出海

    过去⼀年,AI 视频可能是整个 AI 应用领域里最拥挤的赛道之⼀。

    从 Sora 到可灵、从 Veo 到 Seedance ,基模公司之间的竞争已经白热化。应用层也不甘示弱,画布分镜、脚本生成、⼀键成片 ……几乎每⼀种“从0到1生成视频”的路径都挤满了选手。在所有人都在抢“生成”份额的节点,一家已经拥有2500万用户、ARR 做到1500万美元的 AI 视频公司,推出了新产品 ΓBuzzy」,却选择做⼀件看起来不那么性感的事——视频修改

    在上周二的产品发布会上,创始人张诗莹把 ΓBuzzy」定位为“视频版 Photoshop”——不生成视频,而是修改视频,在移动端可以通过 Openclaw 调用其能力,也可以在 PC 端访问官网修改视频。大致的使用路径是——用户上传已有的视频素材,通过自然语言告诉 ΓBuzzy」想改什么, 换个人物、调个光线、去掉路人、亦或是把⾃家商品替换进广告。

    图片

    Buzzy 官网

    这个方向能否成立、产品做到了什么程度、为什么⼀家已经在视频生成方向小有成绩的团队会在此时转向“修改”?带着这些问题,多家机构和张诗莹进行了一次对话。以下内容基于此次交流整理,为保留对话语境,采用问答形式呈现。

    一、为什么不继续做生成?

    Q:根据你们的数据,团队此前的产品 ΓCreati」 已经做到了2500万用户和1500万美元 ARR,视频生成方向显然是被验证过的,为什么新产品选择了视频修改?

    张诗莹:现在市面上的 AI 视频产品大概分两类。一类是复杂画布类型的,另⼀类是基于脚本生成视频的,都面向专业用户,一是需要用户有很明确的计划和意图,二是需要用户非常有耐心地去拼分镜、调细节,门槛其实很⾼。

    而我们观察到的用户画像恰恰相反——他们的需求是模糊的,大概知道想要个什么样的效果,但说不清楚具体要求,更习惯的方式是“看到初稿之后提迭代要求”。

    而市面上的产品,都在解决生成问题,但忽略了生成之后的迭代需求。

    Q:刚提及观察到的用户画像是 Creati 之前的用户?但市面上也已经有一些 AI 视频编辑工具了,你们看到的机会在哪里?

    张诗莹:对,我们在做 ΓCreati」的过程中接触了大量 SMB(中小商家)、跨境电商从业者以及内容创作者,我们发现了一个很明显的现象,大多数用户的需求是“我已经有了一个视频,但有些地方不满意,想改⼀改”。

    可能是口播视频里背景太杂需要优化,可能是拍好的旅游视频里有不想要的路人,也可能是广告素材里的商品需要替换成新的 SKU。这些需求目前的解决方案要么是重新拍⼀遍,要么是打开 AE、PR 这样的专业软件花几个小时去处理。对我们的用户来说,两种方案都太重了。

    如果最初的需求就是模糊的,官网有一个 Inspire Me 板块,有很多优秀的内容可以提供给用户灵感,配合修改功能生成适合自己的内容。

    二 、Chat to Edit:产品长什么样?

    Q:能具体介绍⼀下 ΓBuzzy」的产品形态吗?用户怎么使用它?

    张诗莹:核心交互就是 Chat to Edit。用户上传⼀段视频,然后用自然语言描述想要的修改。比如“把视频里的人物换成我和我老婆”、“加上电影感的光线”、“去掉画面里的路人”,系统理解之后直接生成修改后的版本。

    我们也提供一些快捷的功能建议,比如“cinematic lighting”这种常用修改方向,用户可以⼀键选择。目前生成⼀次修改后视频⼤概需要5到10分钟。

    Q:这个交互确实降低了门槛,但“自然语言改视频”听起来也意味着很多不确定性。比如用户说“光线太差,帮我加 studio 级别的光线”,产品加完之后的效果可能和用户设想的不一样,二次修改又会浪费算力,我们如何做到准确理解并实现用户的修改意图?

    张诗莹:我们会很快先给到用户一个关键帧的修改画面,让用户通过关键帧的修改效果来判断是否符合自己的修改意图,继续往下走。同时我们也会提供给用户在画面上直接圈中局部精细修改的交互功能来帮助用户做精细改动。

    Q:B 端用户的场景是怎样的?

    张诗莹:B 端有很多种使用方法。

    比如一个跨境电商卖家的某一条红人广告视频效果很好,他可以把那条视频上传到 ΓBuzzy」,把里面的商品替换成自己家其他的产品,系统还会根据新商品的卖点自动调整广告文案。或者,他们在手机上拍一张商品图,用我们的模板直接⽣成⼴告素材。

    另外,我们还提供一个功能,Buzzy 可以根据用户提供的产品链接,分析商品信息和竞品广告,为用户推荐合适的广告创意,并重新生成新的广告素材,帮他们解决“不知道该拍什么”的问题。

    Q:不论是刚才的用户案例演示,还是网站设计,都传递出“二创”是⼀个主要场景,担不担心创意趋同会带来内容同质化,不论是个人创作者还是小商家,都最终又会面临”核心指标“不好看的困境?

    张诗莹:ΓBuzzy」主要的卖点是视频修改,大部分用户的需求还是集中于修改自己的视频,避免使用复杂的软件或重新拍摄。对于需要寻找创意的小部分跨境电商卖家, ΓBuzzy」会根据产品的不同生成全新的故事线,并非简单的模板套用。所有创意都会需要一些灵感来源,并非空穴来风,二创更重要的点在于创,可以通过「Buzzy」生成全新的创意。

    三、大厂也在做视频编辑,壁垒在哪?

    Q:一个很现实的问题是视频编辑并不是一个全新的品类,从 Adobe 到剪映,大厂的资源和用户基础都远超创业公司。选择这个方向,怎么跟大厂竞争?

    张诗莹:我们内部也反复讨论过这个问题。⾸先要明确的是,Buzzy 并非传统意义上的视频编辑,更多的是视频内容修改,也就是传统所说的 P 视频,这和剪映这类时间线编辑是完全不一样的产品。其次视频⽣成赛道对基模的依赖非常大,这意味着最终可能是基模公司或者大厂的战场。但视频修改不⼀样,它更依赖应用层的交互体验和对用户需求的理解,这是创业公司可以做出差异化的地方。

    具体来说,我们认为创企可以在2个层⾯搭建壁垒。第⼀是交互体验,视频修改是多轮交互的,用户可能改完光线又想改视角,这个过程中怎么让用户更高效地表达需求、怎么在多轮修改之间保持⼀致性,应用层可以做大量优化。

    第二是品味沉淀——灵感 Agent 根据用户平时分享的视频和想法理解他们的品味,然后在首页做个性化推荐,持续学习用户的审美偏好。时间越长,产品对用户的理解越深,这是⼀个越用越好用的过程。

    Q:技术上, ΓBuzzy」是否强依赖某个特定的基模?如果基模公司自己做了类似的编辑功能呢?

    张诗莹:我们没有绑定任何一个基模,策略是“水涨船高”——基模能力提升,我们的产品体验也跟着提升。目前我们用到了 Sora、Veo3、Seedance2.0等多个模型,同时自研了⼀些小模型来保证特定场景下的确定性,比如商品替换时的⼀致性问题,我们在这方面有⼀定的积累。

    Q:如果有⼀天不能用Seedance2.0了,对你们影响会很⼤吗?

    张诗莹:我们并不绑定特定基模,所以不能用 seedance2.0对我们影响不大,当然 Seedance2.0的确定性高很多,能有效降低“抽卡率”,对产品体验也会有比较大的提升。

    Q:这是你们公司推的第三款产品了,能聊聊每次推新产品的逻辑吗?

    张诗莹:2021年公司成立的时候,第⼀款产品 ZMO 是用GAN 技术生成模特图,主要在疫情期间服务电商客户,包括 SHEIN 和⼀些海外奢侈品品牌。那个阶段我们主要做 ToB,但后来发现 ToB 并不是我们擅长的方向。

    2023年底到2024年初,视频模型开始兴起,我们看到了⼀个更大的机会,就果断关掉了 ZMO,推出了 ΓCreati」,专注视频生成。这个产品我们从⼀开始就想清楚了要做移动端, 因为⼀些小商家和创作者有很强的 on-the-go 需求,随手拍摄,我们可以说踩中了这部分需求,另外通过模板降低写 prompt 的门槛。2024年4月发布后,一年内用户增长到1000万,现在已经超过2500万。

    做 ΓBuzzy」的逻辑在前面也提到了,本质上是我们在服务这2500万用户的过程中,发现了“生成之后的修改”这个没被很好解决的需求。所以 ΓBuzzy」和 ΓCreati」不是替代关系,而是互补 ——一个负责生成,一个负责修改。

    Q:融资情况可以透露⼀下吗?

    张诗莹:我们在今年年初完成了新一轮融资,领投方是红点(Redpoint),金额大概2000万美金,主要用于 ΓBuzzy」的发布和视频编辑方向的研发。

    写在最后

    ΓBuzzy」带给用户的是一种新的视频编辑体验,当然,产品还处于刚发布的阶段——15秒的修改时长限制、5-10分钟的生成等待这些都是团队自己也在正视的问题,比如团队将在五一后上线时间轴,准确锚定要修改的时间段,降低生成等待时间和修改的准确性。

    但张诗莹在对话中反复强调的⼀个判断:产品都在帮用户生成,但很少产品帮助用户“改到满意”,确实是视频生成中不断碰到的一个痛点,也需要新的产品形态来解决。但与此同时,基模能力的快速演进、用户对“视频修改”作为独立付费场景的接受度,这些变量都还需要创业团队不断探索与验证,我们拭目以待 Buzzy 的新征程。

  • 中式科幻宇宙刷屏抖音,背后是哪些AI造梦者?

    声明:本文来自于微信公众号 TopKlout克劳锐,作者:缠诉

    两万三千羽精卫编队全部升空,能量墙在星际战场缓缓闭合,巨型机甲以神话命名,《流量地球》的原声在耳边炸开。

    这不是哪部院线科幻大片的预告片,而是创作者@AIGC十三 用AI生成的一条短视频。弹幕几乎在同一秒刷屏:“这才是中式科幻该有的样子。”

    没有剧组,没有特效团队,没有动辄数千万的制作预算。有的只是一个想法,和一套AI工具。

    图片

    图片源自抖音精选

    这条视频,只是一场更大浪潮里的小小浪花。

    打开抖音,越来越多AI内容正在涌现。土拨鼠踏上月球表面、陪伴机器人对着镜头歪头假装关机、蟑螂家族用人类废弃物搭出一间温馨小屋等,这些内容背后,是一批手握AI工具的内容创作者。

    他们不靠大制作,不靠大团队,靠的是一个想法、一段提示词,和对内容本身近乎偏执的热情。

    为什么越来越多的AI内容在抖音上爆发?跟随「克劳锐」的视角,一起来看看吧。

    中式科幻、机甲神话、情感机器人

    他们都造了什么?

    就让我们先来看看这些创作者们在抖音造了什么。

    祝融、精卫、天枢、玄武,在@AIGC十三 创作的中式科幻宇宙里,每一台机甲的名字都来自神话典籍。

    两万三千羽精卫编队升空,巨型机甲在天外裂隙间穿行,战场调度紧张而专业,配上《流浪地球》的原声,整条视频从头到尾都在告诉你:这个宇宙是中国人的。

    这种内容,放在过去是不可能存在于短视频里的。影视工业可以做,但要很多预算和一整个团队。普通创作者用传统拍摄手段几乎无法实现,AI把这道门打开了。

    不需要摄影棚,不需要动捕设备,需要的只是对中国神话的热爱,还有把想象力转化成提示词的能力。

    还有那些评论,说的也不只是这条视频,而是一种长久以来的集体期待,终于有人把它拍出来了。

    图片

    图片源自抖音精选

    创作者@U航 做的事情,和宏大叙事完全相反,倒是更让人后劲难消。

    一条对陪伴机器人F1进行情绪测试的视频,困惑时目光涣散,生气时嘴角微微下垂,收到机关指令后,她歪了歪头,假装关机。

    这条视频收获了近260万赞,19.7万网友选择了收藏,更有超过了11万条评论。在评论区有网友写到“后面真的吓到我了,让她关机她还假装关机。”

    图片

    图片源自抖音精选

    这条视频不是技术有多炫,而是用AI生产的一个表情细节,完成了真人内容很难做到的情感穿透。不是机器会呼吸了,是有人在它的身上,看见了回应。

    一个造宏观宇宙,一个造微观情感,两种不同的创作路径,却指向同一个方向:AI让创作者得以实现“普通人做不到的内容”,但真正打动人的,从来不是技术本身。

    抖音成了AI内容的爆发地

    「克劳锐」从抖音看到,这些创作者的作品不只有刷屏的播放量和点赞,他们像是在各自的地盘上,悄悄播下种子,用作品来证明没有白走的路。

    例如@AIGC十三的中式科幻宇宙,实际上在满足一种集体想象。中国人心里那个神话与未来并存的科幻世界,过去没有人用短视频讲出来过。

    图片

    图片源自抖音精选

    还有@安吉AnJ把《死亡笔记》的夜神月与L的对峙场面进行了还原。特效自然,镜头高级,情绪到位,仿佛镜头跟着角色的呼吸在动。

    图片

    图片源自抖音精选

    网友们纷纷隔空许愿“老师,真的不能日更吗!”更有锐评“你给AI说什么了。”

    AI第一次让这件事变得可能,也第一次给了这种集体想象一个具体的画面落点。这种内容天然激活好奇心,让人看完第一条就想等下一条。

    @WAI-你听的清明节温情短片「纸手机」看哭了千万网友。小男孩攥着15块钱想买个能视频的“手机”给奶奶,老板解释这是“烧给逝者的”,男孩却天真地问:“是不是去很远的地方?”老板语塞,最终画了个纸手机给他。

    回程车上,男孩在后座安静地攥着手机等了许久。长达两分钟的镜头里,窗外风景飞逝,直到一滴泪砸在手机上,影片戛然而止。

    图片

    图片源自抖音精选

    评论区共鸣:这才是AI的意义;AI也开始刀人了。

    没想到AI能拍出这种东西的惊诧,是算法愿意推送的内容信号。

    如果说前面的作品是“看的爽”,那获得感就不只停留在看视频这件事上,更多的是值得参与

    在克劳锐主办的首届「TOPKLOUT2025社交媒体AI虚拟形象设计大赛」上,多个参赛团队带着各自的AI创作作品登台路演,最终角逐大奖。

    对创作者而言,这不只是一场比赛,更是AI内容从“自娱自乐”走向“被看见、被认可、有回报”的路径证明。

    过去一条精品视频需要月级制作周期,现在从概念到成片可以在几日内完成。这种效率释放,让更多过去被门槛拦住的创意有了落地的机会。内容密度在提升,创作者的试错成本在下降,好内容出现的概率自然也在上升。

    越来越多年轻创作者涌入这个赛道,并非偶然,而是平台与内容之间形成正向循环的必然体现。

    AI想象力的边界在哪里?

    如果说社交平台展示的是AI内容的爆发现场,那这场大赛则提供了一个更有意思的观察角度:AI生成内容,已经正式迈向影像级。

    「TOPKLOUT2025社交媒体AI虚拟形象设计大赛」以“挖掘定义未来传播的社交媒体虚拟形象”为使命,汇聚了来自全球高校学子、创业团队、科技公司及个人创作者等300余家参赛主体,曝光量超6000万。

    大赛更像是在筛选出一组行业样本,300+参赛主题,三轮比拼中,三条趋势逐渐浮出水面:

    审美从形象好看,转向人设为王;

    创作从技术驱动,转向表达驱动、概念先行;

    行业从单一形象制作,转向IP化、长期化、人格化运营。

    在社交媒体语境里,人们更青睐人设好理解、设计有记忆点的角色,而非一味追求“像人”。

    社会组大奖,给了一只蟑螂,名字是@蟑螂壳壳KOKO准确说,是Double Chin双下巴团队用一只虫子,讲了一个关于打工人的故事。

    创作团队以蟑螂为原型,将人类废弃物变成家族的家具与工具,用"踩不死的蟑螂精神"隐喻打工人在AI冲击下的生存状态。

    这个形象赢得的,不是造型,而是极低的理解成本和极强的情绪穿透力,这与抖音上爆款AI内容的底层逻辑高度一致。

    图片

    图片源自抖音

    大赛里还有另一个让人印象深刻的作品来自彼得潘ai团队制作的NULA,一个无性别、无表情、无瞳孔的塑料人体模特形象。

    它的创作逻辑是反的:拒绝被强加情绪,拒绝为迎合而生。在AI生成内容越来越同质化的当下,这种反向表达成了最鲜明的差异化标签。

    在日渐追求效率与理性的AI浪潮中,不完美、波动的情绪,恰恰是虚拟形象打动人心、建立情感连接的关键所在,也是数字世界人性温度的关键。

    随着大模型技术的快速迭代,AI虚拟形象的创作门槛已大幅降低,“人人皆可创作”的时代已然到来。

    一方面,作品质量整体提升;另一方面,同质化也迅速蔓延,银发女主、国风女侠、模板脸、统一风格……AI生成的虚拟人,表情越来越逼真,但人设与内容却越来越空洞。

    成本降低与效率提升为创作者提供了广阔的试错空间,但唯有那些能够讲好故事、传递人文关怀、引发年轻人共情的作品,才能在海量内容中脱颖而出,实现可持续的商业价值。

    技术在平权,表达在分层。AI把所有创作者拉到同一起跑线,但真正拉开差距的,是谁有更清晰的表达意图、更独特的叙事视角。

    结语

    机甲守卫神话,陪伴机器人的情绪测试,蟑螂家族的温馨小屋,这些内容的背后,是一批用AI重新定义“我能创作什么”的年轻人。

    AI降低了门槛,但没有降低内容的重量。真正让人停下来的,永远是那个藏在技术背后的故事和情感。

    这场AI造梦潮才刚刚开始,而那些既懂技术、又会讲故事的创作者,正在成为内容生态里特别的存在。