行业动态
Pocket FM 自研 AI 模型把音频制作提速 80 倍,年化收入冲至 5 亿美元
音频流媒体平台 Pocket FM 借助自研写作与 TTS 模型,将内容生产周期压缩约 80 倍、成本降至原来 1/80…
2026.09.11 · 周五约 2 分钟阅读
音频流媒体平台 Pocket FM 近日披露,借助自研的写作与 TTS 模型,公司在约一年时间内将年化收入运行率(ARR)翻倍至 5 亿美元。这一数据来自 TestingCatalog 在 X 上转述的 Pocket FM 官方信息,展示了生成式 AI 在音频内容工业化生产中的实际经济价值。
AI 把音频生产从「年」压缩到「天」
据 Pocket FM 介绍,过去制作 100 小时的音频内容通常需要近一年的时间,而在新的 AI 流程下,同样的体量可在一天内完成,整体生产成本下降至原来的约 1/80,相当于提速 80 倍。公司强调,AI 主要承担写作与配音环节的执行工作,创意与故事构思仍由人类团队把控,并非完全替代。
- 生产周期:100 小时音频从近 1 年缩短至约 1 天
- 生产成本:降至原来的约 1/80
- 技术路线:自研写作模型 + 自研 TTS 模型
拓展微短剧:上线 Pocket Saga
在主力音频业务之外,Pocket FM 还推出了全 AI 制作的微短剧应用 Pocket Saga。据披露,该产品当前已实现约 1500 万美元的年化收入运行率(ARR),被视为公司将 AI 内容流水线复用到视频形态的初步验证。
资本层面同步跟进
业绩增长之外,Pocket FM 据传正在洽谈一轮约 1 亿至 1.2 亿美元的融资,对应估值约 20 亿美元。如果交易完成,将进一步为公司在 AIGC 内容生产线上的扩张提供资金支持。
案例意义与边界
Pocket FM 的数据为「生成式 AI 能否在内容产业兑现成本与规模红利」提供了一个有数字支撑的样本:自研写作与 TTS 模型,配合人类创意把关,使音频内容的边际成本显著下降,并支撑新业务线快速放量。需要注意的是,相关收入与融资数字来自公司自述及社交媒体转述,尚未见到独立审计或一级市场正式公告,读者在引用时仍应留意信息源限制。
