Google DeepMind 据称推出 Gemini Omni 1.1 Flash 视频生成模型
Google DeepMind 在 X 宣布推出生成式视频模型 Gemini Omni 1.1 Flash,主打高可控性…
Google DeepMind 在 X 平台发布消息称,正在推出名为 Gemini Omni 1.1 Flash 的生成式视频模型,主打更高的可控性和更快的迭代速度。然而需要指出的是,原始公告文本因截断未能看到完整表述,且围绕该消息的具体展示与试用入口主要由 AI 视频公司 Pika 的官方 X 账号发出,传播路径较为特殊。
模型命名与定位存疑
根据 Google DeepMind 放出的简短消息,Gemini Omni 1.1 Flash 定位为面向生成式视频场景的快速版本,强调让视频生成「highly controllable」。但这一命名与 Google 此前已公开的 Gemini 系列(1.0 / 1.5 / 2.0 / 2.5,配以 Flash、Pro、Ultra 等变体)以及独立的 Veo 视频生成模型之间的产品体系关系并不清晰,Google DeepMind 方面也未同步公布模型参数、训练数据、技术架构或独立 API 等细节。
Pika 展示的对比样片
在多条 Pika 官方推文中,使用同一提示词将 Gemini Omni 1.1 Flash 与字节跳动的 Seedance 2.5、阿里巴巴的 Wan 3.0 进行了横向对比,覆盖以下场景:
- 产品开箱(cozy unboxing):三种模型对同一产品拆封瞬间各有不同呈现。
- 香水广告微距特写:Pika 声称该模型在单次生成中完成了较稳定的折射光效果。
- UGC 风格自拍:模拟「小商品 haul」的自拍视角,三家模型表现各异。
上述样片均为 Pika 自行发布的演示物料,并非独立第三方评测。
试用入口
目前 Gemini Omni 1.1 Flash 的可用渠道主要指向 Pika 的 API Club,相关链接在 Pika 的多条推文中反复出现。Google DeepMind 本身尚未公布独立的定价、调用方式或开发者文档。
综合判断
综合现有信息看,消息来源单一(一条被截断的 Google DeepMind 推文 + 多条 Pika 商业推广推文),缺乏官方博客、论文或一线媒体的独立确认,技术细节几乎为零。在更多一手信息发布之前,「Gemini Omni 1.1 Flash」的真实定位——究竟是 Google DeepMind 的正式产品发布,还是 Pika 与 Google 某种形式的合作营销——仍有待进一步核实。
