AI

Xmax AI发布全球首个实时交互视频模型X2.0

Xmax AI正式发布实时交互视频模型X2.0,主打实时渲染、次元交互、触屏交互及Free模式四大核心能力。该模型采用流式生成架构,实现毫秒级响应,并支持在iPhone端侧本地运行。X2.0旨在将视频转化为可实时交互的资产,未来可通过开放API赋能电商试穿、虚拟陪伴、内容IP互动及直播等多元场景,重构视频交互范式。

来源:量子位

Xmax AI正式发布实时交互视频模型X2.0,主打将视频转化为可实时交互的资产。该模型主推三大核心能力与一项自定义模式:

  • 实时渲染:在保留原始动态与光影的前提下,实现毫秒级角色、服装与背景的实时替换。
  • 次元交互:以现实物品为锚点,精准定位并控制虚拟角色运动路径,实现现实与虚拟物体的置换或赋予现实物体虚拟属性。
  • 触屏交互:通过屏幕拖拽,将静态图像唤醒为动态视频,实现触控实时操控。
  • Free模式:通过Prompt实现零门槛特效创作,如喷火、空间扭曲等。

在技术层面,X2.0采用逐帧自回归生成的流式生成架构,将模型响应时间压缩至毫秒级,打破了速度、成本与质量的“不可能三角”。通过多阶段蒸馏、上下文持久化及极致压缩等技术,单张消费级显卡即可满血运行(960分辨率@24fps)。此外,团队在移动端进行深度优化,使X2.0成为全球首个能在iPhone上本地运行的实时交互视频生成模型(384分辨率@16fps)。

在产业应用方面,Xmax计划通过开放API成为视频行业的底层基础设施。其应用场景涵盖:
- 电商与零售:实现“魔镜”式实时虚拟试穿,改造线下试衣间,降低退货率。
- 虚拟陪伴与内容IP:让立牌、手办等实体物品“活”过来,为存量IP提供全新的沉浸式互动体验。
- 直播平台:支持观众实时换人、换装及场景替换,打造千人千面的互动观看体验。

Xmax AI表示,X2.0在实时交互模型赛道具备领先能力,且价格仅为海外同类头部模型的十分之一,致力于推动实时交互视频技术的普及与商业化落地。

原始来源: 量子位

本文由博一・AI营销中枢整理编辑,用于行业观察分享。观点归原作者所有。

更多「AI」资讯

让品牌在 AI 中生长

免费诊断你的品牌 AI 可见度