01
音视频联合感知
把视觉现场、语音内容与时间关系放在同一个上下文中理解,而不是分步拼接。
SeedRealtime 实时音视频智能
SeedRealtime 是面向连续视频、语音交互与自然多模态对话打造的实时音视频 AI 体验。
一条连续的多模态流
不必把问题整理成规整的提示词。界面持续理解变化的场景、交叠的声音,以及自然对话的节奏。
把视觉现场、语音内容与时间关系放在同一个上下文中理解,而不是分步拼接。
持续记住用户目标,在关键目标出现或场景发生变化时主动提醒。
能在噪声中等待、处理打断,并在不抢话的前提下自然回应。
为真实场景而设计
把镜头对准工作台、商品、文档或身边环境,像平常一样说话,模型会持续追踪场景变化。
YOU“指示灯变绿时提醒我。”
SEED它刚刚变绿了,现在可以继续。
面向开发者的接入基础
当前替代方案通过服务端安全路由接入 API Mart。SeedRealtime 正式开放后可直接替换适配器,无需重做产品界面。
查看官方模型发布页APIMART_BASE_URL=https://api.apimart.ai
APIMART_API_KEY=••••••••••••
APIMART_MODEL=gpt-5.2-proSeedRealtime 知识中心
独立编写的实用指南,帮助你理解模型概念、设计 API 网关、选择应用场景,并评估完整的实时多模态产品。
查看全部指南SEEDREALTIME / 2026
现在即可使用实时交互界面;获得官方权限后直接接入生产凭证。