🎯它是干什么的
多模态实时模型:文字、图像、音频统一输入输出,延迟低,适合语音与实时场景。
🧭怎么用 / 什么时候用
API 以 omni 通道调用;做语音助手、看图应用时是延迟敏感场景的经典选择。
✨核心要点
· 原生多模态
· 延迟低适合实时
· 语音场景成熟
🏷标签与栏目
本条目由人工核验后收录;链接指向官方站点,价格档位仅供参考,以官方页面为准。
多模态实时模型:文字、图像、音频统一输入输出,延迟低,适合语音与实时场景。
多模态实时模型:文字、图像、音频统一输入输出,延迟低,适合语音与实时场景。
API 以 omni 通道调用;做语音助手、看图应用时是延迟敏感场景的经典选择。
· 原生多模态
· 延迟低适合实时
· 语音场景成熟
本条目由人工核验后收录;链接指向官方站点,价格档位仅供参考,以官方页面为准。