Aioga
AI资讯 / 模型更新
返回 AI资讯

字节跳动发布音视频全双工大模型 SeedRealtime,已上线豆包 App

IT之家(RSS)Aioga 编辑团队2026-08-05T04:12:05.000Z热度 70

字节跳动 Seed 今日推出原生音视频全双工大模型 SeedRealtime,用统一架构融合音频、视频与文本,支持"边看、边听、边说"的实时交互。端到端评测显示,相比级联模型,...

模型更新IT之家(RSS)

今日 AI 情报摘要

字节跳动 Seed 今日推出原生音视频全双工大模型 SeedRealtime,用统一架构融合音频、视频与文本,支持"边看、边听、边说"的实时交互。

端到端评测显示,相比级联模型,其音视频对话节奏问题减少一半。 该模型已在豆包 App 全量上线,更新至最新版本后可在对话框选择"打电话"体验。

正文 · AI 翻译

字节跳动发布音视频全双工大模型 SeedRealtime,已上线豆包 App 这条更新来自 ithome.com,发布时间为 2026-08-05,Aioga 保留原文入口以便核验。

摘要:字节跳动 Seed 今日推出原生音视频全双工大模型 SeedRealtime,用统一架构融合音频、视频与文本,支持"边看、边听、边说"的实时交互。端到端评测显示,相比级联模型,其音视频对话节奏问题减少一半。该模型已在豆包 App 全量上线,更新至最新版本后可在对话框选择"打电话"体验。

背景:公开材料称,该模型聚焦音视频联合理解、主动交互和对话节奏,可结合声音、画面及时序信息处理指代与歧义,并感知对话状态、背景噪声和画面变化。

Aioga 观察:Aioga 判断,SeedRealtime 的重点不只是增加视频输入,而是尝试在统一架构中同步处理观看、聆听与表达。其实际体验仍需结合更多公开测试和真实使用反馈观察。

影响与后续:端到端人工评测显示,相比级联模型,其音视频对话节奏问题减少一半。值得关注的是,该结果来自公开材料所述评测,尚不能据此推断所有场景中的稳定性与效果。 用户可将豆包 App 更新至最新版本,在对话框选择“打电话”进入视频通话体验。后续可关注模型在复杂噪声、多人对话、连续画面变化及工具调用中的公开表现。

情报判断

Aioga 编辑摘要

字节跳动 Seed 推出原生音视频全双工大模型 SeedRealtime,以统一架构融合音频、视频与文本,支持连续多模态信息流中的实时交互,并已在豆包 App 全量上线。

背景分析

公开材料称,该模型聚焦音视频联合理解、主动交互和对话节奏,可结合声音、画面及时序信息处理指代与歧义,并感知对话状态、背景噪声和画面变化。

Aioga 观点

Aioga 判断,SeedRealtime 的重点不只是增加视频输入,而是尝试在统一架构中同步处理观看、聆听与表达。其实际体验仍需结合更多公开测试和真实使用反馈观察。

影响与后续

端到端人工评测显示,相比级联模型,其音视频对话节奏问题减少一半。值得关注的是,该结果来自公开材料所述评测,尚不能据此推断所有场景中的稳定性与效果。 用户可将豆包 App 更新至最新版本,在对话框选择“打电话”进入视频通话体验。后续可关注模型在复杂噪声、多人对话、连续画面变化及工具调用中的公开表现。

来源与版权说明

本页正文由公开来源页面提取并按原有信息整理,同时保留来源、发布时间和原文入口。版权归原作者及来源网站所有,请通过原文链接核验和阅读来源版本。

抓取通道: RSS · 原始域名: ithome.com

来源: IT之家(RSS)

原文链接: 打开原始来源

Aioga 归档: 查看情报页

Content record: source-page · Updated: 2026-08-05T04:12:05.000Z

API 中转站
API RELAY · DEVELOPER INFRASTRUCTURE

API 中转站

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。

立即访问 api.w173.com
AIOGA SHARE POSTER

分享这篇 AI 情报

字节跳动 Seed 今日推出原生音视频全双工大模型 SeedRealtime,用统一架构融合音频、视频与文本,支持"边看、边听、边说"的实时交互。端到端评测显示,相比级联模型,...

IT之家(RSS)2026-08-05T04:12:05.000Z
扫码打开文章详情扫码直达文章详情

Aioga 自动聚合全球 AI 动态,并保留来源信息用于核验与引用。