风险提示:理性看待区块链,提高风险意识!
USDT USDT $1.00 0.01%
XRP XRP $1.43310000 0.19%
BNB BNB $637.54000000 0.02%
USDC USDC $0.99963000 0.01%
SOL SOL $86.49000000 0.99%
TRX TRX $0.32360000 1.25%
BTC BTC $67,234.00 2.34%
ETH ETH $3,456.00 1.23%
CoinMeta Skill
限时免费体验

让 AI 更快获取有效、准确、可行动的币圈全景信息

字节跳动发布音视频全双工大模型SeedRealtime

摘要

PANews 8月5日消息,据财联社报道,字节跳动正式推出原生音视频全双工大模型SeedRealtime。SeedRealtime用统一架构原生融合音频、视频与文本,能在连续的多模态信息流上实时交互,带来“边看、边听、边说”的全新体验...

PANews 8月5日消息,据财联社报道,字节跳动正式推出原生音视频全双工大模型SeedRealtime。SeedRealtime用统一架构原生融合音频、视频与文本,能在连续的多模态信息流上实时交互,带来“边看、边听、边说”的全新体验。端到端人工评测结果显示,相比级联模型,SeedRealtime的音视频对话节奏问题减少了一半——模型对说话时机的把握更加自然,“话未说完被抢断、话音已落却回应迟缓、或是被背景杂音与闲聊误触发”等卡壳现象显著减少;同时,单次对话能够完整、顺畅交流的概率也有明显提升。目前,SeedRealtime已在豆包App全量上线。

评论 (4)

登录 后即可发表评论
余年
余年 1小时前

端到端评测结果挺好,希望能在更多场景发挥作用,别就局限在豆包。

0 回复
钢铁加牛牛

这模型能带来新体验,要是后续不断优化,应用范围会更广。

0 回复
再见孙悟空

这模型挺牛啊,解决了不少对话节奏问题,在豆包上线后体验应该能提升不少。

0 回复
大风起兮  云飞扬

音视频对话卡壳现象减少很多,交流更顺畅,字节这模型搞的不错。

0 回复
更多