Sveriges mest populära poddar
Eye on AI Weekly Research Watch
Eye on AI Weekly Research Watch

MP-Bench: Evaluating Voice Agents as a Multiparty Conversation Participant

2 min•16 september 2026

Om avsnittet

Voice agents are mostly tested in one-on-one conversation. MP-Bench tests them in groups. Across 12 agents, real-time systems scored 22% or less on comprehension and did no better than chance at knowing when to speak. Authors: Yi-Jen Shih, Shih-Yun Shan Kuan, Guan-Ting Lin, Kai-Wei Chang, Siddhant Arora, Shu-wen Yang, Abdelrahman Mohamed, Shinji Watanabe, Hung-yi Lee, David Harwath Paper: https://arxiv.org/abs/2609.13076v1

Eye on AI Weekly Research Watch med Craig Spencer Smith finns tillgänglig på flera plattformar. Informationen på denna sida kommer från offentliga podd-flöden.