
Eye on AI Weekly Research Watch
MP-Bench: Evaluating Voice Agents as a Multiparty Conversation Participant
2 min•16 september 2026
Om avsnittet
Voice agents are mostly tested in one-on-one conversation. MP-Bench tests them in groups. Across 12 agents, real-time systems scored 22% or less on comprehension and did no better than chance at knowing when to speak.
Authors: Yi-Jen Shih, Shih-Yun Shan Kuan, Guan-Ting Lin, Kai-Wei Chang, Siddhant Arora, Shu-wen Yang, Abdelrahman Mohamed, Shinji Watanabe, Hung-yi Lee, David Harwath
Paper: https://arxiv.org/abs/2609.13076v1
Eye on AI Weekly Research Watch med Craig Spencer Smith finns tillgänglig på flera plattformar. Informationen på denna sida kommer från offentliga podd-flöden.