Uma Avaliação de Confiabilidade de Juízes de Áudio LALM para Agentes de Voz Full-Duplex
arXiv:2607.07985v1 Tipo de Anúncio: novo Resumo: Relatamos a confiabilidade empírica dos modelos Gemini como juízes de áudio que pontuam conversas de agentes full-duplex diretamente a partir da forma de onda estéreo bruta, testados em três modelos da família Gemini: 2.5 Flash, 3.5 Flash e 3.1 Pro. Nossa principal base de evidências utiliza o Gemini 2.5 Flash como o modelo de referência (ground-truth), validado contra três avaliadores humanos calibrados em 209 sessões estéreo, pontuadas em 8 dimensões de produção: 152 conversas full-duplex acros...
arXiv cs.CL
·A. Sayyad, J. Emmons, S. Jones, T. Lin, H. Krishnan
·
// relacionados
Leia também
Blog
As Reddit stock falls, CEO questions value of Google's AI Overviews
Blog
Smallest.ai raises $13M to build ultra-fast voice AI that sounds genuinely human
Modelo
Audio8/Audio8-TTS-Preview-0.6b
Blog