Sobre Cekura Bench

Benchmarks de modelo de fala-para-fala em chamadas telefônicas ao vivo

Resumo da IA

Cekura Bench publishes voice AI benchmarks you can verify. Our new speech-to-speech benchmark tests 9 realtime voice models, including GPT Realtime 2.1, Gemini Live, Grok and Phonic, as complete phone agents on live calls: 82 scenarios, three runs each. Models are ranked on reliability, data accuracy, stalled calls, response time and cost, and every call transcript is public. Cekura Bench also covers voice agent benchmarks and STT benchmarks, with TTS benchmarks coming soon.

Descricao Detalhada

Gemini 3.5 Flash is no longer available. Please switch to Gemini 3.7 Flash in the latest version of Antigravity.

Captura de Tela da Ferramenta

Cekura Bench screenshot
Clique para ampliar

Principais Recursos

Cekura Bench publica benchmarks de voz para verificação.
Realiza testes de benchmark speech-to-speech em tempo real.
Avalia 9 modelos de voz em tempo real, incluindo GPT Realtime 2.1, Gemini Live e Grok Phonic.
Simula agentes de telefone completos em chamadas ao vivo.
Utiliza 82 cenários diferentes, cada um executado três vezes.
Classifica os modelos conforme confiabilidade, precisão dos dados, chamadas paralisadas, tempo de resposta e custo.
Disponibiliza a transcrição completa de cada chamada publicamente.
Cobre benchmarks de agentes de voz.
Inclui benchmarks de STT (speech‑to‑text).
Planeja lançar em breve benchmarks de TTS (text‑to‑speech).
Comentarios 0

Nenhum comentário ainda

Seja o primeiro a compartilhar seus pensamentos e iniciar a conversa!

Participe da conversa

Entre para deixar um comentário e compartilhar seus pensamentos.

0.0
0 reviews
Carregando...
Loading rating distribution...
Carregando...

Loading reviews...