Søgning
3 briefing-resultat(er) for »speech-to-speech«
Opfølgning: Simon Willison tester Googles nye Gemini Live-talemodeller
Simon Willison bygger en web-UI til Googles nye Gemini 3.8 Live og Live Extended Thinking – speech-to-speech-modeller, der konkurrerer med …
Benchmark måler time-to-first-token på tværs af hele voice-stakken
Undersøgelsen dækker LLM, speech-to-text, text-to-speech og speech-to-speech. Voice-agents fejler på latency længe før de fejler på intelligens.
Google DeepMind lancerer Gemini 3.5 Transcribe til intelligent talegenkendelse
Den nye model tilbyder forbedret speech-to-text med dybere forståelse af kontekst og nuancer. Den er designet til at håndtere komplekse lydoptagelser mere …