OpenAI startet GPT-Live-Sprachmodelle und macht Echtzeit-Dialogwechsel zum Kern von ChatGPT
OpenAI hat GPT-Live-Sprachmodelle für ChatGPT vorgestellt und setzt darauf, dass Vollduplex-Sprache KI-Assistenten für Live-Arbeit nützlicher machen kann.
OpenAI hat GPT-Live-Sprachmodelle für ChatGPT vorgestellt und setzt darauf, dass Vollduplex-Sprache KI-Assistenten für Live-Arbeit nützlicher machen kann.
Interfaze hat diffusion-gemma-asr-small veröffentlicht, ein Open-Source-ASR-Modell für sechs Sprachen, das Diffusion-Decoding als neuen Weg für Sprach-KI erprobt.
Amazon hat eine KI-gestützte Einkaufsfunktion eingeführt, die gesprochene Audioantworten auf Produktfragen generiert.
Apple hat das israelische Audio-AI-Startup Q.ai für rund 2 Milliarden US-Dollar übernommen – die zweitgrößte Akquisition des Unternehmens. Dieser Schritt signalisiert einen großen Vorstoß in die KI, insbesondere in Audiotechnologien für Produkte wie die AirPods und das Vision Pro.
Neueste Nachrichten und Analysen zu Audio-KI