OpenAI hat zwei Sprach-zu-Text-Modelle veröffentlicht: GPT Transcribe und GPT Live Transcribe. GPT Transcribe wird zur Verarbeitung von Audioaufnahmen und für Batch-Aufgaben verwendet, während GPT Live Transcribe für Live-Untertitel und Echtzeitszenarien wie Telefonate geeignet ist. Diese beiden Modelle können das Thema der Aufnahme, Schlüsselwörter und Sprachhinweise kombinieren, um die Erkennung von kurzen Sätzen, Zahlen, Fachbegriffen, verschiedenen Akzenten und in lauten Umgebungen zu verbessern. Laut einer Bewertung von Artificial Analysis beträgt die Wortfehlerquote von GPT Transcribe 3,31 %, was 0,7 Prozentpunkte niedriger ist als bei der vorherigen Generation, GPT-4o Transcribe. Der Preis des neuen Modells wurde ebenfalls um 25 % gesenkt, sodass für 1000 Minuten Audio 4,5 US-Dollar berechnet werden.
Dieser Inhalt wird nur zu allgemeinen Informationszwecken bereitgestellt und stellt keine finanzielle, Anlage-, Rechts- oder Steuerberatung dar. Alle erwähnten Ereignisse, Prämien, Online-Aktionen oder zugehörige Informationen sollten nicht als Empfehlung, Aufforderung oder Einladung zum Kauf, Verkauf, Handel oder anderweitigem Umgang mit Krypto-Assets betrachtet werden. Krypto-Assets sind sehr volatil und können zu Verlusten führen. Die Verfügbarkeit von WEEX Services, Produkten und zugehörigen Aktionen kann je nach Region unterschiedlich sein. Sie sind dafür verantwortlich sicherzustellen, dass Ihre Teilnahme mit geltenden lokalen Gesetzen und Vorschriften übereinstimmt.






















