🎁 Neu Kostenlos registrieren, 10 Aufrufe gratis. Bis zu 1 $, ohne Karte.

Google TTS Neural2

Google SprachsyntheseSSML
Input$16/M
Kontext4K

Listenpreise der Anbieter, ohne Plattform-Aufschlag, nutzungsbasierte Abrechnung. Dies sind offizielle Listenpreise. Angemeldete Kunden sehen auf /console/pricing die effektiven Preise inklusive Workspace-Rabatten.

Google TTS Neural2 in 30 Sekunden nutzen

OpenAI-kompatibel: Tauschen Sie die base_url, behalten Sie Ihr SDK. POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="google-tts-neural2",
    messages=[{"role": "user", "content": "Summarize this diff"}],
)
print(resp.choices[0].message.content)

Spezifikationen & Limits

Audio

Sprachen
Eine deutlich kürzere Locale-Liste als bei Standard. Neural2-Stimm-ids sind veröffentlicht für da-DK, de-DE, en-AU, en-GB, en-IN, en-US, es-ES, es-US, fr-CA, fr-FR, hi-IN, it-IT, ja-JP, ko-KR, pt-BR, th-TH und vi-VN. Google merkt an, dass Neural2-Stimmen auf globalen und Einzelregion-Endpunkten verfügbar sind.
Audio-Limits
  • Inhaltsgrenze von insgesamt 5.000 Byte pro synthesize-Anfrage. Ausgabe als LINEAR16 (mit WAV-Header), MP3 mit 32 kbps, OGG_OPUS oder G.711 MULAW und ALAW
  • das optionale sampleRateHertz resampelt und lässt die Anfrage fehlschlagen, wenn die Rate für das Encoding nicht unterstützt wird. Wird nicht über die Streaming-Synthese angeboten. Abgerechnet pro Zeichen einschließlich Leerzeichen und Zeilenumbrüchen, wobei alle SSML-Tags außer <mark> mitzählen
  • der Hinweis, dass ein Mehrbyte-Zeichen einmal zählt, gilt nur für Standard und WaveNet

Realtime

Stimmen
Stimm-ids folgen dem Muster aus Locale plus Buchstabe (en-US-Neural2-F, ja-JP-Neural2-B). Googles Vergleichstabelle führt Neural2 als general purpose, allgemein verfügbar, per SSML steuerbar und nicht streamingfähig, und die Dokumentation gibt an, dass die Stimmen auf derselben Technologie beruhen, die zur Erstellung einer Custom Voice verwendet wird, sodass jeder Custom-Voice-Technologie nutzen kann, ohne eine eigene zu trainieren.
Sitzung
  • AudioConfig-Steuerungen: speakingRate 0.25 bis 2.0 (1.0 nativ)
  • pitch -20.0 bis 20.0 Halbtöne
  • volumeGainDb -96.0 bis 16.0
  • effectsProfileId-Geräteprofile für Wearable, Handset, Kopfhörer, kleine und mittlere Bluetooth-Lautsprecher, große Home-Entertainment-Anlagen, große Autoanlagen und Telefonie-Wiedergabe
  • zu den SSML-Tags gehören speak, break, say-as, sub, mark, prosody, emphasis, phoneme, voice und lang

Modell

Modalitäten
Text → Audio

Die Neural2-Stimmstufe von Google Cloud Text-to-Speech, auf der Preisseite weiterhin unter Legacy TTS models gruppiert. US$0.000016 pro Zeichen (US$16 pro 1 Million Zeichen), wobei die erste 1 Million Zeichen jeden Monat kostenlos ist, gegenüber 4 Millionen bei Standard.

laut Offizielle Google-Dokumentation ↗

Über Google TTS Neural2

Custom-Voice-Technologie, ohne eine Custom Voice zu trainieren
Deutlich kürzere Locale-Liste als Standard
General purpose und per SSML steuerbar, aber ohne Streaming

Google TTS Neural2 erschließt die Neural2-Stimmstufe von Google Cloud Text-to-Speech, und Googles Beschreibung ist ungewöhnlich genau dabei, woher die Stimmen stammen: Neural2-Stimmen beruhen auf derselben Technologie, die zur Erstellung einer Custom Voice verwendet wird, und die Stufe existiert, damit jeder Custom-Voice-Technologie nutzen kann, ohne eine eigene Custom Voice zu trainieren.

  • Die Vergleichstabelle nennt sie general purpose, markiert sie als allgemein verfügbar und gibt ihre Steuerbarkeit mit SSML an, dasselbe Profil, das Standard und WaveNet tragen.
  • Beim Preis erklärt sich die Stufe selbst: US$0.000016 pro Zeichen, angegeben als US$16 pro 1 Million Zeichen, wobei die erste 1 Million Zeichen jeden Monat kostenlos ist statt der 4 Millionen von Standard; die Preisseite gruppiert sie weiterhin unter Legacy TTS models.
  • Der Preis für diese Qualität ist die Reichweite.
  • Wo Standard Locales von Afrikaans bis Kantonesisch abdeckt, erscheinen Neural2-Stimm-ids für eine deutlich kürzere Liste: da-DK, de-DE, en-AU, en-GB, en-IN, en-US, es-ES, es-US, fr-CA, fr-FR, hi-IN, it-IT, ja-JP, ko-KR, pt-BR, th-TH und vi-VN, benannt in der vertrauten Form aus Locale plus Buchstabe wie en-US-Neural2-F.
  • Google merkt an, dass Neural2 auf globalen und Einzelregion-Endpunkten verfügbar ist.
  • Alles Betriebliche teilt sie mit dem Rest der klassischen API: SSML-Eingabe, speakingRate von 0.25 bis 2.0, pitch in Halbtönen über einen Bereich von 20 Punkten in beide Richtungen, volumeGainDb von -96 bis 16, eine optionale Synthese-Abtastrate, die Geräteprofile von Wearables bis Telefonie und die Ausgabe als LINEAR16, MP3, OGG_OPUS, MULAW oder ALAW.
  • Dieselbe Obergrenze von 5.000 Byte Inhalt pro Anfrage gilt, und wie Standard wird Neural2 nicht über die Streaming-Synthese angeboten, was die konkrete Fähigkeit ist, die man gegenüber Chirp 3: HD aufgibt.
  • Die Abrechnung zählt Zeichen einschließlich Leerzeichen und SSML-Tags außer mark.
  • Synthorai stellt es über den OpenAI-kompatiblen Endpoint /v1/audio/speech bereit.

FAQ

Lässt sich die Google TTS Neural2 API kostenlos testen?

Ja, neue Konten erhalten 10 Test-Calls und bis zu $1 kostenloses Guthaben, keine Kreditkarte erforderlich. Bei $16/M Input-Tokens deckt allein dieses Guthaben rund 15 Requests mit je ~4K Tokens gegen Google TTS Neural2 ab.

Worin ist Google TTS Neural2 am besten?

Custom-Voice-Technologie, ohne eine Custom Voice zu trainieren; deutlich kürzere Locale-Liste als Standard; general purpose und per SSML steuerbar, aber ohne Streaming. Das vollständige Bild finden Sie im Über-Abschnitt, direkt aus den offiziellen Release Notes des Anbieters.

Was kostet Google TTS Neural2?

Google TTS Neural2 kostet auf Synthorai $16 pro Million Input-Tokens und $0 pro Million Output-Tokens. Das ist der Listenpreis des Anbieters, ohne Plattform-Aufschlag.

Unterstützt Google TTS Neural2 Prompt-Caching?

Google TTS Neural2 hat auf Synthorai derzeit keinen Cache-Lese-Rabatt. Prompt-Caching gilt weiterhin für andere Modelle auf dem Gateway; cache-fähige Alternativen finden Sie in der Preistabelle. Caching-Vergleich der Anbieter →

Wie erhalte ich Zugang zu Google TTS Neural2?

Richten Sie Ihr vorhandenes OpenAI SDK auf base_url="https://synthorai.io/v1", setzen Sie model="google-tts-neural2", fertig. Ein API-Key deckt jedes Modell auf dem Gateway ab.

Verwandte Modelle

Kostenlosen API-Key holen Ihre Kosten vergleichen →