Google TTS Neural2
Prezzi di listino del provider: senza ricarico della piattaforma, pagamento a consumo. Questi sono i prezzi di listino ufficiali. I clienti autenticati possono vedere i prezzi effettivi, inclusi gli sconti workspace, su /console/pricing.
Usa Google TTS Neural2 in 30 secondi
Compatibile OpenAI: cambia la base_url, tieni il tuo SDK. POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="google-tts-neural2",
messages=[{"role": "user", "content": "Summarize this diff"}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "google-tts-neural2",
messages: [{ role: "user", content: "Summarize this diff" }],
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "google-tts-neural2",
"messages": [{"role": "user", "content": "Hello"}]
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "google-tts-neural2",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("google-tts-neural2")
.addUserMessage("Summarize this diff")
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));Specifiche e limiti
Audio
- Lingue
- Un elenco di locale molto più breve rispetto a Standard. Gli id delle voci Neural2 sono pubblicati per da-DK, de-DE, en-AU, en-GB, en-IN, en-US, es-ES, es-US, fr-CA, fr-FR, hi-IN, it-IT, ja-JP, ko-KR, pt-BR, th-TH e vi-VN. Google segnala che le voci Neural2 sono disponibili sugli endpoint globali e a singola regione.
- Limiti audio
-
- Limite di contenuto di 5.000 byte totali per richiesta di sintesi. Output LINEAR16 (con header WAV), MP3 a 32 kbps, OGG_OPUS oppure G.711 MULAW e ALAW
- il sampleRateHertz opzionale ricampiona e fa fallire la richiesta se la frequenza non è supportata per quella codifica. Non offerto sulla sintesi in streaming. Fatturato per carattere inclusi spazi e a capo, con tutti i tag SSML tranne <mark> conteggiati
- la nota per cui un carattere multibyte conta una volta sola vale solo per Standard e WaveNet
Tempo reale
- Voci
- Gli id delle voci seguono lo schema locale più lettera (en-US-Neural2-F, ja-JP-Neural2-B). La tabella comparativa di Google elenca Neural2 come general purpose, in disponibilità generale, controllabile via SSML e non capace di streaming, e la documentazione afferma che le voci si basano sulla stessa tecnologia usata per creare una Custom Voice, permettendo a chiunque di usare la tecnologia Custom Voice senza addestrarne una propria.
- Sessione
-
- Controlli AudioConfig: speakingRate da 0.25 a 2.0 (1.0 nativo)
- pitch da -20.0 a 20.0 semitoni
- volumeGainDb da -96.0 a 16.0
- profili di dispositivo effectsProfileId per riproduzione su indossabile, telefono, cuffie, altoparlante Bluetooth piccolo e medio, grande impianto home entertainment, grande impianto per auto e telefonia
- i tag SSML includono speak, break, say-as, sub, mark, prosody, emphasis, phoneme, voice e lang
Modello
- Modalità
- testo → audio
Il livello di voci Neural2 di Google Cloud Text-to-Speech, ancora raggruppato sotto i modelli TTS legacy nella pagina dei prezzi. US$0.000016 per carattere (US$16 per 1 milione di caratteri) con il primo milione di caratteri gratuito ogni mese, contro i 4 milioni di Standard.
Informazioni su Google TTS Neural2
Google TTS Neural2 espone il livello di voci Neural2 di Google Cloud Text-to-Speech, e la descrizione che Google ne dà è insolitamente precisa su dove nascano quelle voci: le voci Neural2 si basano sulla stessa tecnologia usata per creare una Custom Voice, e il livello esiste perché chiunque possa usare la tecnologia Custom Voice senza addestrare una propria voce personalizzata.
- La tabella comparativa lo definisce general purpose, lo indica in disponibilità generale e ne dà la controllabilità come SSML, lo stesso profilo che portano Standard e WaveNet.
- È nel prezzo che il livello si dichiara, a US$0.000016 per carattere, indicati come US$16 per 1 milione di caratteri, con il primo milione di caratteri gratuito ogni mese anziché i 4 milioni di Standard; la pagina dei prezzi lo raggruppa ancora sotto i modelli TTS legacy.
- Il prezzo da pagare per quella qualità è l'ampiezza.
- Là dove Standard copre locale dall'afrikaans al cantonese, gli id delle voci Neural2 compaiono per un elenco molto più breve, da-DK, de-DE, en-AU, en-GB, en-IN, en-US, es-ES, es-US, fr-CA, fr-FR, hi-IN, it-IT, ja-JP, ko-KR, pt-BR, th-TH e vi-VN, denominati nella familiare forma locale più lettera come en-US-Neural2-F.
- Google segnala che Neural2 è disponibile sugli endpoint globali e a singola regione.
- Tutto ciò che è operativo è condiviso con il resto della API classica: input SSML, speakingRate da 0.25 a 2.0, pitch in semitoni entro un intervallo di 20 punti in entrambe le direzioni, volumeGainDb da -96 a 16, una frequenza di campionamento di sintesi opzionale, i profili di dispositivo dagli indossabili alla telefonia e l'output come LINEAR16, MP3, OGG_OPUS, MULAW o ALAW.
- Vale lo stesso tetto di 5.000 byte di contenuto per richiesta e, come Standard, Neural2 non è offerto sulla sintesi in streaming, che è la capacità concreta a cui si rinuncia rispetto a Chirp 3: HD.
- La fatturazione conta i caratteri inclusi gli spazi e gli a capo, e conta tutti i tag SSML tranne mark.
- Synthorai lo serve tramite l'endpoint /v1/audio/speech compatibile OpenAI.
FAQ
L'API di Google TTS Neural2 si può provare gratis?
Sì: i nuovi account ricevono 10 chiamate di prova e fino a $1 di credito gratuito, senza carta richiesta. A $16/M token in input, quel credito da solo copre circa 15 richieste da ~4K token verso Google TTS Neural2.
In cosa eccelle Google TTS Neural2?
Tecnologia Custom Voice senza addestrare una voce personalizzata; elenco di locale molto più breve rispetto a Standard; general purpose e controllabile via SSML, ma senza streaming. Il quadro completo è nella sezione «Informazioni», tratto dalle note di rilascio ufficiali del vendor.
Quanto costa Google TTS Neural2?
Su Synthorai, Google TTS Neural2 costa $16 per milione di token in input e $0 per milione di token in output: il prezzo di listino del provider, senza ricarico della piattaforma.
Google TTS Neural2 supporta il caching dei prompt?
Google TTS Neural2 oggi non ha uno sconto sulle letture dalla cache su Synthorai. Il caching dei prompt resta disponibile per gli altri modelli del gateway: vedi la tabella prezzi per le alternative con cache. Confronto del caching tra provider →
Come ottengo l'accesso a Google TTS Neural2?
Punta il tuo SDK OpenAI esistente a base_url="https://synthorai.io/v1", imposta model="google-tts-neural2" e hai finito: una sola chiave API copre tutti i modelli del gateway.