Il 10 settembre 2026 OpenAI ha portato GPT-Live-1 nelle API, a 0,05 dollari al minuto. È lo stesso modello vocale di ChatGPT: ascolta e parla nello stesso momento, ti lascia interrompere, capisce quando stai pensando e quando hai finito.
Per me non è una notizia come le altre. Ho progettato e costruito Centra, un centralino telefonico AI per le PMI italiane già al lavoro con attività reali, quindi conosco bene la catena che c'è dietro una chiamata gestita da un'intelligenza artificiale e dove si rompe. In questo articolo ti spiego cosa cambia con GPT-Live-1, quanto costa davvero una chiamata e quando ha senso per un'azienda.
Cos'è GPT-Live-1 e perché è diverso
Un assistente vocale tradizionale è una catena di tre pezzi: speech-to-text che trascrive, un modello di linguaggio che ragiona, text-to-speech che risponde. Ogni passaggio aggiunge latenza e un punto in cui perdere il ritmo della conversazione. Sei tu, sviluppatore, a dover gestire cosa succede se il cliente interrompe, fa una pausa o cambia argomento.
GPT-Live-1 è full-duplex: un solo modello ragiona sull'audio in entrata e in uscita insieme. Le interruzioni le gestisce da solo, nel momento in cui avvengono, e intanto può delegare il ragionamento pesante a un modello di testo nel backend. La conversazione va avanti mentre il lavoro vero si fa dietro le quinte.
Le funzioni che contano per una PMI
- Gestione delle interruzioni: risponde alle interruzioni e ai "sì, ok" mentre parla, senza handoff fragili tra componenti.
- Delega del ragionamento: passa domande e chiamate a tool a un modello di backend come GPT-6 Astra o a un modello di terze parti.
- Tono, ritmo e stile impostati dal system prompt.
- Rumore di fondo e silenzi gestiti senza interrompere la conversazione né commentare ogni passaggio.
- Sessioni lunghe con contesto conservato meglio.
- Telefonia: agenti vocali full-duplex per chiamate reali, dalle prenotazioni al supporto clienti.
Due dettagli tecnici che apprezzo: GPT-Live-1 fornisce trascrizioni e testo delle risposte in modo nativo, e supporta il rilevamento dei turni anche se non è un modello a turni. Chi ha già un'architettura a turni può continuare a usarla.
Quanto costa GPT-Live-1: il conto vero di una chiamata
Il prezzo di listino è chiaro: 0,05 dollari al minuto per il livello vocale. Ma il livello vocale non è tutta la chiamata. Ecco le tre voci che sommo io quando faccio un preventivo per un centralino AI.
1. Il livello vocale
Una telefonata media in uno studio, in un ristorante o in un'officina dura intorno ai 3 minuti. Sono 0,15 dollari a chiamata. Con 500 chiamate al mese fanno 1.500 minuti, cioè 75 dollari. Con 2.000 chiamate al mese si arriva a 300 dollari. Questa è la parte più prevedibile.
2. Il modello di backend
GPT-Live-1 delega il ragionamento a un modello di testo. Qui puoi scegliere: un modello leggero per prenotazioni e aggiornamenti d'ordine, un modello più potente per i casi complessi. Il costo dipende dai token consumati, quindi da quanto contesto passi a ogni delega.
Ho già analizzato i prezzi di GPT-6 Astra: per una segreteria che prenota appuntamenti userei qualcosa di molto più economico e terrei Astra solo per le richieste che richiedono ragionamento.
3. La telefonia
Numero di telefono, minuti in entrata e in uscita, eventuale gateway SIP. Dipende dal carrier che scegli e non c'entra con OpenAI. Nel mio centralino AI questa parte passa da un provider di telefonia programmabile e va messa in conto a parte.
Quindi la risposta onesta a "quanto costa una segretaria vocale AI" è: 0,05 dollari al minuto è il pavimento, non il totale. Il totale lo decidono il modello di backend e la telefonia.
Cosa cambia rispetto a Vapi e alle pipeline a catena
Centra è nata su una piattaforma di orchestrazione vocale, con la classica catena trascrizione, modello e sintesi vocale, collegata a un provider telefonico e a un backend Laravel. Funziona, ma ho passato più tempo a regolare i tempi di attesa e le interruzioni che a scrivere la logica di business.
Con un modello full-duplex come GPT-Live-1 quella parte sparisce dal mio codice. OpenAI cita un cliente che ha ridotto la base di codice dell'80% eliminando 23.000 righe passando dalla catena a GPT-Live-1. Non ho ancora numeri miei da confrontare, ma so esattamente quali righe sarebbero: quelle che gestiscono le interruzioni.
Dove sto attento
- Italiano: OpenAI parla di voci con accenti, dialetti e lingue diverse e promette di allargare la disponibilità linguistica. Prima di mettere una voce davanti ai clienti di un'azienda campana la provo con chiamate vere, con nomi, indirizzi e codici fiscali dettati al telefono. La comprensione alfanumerica dichiarata è un buon segno, ma va verificata.
- Voci personalizzate: richiedono di contattare il reparto commerciale di OpenAI, non sono self-service.
- Dipendenza dal fornitore: con la catena posso cambiare un pezzo alla volta; con un modello unico cambio tutto o niente.
- Trasparenza: chi chiama deve sapere che parla con un'AI. È buona pratica e, per come si sta muovendo l'Europa, lo spiego nell'articolo sui controlli AI Act.
Quando conviene a un'azienda
Un centralino AI non serve a tutti. Lo consiglio quando vedo almeno una di queste situazioni.
- Chiamate perse: studio medico, officina, ristorante che non risponde durante il servizio. Ogni chiamata persa è un cliente che chiama il concorrente.
- Richieste ripetitive: orari, prenotazioni, stato di un ordine, conferme. Nella mia esperienza la maggior parte delle chiamate di una PMI è di questo tipo.
- Fuori orario: la sera e nel weekend l'AI prende la prenotazione e la scrive nel gestionale, poi al mattino trovi tutto pronto.
Non lo consiglio quando le chiamate sono poche e tutte diverse, oppure quando il valore del cliente sta proprio nel sentire una persona che lo conosce. In quel caso costa meno una segretaria a tempo parziale, e non lo dico per modestia.
Vuoi una segretaria AI già pronta? L'ho costruita io: si chiama Centra
Se non vuoi metterti a integrare API, telefonia e WhatsApp, c'è la strada corta. Centra è il centralino AI che ho costruito per le PMI italiane: quando il tuo telefono squilla a vuoto risponde con una voce italiana naturale, capisce cosa vuole il cliente e gli scrive su WhatsApp per chiudere l'ordine o la prenotazione.
- Zero hardware: funziona con il tuo numero fisso e con qualsiasi operatore, basta una deviazione su mancata risposta.
- Attiva in 24 ore, con configurazione fatta insieme: orari, ferie, FAQ, voce.
- Follow-up su WhatsApp Business ufficiale, con riepilogo che arriva al titolare e al gestionale.
- GDPR-ready: consenso registrato a ogni chiamata, dati in Europa, DPA con ogni cliente.
- Costi chiari: canone mensile in base a chiamate e messaggi, con limiti che si fermano invece di produrre sorprese.
È già al lavoro con pasticcerie, ristoranti, officine, studi medici, parrucchieri e hotel. Se vuoi vedere se funziona per la tua attività, attivala su centraai.it oppure parla con me: nessun impegno.
Come integrerei GPT-Live-1 nel mio stack
La struttura resta quella che uso oggi: il numero di telefono arriva dal carrier, la conversazione la gestisce il modello vocale, la logica di business sta in Laravel e le azioni (prenotare, cercare un ordine, avvisare il titolare su WhatsApp) passano da workflow di automazione AI con n8n e server MCP.
La delega del ragionamento si sposa bene con quello che ho scritto sulla Agents API: GPT-Live-1 tiene la conversazione, un agente nel backend fa il lavoro lungo. Per i flussi semplici, però, una chiamata diretta a un modello leggero costa meno e si controlla meglio.
Domande frequenti su GPT-Live-1
Quanto costa GPT-Live-1 nelle API?
0,05 dollari al minuto per il livello vocale. A parte si pagano i token del modello di backend e la telefonia del carrier.
Che differenza c'è con la Realtime API?
GPT-Live-1 è full-duplex e, nelle valutazioni di OpenAI, migliora il Full Duplex Bench di 30 punti percentuali rispetto a GPT-Realtime-2.1, con guadagni sulla latenza dei turni.
Funziona con le telefonate?
Sì, il supporto telefonico è tra le funzioni annunciate, per prenotazioni, ordini e assistenza.
Parla italiano?
OpenAI dichiara voci in lingue e accenti diversi e promette di ampliare la disponibilità. Va provato con chiamate reali in italiano prima di usarlo con i clienti.
Quanto costa una chiamata di 3 minuti?
0,15 dollari di livello vocale, più il modello di backend e i minuti del carrier.
Leggi anche
- OpenAI Agents API: cos'è, quanto costa e quando usarla
- GPT-6 Astra vs Claude Fable 5.1: quale scegliere e quando
- ChatGPT Images 2.5: Flare o Sunburst e quanto costa via API
- OpenClaw 2.0: cosa cambia quando l'agente AI è di tutti
In conclusione
GPT-Live-1 toglie dal mio codice la parte più fragile di un assistente vocale e la mette in un modello che costa 0,05 dollari al minuto. Il conto completo di una segretaria vocale AI resta però in tre voci: voce, backend e telefonia.
Se vuoi una soluzione pronta, Centra è attiva in 24 ore sul tuo numero. Se invece vuoi un'integrazione su misura, con il tuo volume di chiamate, scrivimi dal form o a info@cosimo.dev: ti preparo il conto sulle tue chiamate reali, non su un esempio.



