Introducing next-generation audio models in the API
Di cosa parla
OpenAI ha reso disponibili nella sua interfaccia per sviluppatori nuovi modelli audio che trasformano il testo in voce. Per la prima volta gli sviluppatori possono dire al modello non solo cosa dire, ma anche come dirlo — per esempio “parla come un agente di assistenza empatico” — permettendo di creare agenti vocali con tono e personalità più controllati e adatti a diversi ruoli.
Cosa permette di osservare
Il cambiamento apre domande pratiche: come progettare la voce e il tono degli assistenti per migliorare l'esperienza degli utenti e quali scelte di personalità offrire agli sviluppatori per diversi contesti d'uso.
Dalla fonte
For the first time, developers can also instruct the text-to-speech model to speak in a specific way—for example, “talk like a sympathetic customer service agent”—unlocking a new level of customization for voice agents.