Risposta concisa: Un token è una piccola porzione di testo o dati che un modello di intelligenza artificiale converte in numeri ed elabora. I token influenzano i costi, la velocità, la memoria e la lunghezza dell'output. Quando un prompt supera la finestra di contesto, il contenuto importante può essere troncato, riassunto o escluso.
Punti chiave:
Tokenizzazione: parole, punteggiatura, spazi e codice possono essere suddivisi in diversi modi.
Contesto: Mantenere le informazioni essenziali all'interno della finestra di token disponibile del modello.
Costo: Ridurre le istruzioni ripetute e il testo superfluo nei flussi di lavoro di intelligenza artificiale ad alto volume.
Chiarezza: Definisci fin da subito il compito principale e organizza i requisiti con etichette chiare.
Efficienza: suddividere i documenti di grandi dimensioni in sezioni logiche prima di combinare i risultati.

Articoli che potrebbero interessarti dopo questo:
🔗 Quali sono i tipi di IA?
Comprendi le categorie di IA in base a capacità, funzionalità, stile di addestramento e utilizzo pratico.
🔗 Cosa sono gli occhiali con intelligenza artificiale?
Scopri le funzionalità degli occhiali intelligenti, gli utilizzi a mani libere, la privacy e i limiti pratici.
🔗 Cos'è la TV con IA?
Scopri come l'intelligenza artificiale migliora immagini, audio, ricerca, consigli e accessibilità.
🔗 Cos'è l'IA
di bassa qualità? Riconoscere i contenuti generati dall'IA e migliorarne l'accuratezza, l'originalità e la finalità.
1. Cos'è un token nell'IA? La risposta semplice
Nell'intelligenza artificiale, un token è un'unità di testo che un modello utilizza per comprendere e generare il linguaggio .
Ad esempio, la frase:
Adoro la pizza.
Potrebbe essere suddiviso in token come:
-
IO -
Amore -
Pizza -
.
Abbastanza semplice.
Ma non è sempre così semplice. Una parola più lunga o insolita potrebbe essere suddivisa in parti più piccole. Ad esempio:
incredibile
Potrebbe diventare qualcosa del genere:
-
un -
credere -
capace
Diversi sistemi di intelligenza artificiale utilizzano diversi tokenizzatori, quindi la suddivisione esatta può variare. Ecco perché i token possono sembrare un po' sfuggenti. Non sono esattamente parole, non sono esattamente lettere e non sempre nemmeno sillabe.
Un modo migliore per pensarci è questo:
I token sono frammenti di linguaggio di piccole dimensioni che un modello di intelligenza artificiale può elaborare. 🍽️
Quando si pone una domanda a un chatbot, il sistema non assimila la frase come un unico pensiero umano. Suddivide l'input in token, li trasforma in numeri, ne elabora le relazioni e poi prevede il token successivo più probabile, ripetendo il processo più volte, finché non formula una risposta.
Quindi, quando le persone chiedono " Cos'è un token nell'IA?", la risposta non è semplicemente "un pezzo di testo". È l'unità di lavoro fondamentale che rende possibile l'IA linguistica.
2. Perché i token sono più importanti di quanto si pensi
I token sono importanti perché influenzano quasi ogni aspetto del funzionamento degli strumenti di intelligenza artificiale.
Influenzano:
-
Quanto testo può gestire contemporaneamente un'IA
-
Quanto costa una richiesta in molti sistemi di intelligenza artificiale
-
Quanto velocemente risponde un modello
-
Quanti dettagli riesce a ricordare il modello
-
Quanto accuratamente il modello comprende il tuo prompt
-
Quanto può essere lunga la risposta
È qui che la cosa si rivela sorprendentemente pratica.
Quando uno strumento di intelligenza artificiale afferma di avere una "finestra di contesto", di solito si riferisce al numero massimo di token che può considerare contemporaneamente. Il tuo prompt, la cronologia della conversazione, il testo caricato, le istruzioni di sistema e la risposta del modello occupano tutti dei token.
Quindi, se incolli un documento enorme in un assistente IA e poi chiedi "Riassumi questo", il modello deve far rientrare quel testo entro il limite di token. Se il contenuto è troppo lungo, alcune parti potrebbero essere troncate, compresse o ignorate a seconda di come è stato progettato lo strumento.
I token non sono solo dettagli tecnici. Rappresentano lo spazio sulla scrivania dell'IA. Troppa carta sulla scrivania e le cose iniziano a scivolare oltre il bordo 📄.
3. I token non sono la stessa cosa delle parole
Questo è probabilmente il più grande malinteso.
Un token non è sempre una parola.
A volte una parola equivale a un token. A volte una parola diventa più token. A volte la punteggiatura o la spaziatura contano come un token a sé stante. Fastidioso? Un po'. Importante? Molto.
Ecco un esempio approssimativo:
| Esempio di testo | Possibile suddivisione del token | Cosa significa |
|---|---|---|
gatto |
gatto |
Una semplice parola, probabilmente un token |
gatti |
gatti o gatto + s
|
Dipende dal tokenizzatore |
internazionalizzazione |
internazionalizzazione o pezzi più piccoli
|
Le parole lunghe spesso si dividono |
basato sull'intelligenza artificiale |
AI + - + potenziato
|
La punteggiatura può contare |
EHI!!! |
EHI + ! + ! + !
|
Sì, anche la punteggiatura può mangiare i token |
supercalifragilistico |
diversi pezzi, probabilmente | Immagino che la modella stia sospirando tra sé e sé 😅 |
Non esiste una regola universale che funzioni perfettamente per ogni modello.
Una stima approssimativa comune è che un token rappresenti spesso pochi caratteri o parte di una parola. Ma questa è solo una regola empirica, non una verità assoluta. Il testo in inglese di solito si tokenizza in modo più efficiente rispetto ad altre lingue, e il codice può comportarsi in modo ancora diverso.
Ecco perché una frase apparentemente breve potrebbe utilizzare più token del previsto. E un lungo paragrafo di parole comuni potrebbe essere tokenizzato in modo più fluido rispetto a un paragrafo ricco di termini tecnici, simboli o formattazione insolita.
4. Come l'IA utilizza i token per generare testo
Ecco la parte un po' magica, anche se si tratta di matematica travestita da mago 🧙.
Quando si digita un prompt, il sistema di intelligenza artificiale fa qualcosa del genere:
-
Divide il testo in token
-
Converte ogni token in un numero o in una rappresentazione numerica
-
Analizza i modelli e le relazioni dei token
-
Prevede il prossimo token probabile
-
Ripete quel processo di previsione
-
Trasforma i token generati nuovamente in testo leggibile
Quindi se digiti:
Il cielo è
Il modello potrebbe prevedere:
blu
Ma potrebbe anche prevedere:
nuvoloso
che cade
non il limite
pieno di stelle
L'output scelto dipende dal modello, dal prompt, dal contesto e dalle impostazioni che controllano la casualità o la creatività.
Ecco perché la scrittura generata dall'IA a volte risulta fluida e altre volte si perde in dettagli insignificanti. Prevede una sequenza di parole dopo l'altra basandosi su schemi appresi, non estrae frasi complete da un archivio.
Ciò non significa che il modello sia "solo un completamento automatico" nel senso più banale del termine. I grandi modelli di intelligenza artificiale apprendono relazioni estremamente complesse tra concetti, linguaggio, struttura, tono, logica e contesto. Ma a livello di output, la macchina produce comunque testo un token alla volta.
Piccoli gradini. Grande illusione. Una scala molto elegante.
5. Tabella comparativa: Tipologie di token nell'IA
I token possono presentarsi in forme diverse a seconda del modello, del tokenizzatore e del tipo di contenuto. Ecco un confronto pratico.
| Tipo di token | Esempio | Dove appare | Perché è importante |
|---|---|---|---|
| Token di parola | mela |
Semplici messaggi di testo | Facile da capire, ordinato e pulito |
| token della sottoparola |
giocare + ing
|
Parole più lunghe o modificate | Aiuta l'IA a gestire le parole sconosciute |
| Token del personaggio |
a, b, c
|
Alcuni sistemi di tokenizzazione | Flessibile, ma può essere inefficiente |
| Token di punteggiatura |
., ?, !
|
Ogni tipo di scrittura, in modo fastidioso | Influisce sul tono e sul conteggio dei token |
| Token di spazio bianco | spazi, interruzioni di riga | Testo formattato e codice | La formattazione non è gratuita, purtroppo |
| Codice binario |
funzione, {, ==
|
Suggerimenti di programmazione | Il codice può bruciare rapidamente i token |
| Chiave speciale | indicatori di inizio/fine | Dietro le quinte | Aiuta l'input della struttura del modello |
| Pezzo sconosciuto o raro | frammenti insoliti | Nomi, gergo, errori di battitura | Può influire leggermente sulla precisione |
Non tutti i modelli di intelligenza artificiale utilizzano tutti questi elementi allo stesso modo. Alcuni sistemi si basano fortemente sulla tokenizzazione delle sottoparole perché bilancia efficienza e flessibilità. Permette al modello di gestire parole che non ha mai visto esattamente prima, suddividendole in parti che riconosce.
Ad esempio, se il modello comprende "micro", "bio"e "logia", ha maggiori probabilità di funzionare correttamente con parole scientifiche complesse, anche quando sono insolite.
Non è perfetto. Ma è piuttosto ingegnoso. 🧩
6. Cos'è un token nell'IA? Perché influisce sui costi?
Molti strumenti di intelligenza artificiale misurano l'utilizzo in token.
Ciò significa che sia il tuo input che l'output dell'IA contribuiscono al consumo di token. Se invii un prompt lungo, vengono utilizzati più token. Se il modello fornisce una risposta lunga, anche in questo caso vengono utilizzati più token.
Una breve domanda come:
Spiega la gravità.
Utilizza un numero relativamente ridotto di token di input.
Ma questo suggerimento:
Spiega la gravità in modo dettagliato e comprensibile anche ai principianti, includendo esempi, confrontandola con il magnetismo, aggiungendo una tabella, riscrivendola per un bambino e infine trasformandola in un discorso.
Utilizza un numero maggiore di token di input e richiede anche un output più lungo.
Quindi il costo del token spesso deriva da entrambe le parti:
-
Token di input : ciò che invii al modello
-
Token di output : ciò che il modello genera
-
Token di contesto : conversazioni o documenti precedenti inclusi
-
Token di sistema : istruzioni nascoste che guidano il comportamento
Ecco perché le chat molto lunghe possono sembrare più lente o limitate. L'IA potrebbe conservare nel suo contesto le parti iniziali della conversazione. Come uno zaino pieno di mattoni. Mattoni preziosi, ma pur sempre mattoni.
Per le aziende che utilizzano l'IA tramite API, l'efficienza dei token può diventare un problema di budget. Un messaggio complesso ripetuto migliaia di volte può comportare uno spreco di denaro sorprendente. Un messaggio chiaro e conciso non è solo più gradevole alla vista, ma può anche essere più economico.
7. Limiti dei token e finestra di contesto dell'IA
La finestra di contesto è uno dei concetti più importanti legati ai token.
Si riferisce al numero di token che un modello di intelligenza artificiale può elaborare contemporaneamente. Ciò include il tuo prompt, i messaggi precedenti, i documenti incollati, le istruzioni e la risposta che viene generata.
Immaginate che l'IA abbia una lavagna. Tutto ciò che deve considerare deve poter essere riposto su quella lavagna. Una volta che la lavagna è piena, qualcosa deve cedere.
Ciò può portare a diverse situazioni:
-
Il modello potrebbe dimenticare le parti precedenti di una lunga conversazione
-
Potrebbe essere necessario riassumere un documento prima di analizzarlo
-
Le domande lunghe potrebbero lasciare meno spazio per risposte lunghe
-
Un contesto ripetitivo può oscurare i dettagli importanti
-
Il modello potrebbe concentrarsi maggiormente sulle informazioni recenti
Ecco perché una progettazione tempestiva è importante.
Un suggerimento come:
Leggi tutto e dimmi cosa è importante.
Può funzionare, ma potrebbe non essere la soluzione ideale.
Un suggerimento migliore potrebbe essere:
Riassumi l'argomentazione principale, elenca i rischi, identifica le contraddizioni e indicami le cinque azioni principali da intraprendere.
Questo conferisce al modello un compito più chiaro e lo aiuta a impiegare i token in attività di valore, anziché dover indovinare le tue intenzioni.
I token non sono solo un limite tecnico. Definiscono il modo in cui dovresti comunicare con l'intelligenza artificiale.
8. Perché la tokenizzazione aiuta l'IA a gestire un linguaggio indisciplinato
Il linguaggio umano è indisciplinato. Aggressivamente indisciplinato.
Le persone usano gergo, errori di battitura, emoji, abbreviazioni, alternanza di codice, nomi di marchi, hashtag, parole inventate e frammenti di frasi che sembrano caduti dalle scale.
La tokenizzazione aiuta l'IA a gestire questo groviglio.
Invece di dover memorizzare ogni singola parola, il modello può suddividere il testo sconosciuto in parti più piccole e conosciute. Questo aiuta a:
-
Errori di ortografia
-
Nuovi termini
-
Parole composte
-
Vocabolario tecnico
-
Nomi
-
gergo di internet
-
Emoji e simboli
-
Sintassi di programmazione
Ad esempio, una parola come:
ultrapersonalizzazione
Potrebbe non essere trattata come un'unica parola familiare. Ma l'IA potrebbe riconoscere elementi come:
-
ultra -
personale -
adozione
Questo gli dà una possibilità di combattere.
Questo è anche il motivo per cui la tokenizzazione è preziosa in diverse lingue. Alcune lingue hanno spazi ben definiti tra le parole. Altre non utilizzano gli spazi allo stesso modo. Alcune hanno forme lessicali complesse. Altre ancora combinano concetti in lunghe parole composte. I sistemi di token aiutano a standardizzare tutto ciò in unità elaborabili.
Non è esattamente un gesto aggraziato. È più come tagliare le verdure con una calcolatrice. Ma funziona 🥕.
9. Token in testo, immagini, audio e intelligenza artificiale multimodale
L'espressione " token" nell'IA viene solitamente utilizzata nei modelli testuali, ma il concetto più ampio può essere applicato anche al di là del testo.
Nell'IA multimodale, i sistemi possono elaborare immagini, audio, video o dati strutturati utilizzando unità simili a token. I dettagli differiscono, ma l'idea di base è simile: suddividere le informazioni complesse in parti più piccole che il modello può elaborare.
Per esempio:
-
Il testo può essere suddiviso in token di parole o sottoparole
-
Le immagini possono essere suddivise in porzioni o rappresentazioni visive
-
L'audio può essere suddiviso in segmenti temporali o unità codificate
-
Il codice può essere suddiviso in token correlati alla sintassi
-
Le tabelle possono essere trasformate in sequenze di token strutturate
Questo è importante perché l'intelligenza artificiale moderna non si limita più alla semplice "chat". È in grado di interpretare screenshot, descrivere immagini, analizzare grafici, trascrivere audio, ragionare sul codice e rispondere in diversi formati.
Ma lo stesso principio fondamentale continua a ripresentarsi:
Suddividi i dati di input in parti gestibili, converti queste parti in numeri e lascia che il modello apprenda le relazioni tra di esse.
In senso lato, si tratta di tokenizzazione.
Si tratta del livello di traduzione tra la consistenza umana e la struttura leggibile dalla macchina.
10. Come i token influenzano la progettazione dei prompt
Il termine "prompt engineering" suona più affascinante di quanto non sia in realtà. A volte significa semplicemente "chiedi in modo chiaro e smetti di riempire il prompt di informazioni inutili". Un'affermazione severa, ma accurata.
I token svolgono un ruolo fondamentale nel migliorare i suggerimenti.
Ecco alcuni modi pratici per utilizzare la consapevolezza dei token:
Sii specifico fin da subito
Metti il compito principale all'inizio:
Scrivi una descrizione concisa del prodotto per una lampada da scrivania economica.
Non:
Stavo pensando di creare qualcosa per la pagina di un prodotto, si tratta di una lampada, e ho bisogno di testo...
La seconda versione spreca gettoni e ritarda il raggiungimento del punto.
Rimuovere il materiale di riempimento non necessario
L'intelligenza artificiale è in grado di comprendere il linguaggio informale, ma le parti superflue compromettono il contesto. Non è necessario scrivere come un robot, ma snellire il testo aiuta.
Utilizzare la struttura
Intestazioni, elenchi puntati, passaggi numerati ed etichette possono aiutare il modello a capire cosa va dove.
Esempio:
-
Obiettivo:
-
Pubblico:
-
Tono:
-
Formato:
-
Vincoli:
Questo metodo solitamente offre prestazioni migliori rispetto a un blocco di testo.
Indica all'IA cosa ignorare
Questo è un potere discreto ma efficace.
Puoi dire:
Ignora le frasi fatte e concentrati solo sulle differenze di prezzo.
Ciò impedisce al modello di concentrare la propria attenzione su contenuti di scarso valore.
Mantieni organizzate le chat lunghe
Nelle conversazioni prolungate, è utile riassumere di tanto in tanto le decisioni chiave. Questo aiuta a preservare il contesto e a ridurre la confusione.
In sostanza, il prompting basato sui token è come fare la valigia. Puoi portare solo l'essenziale, oppure puoi portare tre padelle e poi chiederti perché i calzini non ti vanno bene.
11. Idee sbagliate comuni sui token AI
Chiariamo subito un paio di cose, perché parlare di simboli può facilmente generare confusione.
Errore comune n. 1: Un token equivale a una parola
No. A volte sì, spesso no. I token possono essere parole, parti di parole, punteggiatura o altri elementi.
Errore comune n. 2: Più gettoni significano sempre risposte migliori
Non necessariamente. Un prompt più lungo può essere utile se aggiunge un contesto prezioso. Ma un prompt troppo ricco di informazioni può confondere il modello o sprecare spazio.
Errore comune n. 3: i limiti dei token riguardano solo i documenti lunghi
Influenzano anche le normali chat, soprattutto se la conversazione si sviluppa su più turni. Il modello potrebbe dover tenere conto dei messaggi precedenti, delle istruzioni e della tua ultima richiesta.
Errore comune n. 4: l'IA comprende i token come gli esseri umani comprendono le parole
Non nel senso umano del termine. Gli esseri umani associano alle parole esperienze vissute, ricordi sensoriali, intenzioni ed emozioni. I modelli di intelligenza artificiale elaborano schemi statistici e semantici in sequenze di token. Questo può produrre ragionamenti impressionanti, ma non è lo stesso processo.
Errore comune n. 5: La tokenizzazione è una noiosa operazione di backend
Sembra noioso. Non lo è. La tokenizzazione influenza costi, velocità, memoria, precisione ed esperienza utente. Una piccola cerniera, una porta gigantesca 🚪.
12. Esempi concreti di token nell'IA
Cerchiamo di rendere il concetto meno astratto.
Esempio 1: Conversazione con un chatbot
Tu digiti:
Puoi scrivere un'email cortese chiedendo un rimborso?
L'IA suddivide il tutto in token, comprende lo schema della richiesta e genera una risposta token per token.
Esempio 2: Riassunto esteso del documento
Incolli un documento di policy. L'IA lo suddivide in token. Se rientra nella finestra di contesto, perfetto. Altrimenti, lo strumento potrebbe doverlo suddividere in blocchi, riassumere o troncare.
Esempio 3: Assistente alla programmazione
Tu chiedi:
Correggi questa funzione JavaScript.
Il codice spesso utilizza simboli, indentazioni, operatori e una sintassi specifica. Anche questi elementi vengono tokenizzati. Ecco perché i prompt ricchi di codice possono consumare rapidamente molti token.
Esempio 4: Scrittura di articoli SEO
Una richiesta che include titolo, schema, intestazioni, parole chiave, tono, esempi e meta descrizione utilizza più token rispetto a una richiesta di base. Anche l'output utilizza molti token perché l'articolo è lungo.
Esempio 5: Automazione dell'assistenza clienti
Un'azienda potrebbe inviare all'IA un messaggio del cliente, i dettagli dell'account, frammenti di policy e regole di risposta. Tutto ciò si trasforma in token. Maggiore è il contesto incluso, maggiore attenzione il sistema deve prestare ai limiti e ai costi.
Una volta che inizi a notarli, i token compaiono ovunque. Come la polvere alla luce del sole, ma in chiave più nerd.
13. Perché comprendere i token ti rende più bravo a usare l'IA
Non è necessario diventare un ingegnere di machine learning per trarre vantaggio dalla comprensione dei token.
Una conoscenza di base ti aiuta a:
-
Scrivi prompt più chiari
-
Evitare di sovraccaricare il modello
-
Capire perché a volte le lunghe conversazioni prendono una piega inaspettata
-
Spiega perché una richiesta costa più di un'altra
-
Creare riassunti migliori
-
Lavora in modo più efficiente con i documenti
-
Ottieni risultati di intelligenza artificiale più coerenti
Ti aiuta anche a smettere di considerare l'IA come una scatola magica.
Questa è una cosa positiva. Pensare come se si trattasse di una scatola magica porta a aspettative distorte. Pensare in termini di token rende lo strumento più gestibile.
Quando si comprende che l'IA funziona attraverso schemi ricorrenti, si iniziano a porre domande migliori. Si fornisce un contesto più completo. Si evita di riversare un romanzo nella chat e chiedere "che ne pensi?" - cosa che, a dire il vero, la maggior parte di noi ha desiderato fare almeno una volta.
Quanto migliore è il tuo input, tanto più preciso sarà il percorso dei token che il modello sarà in grado di seguire.
14. Che cos'è un token nell'IA? Il punto chiave pratico
Quindi, cos'è un token nell'IA? È una piccola unità di testo o dati che un modello di IA elabora.
Ma la risposta più pratica è questa:
Un token è l'elemento fondamentale di comunicazione tra il linguaggio umano e il ragionamento automatico. È il modo in cui la tua frase complessa, carica di emozioni e piena di errori di battitura si trasforma in qualcosa che un modello può utilizzare per effettuare calcoli.
I token influenzano il modello:
-
Comprensione
-
Memoria
-
Costo
-
Velocità
-
lunghezza di uscita
-
Precisione
-
Formattazione
-
Gestione del contesto
Sono invisibili per la maggior parte del tempo, ma sono sempre presenti.
Ogni richiesta che scrivi si trasforma in token. Ogni risposta che leggi è stata generata da token. Ogni paragrafo, virgola, emoji, frammento di codice e frase goffa viene scomposto in unità che il modello può elaborare.
Anche questa frase è fatta di token. Molto meta. Leggermente fastidiosa. In un certo senso bella. ✨
15. Nota conclusiva
Che cos'è un token nell'IA? Un token è una piccola porzione di linguaggio che i modelli di IA utilizzano per leggere, interpretare e generare testo. Può essere una parola, una parte di parola, un segno di punteggiatura, uno spazio o un'altra piccola unità, a seconda del tokenizzatore.
Comprendere i token aiuta a capire perché gli strumenti di intelligenza artificiale hanno dei limiti, perché i prompt lunghi costano di più, perché il contesto è importante e perché le istruzioni chiare di solito funzionano meglio di paragrafi lunghi e complessi.
All'inizio può sembrare tutto molto tecnico, ma in realtà si riduce a qualcosa di pratico:
L'intelligenza artificiale non elabora il linguaggio nella sua interezza, come farebbe un essere umano. Lo scompone in token, ne studia gli schemi e prevede cosa dovrebbe seguire.
Piccoli pezzi. Risultati enormi. Una piccola meraviglia singolare 🤖✨
Esempio concreto: creazione di un assistente di assistenza clienti efficiente in termini di token
Scenario
Un piccolo rivenditore di mobili online utilizza un assistente basato sull'intelligenza artificiale per redigere risposte ai reclami relativi alle consegne, alle richieste di rimborso e alle segnalazioni di articoli danneggiati.
Nella sua prima versione, l'assistente riceve l'intero manuale dei resi, la cronologia completa dei messaggi del cliente, i dettagli dell'ordine, diverse risposte di esempio e un lungo insieme di regole di scrittura ogni volta che qualcuno apre un ticket. Di solito produce una risposta accettabile, ma il prompt è eccessivamente lungo, le richieste richiedono più tempo per essere elaborate e i dettagli importanti possono essere nascosti sotto testi di policy irrilevanti.
Il responsabile dell'assistenza riprogetta il flusso di lavoro in modo che ogni richiesta contenga solo le sezioni relative alle policy pertinenti al ticket. I messaggi più vecchi vengono sostituiti con un breve riepilogo fattuale, mentre il messaggio corrente del cliente rimane invariato. Ciò lascia più spazio per la gestione dell'attività stessa e per la relativa risposta.
Di cosa ha bisogno l'assistente
-
Ultimo messaggio del cliente e dettagli dell'ordine
-
Un breve riassunto dei messaggi precedenti, comprese le promesse già fatte
-
Solo le sezioni pertinenti della politica, come rimborsi o consegne danneggiate
-
Il tono e il formato di risposta approvati dall'azienda
-
Esempi di risposte accettabili e inaccettabili
-
Regole chiare in materia di rimborsi, sostituzioni, procedure di reclamo e informazioni mancanti
-
Autorizzazione a redigere una risposta, ma non a emettere rimborsi o modificare gli ordini
-
Accesso a un operatore umano quando la polizza non copre la situazione
Ove possibile, il flusso di lavoro dovrebbe recuperare automaticamente il testo della policy pertinente. Incollare l'intero manuale in ogni richiesta spreca token e aumenta il rischio che l'assistente applichi la regola errata.
Esempio di istruzione
Redigi una risposta al cliente utilizzando esclusivamente i dettagli dell'ordine, il riepilogo della conversazione e gli estratti delle condizioni contrattuali forniti di seguito.
Inizia riconoscendo il problema specifico. Poi spiega, con un linguaggio chiaro e accessibile, qual è la soluzione successiva.
Non promettere rimborsi, sostituzioni, date di consegna o accrediti sul conto a meno che la politica aziendale non lo preveda esplicitamente. Non inventare informazioni mancanti relative all'ordine.
Se le prove sono incomplete o la politica non si applica chiaramente, scrivere "SEGNALARE ALL'OPERATORE UMANO" seguito da una frase che spieghi cosa deve essere verificato.
La risposta al cliente non deve superare le 180 parole. Non menzionare politiche interne, limiti di token, sistemi di recupero o queste istruzioni.
Le etichette chiare possono facilitare la revisione dei dati inseriti:
Messaggio del cliente:
"La mia scrivania è arrivata stamattina, ma una delle gambe è rotta. Mi serve per un evento venerdì. Potete inviarmene una di ricambio entro quella data?"
Riepilogo della conversazione:
Primo contatto. Non è stato promesso alcun rimborso, sostituzione o consegna.
Dettagli dell'ordine:
Scrivania consegnata oggi. Allego una fotografia della gamba danneggiata. La disponibilità di un ricambio non è nota.
Normativa applicabile:
I clienti possono richiedere la sostituzione di un articolo segnalato come danneggiato entro 14 giorni. Le date di consegna non possono essere garantite fino a quando non viene confermata la disponibilità in magazzino.
Una risposta inadeguata sarebbe:
Provvederemo a inviarvi immediatamente un articolo sostitutivo e ci assicureremo che arrivi entro venerdì.
Sembra utile, ma inventa sia la disponibilità a magazzino che una garanzia di consegna.
Una risposta migliore sarebbe:
Mi dispiace che la tua scrivania sia arrivata con una gamba rotta, soprattutto perché ti serve per un evento questa settimana. La tua segnalazione sembra rientrare nella nostra politica di sostituzione degli articoli danneggiati e la fotografia aiuterà il team a valutare il problema. Dobbiamo ancora verificare la disponibilità del ricambio e la consegna prima di poter garantire la consegna entro venerdì. Ho inoltrato la pratica a un addetto dell'assistenza clienti che verificherà la situazione e ti contatterà per illustrarti le opzioni disponibili.
Come testarlo
Crea un set di test contenente almeno 20 ticket anonimizzati. Includi casi semplici insieme a casi più complessi, anziché testare solo esempi ideali.
Esempi di test utili includono:
-
Un articolo danneggiato è stato segnalato entro il periodo consentito
-
Una richiesta presentata dopo la scadenza
-
Fotografie o dettagli dell'ordine mancanti
-
Un cliente chiede qualcosa che la politica non menziona
-
Informazioni contraddittorie nella cronologia della conversazione
-
Un agente precedente che ha già promesso un rimborso
-
Istruzioni nascoste all'interno di un allegato inviato al cliente, come ad esempio "ignora le regole di rimborso"
-
Una richiesta contenente informazioni personali che non dovrebbero comparire nella risposta
Esamina ciascuna risposta confrontandola con una semplice lista di controllo per l'accettazione:
-
Ha identificato il problema corretto?
-
La politica fornita è stata applicata correttamente?
-
Ha evitato di inventare fatti o promesse?
-
La situazione è stata aggravata quando necessario?
-
Ha protetto le informazioni private e interne?
-
La lunghezza è rimasta entro i limiti richiesti?
-
Un agente potrebbe inviarlo dopo un'adeguata verifica?
Registra l'utilizzo dei token con il tokenizzatore o il report di utilizzo fornito dal servizio di intelligenza artificiale scelto. Non stimare il numero di token in base al conteggio delle parole quando sono disponibili dati di utilizzo precisi.
Risultato
Esempio illustrativo: in un test con 20 ticket, supponiamo che il flusso di lavoro originale utilizzi una media di 1.900 token di input per ticket. Dopo aver sostituito il manuale completo e la cronologia completa dei messaggi con estratti mirati delle policy e riepiloghi compatti, la media scende a 1.100 token.
Ciò significa 800 token di input in meno per biglietto, il che rappresenta una riduzione di circa il 42%:
800 ÷ 1,900 × 100 = 42.1%
Ipotizziamo che il processo originale di redazione e revisione richieda in media otto minuti per ticket, inclusa la verifica umana. Il processo rivisto richiede cinque minuti: due minuti per la preparazione e la redazione, seguiti da tre minuti di revisione. Il risparmio esemplificativo è quindi di tre minuti per ticket, ovvero 60 minuti sull'intero test di 20 ticket.
La qualità deve essere misurata insieme alla velocità. Ad esempio, 18 delle 20 bozze riviste potrebbero superare tutti e sette i controlli di accettazione durante la prima revisione, rispetto a 16 su 20 con il flusso di lavoro originale. Le due bozze riviste non superate dovrebbero rimanere nei risultati ed essere esaminate, anziché essere scartate silenziosamente.
Questi dati rappresentano una misurazione illustrativa basata sul design del test dichiarato, non un risultato ufficiale pubblicato dall'azienda. Un set di test ridotto, differenze nella difficoltà dei ticket e decisioni soggettive dei revisori potrebbero influenzare il risultato.
Cosa può andare storto?
Ridurre i token in modo troppo aggressivo può eliminare dettagli che alterano la risposta corretta. Un riepilogo che afferma "il cliente ha richiesto un rimborso", ad esempio, potrebbe omettere il fatto che un operatore precedente lo aveva già approvato.
Il recupero delle informazioni può anche selezionare la sezione errata della policy. L'assistente potrebbe quindi produrre una risposta elaborata basata su regole irrilevanti. Il testo di origine importante dovrebbe pertanto rimanere visibile all'agente che effettua la revisione.
Altri errori comuni includono politiche obsolete, dati dei clienti presenti nei registri, istruzioni nascoste all'interno di documenti caricati, regole di escalation vaghe e un assistente che dichiara di aver completato un'azione quando in realtà ha solo redatto una risposta.
L'obiettivo non è creare il prompt più breve possibile, bensì eliminare le ripetizioni preservando al contempo ogni fatto, regola ed eccezione necessari per una decisione sicura.
Da portare via in modo pratico
L'efficienza dei token deriva dalla selezione di un contesto migliore, non dalla semplice eliminazione di parole. Fornisci all'assistente la richiesta corrente, le prove pertinenti, le regole applicabili e un confine chiaro per l'incertezza. Tutto il resto deve giustificare lo spazio che occupa.
Domande frequenti
Che cos'è un token nell'intelligenza artificiale, in termini semplici?
Nell'intelligenza artificiale, un token è una piccola unità di testo o di dati elaborata da un modello. Può trattarsi di una parola completa, di una parte di parola, di un segno di punteggiatura, di uno spazio o di un simbolo. I sistemi di intelligenza artificiale suddividono i input in token, li convertono in rappresentazioni numeriche e si basano su schemi appresi per prevedere il token successivo nella risposta.
Un token di intelligenza artificiale equivale a una parola?
No, un token non corrisponde sempre a una parola. Le parole comuni possono formare un singolo token, mentre i termini lunghi, insoliti o tecnici possono essere suddivisi in diversi token che rappresentano sottoparole. Anche la punteggiatura, le emoji, gli spazi e la formattazione possono contribuire al conteggio dei token. La suddivisione precisa dipende dal tokenizzatore utilizzato dal modello di intelligenza artificiale.
In che modo i modelli di intelligenza artificiale utilizzano i token per generare risposte?
Un modello di intelligenza artificiale suddivide innanzitutto la tua richiesta in token e li converte in rappresentazioni numeriche. Successivamente, analizza le relazioni tra questi token e prevede quale token ha maggiori probabilità di essere il successivo. Questo processo continua fino al completamento della risposta. Ogni previsione è influenzata dalla richiesta, dal contesto della conversazione, dalle impostazioni del modello e dai token già generati.
Perché i token influiscono sul costo di utilizzo dell'intelligenza artificiale?
Molti servizi di intelligenza artificiale calcolano l'utilizzo in base al numero di token elaborati. I token di input provengono dal prompt dell'utente e dal contesto di supporto, mentre i token di output provengono dalla risposta del modello. Documenti lunghi, istruzioni ripetute e risposte prolisse aumentano quindi l'utilizzo. Per le aziende che gestiscono un elevato numero di richieste API, la rimozione del testo superfluo può contribuire a tenere sotto controllo i costi.
Che cos'è una finestra di contesto AI e in che modo i token la influenzano?
La finestra di contesto rappresenta la quantità massima di informazioni tokenizzate che un modello di intelligenza artificiale può considerare durante una richiesta. Può includere istruzioni di sistema, il prompt dell'utente, documenti caricati, messaggi precedenti e la risposta generata. Man mano che la finestra disponibile si riempie, le informazioni più vecchie o a bassa priorità potrebbero ricevere meno attenzione. Un contesto chiaro e pertinente preserva più spazio per un'analisi e un output mirati.
Cosa succede quando un prompt dell'IA supera il limite di token?
Quando una richiesta è troppo lunga per la finestra di contesto disponibile, il sistema può troncare, riassumere, dividere o escludere parte del contenuto. Il comportamento esatto dipende dallo strumento. Dettagli importanti possono essere persi se compaiono in sezioni omesse. Un approccio comune consiste nel dividere i documenti lunghi in sezioni logiche, analizzare ciascuna di esse e quindi combinare i risultati.
Come posso ridurre l'utilizzo dei token nei miei prompt?
Iniziate con il compito principale ed eliminate le informazioni di sfondo che non influiscono sulla risposta. Utilizzate etichette chiare come obiettivo, pubblico, formato, tono e vincoli, anziché ripetere le istruzioni in tutto il prompt. Nelle conversazioni lunghe, fornite un riepilogo conciso delle decisioni chiave. I prompt strutturati generalmente aiutano il modello a identificare le priorità senza sprecare contesto in informazioni superflue.
Perché il codice, la formattazione e la punteggiatura utilizzano token di intelligenza artificiale?
I modelli di intelligenza artificiale elaborano più delle semplici parole. Operatori, parentesi, rientri, interruzioni di riga, punteggiatura e altri elementi di formattazione possono diventare token separati o frammenti di token. Di conseguenza, i prompt ricchi di codice e i documenti altamente formattati possono consumare rapidamente i token. Preservare la formattazione rilevante è importante, ma rimuovere il codice duplicato, i commenti non necessari o il testo ripetitivo può rendere una richiesta più efficiente.
Che cos'è un token nell'ambito dell'intelligenza artificiale per immagini, audio e modelli multimodali?
Nell'intelligenza artificiale multimodale, il termine token può riferirsi a unità elaborabili che vanno oltre il linguaggio scritto. Le immagini possono essere rappresentate tramite patch o caratteristiche visive, mentre l'audio può essere suddiviso in segmenti codificati. Il metodo tecnico varia da sistema a sistema, ma il principio di base rimane simile: le informazioni complesse vengono convertite in unità numeriche più piccole che il modello può confrontare, interpretare e utilizzare per generare un output.
L'utilizzo di un maggior numero di token produce una risposta migliore da parte dell'IA?
Non automaticamente. I token aggiuntivi sono utili quando forniscono contesto, esempi, requisiti o materiale di riferimento pertinenti. Istruzioni ripetitive o contraddittorie, tuttavia, possono distrarre il modello e ridurne la coerenza. Il prompt più efficace di solito contiene dettagli sufficienti a definire chiaramente il compito senza sovraccaricarlo. La qualità e l'organizzazione dei token spesso contano più della semplice quantità di testo.
Riferimenti
-
Centro assistenza OpenAI : help.openai.com
-
Piattaforma OpenAI - platform.openai.com
-
Sviluppatori OpenAI - developers.openai.com
-
Google per sviluppatori - developers.google.com
-
Hugging Face - huggingface.co
-
TensorFlow - tensoreflow.org
-
Ricerca Google - research.google