La nuova guida al prompting di OpenAI: concentrati sui risultati, non su script passo dopo passo

OpenAI ha rilasciato un nuovo framework di prompting che mette in discussione l'ossessione tradizionale per la "chain-of-thought", esortando gli utenti a dare priorità ai risultati piuttosto che a istruzioni rigide. Questo cambiamento segnala una transizione verso interazioni più intuitive e basate sul ragionamento, in cui al modello viene concessa autonomia invece di uno script restrittivo.

I quattro pilastri di un prompting efficace

Invece di fornire un manuale complesso di parametri API o schemi elaborati, OpenAI sta semplificando l'architettura del prompting in quattro componenti opzionali: Obiettivo (Goal), Contesto (Context), Formato di Output (Output Format) e Vincoli (Boundaries). Fondamentalmente, nessuno di questi è obbligatorio. Per query semplici, un prompt breve spesso produce risultati migliori rispetto a un set di istruzioni eccessivamente strutturato.

La filosofia centrale di questa guida è "iniziare in piccolo". OpenAI suggerisce che gli utenti dovrebbero partire dal risultato desiderato piuttosto che da una sequenza di passaggi granulari. Descrivendo l'obiettivo finale invece del processo, si permette a modelli come GPT-4o di cercare, confrontare informazioni e regolare il proprio approccio autonomamente. Le descrizioni dettagliate del processo dovrebbero essere utilizzate solo quando la metodologia specifica è importante quanto il risultato finale.

Vincoli invece di scripting

Un insegnamento fondamentale per sviluppatori e utenti esperti è che i vincoli sono più efficaci degli script passo dopo passo. Invece di cercare di microgestire ogni mossa dell'IA, OpenAI raccomanda di implementare una o due "regole ferree" per prevenire comportamenti indesiderati. Gli esempi includono direttive come "Mantieni invariati i dati del budget approvato" o "Prepara questo come bozza; non inviarlo".

Questo approccio "less-is-more" si estende alla gestione del contesto. La guida consiglia di allegare solo file — come PDF, fogli di calcolo o immagini — che influenzino effettivamente la risposta. Per il lavoro professionale ad alto rischio, OpenAI suggerisce un ciclo di "auto-verifica", in cui si chiede esplicitamente al modello di controllare il proprio output per errori specifici, come assicurarsi che ogni attività abbia un responsabile e una scadenza designati.

Differenziare la Chat dal "Work" e potenziare Codex

OpenAI sta anche formalizzando la distinzione tra "Chat" e "Work". Mentre la Chat è destinata a query rapide e riformulazioni, il "Work" si riferisce a compiti gravosi che attingono da molteplici fonti (come Gmail, Slack o GitHub) per produrre output consistenti. Sebbene i compiti di tipo Work consumino più crediti, sono progettati per automatizzare flussi di lavoro complessi e ricorrenti.

Per gli sviluppatori che utilizzano Codex, la guida introduce sofisticate capacità di steering e sandboxing. Gli utenti possono ora utilizzare il comando "Steer" per reindirizzare un'esecuzione in corso o "Queue" per mettere in coda l'istruzione successiva. Per gestire progetti di codifica complessi, OpenAI ha introdotto specifici comandi slash:

  • /plan: Analizza il codice e propone un approccio prima dell'esecuzione.
  • /goal: Imposta un obiettivo di alto livello che il modello monitora attraverso più passaggi.
  • /review: Consente audit di sicurezza e logica locali o integrati con GitHub.

Punti chiave

  • Dare priorità ai risultati: Inizia con il risultato desiderato; definisci il processo solo se i passaggi specifici sono essenziali per il compito.
  • Usare vincoli, non script: Utilizza confini netti per prevenire errori invece di cercare di programmare ogni singolo movimento del modello.
  • Sfruttare i comandi specializzati: Utilizza i comandi slash di Codex come /plan e /goal per gestire flussi di lavoro tecnici complessi e multi-fase.