✔️✔️ Doppie Spunte Blu Cap. 12 · Il bestiario dei modelli

Puntata 127

Puntata 127 — Grok di xAI

Livello: ✔️✔️ Doppie Spunte Blu · Capitolo 12 · Il bestiario dei modelli

Il “modello con personalità”, profondamente integrato con X (ex-Twitter). Fast, real-time, meno filtrato. Il prezzo: politica forte attorno al prodotto, scelta da fare con consapevolezza.

un robottino con occhiali scuri e mantello rosso, in posa irriverente, sopra uno sfondo di feed X scrollabile. Accanto, un piccolo cluster GPU enorme etichettato “Colossus” (il datacenter Memphis di xAI)

xAI in 3 righe

Fondata nel 2023 da Elon Musk con team da OpenAI, Tesla, DeepMind. Sede Bay Area. Investitori vari, valutazione ~$50B nel 2025. Differenziatore strategico: integrazione profonda con X (la piattaforma social di Musk), dati real-time di X come asset di training.

Il prodotto principale: Grok, ora alla versione Grok 3 / Grok 4 nel 2026.


La famiglia Grok (2026)

  • Grok 4 — flagship general purpose multimodale.
  • Grok 4 Fast — variante low-latency.
  • Grok 4 Heavy — modello “thinking” extended, alto compute.
  • Aurora — image generation di xAI.
  • Grok per developer: API disponibile via xAI Console.

⚠️ Versioni in evoluzione veloce. Nel 2025, xAI ha rilasciato Grok 3 con un balzo qualitativo significativo, poi Grok 4 nel 2026.


Le 4 caratteristiche distintive

1. Integrazione X (real-time data)

Grok ha accesso nativo a tutti i post di X in tempo reale. Quando chiedi “cosa pensa la gente del nuovo iPhone?” o “cosa è successo nelle ultime ore su [argomento]?”, Grok cerca su X e sintetizza.

Punto di forza unico: velocità di reazione su trend e breaking news. Spesso ha sentiment sociale in real-time prima dei tradizionali answer engines.

2. Personalità “spinta”

Grok è positionato come “meno filtrato” rispetto a competitor:

  • Tono più informale, ironico, talvolta provocatorio.
  • Disposto a rispondere su topic “scivolosi” che altri rifiutano.
  • “Modes” personalizzabili (es. “fun mode”, “research mode”).

Per gli utenti stanchi di hedging eccessivo e disclaimer, è una caratteristica gradita. Per altri, è motivo di preoccupazione editoriale.

3. Compute scale ambizioso

xAI ha costruito Colossus, datacenter di Memphis con 100k+ GPU H100/H200 (espandibile a 1M secondo i piani). È uno dei più grandi cluster AI del mondo.

Conseguenza: training velocissimi, modelli aggiornati spesso.

Grok in app X funziona simile a Perplexity (puntata 126): risposte con fonti, ma le fonti sono spesso post di X stessi, non siti esterni. Differenzia il “knowledge base” da cui pesca.


Quando scegliere Grok

✅ Trend social, opinione pubblica in real-time

Per capire cosa sta dicendo “Internet” su un evento appena successo, Grok è imbattibile.

✅ Domande che altre AI rifiutano

Per chi trova OpenAI/Anthropic/Google troppo over-cautious, Grok risponde di più. Da usare con responsabilità: il fatto che risponda non significa che il contenuto sia accurato o appropriato.

✅ Utenti X power-user

Se vivi su X, Grok è integrato nell’app stessa (icona accanto al feed). Zero context-switching.

⚠️ Coding produzione

Grok 3/4 è competitivo ma raramente la scelta default rispetto a Claude.

❌ Compliance / enterprise UE

Verifica termini: il legame con X e la posizione editoriale di Musk creano frizioni con alcuni clienti enterprise.

❌ Quando ti serve neutralità “tecnica”

La personalità del modello riflette spinte editoriali. Per task neutrali (es. analisi finanziaria oggettiva), modelli con “tone più piatto” come Claude o Gemini possono essere preferibili.


La controversia attorno a Grok

Grok è il modello più politicizzato del frontier 2026. Motivi:

1. Posizione editoriale di Musk

Elon Musk è figura pubblica con posizioni forti. Le decisioni di training (cosa filtrare, cosa permettere, quali “modes” offrire) riflettono quelle posizioni in modo più visibile rispetto ad altri provider.

2. Incidenti documentati

Nel 2024-25 ci sono stati casi pubblici di:

  • Grok che ripeteva contenuti antisemiti dopo modifiche al system prompt (luglio 2025, “MechaHitler incident”, successivamente corretto e con scuse di xAI).
  • Output politici considerati problematici in eventi elettorali.
  • Modifiche apparenti del comportamento del modello senza annunci pubblici, scoperte da utenti.

Conseguenza: trust più basso per uso istituzionale rispetto a competitor.

3. Dati di training da X

Usare i post di X come dataset di training significa amplificare bias e tossicità presenti sulla piattaforma — a meno di curation aggressiva. Bilanciamento difficile.

4. Open-weight di Grok 1, poi closed

Grok 1 (vecchia versione) è stata rilasciata open. Grok 3/4 sono closed. Coerenza editoriale variabile.


Pricing tipico (snapshot 2026)

CanalePrezzo
X Premium ($8-16/mese)Accesso a Grok nell’app X
X Premium+ ($40/mese)Limiti più alti, accesso a modelli top
SuperGrok ($30/mese)Piano standalone, web + mobile
API xAI$3-15 / 1M token input, $15-30 / 1M output

Per la maggior parte degli utenti retail: incluso in X Premium, già pagato per altri motivi (ads-free, post lunghi).


Aurora — l’image gen di xAI

Lanciata nel 2024, Aurora è il modello di generazione immagini di xAI:

  • Più permissivo sui contenuti rispetto a DALL-E / Imagen.
  • Genera anche persone famose che altri rifiutano (anche se con qualche limite).
  • Qualità competitive con DALL-E 3, sotto Midjourney v7 / Flux Pro per artigianalità.

Posizione: utile per utility content (mockup, idee, illustrazioni rapide), problematico per deepfake risk (vedi puntata 79, 257).


I limiti onesti

⚠️ Trust istituzionale basso: aziende e governi spesso cauti nell’usare Grok per uso ufficiale, dopo gli incidenti.

⚠️ Dipendenza X: se X è giù o cambia policy, Grok ne risente.

⚠️ Filtri “spostati”: il fatto che rifiuti meno significa anche che i guardrail sono più deboli. Per produzione consumer, può essere problematico (hate speech, disinformazione facilitata).

⚠️ Ricezione UE: l’AI Act (puntata 191) ha classificato alcuni use case come ad alto rischio. Disponibilità in EU può essere limitata.

⚠️ Adoption enterprise: nonostante la qualità tecnica, molte aziende grandi preferiscono OpenAI/Anthropic/Google per ragioni reputazionali e contractual.


Confronto rapido con i top frontier (2026)

AspettoGrok 4GPT-5Claude 4.7Gemini 2.5 Pro
Real-time social⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐
Coding⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐
Scrittura⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐
Multimodale⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐
“Personalità”⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐
Filtri (meno = più permissivo)⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐
Trust enterprise⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐

Profilo unico: forza nel social/real-time, debolezza nell’enterprise trust.


La questione “modello + piattaforma”

Grok è l’esempio più estremo di un trend del 2026: fusione tra modello AI e piattaforma social. Pro:

  • Dati real-time fluiscono direttamente nel modello.
  • Distribuzione massiva (X ha 500M+ utenti attivi).
  • Loop continuo di feedback.

Contro:

  • Bias della piattaforma diventa bias del modello.
  • Decisioni editoriali della piattaforma riflesse nel modello.
  • Single point of failure.

Trend opposto: Anthropic rifiuta esplicitamente questo modello, mantiene Claude come “modello + API senza piattaforma sociale”. Filosofie diverse.


TEST pratico (5 minuti)

Se hai accesso a X Premium o a x.ai console:

  1. Prendi una domanda sull’attualità di oggi (notizia di poche ore fa).
  2. Confronta:
    • Grok (in app X o web).
    • Perplexity (puntata 126).
    • ChatGPT con search.
    • Gemini con grounding.
  3. Quale ha la risposta più aggiornata?
  4. Quale ha le fonti più affidabili (verifica cliccandole)?
  5. Quale ha il tono che preferisci?

Spesso: Grok vince sulla recency social, Perplexity vince sulla qualità delle fonti, Claude vince sulla profondità di sintesi.


La domanda etica

Usare Grok è una scelta consapevole: significa contribuire economicamente a una piattaforma con posizioni editoriali specifiche, e accettare i suoi compromessi sui guardrail.

Per uso personale, è una questione di preferenza e principi individuali.

Per uso professionale/aziendale, va valutato in policy: alcuni datori di lavoro vietano esplicitamente l’uso di Grok per task aziendali, per ragioni reputazionali o di compliance.

La scelta del modello è anche scelta di valori, soprattutto nel 2026.


Take-away in una riga

Grok ha forze tecniche reali (real-time X, compute scale, personalità) e debolezze reali (trust, filtri, dipendenza editoriale). Scegli con consapevolezza, non per fanboy o boicottaggio.

➡️ Prossima puntata: Reasoning vs rapidi — o-series, thinking, fast.