Passa al contenuto principale

Modelli AI e assistenti

Tutti i livelli

Claude è il nostro nucleo — ma le stesse skill viaggiano. Questa sezione allarga la lente all'intero mondo AI: gli assistenti principali, come si differenziano, quando usare quale, e le tecniche che si trasferiscono attraverso tutti.

What you'll learn
  • Scegliere il modello giusto per un lavoro senza dover ri-imparare il campo ogni volta
  • Muoverti tra assistenti — ChatGPT, Gemini, Grok, modelli open — senza perdere la tua tecnica
  • Far girare modelli capaci sulla tua macchina, e sapere quando ne vale la pena
  • Combinare Claude con modelli locali e framework di agenti

Comincia qui

Se leggi una pagina in questa sezione, leggi questa. Tutto ciò che sta sotto è un ramo da qui.

Poi segui il filo che corrisponde a quello che stai facendo.

Vieni da un altro assistente

Conosci già uno strumento e vuoi che le tue abitudini si trasferiscano.

Confrontare prima di impegnarti

Far girare modelli in proprio

I modelli locali scambiano un po' di capability per privacy, controllo dei costi e lavoro offline. Queste pagine coprono quando quello scambio vale la pena.

Agenti oltre Claude

Tutto in questa sezione

La lista completa, incluse pagine aggiunte da quando questo indice è stato scritto.

Aggiornamento GPT-5.6 di agosto 2026: slider di effort, pulsante Think gratis e il precipizio dei 272K

Il 6 agosto 2026 OpenAI ha spedito un aggiornamento mid-cycle di GPT-5.6 che quasi tutti i pezzi hanno riassunto con 'Sol è più intelligente'. La vera storia: un controllo di effort a sei livelli che cambia come prezzi una richiesta, un pulsante Think sul piano gratuito, un precipizio di pricing a 272K token che ri-prezza l'intera chiamata, e una modalità Fast che gira solo su Sol. Cosa significa ciascuna cosa per chi usa Claude.

DeepSeek V4-Flash-Vision: il primo open weight di frontiera con visione nativa

Il 31 agosto 2026 DeepSeek ha rilasciato open source V4-Flash-Vision-Exp: un MoE da 305B che aggiunge visione nativa a V4-Flash senza intaccare i punteggi degli agenti testuali, eguaglia o batte Claude Opus 4.8 su ApexBench / Agents' Last Exam / ZeroBench a una frazione del prezzo, ed è distribuito con licenza MIT. I numeri specifici, il limite rigido di 384 token per immagine che la maggior parte delle guide ignora, e il modo concreto per eseguirlo.

Browser a login condiviso per agenti AI: il pattern ego lite

Una nuova classe di browser — meglio esemplificata da ego lite, che ha raggiunto il #1 su GitHub Trending il 24 luglio 2026 — permette a Claude Code, Codex, Cursor e a qualsiasi altro coding agent di guidare una sessione Chromium isolata che eredita i tuoi login reali. Cosa risolvono davvero Spaces e snapshot semantici, perché insidiano Playwright per il lavoro con agenti, e il costo di sicurezza di condividere i cookie di sessione con un processo autonomo.

Cloudflare Kitesurf: il primo runtime browser costruito per agenti AI (non per umani)

Il 6 agosto 2026 Cloudflare ha lanciato Kitesurf, un browser stateless agent-first che gira interamente in V8 isolate su Workers. Usa 3-7x meno CPU e memoria di Chromium su task comuni degli agenti — al costo di ~1.7x più tempo wall-clock. Scritto in Rust, usa il parser CSS di Firefox (Stylo) e il rendering engine Blitz, drop-in compatibile con Puppeteer/Playwright via Chrome DevTools Protocol. Questa pagina: cosa è cambiato, quando raggiungerlo invece di headless Chrome, come collegarlo a Claude Code / Codex / il tuo client MCP, e le quattro cose che al momento proprio non può fare.

Colibrì: far girare un MoE da 744B dal tuo SSD (e cosa ti costa davvero)

Colibrì è un engine in C puro, senza dipendenze, che esegue GLM-5.2 (744B), Kimi K3 (2.8T), DeepSeek V4.1 Flash e altri sei modelli MoE di frontiera su una macchina da 16–32 GB tenendo i layer densi in RAM e facendo streaming degli expert instradati da NVMe. Questa pagina spiega la gerarchia di memoria, i numeri che decidono se è usabile per te (da 0,05 a 6,8 tok/s), le insidie dell'usura SSD e dello speculative decoding, e i comandi esatti per ottenere il primo token.

OpenAI Agents API vs Claude Managed Agents: il loop agentico hosted, a confronto

Il 10 settembre 2026 OpenAI ha messo l'harness di Codex dietro una singola chiamata API: la beta pubblica della Agents API — sessioni durevoli, sandbox hosted o self-hosted, compaction automatica, tool search, subagenti. Anthropic offre la stessa forma da aprile con Managed Agents. Entrambi usano le stesse quattro primitive; differiscono su permessi, segreti, budget, policy di rete e costo della sandbox. Il confronto fianco a fianco, le forme delle richieste, i sei gotcha e quando scegliere quale.

Prossimi passi