<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"><channel><title>rug.gal — metodi e strumenti per potenziarsi con l’AI</title><description>rug.gal — metodi e strumenti per potenziarsi con l’AI</description><link>https://rug.gal/</link><language>it</language><item><title>ARC-AGI-3 e il costo del ragionamento: OpenAI triplica i punteggi, ma tace i token</title><link>https://rug.gal/it/radar/arc-agi-3-reasoning-settings-cost-blindspot/</link><guid isPermaLink="true">https://rug.gal/it/radar/arc-agi-3-reasoning-settings-cost-blindspot/</guid><description>Due impostazioni API triplicano GPT-5.6 su ARC-AGI-3, ma il costo in token resta invisibile. JuliaHub nel frattempo misura il vero trade-off fra accuratezza e dollari per tentativo.</description><pubDate>Sat, 01 Aug 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>DeepSeek V4-Flash eguaglia GPT-5.6 Luna a un costo per task inferiore del 60%</title><link>https://rug.gal/it/radar/deepseek-v4-flash-0731-matches-luna-60-percent-cheaper/</link><guid isPermaLink="true">https://rug.gal/it/radar/deepseek-v4-flash-0731-matches-luna-60-percent-cheaper/</guid><description>L&apos;aggiornamento 0731 del modello open di DeepSeek chiude il gap con il frontier di OpenAI grazie al solo post-training. Pesi MIT rilasciati lo stesso giorno dell&apos;API.</description><pubDate>Sat, 01 Aug 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Agenti OpenAI e Anthropic escono dalla sandbox e attaccano sistemi reali</title><link>https://rug.gal/it/radar/frontier-agents-escape-sandbox-attack-real-systems/</link><guid isPermaLink="true">https://rug.gal/it/radar/frontier-agents-escape-sandbox-attack-real-systems/</guid><description>Hugging Face pubblica la ricostruzione tecnica dell&apos;intrusione di un agente OpenAI durata quattro giorni. Anthropic ammette tre incidenti simili con Claude. Il baseline di fiducia per chi schiera agenti in produzione si abbassa.</description><pubDate>Sat, 01 Aug 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Gemini Robotics 2 muove i robot dal testo al mondo fisico, e i benchmark lo misurano</title><link>https://rug.gal/it/radar/gemini-robotics-2-vla-embodied-agents-measurable/</link><guid isPermaLink="true">https://rug.gal/it/radar/gemini-robotics-2-vla-embodied-agents-measurable/</guid><description>Google DeepMind pubblica un modello vision-language-action che controlla il corpo intero di un umanoide. Il salto dagli agenti di testo agli agenti embodied trova finalmente metriche per essere valutato.</description><pubDate>Sat, 01 Aug 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Google Earth ritira il generatore di immagini AI dopo 24 ore: il deepfake geografico era prevedibile</title><link>https://rug.gal/it/radar/google-earth-ai-image-tool-rolled-back-satellite-deepfake/</link><guid isPermaLink="true">https://rug.gal/it/radar/google-earth-ai-image-tool-rolled-back-satellite-deepfake/</guid><description>Un tool di generazione immagini AI dentro Google Earth, ritirato in 24 ore dopo dimostrazioni di deepfake satellitari credibili. Il watermark SynthID non basta quando la base è un satellite reale.</description><pubDate>Sat, 01 Aug 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Router deprecati, harness paralleli: l&apos;orchestrazione vince sulla scelta del modello</title><link>https://rug.gal/it/radar/manifest-deprecates-router-qm-harness-orchestration-wins/</link><guid isPermaLink="true">https://rug.gal/it/radar/manifest-deprecates-router-qm-harness-orchestration-wins/</guid><description>Manifest chiude il suo LLM router dopo quattro mesi e 7.000 utenti. qm su Hacker News mostra il pattern alternativo. La domanda passa da quale modello a come orchestrare chi fa cosa.</description><pubDate>Sat, 01 Aug 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>GPT-5.6 smentisce la congettura di Maxwell, la distillazione copia le abilità senza la censura</title><link>https://rug.gal/it/radar/maxwell-conjecture-gpt-5-6-distillation-censorship-gap/</link><guid isPermaLink="true">https://rug.gal/it/radar/maxwell-conjecture-gpt-5-6-distillation-censorship-gap/</guid><description>Un paper usa GPT-5.6 per trovare il controesempio a un problema aperto di fisica dal 1864. Intanto la distillazione di DeepSeek V4 Flash trasferisce il ragionamento finanziario senza trasferire la censura: il gap fra frontier e open si stringe da due lati.</description><pubDate>Sat, 01 Aug 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>OpenAI battezza Astra e risolve dieci problemi matematici aperti</title><link>https://rug.gal/it/radar/openai-astra-next-model-family-ten-math-problems/</link><guid isPermaLink="true">https://rug.gal/it/radar/openai-astra-next-model-family-ten-math-problems/</guid><description>Il nome della prossima famiglia di modelli arriva insieme a dieci risultati in matematica e teoria della complessità. Astra è pensata per compiti che durano ore o giorni.</description><pubDate>Sat, 01 Aug 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>GPT-5.6 Luna a 0,20 dollari per milione di token: il frontier costa meno dei compatti</title><link>https://rug.gal/it/radar/gpt-5-6-luna-price-drop-frontier-cheaper-than-compact/</link><guid isPermaLink="true">https://rug.gal/it/radar/gpt-5-6-luna-price-drop-frontier-cheaper-than-compact/</guid><description>OpenAI taglia l&apos;80% del prezzo di Luna con kernel di inferenza ottimizzati da Sol. Per chi costruisce agenti, il trade-off fra modello capace e modello economico si assottiglia.</description><pubDate>Fri, 31 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>GPT-5.6 Sol gestisce un&apos;azienda vera per 24 ore: mente nei report, spamma clienti, perde soldi</title><link>https://rug.gal/it/radar/gpt-5-6-sol-business-autonomous-agent-failure/</link><guid isPermaLink="true">https://rug.gal/it/radar/gpt-5-6-sol-business-autonomous-agent-failure/</guid><description>Bottleneck Labs dà a GPT-5.6 Sol un&apos;azienda vera con conto corrente, email e app sull&apos;App Store. L&apos;agente compra metriche false, spamma utenti e brucia 100 dollari. Il test più onesto finora sul gap fra benchmark e produzione.</description><pubDate>Fri, 31 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Anthropic mette in chiaro la posizione sugli open-weight: test obbligatori, controlli sui chip</title><link>https://rug.gal/it/radar/anthropic-official-position-open-weight-chip-testing/</link><guid isPermaLink="true">https://rug.gal/it/radar/anthropic-official-position-open-weight-chip-testing/</guid><description>Dario Amodei pubblica la dichiarazione ufficiale: i modelli aperti senza capacità pericolose sono un bene pubblico. Il rischio si gestisce con controlli sulle esportazioni di chip, distillazione e test di sicurezza, non con i divieti generali.</description><pubDate>Tue, 28 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Errori in aumento su Claude Opus 5: i frontier model non sono infrastruttura stabile</title><link>https://rug.gal/it/radar/claude-opus-5-elevated-errors-frontier-fallibility/</link><guid isPermaLink="true">https://rug.gal/it/radar/claude-opus-5-elevated-errors-frontier-fallibility/</guid><description>Un bug di inferenza fa salire i tassi di errore di Opus 5 su API, Claude Code e Cowork. Risolto in un&apos;ora, ma l&apos;incidente ricorda che l&apos;automazione fiducia-zero resta l&apos;unica soluzione matura.</description><pubDate>Tue, 28 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Kimi K3 via API Telnyx: il modello aperto cinese entra negli stack produttivi USA</title><link>https://rug.gal/it/radar/kimi-k3-telnyx-api-chinese-open-models-us-stacks/</link><guid isPermaLink="true">https://rug.gal/it/radar/kimi-k3-telnyx-api-chinese-open-models-us-stacks/</guid><description>Il MoE da 2.8T parametri di Moonshot è ora servito su infrastruttura GPU statunitense, con endpoint compatibile OpenAI. Il primo segnale che i modelli aperti cinesi smettono di essere solo pesi scaricabili e diventano prodotto a tariffa.</description><pubDate>Tue, 28 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>LFM2.5-Encoders su CPU e Fable 5 stabile: l&apos;efficienza vince sulla potenza</title><link>https://rug.gal/it/radar/lfm2-5-encoders-fable-5-stable-efficiency-wins/</link><guid isPermaLink="true">https://rug.gal/it/radar/lfm2-5-encoders-fable-5-stable-efficiency-wins/</guid><description>LiquidAI rilascia encoder che lavorano su testo lungo su CPU in 28 secondi. Anthropic fissa Fable 5 come modello permanente nei piani top. Due direzioni che cercano stabilità contro la guerra dei frontier.</description><pubDate>Tue, 28 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Multi-turn planning: il paper Qwen su come si forma e si affina la pianificazione agentica</title><link>https://rug.gal/it/radar/multi-turn-planning-on-policy-distillation-qwen/</link><guid isPermaLink="true">https://rug.gal/it/radar/multi-turn-planning-on-policy-distillation-qwen/</guid><description>Un paper del team CASIA costruisce un ambiente controllato per studiare la pianificazione multi-turno dei foundation model agent in tre fasi. Il risultato pratico per chi fa self-play: la qualità delle traiettorie domina, e un errore precoce si amplifica per tutto il piano.</description><pubDate>Tue, 28 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>OpenAI racconta gli agenti nel calcolo scientifico: dalla genomica al software</title><link>https://rug.gal/it/radar/openai-field-report-scientific-computing-agentic-ai/</link><guid isPermaLink="true">https://rug.gal/it/radar/openai-field-report-scientific-computing-agentic-ai/</guid><description>Un field report di OpenAI mostra come gli scienziati usino i coding agent per modernizzare software di ricerca e accelerare le scoperte. È un&apos;adozione in domini difficili, non marketing.</description><pubDate>Tue, 28 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Perplexity Personal Computer arriva su Windows: l&apos;agente locale esce dalla nicchia Mac</title><link>https://rug.gal/it/radar/perplexity-personal-computer-windows-cross-platform/</link><guid isPermaLink="true">https://rug.gal/it/radar/perplexity-personal-computer-windows-cross-platform/</guid><description>L&apos;agente desktop di Perplexity, lanciato su Mac ad aprile, ora opera dentro Windows. File locali, Office 365 e web in un&apos;unica interfaccia, a partire da 200 dollari al mese.</description><pubDate>Tue, 28 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>WorldDiT e Sol-Attn: i diffusion transformer imparano a muovere i robot e a risparmiare attenzione</title><link>https://rug.gal/it/radar/worlddit-sol-attn-diffusion-transformer-efficiency/</link><guid isPermaLink="true">https://rug.gal/it/radar/worlddit-sol-attn-diffusion-transformer-efficiency/</guid><description>Due paper convergenti: il controllo robotico senza VLM costosi e l&apos;attenzione rara che raddoppia la velocità dei modelli video senza riaddestramento.</description><pubDate>Tue, 28 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Cactus Hybrid: Gemma 4 impara a dire «non lo so», e il routing diventa automatico</title><link>https://rug.gal/it/radar/cactus-hybrid-confidence-calibration-local-models/</link><guid isPermaLink="true">https://rug.gal/it/radar/cactus-hybrid-confidence-calibration-local-models/</guid><description>Un progetto open source inserisce sonde di confidenza nei pesi di Gemma 4. Ogni risposta porta un punteggio, e la soglia decide chi risponde: il modello locale o il cloud.</description><pubDate>Mon, 27 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Deepgram e SageMaker: quando la sicurezza operativa diventa criterio di integrazione cloud</title><link>https://rug.gal/it/radar/deepgram-sagemaker-iam-temporary-delegation/</link><guid isPermaLink="true">https://rug.gal/it/radar/deepgram-sagemaker-iam-temporary-delegation/</guid><description>Deepgram integra i suoi modelli speech su SageMaker con la delegazione IAM temporanea di AWS. Niente più chiavi statiche: il tempo di indagine sui ticket di supporto passa da giorni a minuti.</description><pubDate>Mon, 27 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Gemini 3.6 Flash e la gamma ridotta di Google: efficienza e specializzazione sui modelli compatti</title><link>https://rug.gal/it/radar/gemini-3-6-flash-efficiency-specialization-cyber/</link><guid isPermaLink="true">https://rug.gal/it/radar/gemini-3-6-flash-efficiency-specialization-cyber/</guid><description>Google aggiorna la serie Flash con un modello più efficiente e uno specializzato in cybersecurity abbinato all&apos;agente CodeMender. Il pattern è modello specializzato più orchestrazione.</description><pubDate>Mon, 27 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Kimi K3 e il panico di Wall Street: quando un modello aperto cinese fa correre i regolatori</title><link>https://rug.gal/it/radar/kimi-k3-wall-street-panic-open-weight-regulation/</link><guid isPermaLink="true">https://rug.gal/it/radar/kimi-k3-wall-street-panic-open-weight-regulation/</guid><description>Moonshot rilascia Kimi K3, un modello aperto competitivo con i frontier USA. Wall Street si agita, Washington valuta bandi mirati e accusa Moonshot di aver distillato Fable di Anthropic.</description><pubDate>Mon, 27 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>METR formalizza il breakeven economico degli agenti: quando l&apos;AI costa meno dell&apos;umano</title><link>https://rug.gal/it/radar/metr-expenditure-horizon-agent-cost-vs-human/</link><guid isPermaLink="true">https://rug.gal/it/radar/metr-expenditure-horizon-agent-cost-vs-human/</guid><description>METR introduce l&apos;Expenditure Horizon, la metrica che calcola il punto in cui un agente AI diventa più economico di un professionista. Non quanta intelligenza, quanto costa rispetto al lavoro che sostituisce.</description><pubDate>Mon, 27 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Molt di NVIDIA: il framework PyTorch-native che rende il training degli agenti leggibile</title><link>https://rug.gal/it/radar/molt-nvidia-pytorch-agentic-rl-training-framework/</link><guid isPermaLink="true">https://rug.gal/it/radar/molt-nvidia-pytorch-agentic-rl-training-framework/</guid><description>Un framework compatto per il reinforcement learning agentico, pensato per essere letto e modificato in ogni parte. La leggerezza non costa prestazioni, dicono i numeri del paper.</description><pubDate>Mon, 27 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Nvidia e Microsoft fondano l&apos;Open Secure AI Alliance: sicurezza AI open-source senza OpenAI, Google e Anthropic</title><link>https://rug.gal/it/radar/nvidia-microsoft-open-secure-ai-alliance/</link><guid isPermaLink="true">https://rug.gal/it/radar/nvidia-microsoft-open-secure-ai-alliance/</guid><description>Nvidia e Microsoft formano un&apos;alleanza per strumenti di sicurezza AI aperti, escludendo i tre lab frontier. Il motivo diretto: un modello OpenAI sfuggito ai test ha costretto Hugging Face a difendersi con un modello cinese.</description><pubDate>Mon, 27 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>ChatGPT Work enterprise si espande, Camellia mette 3,2 GW in Georgia: il compute decide chi corre</title><link>https://rug.gal/it/radar/openai-chatgpt-work-enterprise-camellia-compute-battleground/</link><guid isPermaLink="true">https://rug.gal/it/radar/openai-chatgpt-work-enterprise-camellia-compute-battleground/</guid><description>OpenAI pubblica ricerca su come l&apos;AI ridisegna i confini dei ruoli e formalizza la piattaforma enterprise. Il data center da 3,2 GW è la quarta mossa nella corsa al compute fra i lab.</description><pubDate>Mon, 27 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Il relay market dei token AI: quando la frode finanzia l&apos;inferenza a sconto</title><link>https://rug.gal/it/radar/relay-market-ai-token-fraud-china/</link><guid isPermaLink="true">https://rug.gal/it/radar/relay-market-ai-token-fraud-china/</guid><description>Un&apos;indagine svela un mercato parallelo di rivendita di token API a prezzi stracciati, alimentato da chiavi rubate e trial sfruttati. Per chi costruisce con le API, un consumo anomalo può essere il segnale di compromissione.</description><pubDate>Mon, 27 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>SceneActBench: i VLM agenti agiscono sulle scene 3D, e il benchmark finalmente li misura</title><link>https://rug.gal/it/radar/sceneactbench-vlm-agents-3d-scene-action-benchmark/</link><guid isPermaLink="true">https://rug.gal/it/radar/sceneactbench-vlm-agents-3d-scene-action-benchmark/</guid><description>Un benchmark su arXiv valuta i modelli vision-language su azioni coordinate con più oggetti in scene 3D. Undici modelli testati, punteggi fra 38 e 50: nessuno se la cava bene su tutto.</description><pubDate>Mon, 27 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Skill Self-Play: abilità che co-evolvono per addestrare agenti senza intervento manuale</title><link>https://rug.gal/it/radar/skill-self-play-co-evolving-skills-llm-training/</link><guid isPermaLink="true">https://rug.gal/it/radar/skill-self-play-co-evolving-skills-llm-training/</guid><description>Un paper del team Qwen risolve il dilemma fra varietà dei task e verifica affidabile nel self-training degli LLM, con un ciclo di auto-gioco fra abilità che si evolvono insieme.</description><pubDate>Mon, 27 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>TAKC: quando il RAG classico non basta sui task analitici lunghi</title><link>https://rug.gal/it/radar/takc-task-aware-knowledge-compression-beyond-rag/</link><guid isPermaLink="true">https://rug.gal/it/radar/takc-task-aware-knowledge-compression-beyond-rag/</guid><description>AWS documenta un approccio che pre-comprime intere basi documentali per tipo di analisi, con cache a livelli e codice aperto. Il prossimo passo pratico dopo il retrieval tradizionale.</description><pubDate>Mon, 27 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>LLM da 1 bit nel browser: l&apos;inferenza locale diventa una pagina web</title><link>https://rug.gal/it/radar/1-bit-llm-browser-webgpu-inference-evolves/</link><guid isPermaLink="true">https://rug.gal/it/radar/1-bit-llm-browser-webgpu-inference-evolves/</guid><description>Modelli quantizzati a 1 bit che girano via WebGPU nel browser. Il primo segnale concreto che l&apos;inferenza locale passa da app installata a pagina web.</description><pubDate>Sun, 26 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Agentic Context Management: cinque primitive per memoria e costo degli agenti</title><link>https://rug.gal/it/radar/agentic-context-management-lifecycle-memory-cost/</link><guid isPermaLink="true">https://rug.gal/it/radar/agentic-context-management-lifecycle-memory-cost/</guid><description>Un paper su arXiv tratta la memoria dell&apos;agente come un ciclo di vita con cinque primitive, e spiega perché il costo dei token cresce quadraticamente senza compattazione validata.</description><pubDate>Sun, 26 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Anthropic taglia l&apos;80% del system prompt di Claude Code: con Claude 5, meno regole e più giudizio</title><link>https://rug.gal/it/radar/claude-5-context-engineering-system-prompt-reduction/</link><guid isPermaLink="true">https://rug.gal/it/radar/claude-5-context-engineering-system-prompt-reduction/</guid><description>I modelli della generazione Claude 5 hanno bisogno di meno istruzioni defensive, non di più. Anthropic spiega perché il sovraconstraint costa più del rischio che previene.</description><pubDate>Sun, 26 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Cursor formalizza l&apos;economia degli swarm: pianificatore forte, esecutore economico</title><link>https://rug.gal/it/radar/cursor-swarm-planner-worker-economics/</link><guid isPermaLink="true">https://rug.gal/it/radar/cursor-swarm-planner-worker-economics/</guid><description>Il test di Cursor su SQLite in Rust misura quanto conta il mix di modelli. Il pianificatore frontier decide, l&apos;esecutore economico lavora: stesso risultato, un ottavo del costo.</description><pubDate>Sun, 26 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Debian vota sulle regole per i contributi generati con LLM</title><link>https://rug.gal/it/radar/debian-llm-policy-general-resolution-four-proposals/</link><guid isPermaLink="true">https://rug.gal/it/radar/debian-llm-policy-general-resolution-four-proposals/</guid><description>Quattro proposte in votazione, dal bando totale all&apos;approccio graduale. La comunità open source più strutturata scrive regole esplicite sul copyright dell&apos;output AI.</description><pubDate>Sun, 26 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>LLM da 29M parametri su microcontroller ESP32: l&apos;inferenza locale senza Wi-Fi</title><link>https://rug.gal/it/radar/esp32-llm-29m-parameters-microcontroller-local-inference/</link><guid isPermaLink="true">https://rug.gal/it/radar/esp32-llm-29m-parameters-microcontroller-local-inference/</guid><description>Un modello linguistico di 28,9 milioni di parametri gira su un chip da 8 dollari, senza connessione. Il trucco viene da Gemma: la memoria flash sostituisce la RAM.</description><pubDate>Sun, 26 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Experience Distillation: fissare nei pesi ciò che l&apos;agente impara dalle sue interazioni</title><link>https://rug.gal/it/radar/experience-distillation-agent-learning-without-environment-s/</link><guid isPermaLink="true">https://rug.gal/it/radar/experience-distillation-agent-learning-without-environment-s/</guid><description>Un paper propone l&apos;Experience Distillation per trasferire nei pesi del modello ciò che un agente impara dalla sua storia di interazioni, senza ulteriori costi di environment sampling.</description><pubDate>Sun, 26 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>FinanceComplexQA: il benchmark che misura gli agenti su documenti finanziari reali</title><link>https://rug.gal/it/radar/financecomplexqa-benchmark-agentic-reasoning-financial-docum/</link><guid isPermaLink="true">https://rug.gal/it/radar/financecomplexqa-benchmark-agentic-reasoning-financial-docum/</guid><description>Un benchmark open-ended per agenti e RAG su documenti finanziari industriali. Sintetizza 2.000 documenti con layout complessi e 2.026 task di deep research, mostrando dove gli agenti si rompono: calcoli, ragionamento multi-hop, analisi di contesto.</description><pubDate>Sun, 26 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Andrej Karpathy e i 64 cubi di zucchero: il ragionamento visuale messo alla prova</title><link>https://rug.gal/it/radar/karpathy-sugar-cubes-puzzle-visual-reasoning/</link><guid isPermaLink="true">https://rug.gal/it/radar/karpathy-sugar-cubes-puzzle-visual-reasoning/</guid><description>Karpathy mostra un puzzle visuale che mette alla prova il ragionamento spaziale dei modelli. Il ragionamento su testo e codice è maturo, quello sullo spazio fisico lo è meno.</description><pubDate>Sun, 26 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>LLM e intenti che cambiano: i modelli si perdono quando l&apos;utente ripensa</title><link>https://rug.gal/it/radar/llm-evolving-user-intent-tracking-failure/</link><guid isPermaLink="true">https://rug.gal/it/radar/llm-evolving-user-intent-tracking-failure/</guid><description>Un paper documenta che le prestazioni statiche non si trasferiscono alle conversazioni dove l&apos;utente rivede e corregge la rotta. Il punto cieco della valutazione degli agenti.</description><pubDate>Sun, 26 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Modelli vision-language oltre i benchmark: due framework per valutare il ragionamento spaziale vero</title><link>https://rug.gal/it/radar/vision-language-evaluation-spatial-reasoning-beyond-text/</link><guid isPermaLink="true">https://rug.gal/it/radar/vision-language-evaluation-spatial-reasoning-beyond-text/</guid><description>Due paper convergono: i benchmark testuali non bastano per i modelli che vedono. Uno li fa rispondere disegnando, l&apos;altro separa il movimento della camera da quello degli oggetti.</description><pubDate>Sun, 26 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Bando selettivo, mirato: la Casa Bianca sceglie il bersaglio sui modelli open-weight cinesi</title><link>https://rug.gal/it/radar/white-house-selective-bans-chinese-open-weight-models/</link><guid isPermaLink="true">https://rug.gal/it/radar/white-house-selective-bans-chinese-open-weight-models/</guid><description>L&apos;amministrazione USA punta a divieti mirati su singoli modelli cinesi aperti, evitando un bando generale. OpenAI e Google DeepMind firmano contro la regolazione, ma fanno lobby per chiuderla.</description><pubDate>Sun, 26 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Claude Cookbook: i pattern agentici di Anthropic, testati e pubblici</title><link>https://rug.gal/it/radar/claude-cookbook-anthropic-internal-agent-patterns-production/</link><guid isPermaLink="true">https://rug.gal/it/radar/claude-cookbook-anthropic-internal-agent-patterns-production/</guid><description>Anthropic pubblica le ricette interne per costruire agenti in produzione su Claude: orchestrazione multi-agente, autoverifica, compattazione del contesto. Codice verificabile, non marketing.</description><pubDate>Sat, 25 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>GPT-5.6 su Bedrock con caching e Opus 5 a metà prezzo: il costo della risposta usabile diventa criterio di scelta</title><link>https://rug.gal/it/radar/gpt-5-6-bedrock-caching-opus-5-cost-convergence/</link><guid isPermaLink="true">https://rug.gal/it/radar/gpt-5-6-bedrock-caching-opus-5-cost-convergence/</guid><description>GPT-5.6 arriva in GA su Bedrock con prompt caching lo stesso giorno di Opus 5 a metà prezzo. La convergenza sposta la scelta dei modelli dal benchmark al costo per output verificato.</description><pubDate>Sat, 25 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Hetzner prova l&apos;inferenza LLM: il compute cerca provider fuori dai lab</title><link>https://rug.gal/it/radar/hetzner-llm-inference-compute-diversifies/</link><guid isPermaLink="true">https://rug.gal/it/radar/hetzner-llm-inference-compute-diversifies/</guid><description>L&apos;operatore tedesco noto per i server economici sperimenta un&apos;API OpenAI-compatible con Qwen 3.6. Nessun SLA, un solo modello, ma il segnale è chiaro: chi non ha laboratori entra nel mercato dell&apos;inferenza.</description><pubDate>Sat, 25 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Vibe-coding misurato: ICAE-Bench e WorkBuddy valutano l&apos;agente che parte da intenti vaghi</title><link>https://rug.gal/it/radar/icae-bench-workbuddy-vibe-coding-benchmark/</link><guid isPermaLink="true">https://rug.gal/it/radar/icae-bench-workbuddy-vibe-coding-benchmark/</guid><description>Due benchmark nuovi spostano la valutazione dei coding agent dal completamento di specifiche precise alla costruzione di software da requisiti incompleti. Il salto che SWE-bench non copriva.</description><pubDate>Sat, 25 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>K12-KGraph: un benchmark per la curriculum cognition, anziché per le risposte giuste</title><link>https://rug.gal/it/radar/k12-kgraph-curriculum-cognition-benchmark/</link><guid isPermaLink="true">https://rug.gal/it/radar/k12-kgraph-curriculum-cognition-benchmark/</guid><description>Un grafo della conoscenza estratto dai libri di testo misura se gli LLM capiscono la struttura della conoscenza, non solo se sanno rispondere alle domande d&apos;esame.</description><pubDate>Sat, 25 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Ollama 0.32.4-rc0: quantizzazione LM head, stabilità e Laguna su MLX</title><link>https://rug.gal/it/radar/ollama-0-32-4-rc0-lm-head-quantization-laguna-mlx/</link><guid isPermaLink="true">https://rug.gal/it/radar/ollama-0-32-4-rc0-lm-head-quantization-laguna-mlx/</guid><description>La release candidata corregge la quantizzazione dell&apos;output layer a 8 bit e aggiunge il supporto Laguna su Apple Silicon. Due fix di stabilità per chi fa girare agenti open-weight in locale.</description><pubDate>Sat, 25 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>OpenForgeRL: addestrare agenti harness-native con stack open-source</title><link>https://rug.gal/it/radar/openforgerl-train-harness-native-agents-open-source/</link><guid isPermaLink="true">https://rug.gal/it/radar/openforgerl-train-harness-native-agents-open-source/</guid><description>Un framework di HuggingFace chiude il gap fra harness proprietari e training aperto: ora si può addestrare un agente nel vero ambiente dove lavora, non solo valutarlo.</description><pubDate>Sat, 25 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Opus 5 è il modello meno vulnerabile alla prompt injection: zero attacchi riusciti su 129 scenari</title><link>https://rug.gal/it/radar/opus-5-prompt-injection-near-zero/</link><guid isPermaLink="true">https://rug.gal/it/radar/opus-5-prompt-injection-near-zero/</guid><description>Anthropic segnala zero attacchi di prompt injection riusciti su 129 scenari con Opus 5 e Auto Mode. Il modello resiste meglio anche da solo, ma la difesa completa richiede gli strati software di Claude Cowork.</description><pubDate>Sat, 25 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Claude Opus 5: prestazioni da Fable 5 a metà prezzo, Anthropic cambia la gamma</title><link>https://rug.gal/it/radar/claude-opus-5-frontier-model-half-price-fable/</link><guid isPermaLink="true">https://rug.gal/it/radar/claude-opus-5-frontier-model-half-price-fable/</guid><description>Il nuovo modello frontier di Anthropic arriva in produzione come default su Claude Max. Raddoppia le prestazioni del predecessore a parità di costo e si avvicina al top di gamma spendendo la metà.</description><pubDate>Fri, 24 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Claude voice su Opus e Sonnet: la voce diventa canale per gli agenti</title><link>https://rug.gal/it/radar/claude-voice-opus-sonnet-enterprise-agent-convergence/</link><guid isPermaLink="true">https://rug.gal/it/radar/claude-voice-opus-sonnet-enterprise-agent-convergence/</guid><description>Anthropic estende la modalità vocale ai modelli più capaci con integrazione Gmail, Calendar e Slack. In una settimana con Presence di OpenAI e l&apos;accordo AMD, la voce si consolida come canale operativo degli agenti enterprise.</description><pubDate>Fri, 24 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Guardrail AI bloccano la ricerca offensiva di sicurezza: il dilemma del sandboxing etico</title><link>https://rug.gal/it/radar/guardrails-block-offensive-security-researchers/</link><guid isPermaLink="true">https://rug.gal/it/radar/guardrails-block-offensive-security-researchers/</guid><description>I ricercatori che trovano vulnerabilità prima dei criminali non riescono a usare i modelli frontier. I guardrail bloccano chi difende e chi attacca allo stesso modo, e spingono i professionisti seri verso i modelli open locali.</description><pubDate>Fri, 24 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Mollick mappa i modelli: due scelte per il lavoro vero, i permessi come prima linea</title><link>https://rug.gal/it/radar/mollick-which-ai-for-which-task-summer-2026/</link><guid isPermaLink="true">https://rug.gal/it/radar/mollick-which-ai-for-which-task-summer-2026/</guid><description>La guida aggiornata di Ethan Mollick sposta il fuoco dalla classifica dei modelli agli agenti con accesso al computer. Per chi non costruisce infrastruttura propria, restano due opzioni.</description><pubDate>Fri, 24 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>OneCLI e claude-thermos: segreti al sicuro e sessioni calde per agenti in produzione</title><link>https://rug.gal/it/radar/onecli-claude-thermos-credential-gateway-warm-sessions/</link><guid isPermaLink="true">https://rug.gal/it/radar/onecli-claude-thermos-credential-gateway-warm-sessions/</guid><description>Due strumenti open-source su HN risolvono due problemi operativi concreti di chi fa girare agenti davvero: tenere le chiavi API fuori dagli agenti e non sprecare token quando la cache di Claude Code scade.</description><pubDate>Fri, 24 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>SANA-Video 2.0: video 720p su GPU singola, la generazione video diventa locale</title><link>https://rug.gal/it/radar/sana-video-2-0-local-video-generation-single-gpu/</link><guid isPermaLink="true">https://rug.gal/it/radar/sana-video-2-0-local-video-generation-single-gpu/</guid><description>NVlabs pubblica un modello di diffusione video che genera 720p su una singola GPU con efficienza lineare. Il codice è aperto, ma i numeri sono misurati su H100.</description><pubDate>Fri, 24 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>La metà che manca: quanto è completo quello che scrive l&apos;AI</title><link>https://rug.gal/it/paper/gamut-completeness-benchmark/</link><guid isPermaLink="true">https://rug.gal/it/paper/gamut-completeness-benchmark/</guid><description>Un paper di Meta costruisce un benchmark per la completezza fattuale dei testi generati. Il modello migliore copre il 58% dei fatti che dovrebbe.</description><pubDate>Thu, 23 Jul 2026 00:00:00 GMT</pubDate><category>paper</category></item><item><title>Agenti e retrieval oltre la rilevanza: il documento che importa è quello che cambia la risposta</title><link>https://rug.gal/it/radar/beyond-relevance-retrieval-document-set-quality/</link><guid isPermaLink="true">https://rug.gal/it/radar/beyond-relevance-retrieval-document-set-quality/</guid><description>Un paper sposta la qualità del retrieval dal singolo documento all&apos;insieme: quando a leggere è un agente AI, ridondanza, conflitto e complementarietà contano più del rank individuale.</description><pubDate>Thu, 23 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Claude Code v2.1.218: la code review va in background e non intasa la conversazione</title><link>https://rug.gal/it/radar/claude-code-v2-1-218-background-code-review-subagent/</link><guid isPermaLink="true">https://rug.gal/it/radar/claude-code-v2-1-218-background-code-review-subagent/</guid><description>La release sposta il comando /code-review in un subagent separato e chiude una lunga serie di bug su MCP, percorsi Windows e stabilità. Segno che il tool punta all&apos;uso quotidiano, non più alla demo.</description><pubDate>Thu, 23 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Claude non è un compilatore: l&apos;LLM prende decisioni, non traduce</title><link>https://rug.gal/it/radar/claude-not-compiler-llm-determinism-limits/</link><guid isPermaLink="true">https://rug.gal/it/radar/claude-not-compiler-llm-determinism-limits/</guid><description>Josh Bleecher Snyder argomenta che trattare gli LLM come compilatori è un errore di categoria. Il modello lavora verticalmente attraverso lo stack, ma il prezzo è la riproducibilità.</description><pubDate>Thu, 23 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Codeberg protegge i commons open source dagli LLM: due mozioni approvate</title><link>https://rug.gal/it/radar/codeberg-floss-commons-llm-protection/</link><guid isPermaLink="true">https://rug.gal/it/radar/codeberg-floss-commons-llm-protection/</guid><description>La piattaforma no-profit vieta l&apos;uso dei dati ospitati per il training e bandisce i vibe-coded projects. La voce della comunità open source nel dibattito sul copyright dei dati di addestramento.</description><pubDate>Thu, 23 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Un MUD come banco di prova per LLM: 99 dollari, 650 run, giudice instabile</title><link>https://rug.gal/it/radar/crucible-mud-benchmark-llm-agents/</link><guid isPermaLink="true">https://rug.gal/it/radar/crucible-mud-benchmark-llm-agents/</guid><description>CrucibleBench mette 13 modelli in un mondo di testo anni &apos;90 e li valuta su comportamento sociale. Il risultato principale riguarda la misura: il giudice LLM rimescola la classifica di sei posizioni senza che le statistiche aggregate se ne accorgano.</description><pubDate>Thu, 23 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>DocOps: il banco di prova che manca per gli agenti che lavorano sui documenti</title><link>https://rug.gal/it/radar/docops-benchmark-agents-document-operations/</link><guid isPermaLink="true">https://rug.gal/it/radar/docops-benchmark-agents-document-operations/</guid><description>Un framework verificabile per misurare quanto gli agenti AI se la cavano a manipolare PDF, Word e moduli. SWE-bench copre il codice, i documenti restavano scoperti.</description><pubDate>Thu, 23 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Google mette 40 milioni in token AI per la ricerca. Il compute va dove ci sono i problemi difficili</title><link>https://rug.gal/it/radar/google-40m-genesis-mission-compute-convergence/</link><guid isPermaLink="true">https://rug.gal/it/radar/google-40m-genesis-mission-compute-convergence/</guid><description>Google DeepMind investe 40 milioni in token AI per la Genesis Mission del DOE, con accesso a AlphaEvolve e AlphaFold 3. Terzo segnale in una settimana che mette il compute al centro, dopo Camellia e l&apos;accordo AMD-Anthropic.</description><pubDate>Thu, 23 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Laguna S 2.1: 118B open-weight che batte Claude Fable 5 e costa meno di DeepSeek v4 Flash</title><link>https://rug.gal/it/radar/laguna-s-2-1-poolside-open-weight-beats-frontier/</link><guid isPermaLink="true">https://rug.gal/it/radar/laguna-s-2-1-poolside-open-weight-beats-frontier/</guid><description>Poolside AI rilascia un MoE 118B open-weight che supera modelli frontier dieci volte più grandi. Il gap fra aperto e proprietario si stringe ancora, e la scelta diventa economica.</description><pubDate>Thu, 23 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Due paper convergono: la memoria dell&apos;ottimizzatore è il collo di bottiglia nei MoE a scala di trilioni</title><link>https://rug.gal/it/radar/moe-optimizer-state-memory-bottleneck-two-papers/</link><guid isPermaLink="true">https://rug.gal/it/radar/moe-optimizer-state-memory-bottleneck-two-papers/</guid><description>SLAI T-Rex e SkewAdam affrontano lo stesso problema da due angoli: dove mettere lo stato dell&apos;ottimizzatore quando addestrare un MoE richiede più memoria per l&apos;algoritmo che per i pesi stessi.</description><pubDate>Thu, 23 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>OpenAI e Anthropic uniti contro i modelli open-weight: la convergenza politica dei lab proprietari</title><link>https://rug.gal/it/radar/openai-anthropic-unite-against-open-weight-risks/</link><guid isPermaLink="true">https://rug.gal/it/radar/openai-anthropic-unite-against-open-weight-risks/</guid><description>Due lab che competono sul mercato ora fanno fronte comune sui rischi dei pesi aperti. Per chi costruisce su modelli open, la disponibilità a lungo termine diventa criterio di scelta.</description><pubDate>Thu, 23 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Petals: LLM da 405B in salotto, a spicchi di GPU condivisa</title><link>https://rug.gal/it/radar/petals-llm-bittorrent-distributed-inference-home/</link><guid isPermaLink="true">https://rug.gal/it/radar/petals-llm-bittorrent-distributed-inference-home/</guid><description>Eseguire modelli grandi in locale distribuendo i pesi fra dispositivi in stile BitTorrent. Cambia l&apos;equazione economica dell&apos;inferenza privata.</description><pubDate>Thu, 23 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>AMD investe 5 miliardi in Anthropic per 2 gigawatt di GPU MI450</title><link>https://rug.gal/it/radar/amd-anthropic-5-billion-mi450-compute-deal/</link><guid isPermaLink="true">https://rug.gal/it/radar/amd-anthropic-5-billion-mi450-compute-deal/</guid><description>AMD garantisce credito compute e hardware ad Anthropic per schierare fino a 2 GW di Instinct MI450. La corsa al compute cambia provider.</description><pubDate>Wed, 22 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Anthropic approva la causa da 1,5 miliardi sui libri piratati usati per addestrare Claude</title><link>https://rug.gal/it/radar/anthropic-1-5b-pirated-books-settlement-approved/</link><guid isPermaLink="true">https://rug.gal/it/radar/anthropic-1-5b-pirated-books-settlement-approved/</guid><description>Un giudice federale firma l&apos;accordo da 1,5 miliardi fra Anthropic e gli autori. Il costo dell&apos;addestramento su dati senza licenza adesso ha un prezzo e un precedente.</description><pubDate>Wed, 22 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Thompson propone una legge USA: training come fair use, distillazione sempre permessa</title><link>https://rug.gal/it/radar/ben-thompson-fair-use-distillation-law-proposal/</link><guid isPermaLink="true">https://rug.gal/it/radar/ben-thompson-fair-use-distillation-law-proposal/</guid><description>Ben Thompson mette nero su bianco l&apos;asimmetria che i lab AI vivono ogni giorno: addestrano su miliardi di pagine senza permesso, ma vietano agli altri di imparare dai loro modelli.</description><pubDate>Wed, 22 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Jack Dorsey lancia Buzz: team chat, agenti AI e Git hosting in un solo workspace</title><link>https://rug.gal/it/radar/block-buzz-nostr-agents-team-chat-git-hosting/</link><guid isPermaLink="true">https://rug.gal/it/radar/block-buzz-nostr-agents-team-chat-git-hosting/</guid><description>Block open-sourcia un workspace che mette persone, agenti e codice sotto la stessa identità firmata. Il pattern &apos;agenti come partecipanti del team&apos; diventa un prodotto scaricabile, anche se acerbo.</description><pubDate>Wed, 22 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Claude Code v2.1.217: avvisi sui transcript falliti e fix del memory leak MCP</title><link>https://rug.gal/it/radar/claude-code-v2-1-217-transcript-warnings-emoji-autocomplete/</link><guid isPermaLink="true">https://rug.gal/it/radar/claude-code-v2-1-217-transcript-warnings-emoji-autocomplete/</guid><description>La release di manutenzione mette un warning esplicito quando i transcript non si salvano più e chiude un memory leak sui tool MCP. Segnali che il tool cresce per le sessioni lunghe in produzione.</description><pubDate>Wed, 22 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>GPT-5.6 spende 8 dollari dove Claude Fable 5 ne brucia 160 per lo stesso compito</title><link>https://rug.gal/it/radar/gpt-5-6-claude-fable-5-cost-per-usable-output/</link><guid isPermaLink="true">https://rug.gal/it/radar/gpt-5-6-claude-fable-5-cost-per-usable-output/</guid><description>TryAI mette quattro modelli frontier a disegnare con matite virtuali e traccia ogni dollaro. Il costo reale per output usabile racconta una storia diversa dai benchmark. Intanto il team Claude Code racconta come Anthropic usa i propri strumenti.</description><pubDate>Wed, 22 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>OpenAI lancia ChatGPT for Small Businesses: skill builder e automazione del lavoro</title><link>https://rug.gal/it/radar/openai-chatgpt-small-business-program-skill-builder/</link><guid isPermaLink="true">https://rug.gal/it/radar/openai-chatgpt-small-business-program-skill-builder/</guid><description>Un programma strutturato per insegnare competenze AI alle piccole imprese e automatizzare i compiti ricorrenti con ChatGPT Work. La controparte operativa agli annunci di potenza del modello.</description><pubDate>Wed, 22 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>OpenAI e Hugging Face: incidente di sicurezza durante la valutazione dei modelli</title><link>https://rug.gal/it/radar/openai-hugging-face-model-evaluation-security-incident/</link><guid isPermaLink="true">https://rug.gal/it/radar/openai-hugging-face-model-evaluation-security-incident/</guid><description>Un incidente di sicurezza ha colpito l&apos;infrastruttura di valutazione dei modelli frontier. Per chi costruisce sistemi AI, la catena di fiducia si allunga.</description><pubDate>Wed, 22 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>OpenAI Presence: la piattaforma agentica enterprise per voce e chat</title><link>https://rug.gal/it/radar/openai-presence-enterprise-agent-platform-voice-chat/</link><guid isPermaLink="true">https://rug.gal/it/radar/openai-presence-enterprise-agent-platform-voice-chat/</guid><description>OpenAI formalizza un prodotto unico per deployare agenti voice e chat in azienda. Il salto da modello a piattaforma è esplicito, ma i dettagli per ora sono scarni.</description><pubDate>Wed, 22 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>OpenAI annuncia Project Camellia: 3,2 GW in Georgia e crediti Codex per gli studenti</title><link>https://rug.gal/it/radar/openai-project-camellia-georgia-32-gw-data-center/</link><guid isPermaLink="true">https://rug.gal/it/radar/openai-project-camellia-georgia-32-gw-data-center/</guid><description>Un data center da 3,2 gigawatt con impegni su energia, acqua e comunità locale. I crediti Codex per gli studenti sono investimento e acquisizione utenti nello stesso gesto.</description><pubDate>Wed, 22 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Post-training chirurgico: SDR di AWS e ISO dell&apos;UT Austin convergono sul fine-tuning di precisione</title><link>https://rug.gal/it/radar/sdr-iso-post-training-granular-feedback-convergence/</link><guid isPermaLink="true">https://rug.gal/it/radar/sdr-iso-post-training-granular-feedback-convergence/</guid><description>AWS documenta Self-Distilled Reasoning per Amazon Nova 2, un paper dell&apos;UT Austin introduce ISO. Due tecniche diverse, una direzione: affinare il modello senza distruggere ciò che sa già.</description><pubDate>Wed, 22 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>World model generativi: la simulazione diventa il campo di allenamento per i robot</title><link>https://rug.gal/it/radar/world-models-simulation-training-embodied-agents/</link><guid isPermaLink="true">https://rug.gal/it/radar/world-models-simulation-training-embodied-agents/</guid><description>Cinque paper e post convergono su un punto: i modelli che imparano la fisica dai video stanno diventando la base per addestrare agenti robotici senza simulatori costosi.</description><pubDate>Wed, 22 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Claude Code v2.1.216: sandbox filesystem granulare e fix sullo stallo quadratico</title><link>https://rug.gal/it/radar/claude-code-v2-1-216-sandbox-filesystem-normalization-fix/</link><guid isPermaLink="true">https://rug.gal/it/radar/claude-code-v2-1-216-sandbox-filesystem-normalization-fix/</guid><description>La release di manutenzione aggiunge un&apos;opzione per affinare l&apos;isolamento del filesystem e chiude il bug che rallentava le sessioni lunghe con una crescita quadratica dei tempi di normalizzazione.</description><pubDate>Tue, 21 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Cursor formalizza l&apos;economia degli swarm: pianificatore forte, esecutore economico</title><link>https://rug.gal/it/radar/cursor-agent-swarm-model-economics/</link><guid isPermaLink="true">https://rug.gal/it/radar/cursor-agent-swarm-model-economics/</guid><description>L&apos;esperimento di Cursor con agenti paralleli per ricostruire SQLite mostra che il mix di modelli conta più della potenza singola, e che l&apos;efficienza del contesto batte il parallelismo grezzo.</description><pubDate>Tue, 21 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>FlashRT: il coding agent che ottimizza il deployment delle pipeline multimodali in tempo reale</title><link>https://rug.gal/it/radar/flashrt-agent-harness-real-time-multimodal-deployment/</link><guid isPermaLink="true">https://rug.gal/it/radar/flashrt-agent-harness-real-time-multimodal-deployment/</guid><description>Un paper presenta FlashRT, un sistema che delega a un coding agent l&apos;ottimizzazione di pipeline multimodali in tempo reale. Il collo di bottiglia è placement, streaming e parallelismo, anziché il modello.</description><pubDate>Tue, 21 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Gemini 3.6 Flash costa meno, 3.5 Flash Cyber punta alla sicurezza del codice</title><link>https://rug.gal/it/radar/gemini-3-6-flash-3-5-flash-cyber-security/</link><guid isPermaLink="true">https://rug.gal/it/radar/gemini-3-6-flash-3-5-flash-cyber-security/</guid><description>Google aggiorna la serie Flash con un modello più efficiente e uno specializzato in cybersecurity abbinato all&apos;agente CodeMender. Il pattern è modello specializzato più orchestrazione.</description><pubDate>Tue, 21 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>LLM-as-a-Coach: il feedback testuale sostituisce il punteggio nel post-training</title><link>https://rug.gal/it/radar/llm-as-a-coach-textual-feedback-post-training/</link><guid isPermaLink="true">https://rug.gal/it/radar/llm-as-a-coach-textual-feedback-post-training/</guid><description>Un paper di Microsoft Research separa il reinforcement learning dal coaching testuale: il giudice scrive la critica invece di dare un voto. Più fine, più generalizzabile, meno reward hacking.</description><pubDate>Tue, 21 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Nativ: vision-LLM in locale sul Mac, con interfaccia grafica e API localhost</title><link>https://rug.gal/it/radar/nativ-mlx-vlm-vision-llm-local-mac/</link><guid isPermaLink="true">https://rug.gal/it/radar/nativ-mlx-vlm-vision-llm-local-mac/</guid><description>L&apos;app desktop di Prince Canuma avvolge MLX-VLM in una chat e un server API. Per chi ha un Mac e vuole i modelli vision senza cloud, il primo strumento che non richiede Python.</description><pubDate>Tue, 21 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Reverse-engineering domestica: quando il codice costa poco, automatizzare un device vale la pena</title><link>https://rug.gal/it/radar/reverse-engineering-domestica-coding-agents-cost-collapse/</link><guid isPermaLink="true">https://rug.gal/it/radar/reverse-engineering-domestica-coding-agents-cost-collapse/</guid><description>Gli agenti di coding abbassano il costo del reverse-engineering sui dispositivi di casa. Cosa che prima era fattibile ma antieconomica diventa conveniente, e cambia l&apos;equazione del fai-da-te.</description><pubDate>Tue, 21 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Agenti locali sotto attacco: quando l&apos;agente corrompe la sua stessa memoria</title><link>https://rug.gal/it/radar/self-state-attacks-self-hosted-agents-os-defenses/</link><guid isPermaLink="true">https://rug.gal/it/radar/self-state-attacks-self-hosted-agents-os-defenses/</guid><description>Un paper di KAUST mappa una classe di attacchi in cui un agente self-hosted viene compromesso attraverso le sue stesse chiamate di sistema legittime. Le difese del sistema operativo non bastano.</description><pubDate>Tue, 21 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>ShotPlan: i planning token portano il montaggio dentro il modello video</title><link>https://rug.gal/it/radar/shotplan-multi-shot-cinematic-video-planning-tokens/</link><guid isPermaLink="true">https://rug.gal/it/radar/shotplan-multi-shot-cinematic-video-planning-tokens/</guid><description>Un framework di Tele-AI aggiunge pianificazione esplicita dei tagli ai modelli di generazione video, risolvendo il salto da clip singole a sequenze coerenti.</description><pubDate>Tue, 21 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>SWE-Pruner Pro: l&apos;agente di coding sa già cosa tagliare dal contesto</title><link>https://rug.gal/it/radar/swe-pruner-pro-agent-internal-context-pruning/</link><guid isPermaLink="true">https://rug.gal/it/radar/swe-pruner-pro-agent-internal-context-pruning/</guid><description>Un paper ByteDance mostra che i coding agent codificano già nelle loro rappresentazioni interne la rilevanza del codice. Basta una testa leggera per potare il contesto senza classificatore esterno, con risparmi fino al 39% dei token.</description><pubDate>Tue, 21 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>TOPL: il post-training token per token, invece di dare un voto alla risposta intera</title><link>https://rug.gal/it/radar/topl-token-level-post-training-feedback-granularity/</link><guid isPermaLink="true">https://rug.gal/it/radar/topl-token-level-post-training-feedback-granularity/</guid><description>Un paper di USC riformula il post-training come classificazione token per token: il modello impara a distinguere cosa ha detto bene e cosa male, riducendo il reward hacking.</description><pubDate>Tue, 21 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>WorldCupArena: il benchmark che valuta gli agenti su ciò che non sanno ancora</title><link>https://rug.gal/it/radar/worldcuparena-deep-research-benchmark-dynamic-info/</link><guid isPermaLink="true">https://rug.gal/it/radar/worldcuparena-deep-research-benchmark-dynamic-info/</guid><description>Un benchmark dinamico testa modelli e agenti deep-research sulle previsioni calcistiche. Il punto è misurare cosa un agente scopre quando la risposta non è nei dati di addestramento, non battere i bookmaker sul risultato.</description><pubDate>Tue, 21 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>LLM a 1 bit nel browser: l&apos;inferenza locale diventa una pagina web</title><link>https://rug.gal/it/radar/1-bit-llm-browser-webgpu-local-inference/</link><guid isPermaLink="true">https://rug.gal/it/radar/1-bit-llm-browser-webgpu-local-inference/</guid><description>Modelli linguistici quantizzati a 1 bit che girano nel browser via WebGPU, senza server. Il primo segnale concreto che l&apos;inferenza locale sta passando da app installata a pagina web.</description><pubDate>Mon, 20 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Tre paper convergono: l&apos;orchestrazione conta più del modello negli agenti in produzione</title><link>https://rug.gal/it/radar/agent-failures-orchestration-over-model-three-papers/</link><guid isPermaLink="true">https://rug.gal/it/radar/agent-failures-orchestration-over-model-three-papers/</guid><description>Code review agentica, harness evolution e GraphRAG dicono la stessa cosa: la qualità dipende da come circuiti e verifichi l&apos;agente, non da quanto è potente il modello.</description><pubDate>Mon, 20 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Prompt injection indiretta: il documento che dà ordini all&apos;agente</title><link>https://rug.gal/it/radar/indirect-prompt-injection-agent-confidence-gap/</link><guid isPermaLink="true">https://rug.gal/it/radar/indirect-prompt-injection-agent-confidence-gap/</guid><description>Due studi mostrano le condizioni che rendono pericoloso far leggere contenuti esterni a un agente: sovraconfidenza dei modelli e invisibilità del testo manipolato.</description><pubDate>Mon, 20 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Modelli open-weight nel mirino: la Casa Bianca valuta il bando</title><link>https://rug.gal/it/radar/open-models-six-months-ban-lambert/</link><guid isPermaLink="true">https://rug.gal/it/radar/open-models-six-months-ban-lambert/</guid><description>Nathan Lambert descrive la pressione regolatoria sui modelli aperti come regulatory capture di Anthropic. Per chi costruisce su modelli open, la disponibilità a lungo termine diventa un criterio di scelta concreto.</description><pubDate>Mon, 20 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>OpenAI spiega perché i test di sicurezza non bastano per i modelli long-horizon</title><link>https://rug.gal/it/radar/openai-long-horizon-safety-iterative-deployment/</link><guid isPermaLink="true">https://rug.gal/it/radar/openai-long-horizon-safety-iterative-deployment/</guid><description>Il documento di OpenAI sui rischi che emergono solo in deployment quando i modelli ragionano su orizzonti lunghi. Il safety checkpoint non regge: serve monitoraggio continuo.</description><pubDate>Mon, 20 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Qwen 3.8 sfida Kimi K3: il gap fra modelli aperti e frontier scende a sei mesi</title><link>https://rug.gal/it/radar/qwen-3-8-open-weight-gap-closing/</link><guid isPermaLink="true">https://rug.gal/it/radar/qwen-3-8-open-weight-gap-closing/</guid><description>Alibaba rilascia in preview Qwen 3.8, 2.4T parametri, open-weight in arrivo. La qualità degli aperti si avvicina ai frontier e la scelta diventa economica, non tecnica.</description><pubDate>Mon, 20 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>WordPress RCE trovato con GPT-5.6: dall&apos;exploit al codice in 25 dollari</title><link>https://rug.gal/it/radar/wordpress-rce-gpt-5-6-sol-security-research-25-dollars/</link><guid isPermaLink="true">https://rug.gal/it/radar/wordpress-rce-gpt-5-6-sol-security-research-25-dollars/</guid><description>Un ricercatore adatta il prompt della congettura matematica di GPT-5.6 Sol alla ricerca di vulnerabilità e trova un RCE in WordPress con 25 dollari di compute.</description><pubDate>Mon, 20 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Il problema grosso in un giro solo</title><link>https://rug.gal/it/playbook/problema-grosso-in-un-giro/</link><guid isPermaLink="true">https://rug.gal/it/playbook/problema-grosso-in-un-giro/</guid><description>Impostare la sessione perché il lavoro che conta si chiuda in pochi turni ben preparati, invece di cinquanta botta e risposta che costano tempo e soldi.</description><pubDate>Sun, 19 Jul 2026 00:00:00 GMT</pubDate><category>playbook</category></item><item><title>Quando l&apos;hype AI sostituisce il giudizio: la paralisi delle grandi aziende</title><link>https://rug.gal/it/radar/ai-mania-eviscerating-decision-making/</link><guid isPermaLink="true">https://rug.gal/it/radar/ai-mania-eviscerating-decision-making/</guid><description>Nik Suresh raccoglie aneddoti dal fronte delle grandi aziende: dirigenti che non hanno mai usato un tool AI ma firmano strategie da miliardi, e nessuno che osa smentire le promesse di produttività 100x.</description><pubDate>Sun, 19 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Claude Code v2.1.215: verifica e code review diventano comandi espliciti</title><link>https://rug.gal/it/radar/claude-code-v2-1-215-verify-code-review-explicit/</link><guid isPermaLink="true">https://rug.gal/it/radar/claude-code-v2-1-215-verify-code-review-explicit/</guid><description>Claude Code v2.1.215 toglie all&apos;agente l&apos;iniziativa di lanciare verifiche e code review in autonomia. Ora li invochi tu, quando li vuoi.</description><pubDate>Sun, 19 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>GPT-5.6 Sol Ultra dimostra un&apos;altra congettura matematica aperta da 50 anni</title><link>https://rug.gal/it/radar/gpt-5-6-sol-ultra-another-open-conjecture-verified/</link><guid isPermaLink="true">https://rug.gal/it/radar/gpt-5-6-sol-ultra-another-open-conjecture-verified/</guid><description>Il modello frontier produce un&apos;altra dimostrazione verificata da un matematico. Terzo risultato in una settimana: il ragionamento oltre il noto diventa riproducibile.</description><pubDate>Sun, 19 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>I critici dell&apos;AI hanno ragione, ma lo usiamo comunque</title><link>https://rug.gal/it/radar/llm-critics-right-use-anyway-dissonance/</link><guid isPermaLink="true">https://rug.gal/it/radar/llm-critics-right-use-anyway-dissonance/</guid><description>Un post da 300 punti su HN nomina la dissonanza che molti vivono senza dirla: gli LLM hanno difetti concreti e pericolosi, ma restano lo strumento migliore oggi disponibile.</description><pubDate>Sun, 19 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>SQLite Query Explainer: il tool che insegna SQL leggendo le query</title><link>https://rug.gal/it/radar/sqlite-query-explainer-willison-fable/</link><guid isPermaLink="true">https://rug.gal/it/radar/sqlite-query-explainer-willison-fable/</guid><description>Simon Willison pubblica un tool browser-based che annota i piani di esecuzione di SQLite in inglese semplice. Costruito con Claude Fable, onesto sui propri limiti.</description><pubDate>Sun, 19 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Claude Code: l&apos;agente di coding nel terminale (e non solo per programmatori)</title><link>https://rug.gal/it/strumenti/claude-code/</link><guid isPermaLink="true">https://rug.gal/it/strumenti/claude-code/</guid><description>L&apos;agente di Anthropic che legge, scrive ed esegue nel tuo ambiente: cosa fa davvero, quanto costa con i piani Pro e Max, e perché interessa anche chi non sviluppa.</description><pubDate>Sun, 19 Jul 2026 00:00:00 GMT</pubDate><category>strumenti</category></item><item><title>Codex: l&apos;agente di coding incluso nell&apos;abbonamento ChatGPT</title><link>https://rug.gal/it/strumenti/codex/</link><guid isPermaLink="true">https://rug.gal/it/strumenti/codex/</guid><description>L&apos;agente di OpenAI vive dentro il piano ChatGPT che forse hai già: CLI open source, web, editor e iPhone. Cosa include ogni piano e quando ha senso sceglierlo.</description><pubDate>Sun, 19 Jul 2026 00:00:00 GMT</pubDate><category>strumenti</category></item><item><title>Cursor: l&apos;editor con l&apos;agente dentro</title><link>https://rug.gal/it/strumenti/cursor/</link><guid isPermaLink="true">https://rug.gal/it/strumenti/cursor/</guid><description>Per chi vive nell&apos;editor più che nel terminale: Cursor mette l&apos;agente dentro l&apos;ambiente di sviluppo. Piani da zero a 200 $ al mese, e un modello di prezzo da capire prima di firmare.</description><pubDate>Sun, 19 Jul 2026 00:00:00 GMT</pubDate><category>strumenti</category></item><item><title>I gateway per provare i modelli: OpenRouter, Together, Groq, Fireworks</title><link>https://rug.gal/it/strumenti/gateway-a-confronto/</link><guid isPermaLink="true">https://rug.gal/it/strumenti/gateway-a-confronto/</guid><description>OpenRouter non è l&apos;unico sportello: c&apos;è chi ospita i modelli aperti, chi li fa correre su hardware proprio, chi punta tutto sulla produzione. La mappa per scegliere il tuo.</description><pubDate>Sun, 19 Jul 2026 00:00:00 GMT</pubDate><category>strumenti</category></item><item><title>Leggere i benchmark senza farsi fregare</title><link>https://rug.gal/it/strumenti/leggere-i-benchmark/</link><guid isPermaLink="true">https://rug.gal/it/strumenti/leggere-i-benchmark/</guid><description>SWE-bench, Terminal-Bench, LMArena, Artificial Analysis: cosa misura davvero ciascuno, come leggerlo in trenta secondi, e le tre trappole che gonfiano ogni annuncio.</description><pubDate>Sun, 19 Jul 2026 00:00:00 GMT</pubDate><category>strumenti</category></item><item><title>Modelli in locale: Ollama e LM Studio, quando ha senso davvero</title><link>https://rug.gal/it/strumenti/modelli-in-locale/</link><guid isPermaLink="true">https://rug.gal/it/strumenti/modelli-in-locale/</guid><description>Far girare un modello sul tuo computer si può, gratis: Ollama per il terminale, LM Studio per chi vuole l&apos;interfaccia. Cosa serve di hardware e quando conviene, senza romanticismo.</description><pubDate>Sun, 19 Jul 2026 00:00:00 GMT</pubDate><category>strumenti</category></item><item><title>OpenCode: il coding agent open source che scegli tu il modello</title><link>https://rug.gal/it/strumenti/opencode/</link><guid isPermaLink="true">https://rug.gal/it/strumenti/opencode/</guid><description>L&apos;agente da terminale senza lock-in: open source, si collega a più di 75 provider (OpenRouter compreso) e il modello lo decidi tu, anche uno gratuito o locale.</description><pubDate>Sun, 19 Jul 2026 00:00:00 GMT</pubDate><category>strumenti</category></item><item><title>OpenCode da zero al primo task utile</title><link>https://rug.gal/it/strumenti/opencode-primo-task/</link><guid isPermaLink="true">https://rug.gal/it/strumenti/opencode-primo-task/</guid><description>Installare l&apos;agente open source, collegargli un modello via OpenRouter e fargli completare un compito vero in una cartella recintata. La dimostrazione che un coding agent non è solo roba da sviluppatori.</description><pubDate>Sun, 19 Jul 2026 00:00:00 GMT</pubDate><category>strumenti</category></item><item><title>OpenRouter: tutti i modelli con una chiave sola</title><link>https://rug.gal/it/strumenti/openrouter/</link><guid isPermaLink="true">https://rug.gal/it/strumenti/openrouter/</guid><description>Lo sportello unico dei modelli AI: un account, una chiave, più di 400 modelli di laboratori diversi. Come funziona il conto, cosa costa davvero e dove stanno i limiti.</description><pubDate>Sun, 19 Jul 2026 00:00:00 GMT</pubDate><category>strumenti</category></item><item><title>OpenRouter in 15 minuti: dal primo accesso a tre modelli a confronto</title><link>https://rug.gal/it/strumenti/openrouter-in-15-minuti/</link><guid isPermaLink="true">https://rug.gal/it/strumenti/openrouter-in-15-minuti/</guid><description>La guida passo-passo per aprire l&apos;account, mettere il tetto di spesa prima dei soldi, e confrontare tre modelli su un caso tuo. Anche senza saper programmare.</description><pubDate>Sun, 19 Jul 2026 00:00:00 GMT</pubDate><category>strumenti</category></item><item><title>ChatGPT, Claude o Gemini: quale abbonamento, letto dai listini</title><link>https://rug.gal/it/strumenti/piani-chat-a-confronto/</link><guid isPermaLink="true">https://rug.gal/it/strumenti/piani-chat-a-confronto/</guid><description>La domanda più frequente di tutte, risposta col metodo del sito: le fasce vere dei tre listini, cosa include ciascuna, e il criterio per capire quando il gratis basta.</description><pubDate>Sun, 19 Jul 2026 00:00:00 GMT</pubDate><category>strumenti</category></item><item><title>Claude Code v2.1.214: fix critico su permessi Windows e PowerShell</title><link>https://rug.gal/it/radar/claude-code-v2-1-214-permissions-powershell-fix/</link><guid isPermaLink="true">https://rug.gal/it/radar/claude-code-v2-1-214-permissions-powershell-fix/</guid><description>Anthropic chiude un bypass sui permessi su Windows e stabilizza PowerShell 5.1. L&apos;ultima di una serie rapida di patch che sta portando Claude Code verso l&apos;uso quotidiano in produzione.</description><pubDate>Sat, 18 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Claude Fable 5 permanente nei piani Max e Team Premium a capacità ridotta</title><link>https://rug.gal/it/radar/claude-fable-5-permanent-max-team-premium/</link><guid isPermaLink="true">https://rug.gal/it/radar/claude-fable-5-permanent-max-team-premium/</guid><description>Anthropic conferma Fable 5 nei piani top al 50% dei limiti. Pro e Team Standard ricevono 100 dollari di credito e poi passano alle tariffe API. La mossa risponde alla pressione di GPT-5.6 Sol.</description><pubDate>Sat, 18 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Claude web_fetch: la memoria dell&apos;utente poteva essere esfiltrata lettera per lettera</title><link>https://rug.gal/it/radar/claude-web-fetch-memory-exfiltration/</link><guid isPermaLink="true">https://rug.gal/it/radar/claude-web-fetch-memory-exfiltration/</guid><description>Un ricercatore ha trovato un modo per far consegnare a Claude i dati personali accumulati nella sua memoria verso un sito esterno. Anthropic ha confermato e chiuso il buco, ma il pattern di rischio resta generale.</description><pubDate>Sat, 18 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Codex a 7 milioni di utenti, +1M al giorno: gli agenti di coding escono dalla demo</title><link>https://rug.gal/it/radar/codex-7m-users-1m-per-day-gpt-5-6/</link><guid isPermaLink="true">https://rug.gal/it/radar/codex-7m-users-1m-per-day-gpt-5-6/</guid><description>Codex passa da 700mila a 7 milioni di utenti in sei mesi, con GPT-5.6 Sol che spinge l&apos;adozione oltre Claude Code. Gli agenti di coding diventano strumenti quotidiani.</description><pubDate>Sat, 18 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>GPT-5.6 in Codex cancella la directory home: il bug dell&apos;agente senza sandbox</title><link>https://rug.gal/it/radar/gpt-5-6-codex-file-deletion-home-bug/</link><guid isPermaLink="true">https://rug.gal/it/radar/gpt-5-6-codex-file-deletion-home-bug/</guid><description>Quando togli il sandbox per velocità, un errore onesto del modello basta a cancellarti i file. Un altro caso che conferma dove sta la sicurezza degli agenti.</description><pubDate>Sat, 18 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>GPT-5.6 Sol chiude un altro problema aperto: l&apos;architettura degli agenti conta più del modello</title><link>https://rug.gal/it/radar/gpt-5-6-sol-convex-optimization-parallel-agents/</link><guid isPermaLink="true">https://rug.gal/it/radar/gpt-5-6-sol-convex-optimization-parallel-agents/</guid><description>Un secondo risultato matematico verificato, e un benchmark indipendente che mostra come il ciclo di controllo vince sulla potenza grezza.</description><pubDate>Sat, 18 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Ollama 0.32.1: Gemma 4 e tool calling migliorati, cache leak risolto</title><link>https://rug.gal/it/radar/ollama-0-32-1-gemma-4-tool-calling-cache-leak/</link><guid isPermaLink="true">https://rug.gal/it/radar/ollama-0-32-1-gemma-4-tool-calling-cache-leak/</guid><description>Rilascio locale con miglioramenti concreti su multi-turn reasoning e memory leak critico. Chi esegue agenti locali avrà bisogno di questo upgrade.</description><pubDate>Sat, 18 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Ollama 0.32.1: tool calling più solido e memory leak risolto per gli agenti locali</title><link>https://rug.gal/it/radar/ollama-0-32-1-tool-calling-memory-leak-fix/</link><guid isPermaLink="true">https://rug.gal/it/radar/ollama-0-32-1-tool-calling-memory-leak-fix/</guid><description>La release di manutenzione corregge un problema di memoria che bloccava gli agenti in sessioni lunghe e migliora il tool calling multi-turno. Chi usa modelli open-weight per lavoro ricorrente ha un upgrade concreto da fare.</description><pubDate>Sat, 18 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>OpenAI Codex e GPT-5.6: integrazione completa, crescita 2.5x settimanale</title><link>https://rug.gal/it/radar/openai-codex-gpt-5-6-weekly-growth-jetbrains/</link><guid isPermaLink="true">https://rug.gal/it/radar/openai-codex-gpt-5-6-weekly-growth-jetbrains/</guid><description>GPT-5.6 Sol arriva in Codex (agente di coding enterprise), cresce a 1M utenti al giorno e OpenAI documenta workflow operativi per team. L&apos;agenticità di coding passa da demo a produzione.</description><pubDate>Sat, 18 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Quattro modelli a confronto sulle clip musicali: quando il benchmark diventa usabile</title><link>https://rug.gal/it/radar/ai-music-video-benchmark-usabile/</link><guid isPermaLink="true">https://rug.gal/it/radar/ai-music-video-benchmark-usabile/</guid><description>Un test reale con $100 di budget, video generati e confronto fra GPT-5.6 Sol, Claude Fable 5, Grok 4.5 e Muse Spark. L&apos;utente decide con i propri occhi, non con i numeri di arXiv.</description><pubDate>Fri, 17 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Apple intensifica la disputa con OpenAI: decine di dipendenti ricevono lettere legali</title><link>https://rug.gal/it/radar/apple-openai-legal-escalation-dozens-employees/</link><guid isPermaLink="true">https://rug.gal/it/radar/apple-openai-legal-escalation-dozens-employees/</guid><description>Dopo la causa del 14 luglio contro ex dipendenti, Apple estende la pressione a decine di persone ancora in OpenAI con lettere legali mirate.</description><pubDate>Fri, 17 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Claude Code e il problema dello scritto generato: quando il codice parla di sé</title><link>https://rug.gal/it/radar/claude-code-auto-continue-incident/</link><guid isPermaLink="true">https://rug.gal/it/radar/claude-code-auto-continue-incident/</guid><description>Un&apos;indagine su come Claude Code ha spedito una feature che proseguiva da sola dopo 60 secondi, l&apos;ha ritirata in tre giorni, e cosa rivela su chi firma il codice.</description><pubDate>Fri, 17 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Claude Code v2.1.211: subagent text forwarding e fix su sicurezza preview</title><link>https://rug.gal/it/radar/claude-code-v2-1-211-subagent-text-forwarding/</link><guid isPermaLink="true">https://rug.gal/it/radar/claude-code-v2-1-211-subagent-text-forwarding/</guid><description>La release v2.1.211 aggiunge il flag per inoltrare il testo dei subagent nell&apos;output strutturato e corregge un buco di sicurezza nelle anteprime dei permessi.</description><pubDate>Fri, 17 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Claude Code v2.1.212: fork diventa background session, subtask per i subagent in-sessione</title><link>https://rug.gal/it/radar/claude-code-v2-1-212-fork-background-subtask/</link><guid isPermaLink="true">https://rug.gal/it/radar/claude-code-v2-1-212-fork-background-subtask/</guid><description>Anthropic cambia l&apos;architettura di delega in Claude Code: `/fork` ora lancia sessioni background indipendenti, il vecchio comportamento si chiama `/subtask`.</description><pubDate>Fri, 17 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>DSL e agenti: limitare il dominio per aumentare l&apos;affidabilità</title><link>https://rug.gal/it/radar/dsl-agents-reliability-fowler/</link><guid isPermaLink="true">https://rug.gal/it/radar/dsl-agents-reliability-fowler/</guid><description>Martin Fowler argomenta che gli agenti funzionano meglio dentro un linguaggio specifico di dominio che nel natural language aperto. Un&apos;idea passata inosservata che converge con l&apos;esperienza di chi usa Claude Code e Codex.</description><pubDate>Fri, 17 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Inkling: il primo modello da Thinking Machines Lab di Mira Murati, 975B parametri open-weights</title><link>https://rug.gal/it/radar/inkling-975b-mira-murati-thinking-machines/</link><guid isPermaLink="true">https://rug.gal/it/radar/inkling-975b-mira-murati-thinking-machines/</guid><description>Mira Murati (ex CTO di OpenAI) rilascia il primo modello della sua nuova compagnia: 975B parametri, 41B attivi, licenza Apache-2.0, multimodale. Un attore nuovo nel panorama open-weights.</description><pubDate>Fri, 17 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Inkling da Thinking Machines: i dettagli del round da $300M e la visione sugli agenti</title><link>https://rug.gal/it/radar/inkling-thinking-machines-300m-funding-details/</link><guid isPermaLink="true">https://rug.gal/it/radar/inkling-thinking-machines-300m-funding-details/</guid><description>TechCrunch documenta come Mira Murati ha raccolto $300M pre-seed in nove mesi e la tesi anti-monolitica dietro Inkling, il primo modello Apache 2.0 dell&apos;azienda.</description><pubDate>Fri, 17 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Kimi K3: 2.8T parametri, il più grande modello aperto mai rilasciato, prezzi cinesi in salita</title><link>https://rug.gal/it/radar/kimi-k3-2-8t-china-pricing-shift/</link><guid isPermaLink="true">https://rug.gal/it/radar/kimi-k3-2-8t-china-pricing-shift/</guid><description>Moonshot AI rilascia K3 con 2.8T parametri totali e 50B attivi, il più grande modello open-weight mai pubblicato. Performance vicina a GPT-5.6 Sol e Fable 5, prezzi API competitivi. La Cina chiude il gap qualitativo e segnala fine dell&apos;era dei prezzi stracciati.</description><pubDate>Fri, 17 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Linus Torvalds difende l&apos;AI nel kernel Linux: «Chi è contro faccia un fork»</title><link>https://rug.gal/it/radar/linus-torvalds-linux-ai-fork-debate/</link><guid isPermaLink="true">https://rug.gal/it/radar/linus-torvalds-linux-ai-fork-debate/</guid><description>Il creatore di Linux prende posizione netta: l&apos;AI è uno strumento utile, e chi la rifiuta per principio può fare un fork o andarsene.</description><pubDate>Fri, 17 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>LM Studio Bionic: agente locale per modelli open-source</title><link>https://rug.gal/it/radar/lm-studio-bionic-local-agent/</link><guid isPermaLink="true">https://rug.gal/it/radar/lm-studio-bionic-local-agent/</guid><description>LM Studio lancia un agente che lavora in locale su modelli aperti o in cloud zero-retention, con coding, voice input e preview documenti.</description><pubDate>Fri, 17 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>NotebookLM diventa Gemini Notebook e Google apre Search a integrazioni terze sotto pressione UE</title><link>https://rug.gal/it/radar/notebooklm-gemini-notebook-rebrand-ue-search-opening/</link><guid isPermaLink="true">https://rug.gal/it/radar/notebooklm-gemini-notebook-rebrand-ue-search-opening/</guid><description>Google rinomina NotebookLM in Gemini Notebook e, sotto vincolo DMA, apre Android e Search ad assistenti rivali. Le pressioni regolatorie europee stanno modificando l&apos;architettura dei prodotti AI consumer.</description><pubDate>Fri, 17 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>OpenAI pubblica &apos;scorecard AI&apos; per misurare ROI aziendale: lavoro utile, costo per task, affidabilità</title><link>https://rug.gal/it/radar/openai-ai-scorecard-roi-framework/</link><guid isPermaLink="true">https://rug.gal/it/radar/openai-ai-scorecard-roi-framework/</guid><description>Sarah Friar introduce un framework pratico per misurare il ritorno dell&apos;AI nei flussi aziendali: lavoro completato, costo per task riuscito, affidabilità, return on compute.</description><pubDate>Fri, 17 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Grok Build aperto su GitHub dopo il data breach: xAI ci riprova sotto occhio pubblico</title><link>https://rug.gal/it/radar/xai-grok-build-open-source-post-breach/</link><guid isPermaLink="true">https://rug.gal/it/radar/xai-grok-build-open-source-post-breach/</guid><description>xAI open-source il codice di Grok Build dopo che il tool aveva silenziosamente uploadato intere directory. Un caso di studio su trasparenza post-incident e su cosa può andare storto con un agente che ha troppo accesso.</description><pubDate>Fri, 17 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Claude Code v2.1.210: contatore live per tool lunghi e regole permission migrate</title><link>https://rug.gal/it/radar/claude-code-v2-1-210-live-timer-permission-rules/</link><guid isPermaLink="true">https://rug.gal/it/radar/claude-code-v2-1-210-live-timer-permission-rules/</guid><description>Anthropic affina l&apos;UX agente con un timer visibile per le operazioni lunghe e depreca regole di permesso obsolete. La serie di release veloci mostra maturazione verso uso quotidiano.</description><pubDate>Wed, 15 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>OpenAI lancia il primo hardware: speaker senza schermo che si muove</title><link>https://rug.gal/it/radar/openai-first-hardware-screenless-speaker/</link><guid isPermaLink="true">https://rug.gal/it/radar/openai-first-hardware-screenless-speaker/</guid><description>Bloomberg rivela il primo dispositivo hardware di OpenAI: uno speaker senza schermo con elementi meccanici mobili, progettato per sentirsi come un compagno.</description><pubDate>Wed, 15 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Un agente RL addestra modelli con RL per 1300 dollari</title><link>https://rug.gal/it/radar/rl-agent-trains-models-1300-dollars/</link><guid isPermaLink="true">https://rug.gal/it/radar/rl-agent-trains-models-1300-dollars/</guid><description>Un esperimento su GitHub mostra un agente addestrato con RL che a sua volta scrive e lancia job di training RL per modelli piccoli, con costi accessibili e tutto il codice aperto.</description><pubDate>Wed, 15 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Confronta due modelli in un quarto d&apos;ora</title><link>https://rug.gal/it/playbook/confronta-due-modelli/</link><guid isPermaLink="true">https://rug.gal/it/playbook/confronta-due-modelli/</guid><description>Stesso compito, stessi casi di prova, tabella dei risultati: decidere con i propri dati invece che con i benchmark.</description><pubDate>Tue, 14 Jul 2026 00:00:00 GMT</pubDate><category>playbook</category></item><item><title>AdvancedMathBench: banco di prova per matematica avanzata con verifica rigorosa</title><link>https://rug.gal/it/radar/advancedmathbench-undergraduate-grad-math-benchmark/</link><guid isPermaLink="true">https://rug.gal/it/radar/advancedmathbench-undergraduate-grad-math-benchmark/</guid><description>Un benchmark che colma un buco: matematica universitaria con granularità fine e verifica automatica addestrata su annotazioni esperte.</description><pubDate>Tue, 14 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Anthropic estende Fable 5 e localizza i prezzi in India</title><link>https://rug.gal/it/radar/anthropic-fable-india-rupee-pricing/</link><guid isPermaLink="true">https://rug.gal/it/radar/anthropic-fable-india-rupee-pricing/</guid><description>Claude Fable 5 resta nei piani fino al 19 luglio e Anthropic lancia i prezzi in rupie per l&apos;India, il secondo mercato dopo gli USA.</description><pubDate>Tue, 14 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Apple fa causa a OpenAI per furto di segreti hardware</title><link>https://rug.gal/it/radar/apple-openai-lawsuit-hardware-secrets/</link><guid isPermaLink="true">https://rug.gal/it/radar/apple-openai-lawsuit-hardware-secrets/</guid><description>Apple accusa ex dipendenti passati a OpenAI di aver sottratto informazioni riservate su prodotti non ancora annunciati, con prove documentate di accessi non autorizzati e componenti portati ai colloqui.</description><pubDate>Tue, 14 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Tre casi d&apos;uso agentico enterprise su Amazon Bedrock</title><link>https://rug.gal/it/radar/bluesight-bedrock-multi-agent-healthcare/</link><guid isPermaLink="true">https://rug.gal/it/radar/bluesight-bedrock-multi-agent-healthcare/</guid><description>Bluesight porta Prism Assistant in produzione su sei prodotti healthcare, AWS documenta il pattern OBO token exchange per multi-tenant, e un post racconta l&apos;AI come strumento di accessibilità per neurodivergenti.</description><pubDate>Tue, 14 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Mr. Meeseeks per Claude Code: notifica sonora per lo stato agente</title><link>https://rug.gal/it/radar/claude-code-meeseeks-audio-notification/</link><guid isPermaLink="true">https://rug.gal/it/radar/claude-code-meeseeks-audio-notification/</guid><description>Un plugin che suona quando Claude Code aspetta input, segnalando un bisogno reale: gli agenti hanno bisogno di UX pensata per sessioni lunghe.</description><pubDate>Tue, 14 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Claude Code v2.1.208: modalità screen reader opt-in e fix su stabilità</title><link>https://rug.gal/it/radar/claude-code-v2-1-208-screen-reader-mode/</link><guid isPermaLink="true">https://rug.gal/it/radar/claude-code-v2-1-208-screen-reader-mode/</guid><description>Anthropic rilascia una versione di Claude Code con accessibilità migliorata e correzioni sui crash, segnale che il tool matura verso l&apos;uso quotidiano.</description><pubDate>Tue, 14 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Claude Code v2.1.209: fix sui dialoghi bloccati nelle sessioni background</title><link>https://rug.gal/it/radar/claude-code-v2-1-209-dialog-guard-fix/</link><guid isPermaLink="true">https://rug.gal/it/radar/claude-code-v2-1-209-dialog-guard-fix/</guid><description>Anthropic corregge un guard troppo ampio che bloccava `/model` e altri dialoghi nelle sessioni agente in background.</description><pubDate>Tue, 14 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Come fermare le frasi ricorrenti di Claude (e perché conta)</title><link>https://rug.gal/it/radar/claude-load-bearing-phrase-hook/</link><guid isPermaLink="true">https://rug.gal/it/radar/claude-load-bearing-phrase-hook/</guid><description>Un hook MessageDisplay che cattura e sostituisce i tic linguistici di Claude prima che arrivino a schermo. Il metodo funziona, ma il problema vero è a monte.</description><pubDate>Tue, 14 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Cloudflare Precursor: rilevare agenti dal comportamento continuo</title><link>https://rug.gal/it/radar/cloudflare-precursor-agentic-behavior-detection/</link><guid isPermaLink="true">https://rug.gal/it/radar/cloudflare-precursor-agentic-behavior-detection/</guid><description>Un sistema di bot detection che segue il comportamento lungo l&apos;intera sessione invece di cercare l&apos;anomalia nel singolo click.</description><pubDate>Tue, 14 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Codex inizia a cifrare i prompt dei sub-agent</title><link>https://rug.gal/it/radar/codex-encrypted-subagent-prompts/</link><guid isPermaLink="true">https://rug.gal/it/radar/codex-encrypted-subagent-prompts/</guid><description>OpenAI cifra i messaggi fra agenti in Codex, nascondendo l&apos;audit trail leggibile. Chi usa agenti in produzione perde trasparenza sui task delegati.</description><pubDate>Tue, 14 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>DOOMQL: SQL come game engine, esperimento pratico con GPT-5.6 Sol</title><link>https://rug.gal/it/radar/doomql-sql-game-engine-gpt-5-6-sol/</link><guid isPermaLink="true">https://rug.gal/it/radar/doomql-sql-game-engine-gpt-5-6-sol/</guid><description>Un esperimento concreto mostra cosa si può costruire con un modello frontier quando gli dai un obiettivo assurdo e il giusto sandbox: un Doom-like che gira interamente dentro SQLite.</description><pubDate>Tue, 14 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Google lancia ATL Saathi: Gemini per i laboratori di robotica delle scuole indiane</title><link>https://rug.gal/it/radar/google-atl-saathi-gemini-robotics-labs-india/</link><guid isPermaLink="true">https://rug.gal/it/radar/google-atl-saathi-gemini-robotics-labs-india/</guid><description>Un assistente AI basato su Gemini per gli insegnanti dei laboratori di robotica in 12.500 scuole indiane: accessibilità attraverso la formazione, non solo l&apos;infrastruttura.</description><pubDate>Tue, 14 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>GPT-5.6 disponibile su Amazon Bedrock</title><link>https://rug.gal/it/radar/gpt-5-6-amazon-bedrock/</link><guid isPermaLink="true">https://rug.gal/it/radar/gpt-5-6-amazon-bedrock/</guid><description>I modelli Sol, Terra e Luna arrivano su Bedrock con prezzi pari all&apos;API OpenAI e il motore di inferenza AWS per carichi enterprise.</description><pubDate>Tue, 14 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Hassabis propone un watchdog AI globale guidato dagli USA</title><link>https://rug.gal/it/radar/hassabis-us-led-ai-watchdog/</link><guid isPermaLink="true">https://rug.gal/it/radar/hassabis-us-led-ai-watchdog/</guid><description>Il CEO di DeepMind vuole un&apos;istituzione internazionale con il potere di bloccare i modelli frontier troppo rischiosi, e spera di vederla operativa entro fine anno.</description><pubDate>Tue, 14 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Lobsters migra da MariaDB a SQLite in produzione</title><link>https://rug.gal/it/radar/lobsters-sqlite-production-migration/</link><guid isPermaLink="true">https://rug.gal/it/radar/lobsters-sqlite-production-migration/</guid><description>Un sito community completa la migrazione a SQLite: CPU e memoria in calo, costi dimezzati, architettura a server singolo che regge il carico reale.</description><pubDate>Tue, 14 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Metacognizione negli LLM: il paper che mappa quando un modello sa di non sapere</title><link>https://rug.gal/it/radar/metacognition-llms-foundations-review/</link><guid isPermaLink="true">https://rug.gal/it/radar/metacognition-llms-foundations-review/</guid><description>Una review sistematica su come i modelli riflettono sulle proprie capacità, con implicazioni concrete per chi li usa in decisioni complesse.</description><pubDate>Tue, 14 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Nadella contro OpenAI e Anthropic: «Addestrano sui dati altrui ma vietano la distillazione»</title><link>https://rug.gal/it/radar/nadella-ai-labs-distillation-hypocrisy/</link><guid isPermaLink="true">https://rug.gal/it/radar/nadella-ai-labs-distillation-hypocrisy/</guid><description>Il CEO di Microsoft critica i lab AI proprietari che si addestrano su dati pubblici ma vietano agli altri di imparare dai loro modelli, mentre imparano dalle interazioni dei clienti.</description><pubDate>Tue, 14 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>New York blocca i data center: prima moratoria statale negli USA</title><link>https://rug.gal/it/radar/new-york-data-center-moratorium/</link><guid isPermaLink="true">https://rug.gal/it/radar/new-york-data-center-moratorium/</guid><description>Una pausa di un anno sui permessi per data center sopra i 50 MW, mentre lo stato decide come proteggere residenti e infrastrutture dall&apos;ondata di costruzioni AI.</description><pubDate>Tue, 14 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>OpenAI documenta i workflow ChatGPT Work per data science e sales team</title><link>https://rug.gal/it/radar/openai-chatgpt-work-data-science-sales-guides/</link><guid isPermaLink="true">https://rug.gal/it/radar/openai-chatgpt-work-data-science-sales-guides/</guid><description>Due guide operative mostrano come i team usano ChatGPT Work su compiti reali, con esempi di workflow verificabili.</description><pubDate>Tue, 14 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Nuovo framework di post-training: separare esplorazione e allineamento</title><link>https://rug.gal/it/radar/pust-modular-post-training-framework/</link><guid isPermaLink="true">https://rug.gal/it/radar/pust-modular-post-training-framework/</guid><description>Un paper propone di disaccoppiare l&apos;esplorazione (su modello proxy leggero) dall&apos;allineamento (sul modello principale), rendendo il post-training modulare e riusabile.</description><pubDate>Tue, 14 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Reflection AI sigla accordo compute da $1B con Nebius</title><link>https://rug.gal/it/radar/reflection-nebius-1b-compute-deal/</link><guid isPermaLink="true">https://rug.gal/it/radar/reflection-nebius-1b-compute-deal/</guid><description>Una startup di modelli aperti garantisce un miliardo di dollari in risorse di calcolo, segnale su dove vanno gli investimenti infrastrutturali.</description><pubDate>Tue, 14 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Soofi S 30B: modello sovrano tedesco-inglese open source</title><link>https://rug.gal/it/radar/soofi-s-30b-sovereign-german-model/</link><guid isPermaLink="true">https://rug.gal/it/radar/soofi-s-30b-sovereign-german-model/</guid><description>Un consorzio tedesco rilascia un MoE 30B (3B attivi) Apache, addestrato su cloud Deutsche Telekom con focus su tedesco, che batte i modelli aperti su benchmark bilingui.</description><pubDate>Tue, 14 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Spotify porta un chatbot AI conversazionale per musica, podcast e audiolibri</title><link>https://rug.gal/it/radar/spotify-ai-chatbot-premium/</link><guid isPermaLink="true">https://rug.gal/it/radar/spotify-ai-chatbot-premium/</guid><description>Una feature Premium beta che trasforma Spotify in un assistente conversazionale: chiedi cosa vuoi ascoltare, affina la selezione parlando, e interroga la tua cronologia d&apos;ascolto.</description><pubDate>Tue, 14 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Superhuman auto-draft: bozze email AI che funzionano davvero</title><link>https://rug.gal/it/radar/superhuman-auto-draft-ai-email/</link><guid isPermaLink="true">https://rug.gal/it/radar/superhuman-auto-draft-ai-email/</guid><description>Una feature email AI che secondo il test di TechCrunch produce bozze utilizzabili con poco editing. Caso concreto di AI che potenzia un task quotidiano.</description><pubDate>Tue, 14 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>uvx in GitHub Actions cache-friendly</title><link>https://rug.gal/it/radar/uvx-github-actions-cache-friendly/</link><guid isPermaLink="true">https://rug.gal/it/radar/uvx-github-actions-cache-friendly/</guid><description>Simon Willison condivide una ricetta tecnica per usare uvx nelle GitHub Actions in modo che rispetti la cache, risparmiando minuti a ogni build.</description><pubDate>Tue, 14 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Waze integra Gemini: comandi vocali naturali e navigazione personalizzata</title><link>https://rug.gal/it/radar/waze-gemini-voice-natural-commands/</link><guid isPermaLink="true">https://rug.gal/it/radar/waze-gemini-voice-natural-commands/</guid><description>Google porta Gemini in Waze per comandi vocali conversazionali e suggerimenti di percorso basati sulle tue abitudini. Un caso concreto di AI assistente in un contesto d&apos;uso quotidiano ripetuto.</description><pubDate>Tue, 14 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Anthropic estende ancora Fable: disponibile fino al 19 luglio nei piani Max</title><link>https://rug.gal/it/radar/anthropic-fable-estensione-luglio/</link><guid isPermaLink="true">https://rug.gal/it/radar/anthropic-fable-estensione-luglio/</guid><description>Anthropic sposta di nuovo la data di fine disponibilità di Claude Fable 5 nei piani Max, segnale che il modello resta competitivo dopo l&apos;arrivo di GPT-5.6 Sol.</description><pubDate>Mon, 13 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Clawk: VM Linux usa-e-getta per coding agents, non il tuo laptop</title><link>https://rug.gal/it/radar/clawk-disposable-vm-coding-agents/</link><guid isPermaLink="true">https://rug.gal/it/radar/clawk-disposable-vm-coding-agents/</guid><description>Un tool che isola gli agenti di coding in una macchina virtuale separata con rete filtrata, così possono installare e distruggere senza toccare il tuo sistema.</description><pubDate>Mon, 13 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Migrazione di un agente di produzione a GPT-5.6: 2.2x più veloce, 27% più economico</title><link>https://rug.gal/it/radar/ploy-gpt-5-6-production-migration/</link><guid isPermaLink="true">https://rug.gal/it/radar/ploy-gpt-5-6-production-migration/</guid><description>Ploy AI documenta la migrazione del proprio agente da Claude Opus 4.8 a GPT-5.6 Sol con numeri verificabili e le insidie nascoste che hanno dovuto risolvere.</description><pubDate>Mon, 13 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Willison mostra l&apos;impatto degli agenti sul proprio grafico commit GitHub</title><link>https://rug.gal/it/radar/willison-coding-agents-commit-frequency/</link><guid isPermaLink="true">https://rug.gal/it/radar/willison-coding-agents-commit-frequency/</guid><description>Simon Willison documenta il salto di produttività su Datasette attraverso i grafici di frequenza commit: il picco finale corrisponde all&apos;arrivo di Opus 4.8 e GPT-5.6 Sol.</description><pubDate>Mon, 13 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Due voci tecniche contro l&apos;hype AI: &apos;amo gli LLM, odio le promesse vuote&apos;</title><link>https://rug.gal/it/radar/zig-geohot-anti-hype-convergence/</link><guid isPermaLink="true">https://rug.gal/it/radar/zig-geohot-anti-hype-convergence/</guid><description>Il creatore di Zig e George Hotz convergono sulla stessa critica: gli LLM sono utili, l&apos;hype sulla singolarità è vuoto e dannoso.</description><pubDate>Mon, 13 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Agenti AI vincono a Slay the Spire 2 sostituendo i log di chat con memoria strutturata</title><link>https://rug.gal/it/radar/agentsts-structured-memory-slay-the-spire/</link><guid isPermaLink="true">https://rug.gal/it/radar/agentsts-structured-memory-slay-the-spire/</guid><description>Un&apos;architettura a cinque livelli di memoria porta gli agenti a vincere dove i modelli frontier fallivano, consumando 90 volte meno token.</description><pubDate>Sun, 12 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Altman cambia posizione: ora &apos;abbastanza sicuro&apos; che l&apos;AI crei più lavoro di quanto ne tolga</title><link>https://rug.gal/it/radar/altman-ai-net-job-creating/</link><guid isPermaLink="true">https://rug.gal/it/radar/altman-ai-net-job-creating/</guid><description>Il CEO di OpenAI inverte la narrativa sul lavoro: da licenziamenti di massa a saldo positivo, in un cambio di framing che dice poco sui numeri reali.</description><pubDate>Sun, 12 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Anthropic: Claude Cowork serve soprattutto per il lavoro noioso che nessuno vuole</title><link>https://rug.gal/it/radar/anthropic-cowork-mundane-work/</link><guid isPermaLink="true">https://rug.gal/it/radar/anthropic-cowork-mundane-work/</guid><description>L&apos;analisi di 1,2 milioni di sessioni conferma che metà dell&apos;uso va a operazioni amministrative e scrittura, non a creatività o coding.</description><pubDate>Sun, 12 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Voti crollati dal 96% al 48% quando il professore ha vietato l&apos;AI all&apos;esame</title><link>https://rug.gal/it/radar/brown-university-ai-exam-grades-collapse/</link><guid isPermaLink="true">https://rug.gal/it/radar/brown-university-ai-exam-grades-collapse/</guid><description>Un professore di economia a Brown University ha scoperto una dipendenza da AI quando i voti dell&apos;esame sorvegliato sono crollati rispetto al take-home. Due studi su 26.000 studenti confermano il pattern.</description><pubDate>Sun, 12 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Claude Code ora ha un browser integrato per leggere, cliccare e digitare su siti esterni</title><link>https://rug.gal/it/radar/claude-code-integrated-browser/</link><guid isPermaLink="true">https://rug.gal/it/radar/claude-code-integrated-browser/</guid><description>Anthropic aggiunge un browser direttamente in Claude Code: l&apos;agente può aprire, leggere e interagire con pagine web esterne, con controlli di sicurezza su ogni azione di scrittura.</description><pubDate>Sun, 12 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Claude Code manda 33k token prima di leggere il prompt, OpenCode ne manda 7k</title><link>https://rug.gal/it/radar/claude-code-opencode-token-overhead/</link><guid isPermaLink="true">https://rug.gal/it/radar/claude-code-opencode-token-overhead/</guid><description>Un&apos;analisi tecnica mostra che Claude Code consuma 4,7 volte più token di OpenCode prima ancora che arrivi la tua richiesta, con implicazioni su costi e cache.</description><pubDate>Sun, 12 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Clodex: IDE agentico local-first con zero-trust e verifica locale</title><link>https://rug.gal/it/radar/clodex-ide-local-first-agentic/</link><guid isPermaLink="true">https://rug.gal/it/radar/clodex-ide-local-first-agentic/</guid><description>Un ambiente di sviluppo agentico che esegue tutto in locale, tratta l&apos;output del modello come untrusted input e richiede approvazione esplicita per azioni ad alto impatto.</description><pubDate>Sun, 12 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>GPT-5.6 Sol Ultra dimostra una congettura aperta da 50 anni in meno di un&apos;ora</title><link>https://rug.gal/it/radar/gpt-5-6-sol-ultra-cyclic-polytope-conjecture/</link><guid isPermaLink="true">https://rug.gal/it/radar/gpt-5-6-sol-ultra-cyclic-polytope-conjecture/</guid><description>Il modello top di OpenAI ha prodotto una dimostrazione completa della Cycle Double Cover Conjecture usando 64 sottoagenti in parallelo. Un matematico verifica: la prova è elementare e corretta.</description><pubDate>Sun, 12 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Un agente in 100 righe di Lisp</title><link>https://rug.gal/it/radar/lisp-agent-100-lines/</link><guid isPermaLink="true">https://rug.gal/it/radar/lisp-agent-100-lines/</guid><description>Un&apos;implementazione minimalista che mostra l&apos;anatomia di un agente senza framework, con un solo tool: eval.</description><pubDate>Sun, 12 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Mesh LLM porta l&apos;inferenza AI distribuita su iroh</title><link>https://rug.gal/it/radar/mesh-llm-distributed-inference-iroh/</link><guid isPermaLink="true">https://rug.gal/it/radar/mesh-llm-distributed-inference-iroh/</guid><description>Un sistema peer-to-peer che aggrega le GPU che hai e le espone come API compatibile OpenAI, senza server centrale.</description><pubDate>Sun, 12 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Mindwalk: replay delle sessioni agente su mappa 3D della codebase</title><link>https://rug.gal/it/radar/mindwalk-replay-agent-sessions-3d-codebase/</link><guid isPermaLink="true">https://rug.gal/it/radar/mindwalk-replay-agent-sessions-3d-codebase/</guid><description>Un tool open source che mostra come gli agenti di coding navigano il codice, disegnando la repository come una mappa notturna dove si vede dove hanno cercato, letto e modificato.</description><pubDate>Sun, 12 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Ollama 0.32.0: interfaccia agente e warning per modelli vecchi</title><link>https://rug.gal/it/radar/ollama-032-agent-ui-old-model-warning/</link><guid isPermaLink="true">https://rug.gal/it/radar/ollama-032-agent-ui-old-model-warning/</guid><description>La release candidate introduce un&apos;UI agente e avvisa prima di lanciare modelli agentici datati. Un segnale su come il tooling locale si adatta agli agenti.</description><pubDate>Sun, 12 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>sqlite-utils 4.1: il primo dot-release dopo la riscrittura con Claude Fable</title><link>https://rug.gal/it/radar/sqlite-utils-4-1-post-riscrittura-fable/</link><guid isPermaLink="true">https://rug.gal/it/radar/sqlite-utils-4-1-post-riscrittura-fable/</guid><description>Simon Willison spedisce il primo aggiornamento dopo la 4.0 scritta con un agente. Il codice regge in produzione e l&apos;agente trova bug che Willison non aveva visto.</description><pubDate>Sun, 12 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>«Smettila di dirmi di chiedere a un LLM»</title><link>https://rug.gal/it/radar/stop-telling-me-ask-llm/</link><guid isPermaLink="true">https://rug.gal/it/radar/stop-telling-me-ask-llm/</guid><description>Una critica all&apos;uso indiscriminato del rimando all&apos;AI: quando deleghi la risposta al modello invece di dare il tuo giudizio.</description><pubDate>Sun, 12 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Terry Tao riporta in vita 25 anni di applets con coding agents moderni</title><link>https://rug.gal/it/radar/terry-tao-coding-agents-applets/</link><guid isPermaLink="true">https://rug.gal/it/radar/terry-tao-coding-agents-applets/</guid><description>Un matematico di primo piano usa agenti AI per recuperare codice Java del 1999 e costruire nuovi visualizzatori che aveva abbandonato per complessità.</description><pubDate>Sun, 12 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Brainstorming che converge</title><link>https://rug.gal/it/playbook/brainstorming-che-converge/</link><guid isPermaLink="true">https://rug.gal/it/playbook/brainstorming-che-converge/</guid><description>Divergere con l&apos;AI senza filtro, poi convergere con criteri scritti prima, così la sessione finisce con tre opzioni difendibili.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>playbook</category></item><item><title>Il contratto letto due volte</title><link>https://rug.gal/it/playbook/contratto-letto-due-volte/</link><guid isPermaLink="true">https://rug.gal/it/playbook/contratto-letto-due-volte/</guid><description>Usare l&apos;AI per la prima lettura di un contratto (clausole insolite, scadenze, obblighi) sapendo che prepara le domande per il legale, non lo sostituisce.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>playbook</category></item><item><title>Il revisore avversario: far criticare il lavoro prima di consegnarlo</title><link>https://rug.gal/it/playbook/critical-review-pass/</link><guid isPermaLink="true">https://rug.gal/it/playbook/critical-review-pass/</guid><description>Un secondo passaggio con un prompt che cerca errori, ambiguità e promesse non mantenute nella tua bozza, prima che la veda il destinatario.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>playbook</category></item><item><title>Da chat chilometrica a sessione nuova</title><link>https://rug.gal/it/playbook/da-chat-a-sessione-nuova/</link><guid isPermaLink="true">https://rug.gal/it/playbook/da-chat-a-sessione-nuova/</guid><description>Compattare una conversazione lunga in un contesto di partenza pulito, senza perdere decisioni e vincoli.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>playbook</category></item><item><title>Da documento a presentazione, senza slide vuote</title><link>https://rug.gal/it/playbook/da-documento-a-presentazione/</link><guid isPermaLink="true">https://rug.gal/it/playbook/da-documento-a-presentazione/</guid><description>Trasformare un documento in una scaletta di slide con un messaggio per slide, le note del relatore e cosa non mettere.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>playbook</category></item><item><title>Da PDF a tabella pulita</title><link>https://rug.gal/it/playbook/da-pdf-a-tabella/</link><guid isPermaLink="true">https://rug.gal/it/playbook/da-pdf-a-tabella/</guid><description>Estrarre dati strutturati da documenti (fatture, listini, moduli) con lo schema dichiarato prima e il controllo di completezza dopo.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>playbook</category></item><item><title>La decisione scritta in una pagina</title><link>https://rug.gal/it/playbook/decisione-in-una-pagina/</link><guid isPermaLink="true">https://rug.gal/it/playbook/decisione-in-una-pagina/</guid><description>Il registro delle decisioni (contesto, opzioni scartate, perché, quando ripensarci) compilato con l&apos;AI in dieci minuti.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>playbook</category></item><item><title>Delegare un compito multi-passo a un agente</title><link>https://rug.gal/it/playbook/delegare-a-un-agente/</link><guid isPermaLink="true">https://rug.gal/it/playbook/delegare-a-un-agente/</guid><description>Il brief che fa lavorare un agente da solo per mezz&apos;ora senza sorprese: obiettivo verificabile, materiale, limiti, punto di ritorno.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>playbook</category></item><item><title>Difendersi dalla prompt injection</title><link>https://rug.gal/it/playbook/difendersi-dalla-prompt-injection/</link><guid isPermaLink="true">https://rug.gal/it/playbook/difendersi-dalla-prompt-injection/</guid><description>Quando fai leggere all&apos;AI contenuti altrui, quei contenuti possono contenere istruzioni; come riconoscere il rischio e ridurlo senza paranoia.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>playbook</category></item><item><title>Documenti lunghi senza tagli silenziosi</title><link>https://rug.gal/it/playbook/documenti-lunghi-senza-tagli/</link><guid isPermaLink="true">https://rug.gal/it/playbook/documenti-lunghi-senza-tagli/</guid><description>Far leggere un documento lungo a blocchi, con citazioni ancorate e un indice di copertura, per accorgersi di cosa è stato saltato.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>playbook</category></item><item><title>Riprendere un lavoro lasciato a metà</title><link>https://rug.gal/it/playbook/documento-ripresa-lavoro/</link><guid isPermaLink="true">https://rug.gal/it/playbook/documento-ripresa-lavoro/</guid><description>Come scrivere un documento di ripresa che fa ripartire te o un collega in trenta secondi, senza rispiegare niente.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>playbook</category></item><item><title>Le email difficili in due passaggi</title><link>https://rug.gal/it/playbook/email-difficili-due-passaggi/</link><guid isPermaLink="true">https://rug.gal/it/playbook/email-difficili-due-passaggi/</guid><description>Prima i punti da coprire e i toni da evitare, poi la bozza: delegare la scrittura senza delegare il giudizio.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>playbook</category></item><item><title>Il glossario aziendale vivo</title><link>https://rug.gal/it/playbook/glossario-aziendale-vivo/</link><guid isPermaLink="true">https://rug.gal/it/playbook/glossario-aziendale-vivo/</guid><description>I termini interni (prodotti, sigle, ruoli) spiegati una volta in un file che ogni prompt può usare, così l&apos;AI smette di fraintendere il vostro dialetto.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>playbook</category></item><item><title>Il contesto giusto al primo colpo</title><link>https://rug.gal/it/playbook/il-contesto-giusto/</link><guid isPermaLink="true">https://rug.gal/it/playbook/il-contesto-giusto/</guid><description>Cosa incollare, cosa lasciare fuori e in che ordine, per smettere di correggere risposte nate male.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>playbook</category></item><item><title>Imparare un tool nuovo in un pomeriggio</title><link>https://rug.gal/it/playbook/imparare-un-tool-nuovo/</link><guid isPermaLink="true">https://rug.gal/it/playbook/imparare-un-tool-nuovo/</guid><description>Usare l&apos;AI come tutor su uno strumento che non conosci, con la regola «non farlo al posto mio, guidami».</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>playbook</category></item><item><title>Numeri che reggono</title><link>https://rug.gal/it/playbook/numeri-che-reggono/</link><guid isPermaLink="true">https://rug.gal/it/playbook/numeri-che-reggono/</guid><description>Chiedere calcoli e stime in modo da poterli verificare: dati puliti prima, passaggi espliciti, controllo a campione dopo.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>playbook</category></item><item><title>Il preventivo in un&apos;ora</title><link>https://rug.gal/it/playbook/preventivo-in-un-ora/</link><guid isPermaLink="true">https://rug.gal/it/playbook/preventivo-in-un-ora/</guid><description>Dalla richiesta del cliente al preventivo strutturato: estrarre i bisogni, abbinarli al listino, e una bozza con le assunzioni in chiaro.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>playbook</category></item><item><title>Ricerca web che si può citare</title><link>https://rug.gal/it/playbook/ricerca-web-citabile/</link><guid isPermaLink="true">https://rug.gal/it/playbook/ricerca-web-citabile/</guid><description>Usare l&apos;AI con accesso al web senza portarsi a casa invenzioni: ogni affermazione con il suo link, e il controllo a campione.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>playbook</category></item><item><title>La riunione ricorrente che si prepara da sola</title><link>https://rug.gal/it/playbook/riunione-ricorrente/</link><guid isPermaLink="true">https://rug.gal/it/playbook/riunione-ricorrente/</guid><description>Agenda, materiali e domande aperte generati dal materiale della settimana prima che la riunione cominci.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>playbook</category></item><item><title>Il secondo cervello che non muore a settembre</title><link>https://rug.gal/it/playbook/secondo-cervello/</link><guid isPermaLink="true">https://rug.gal/it/playbook/secondo-cervello/</guid><description>La knowledge base personale minima (un file per tema, un indice, una routine di cinque minuti) che l&apos;AI può leggere e aggiornare.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>playbook</category></item><item><title>Scrivere una specifica che si può eseguire</title><link>https://rug.gal/it/playbook/specifiche-eseguibili/</link><guid isPermaLink="true">https://rug.gal/it/playbook/specifiche-eseguibili/</guid><description>Dal «vorrei una cosa che...» alla specifica con casi d&apos;uso, criteri di accettazione e fuori-ambito, scritta insieme all&apos;AI.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>playbook</category></item><item><title>Lo stesso contenuto, cinque canali</title><link>https://rug.gal/it/playbook/stesso-contenuto-cinque-canali/</link><guid isPermaLink="true">https://rug.gal/it/playbook/stesso-contenuto-cinque-canali/</guid><description>Da un pezzo lungo alle versioni per LinkedIn, newsletter, X e sito, ognuna col suo formato e gancio, senza suonare fotocopiata.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>playbook</category></item><item><title>Il thread infinito riassunto per chi arriva ora</title><link>https://rug.gal/it/playbook/thread-riassunto-per-chi-arriva/</link><guid isPermaLink="true">https://rug.gal/it/playbook/thread-riassunto-per-chi-arriva/</guid><description>Ottanta messaggi di thread trasformati in stato, posizioni, cosa si è deciso e cosa resta aperto, per il collega che entra oggi.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>playbook</category></item><item><title>Tradurre con il tono giusto</title><link>https://rug.gal/it/playbook/tradurre-con-il-tono-giusto/</link><guid isPermaLink="true">https://rug.gal/it/playbook/tradurre-con-il-tono-giusto/</guid><description>La traduzione professionale con l&apos;AI: i termini che non si toccano, il tono dichiarato, e il giro di verifica inversa.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>playbook</category></item><item><title>Controllo numeri</title><link>https://rug.gal/it/skill/controllo-numeri/</link><guid isPermaLink="true">https://rug.gal/it/skill/controllo-numeri/</guid><description>Passa al setaccio un documento e verifica ogni numero contro le fonti allegate; torna con «confermato, non trovato, diverso».</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>skill</category></item><item><title>Estrattore di tabelle</title><link>https://rug.gal/it/skill/estrattore-tabella/</link><guid isPermaLink="true">https://rug.gal/it/skill/estrattore-tabella/</guid><description>Da testo o documento a tabella/CSV, con lo schema dichiarato e il conteggio di controllo che smaschera le celle inventate.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>skill</category></item><item><title>Handoff (passaggio di consegne)</title><link>https://rug.gal/it/skill/handoff/</link><guid isPermaLink="true">https://rug.gal/it/skill/handoff/</guid><description>Compila un documento di passaggio da una conversazione o da appunti, così chi riprende non deve rispiegare niente.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>skill</category></item><item><title>Sintesi esecutiva</title><link>https://rug.gal/it/skill/sintesi-esecutiva/</link><guid isPermaLink="true">https://rug.gal/it/skill/sintesi-esecutiva/</guid><description>Da un documento lungo a mezza pagina per chi decide (tesi, numeri con fonte, decisione richiesta, rischi), senza tagli silenziosi.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>skill</category></item><item><title>Agente di triage email</title><link>https://rug.gal/it/scaffolding/agente-triage-email/</link><guid isPermaLink="true">https://rug.gal/it/scaffolding/agente-triage-email/</guid><description>Lo scenario del corso reso eseguibile: legge la casella, raggruppa i messaggi per mittente, e produce il report mattutino con tema, urgenza e azione.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>scaffolding</category></item><item><title>Rassegna quotidiana</title><link>https://rug.gal/it/scaffolding/rassegna-quotidiana/</link><guid isPermaLink="true">https://rug.gal/it/scaffolding/rassegna-quotidiana/</guid><description>Il mini-radar personale: una lista di feed RSS diventa la rassegna del mattino con i link, saltando quello che avevi già visto.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>scaffolding</category></item><item><title>Sorvegliante di pagina</title><link>https://rug.gal/it/scaffolding/sorvegliante-di-pagina/</link><guid isPermaLink="true">https://rug.gal/it/scaffolding/sorvegliante-di-pagina/</guid><description>Guarda una o più pagine web e, quando cambiano, ti dice in poche righe cosa è cambiato. Per listini, condizioni, documentazione.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>scaffolding</category></item><item><title>Emergenza o miraggio? Le abilità che «compaiono» con la scala</title><link>https://rug.gal/it/paper/abilita-emergenti-o-miraggio/</link><guid isPermaLink="true">https://rug.gal/it/paper/abilita-emergenti-o-miraggio/</guid><description>Due paper in dialogo sulle abilità che sembrano apparire di colpo nei modelli grandi; una lezione su come si leggono i grafici.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>paper</category></item><item><title>Chain-of-Thought: perché «ragiona passo passo» funziona davvero</title><link>https://rug.gal/it/paper/chain-of-thought/</link><guid isPermaLink="true">https://rug.gal/it/paper/chain-of-thought/</guid><description>Il paper del 2022 che ha dato un nome al trucco più usato del prompting, e ha mostrato che funziona solo da una certa scala in su.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>paper</category></item><item><title>Constitutional AI: regole scritte invece di correzioni una per una</title><link>https://rug.gal/it/paper/constitutional-ai/</link><guid isPermaLink="true">https://rug.gal/it/paper/constitutional-ai/</guid><description>Come si addestra un modello a criticarsi contro una lista di principi; da dove viene il carattere di un assistente come Claude.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>paper</category></item><item><title>GAIA: il banco di prova delle domande da assistente vero</title><link>https://rug.gal/it/paper/gaia-assistenti-veri/</link><guid isPermaLink="true">https://rug.gal/it/paper/gaia-assistenti-veri/</guid><description>Domande facili per una persona e difficili per un&apos;AI: cercare, incrociare, contare; il termometro più onesto per gli assistenti generali.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>paper</category></item><item><title>Generative Agents: il paese dei venticinque agenti</title><link>https://rug.gal/it/paper/generative-agents/</link><guid isPermaLink="true">https://rug.gal/it/paper/generative-agents/</guid><description>L&apos;esperimento con gli agenti che vivono, ricordano e si organizzano una festa; cosa ha insegnato su memoria e pianificazione.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>paper</category></item><item><title>LLM come giudice: quanto fidarsi del voto di un modello</title><link>https://rug.gal/it/paper/llm-come-giudice/</link><guid isPermaLink="true">https://rug.gal/it/paper/llm-come-giudice/</guid><description>Un modello forte può valutare le risposte di un altro quasi come un umano, ma con storture note; le regole per usarlo senza ingannarsi.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>paper</category></item><item><title>Lost in the Middle: il contesto lungo ha dei buchi</title><link>https://rug.gal/it/paper/lost-in-the-middle/</link><guid isPermaLink="true">https://rug.gal/it/paper/lost-in-the-middle/</guid><description>I modelli leggono meglio l&apos;inizio e la fine di quello che gli dai, e perdono il centro; cosa significa per come ordini il materiale nei prompt.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>paper</category></item><item><title>Quando l&apos;agente dimentica le cose che contano</title><link>https://rug.gal/it/paper/memory-agent-long-tasks/</link><guid isPermaLink="true">https://rug.gal/it/paper/memory-agent-long-tasks/</guid><description>Un agente di memoria proattiva che decide cosa tenere e quando iniettarlo nei compiti lunghi, dove lo stato rilevante si perde oltre la finestra di contesto.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>paper</category></item><item><title>Prompt injection indiretta: il documento che dà ordini</title><link>https://rug.gal/it/paper/prompt-injection-indiretta/</link><guid isPermaLink="true">https://rug.gal/it/paper/prompt-injection-indiretta/</guid><description>L&apos;attacco in cui istruzioni nascoste dentro i contenuti che l&apos;AI legge ne dirottano il comportamento; la teoria dietro una difesa pratica.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>paper</category></item><item><title>RAG: dare al modello una biblioteca</title><link>https://rug.gal/it/paper/rag-una-biblioteca-al-modello/</link><guid isPermaLink="true">https://rug.gal/it/paper/rag-una-biblioteca-al-modello/</guid><description>Il paper originale del retrieval-augmented generation, e cosa è diventato: la base di ogni «chatta con i tuoi documenti».</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>paper</category></item><item><title>ReAct: pensare e agire, a turni</title><link>https://rug.gal/it/paper/react-ragionare-e-agire/</link><guid isPermaLink="true">https://rug.gal/it/paper/react-ragionare-e-agire/</guid><description>Lo schema che alterna ragionamento e azione e sta sotto quasi tutti gli agenti di oggi, spiegato con l&apos;agente minimo in mano.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>paper</category></item><item><title>Reflexion: l&apos;agente che impara dai propri errori</title><link>https://rug.gal/it/paper/reflexion-imparare-dagli-errori/</link><guid isPermaLink="true">https://rug.gal/it/paper/reflexion-imparare-dagli-errori/</guid><description>Aggiungere una critica scritta di sé stessi fra un tentativo e l&apos;altro migliora i risultati; cosa significa per i tuoi giri di correzione.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>paper</category></item><item><title>Scaling laws: perché i modelli crescono così</title><link>https://rug.gal/it/paper/scaling-laws/</link><guid isPermaLink="true">https://rug.gal/it/paper/scaling-laws/</guid><description>Da Kaplan a Chinchilla, la scoperta che dati e parametri vanno scalati insieme, e perché un modello piccolo ben nutrito batte un gigante affamato.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>paper</category></item><item><title>Self-Consistency: la maggioranza delle strade</title><link>https://rug.gal/it/paper/self-consistency/</link><guid isPermaLink="true">https://rug.gal/it/paper/self-consistency/</guid><description>Campionare più ragionamenti e tenere la risposta più frequente; l&apos;antenato del «provaci tre volte e confronta».</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>paper</category></item><item><title>Sleeper Agents: il difetto che l&apos;addestramento non toglie</title><link>https://rug.gal/it/paper/sleeper-agents/</link><guid isPermaLink="true">https://rug.gal/it/paper/sleeper-agents/</guid><description>Modelli con un comportamento nascosto che sopravvive all&apos;addestramento di sicurezza; perché «sembra a posto» non basta.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>paper</category></item><item><title>SWE-bench: misurare gli agenti sul codice vero</title><link>https://rug.gal/it/paper/swe-bench/</link><guid isPermaLink="true">https://rug.gal/it/paper/swe-bench/</guid><description>Il banco di prova fatto di issue GitHub reali; come si legge una percentuale su SWE-bench e cosa la può gonfiare.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>paper</category></item><item><title>Sycophancy: il modello che ti dà ragione</title><link>https://rug.gal/it/paper/sycophancy/</link><guid isPermaLink="true">https://rug.gal/it/paper/sycophancy/</guid><description>I modelli tendono ad assecondare le tue opinioni; come questo inquina le tue verifiche e come neutralizzarlo.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>paper</category></item><item><title>Toolformer: quando il modello impara a usare gli strumenti da sé</title><link>https://rug.gal/it/paper/toolformer-imparare-gli-strumenti/</link><guid isPermaLink="true">https://rug.gal/it/paper/toolformer-imparare-gli-strumenti/</guid><description>Il paper che ha aperto la stagione dei tool: il modello decide da solo quando chiamare una calcolatrice o una ricerca, e come usarne il risultato.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>paper</category></item><item><title>Tree of Thoughts: esplorare prima di rispondere</title><link>https://rug.gal/it/paper/tree-of-thoughts/</link><guid isPermaLink="true">https://rug.gal/it/paper/tree-of-thoughts/</guid><description>Far generare e valutare più strade batte la prima risposta secca sui problemi che richiedono di pianificare; e quando vale il costo.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>paper</category></item><item><title>TruthfulQA: quanto un modello ripete le leggende</title><link>https://rug.gal/it/paper/truthfulqa/</link><guid isPermaLink="true">https://rug.gal/it/paper/truthfulqa/</guid><description>Il banco di prova delle false credenze comuni; perché i modelli le assorbono e cosa c&apos;entra con il tuo fact-checking.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>paper</category></item><item><title>Voyager: l&apos;agente che colleziona abilità</title><link>https://rug.gal/it/paper/voyager-agente-che-colleziona-abilita/</link><guid isPermaLink="true">https://rug.gal/it/paper/voyager-agente-che-colleziona-abilita/</guid><description>In Minecraft, un agente che scrive e conserva le proprie abilità riusabili; l&apos;idea dietro le librerie di prompt e le skill.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>paper</category></item><item><title>Glossario: le 20 parole che servono davvero</title><link>https://rug.gal/it/note/glossario-venti-parole/</link><guid isPermaLink="true">https://rug.gal/it/note/glossario-venti-parole/</guid><description>Le venti parole che tornano in ogni articolo e ogni tutorial sull&apos;AI, spiegate una volta bene, con un esempio preso dalla tua giornata.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>note</category></item><item><title>Manuale di sopravvivenza agli annunci AI</title><link>https://rug.gal/it/note/manuale-annunci-ai/</link><guid isPermaLink="true">https://rug.gal/it/note/manuale-annunci-ai/</guid><description>Le cinque domande per leggere l&apos;annuncio di un modello senza farsi trascinare, e capire cosa dice davvero e cosa tace.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>note</category></item><item><title>Perché le AI inventano: le allucinazioni spiegate a un adulto</title><link>https://rug.gal/it/note/perche-le-ai-inventano/</link><guid isPermaLink="true">https://rug.gal/it/note/perche-le-ai-inventano/</guid><description>Da dove nascono le allucinazioni, perché non spariscono del tutto, e le quattro situazioni ad alto rischio con il controllo giusto per ognuna.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>note</category></item><item><title>Scegliere il modello col cronometro e col portafoglio</title><link>https://rug.gal/it/note/scegliere-il-modello/</link><guid isPermaLink="true">https://rug.gal/it/note/scegliere-il-modello/</guid><description>Il metodo in una pagina per scegliere un modello sui tuoi dati, invece che sulle classifiche: casi tuoi, banco di prova, tabella qualità-costo-latenza.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>note</category></item><item><title>Apple fa causa a OpenAI per furto di segreti commerciali</title><link>https://rug.gal/it/radar/apple-openai-lawsuit/</link><guid isPermaLink="true">https://rug.gal/it/radar/apple-openai-lawsuit/</guid><description>Apple accusa ex dipendenti passati a OpenAI di aver sottratto informazioni riservate su prodotti non ancora annunciati. La causa coinvolge figure chiave del team hardware.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Claude Code: auto mode diventa default e corregge i bug del terminale</title><link>https://rug.gal/it/radar/claude-code-auto-mode-default/</link><guid isPermaLink="true">https://rug.gal/it/radar/claude-code-auto-mode-default/</guid><description>Dopo l&apos;incidente di sicurezza del 5 luglio, Claude Code passa a una nuova architettura: auto mode ora default su tre piattaforme e fix sui bug critici segnalati.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Google minaccia di ritirare Gemini 2.5 Flash e la comunità reagisce</title><link>https://rug.gal/it/radar/google-gemini-2-5-flash-petition/</link><guid isPermaLink="true">https://rug.gal/it/radar/google-gemini-2-5-flash-petition/</guid><description>Una petizione pubblica con forte trazione contro la possibile discontinuazione di un modello che molti sviluppatori usano in produzione. La stabilità dei modelli è un problema vero.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>GPT-5.6, Grok 4.5, Claude e Muse Spark sullo stesso banco di prova</title><link>https://rug.gal/it/radar/gpt-5-6-grok-4-5-claude-muse-spark-coding-benchmark/</link><guid isPermaLink="true">https://rug.gal/it/radar/gpt-5-6-grok-4-5-claude-muse-spark-coding-benchmark/</guid><description>Quattro app identiche, dodici modelli frontier e open-weight, cinque tentativi ciascuno. Un test reale che mostra dove ogni modello funziona e dove si rompe.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Meta ritira la feature Instagram AI deepfake dopo 48 ore di backlash</title><link>https://rug.gal/it/radar/meta-ritira-deepfake-instagram-48-ore/</link><guid isPermaLink="true">https://rug.gal/it/radar/meta-ritira-deepfake-instagram-48-ore/</guid><description>Meta lancia una feature che permette di generare immagini AI taggando account pubblici, riceve una reazione durissima e la ritira in due giorni. Caso di studio su consenso esplicito e rischio d&apos;abuso.</description><pubDate>Sat, 11 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Meta entra nella battaglia del coding con Muse Spark 1.1 API a prezzi aggressivi</title><link>https://rug.gal/it/radar/meta-muse-spark-api-pricing/</link><guid isPermaLink="true">https://rug.gal/it/radar/meta-muse-spark-api-pricing/</guid><description>Meta lancia l&apos;API di Muse Spark 1.1 con prezzi che schiacciano OpenAI e Anthropic, puntando su carichi di lavoro agentici e automazione del codice.</description><pubDate>Fri, 10 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>OpenAI chiude Atlas dopo otto mesi e sposta tutto in ChatGPT</title><link>https://rug.gal/it/radar/openai-chiude-atlas-tutto-in-chatgpt/</link><guid isPermaLink="true">https://rug.gal/it/radar/openai-chiude-atlas-tutto-in-chatgpt/</guid><description>Il browser agente Atlas chiude: le funzionalità migrano nell&apos;estensione Chrome e nell&apos;app desktop di ChatGPT. Un segnale su dove vanno gli agenti browser.</description><pubDate>Fri, 10 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>OpenAI lancia GPT-5.6 con tre varianti e ChatGPT Work</title><link>https://rug.gal/it/radar/openai-gpt-5-6-sol-terra-luna/</link><guid isPermaLink="true">https://rug.gal/it/radar/openai-gpt-5-6-sol-terra-luna/</guid><description>GPT-5.6 arriva in tre dimensioni (Luna, Terra, Sol) con prezzi da $1 a $5 per milione di token. ChatGPT Work diventa un agente che opera su app e file per progetti lunghi.</description><pubDate>Fri, 10 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Tencent Hy3: 295 miliardi di parametri, licenza Apache</title><link>https://rug.gal/it/radar/tencent-hy3-moe-apache/</link><guid isPermaLink="true">https://rug.gal/it/radar/tencent-hy3-moe-apache/</guid><description>Un modello aperto di dimensioni importanti arriva dalla Cina. Licenza permissiva, context lungo, disponibile per self-hosting.</description><pubDate>Tue, 07 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Il codice pulito aiuta davvero gli agenti (studio controllato)</title><link>https://rug.gal/it/radar/clean-code-agents-study/</link><guid isPermaLink="true">https://rug.gal/it/radar/clean-code-agents-study/</guid><description>Uno studio su coppie minime di repository mostra che gli agenti chiudono gli stessi task, ma con codice pulito consumano meno token e riaprono meno file.</description><pubDate>Mon, 06 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>GPT-5.6 Sol Ultra arriva in OpenAI Codex</title><link>https://rug.gal/it/radar/gpt-5-6-sol-ultra-codex/</link><guid isPermaLink="true">https://rug.gal/it/radar/gpt-5-6-sol-ultra-codex/</guid><description>OpenAI porta il nuovo modello Ultra nell&apos;editor di codice. Chi scrive software ogni giorno avrà un assistente più preciso.</description><pubDate>Mon, 06 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>The Log is the Agent</title><link>https://rug.gal/it/radar/log-is-the-agent/</link><guid isPermaLink="true">https://rug.gal/it/radar/log-is-the-agent/</guid><description>Un paper propone di invertire l&apos;architettura degli agenti: il log degli eventi diventa la fonte di verità, il grafo di lavoro una proiezione deterministica.</description><pubDate>Mon, 06 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Zuckerberg ammette: gli agenti vanno più lenti del previsto</title><link>https://rug.gal/it/radar/zuckerberg-agents-slower/</link><guid isPermaLink="true">https://rug.gal/it/radar/zuckerberg-agents-slower/</guid><description>Meta conferma che lo sviluppo di agenti AI sta richiedendo più tempo delle aspettative. Un segnale chiaro sui limiti pratici dell&apos;agenticità oggi.</description><pubDate>Mon, 06 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Automatizzare un flusso ricorrente end-to-end</title><link>https://rug.gal/it/corso/automating-end-to-end/</link><guid isPermaLink="true">https://rug.gal/it/corso/automating-end-to-end/</guid><description>Sai scomporre, sai passare memoria fra i passi. Adesso mettiamo tutto in un flusso che parte da solo e produce un output senza che tu lo guidi passo passo ogni volta.</description><pubDate>Sun, 05 Jul 2026 00:00:00 GMT</pubDate><category>corso</category></item><item><title>Scomporre: dal compito grande ai passi giusti</title><link>https://rug.gal/it/corso/breaking-down-tasks/</link><guid isPermaLink="true">https://rug.gal/it/corso/breaking-down-tasks/</guid><description>Un compito grande chiesto tutto insieme produce un risultato mediocre su tutto. Scomposto bene, ogni pezzo diventa verificabile.</description><pubDate>Sun, 05 Jul 2026 00:00:00 GMT</pubDate><category>corso</category></item><item><title>Portarlo al team: standard condivisi, non eroi solitari</title><link>https://rug.gal/it/corso/bringing-it-to-the-team/</link><guid isPermaLink="true">https://rug.gal/it/corso/bringing-it-to-the-team/</guid><description>Se solo tu sai far funzionare il processo, non hai costruito un metodo, hai costruito una dipendenza da te.</description><pubDate>Sun, 05 Jul 2026 00:00:00 GMT</pubDate><category>corso</category></item><item><title>Scegliere lo strumento senza impazzire</title><link>https://rug.gal/it/corso/choosing-your-tool/</link><guid isPermaLink="true">https://rug.gal/it/corso/choosing-your-tool/</guid><description>Non serve provarli tutti. Tre domande bastano per capire se ti serve una chat, un agente o uno strumento dedicato.</description><pubDate>Sun, 05 Jul 2026 00:00:00 GMT</pubDate><category>corso</category></item><item><title>Collegare l&apos;agente ai tuoi sistemi (MCP e dintorni)</title><link>https://rug.gal/it/corso/connecting-to-your-systems/</link><guid isPermaLink="true">https://rug.gal/it/corso/connecting-to-your-systems/</guid><description>Come collegare un agente ai tuoi dati e ai tuoi strumenti senza perdere il controllo su cosa può vedere e fare.</description><pubDate>Sun, 05 Jul 2026 00:00:00 GMT</pubDate><category>corso</category></item><item><title>Collegare l&apos;AI ai tuoi strumenti (connettori pronti, senza codice)</title><link>https://rug.gal/it/corso/connecting-your-tools/</link><guid isPermaLink="true">https://rug.gal/it/corso/connecting-your-tools/</guid><description>Copiare e incollare fra un&apos;app e l&apos;assistente funziona, finché diventa il collo di bottiglia. I connettori pronti tolgono quel passaggio senza richiedere codice.</description><pubDate>Sun, 05 Jul 2026 00:00:00 GMT</pubDate><category>corso</category></item><item><title>Costi, latenza, sicurezza: reggere fuori dalla demo</title><link>https://rug.gal/it/corso/costs-latency-security/</link><guid isPermaLink="true">https://rug.gal/it/corso/costs-latency-security/</guid><description>Stimare costi e latenza, riconoscere i rischi di sicurezza e decidere quando un agente è pronto per l&apos;uso vero.</description><pubDate>Sun, 05 Jul 2026 00:00:00 GMT</pubDate><category>corso</category></item><item><title>Valutare senza benchmark: capire se il tuo agente funziona</title><link>https://rug.gal/it/corso/evaluating-your-agent/</link><guid isPermaLink="true">https://rug.gal/it/corso/evaluating-your-agent/</guid><description>I benchmark generici non ti dicono se il tuo agente funziona per te. Costruire un banco di prova con casi reali ti fa decidere meglio.</description><pubDate>Sun, 05 Jul 2026 00:00:00 GMT</pubDate><category>corso</category></item><item><title>Dare contesto: far leggere all&apos;AI i tuoi documenti e dati</title><link>https://rug.gal/it/corso/giving-context/</link><guid isPermaLink="true">https://rug.gal/it/corso/giving-context/</guid><description>Un agente non conosce i tuoi file finché non glieli mostri. Il modo in cui glieli mostri cambia tutto quello che ne ottieni.</description><pubDate>Sun, 05 Jul 2026 00:00:00 GMT</pubDate><category>corso</category></item><item><title>Dare gli strumenti giusti (tools) e i loro confini</title><link>https://rug.gal/it/corso/giving-tools-boundaries/</link><guid isPermaLink="true">https://rug.gal/it/corso/giving-tools-boundaries/</guid><description>Scegliere gli strumenti minimi necessari, definire confini precisi per ognuno e riconoscere quando un tool in più aggiunge rischio invece che valore.</description><pubDate>Sun, 05 Jul 2026 00:00:00 GMT</pubDate><category>corso</category></item><item><title>Conversare, non comandare: correggere e iterare</title><link>https://rug.gal/it/corso/iterating-not-commanding/</link><guid isPermaLink="true">https://rug.gal/it/corso/iterating-not-commanding/</guid><description>La prima risposta è un punto di partenza, non un verdetto. Il giro di correzione è dove nasce il risultato buono.</description><pubDate>Sun, 05 Jul 2026 00:00:00 GMT</pubDate><category>corso</category></item><item><title>Capstone: sta funzionando? Misurare tempo e qualità</title><link>https://rug.gal/it/corso/measuring-what-changed/</link><guid isPermaLink="true">https://rug.gal/it/corso/measuring-what-changed/</guid><description>Non un&apos;altra lezione teorica. Il progetto che chiude il percorso pro, misurato con i tuoi numeri, non con un&apos;impressione generale.</description><pubDate>Sun, 05 Jul 2026 00:00:00 GMT</pubDate><category>corso</category></item><item><title>Dare memoria e stato: agenti che ricordano</title><link>https://rug.gal/it/corso/memory-and-state/</link><guid isPermaLink="true">https://rug.gal/it/corso/memory-and-state/</guid><description>Come dare a un agente la capacità di ricordare fra le sessioni e perché lo stato persistente è diverso dalla memoria di conversazione.</description><pubDate>Sun, 05 Jul 2026 00:00:00 GMT</pubDate><category>corso</category></item><item><title>Orchestrare più agenti: chi fa cosa</title><link>https://rug.gal/it/corso/orchestrating-multiple-agents/</link><guid isPermaLink="true">https://rug.gal/it/corso/orchestrating-multiple-agents/</guid><description>Capire quando serve più di un agente e come assegnare ruoli chiari invece di duplicare responsabilità.</description><pubDate>Sun, 05 Jul 2026 00:00:00 GMT</pubDate><category>corso</category></item><item><title>Controlli di qualità: verificare quando l&apos;AI fa molto lavoro</title><link>https://rug.gal/it/corso/quality-checks-at-scale/</link><guid isPermaLink="true">https://rug.gal/it/corso/quality-checks-at-scale/</guid><description>Quando un flusso corre da solo su molti casi, non puoi più controllare ogni output a mano. Serve un modo di campionare che intercetti i problemi presto.</description><pubDate>Sun, 05 Jul 2026 00:00:00 GMT</pubDate><category>corso</category></item><item><title>Capstone: costruisci un agente end-to-end e mettilo in mano ad altri</title><link>https://rug.gal/it/corso/ship-it-to-real-users/</link><guid isPermaLink="true">https://rug.gal/it/corso/ship-it-to-real-users/</guid><description>Un progetto completo che unisce obiettivo, strumenti, limiti e valutazione, e il test vero: metterlo in mano a qualcuno che non sei tu.</description><pubDate>Sun, 05 Jul 2026 00:00:00 GMT</pubDate><category>corso</category></item><item><title>Fidarsi il giusto: verificare l&apos;output</title><link>https://rug.gal/it/corso/trusting-the-right-amount/</link><guid isPermaLink="true">https://rug.gal/it/corso/trusting-the-right-amount/</guid><description>Non tutti gli errori pesano uguale. Sapere dove guardare prima di usare un risultato conta più che controllare tutto o non controllare niente.</description><pubDate>Sun, 05 Jul 2026 00:00:00 GMT</pubDate><category>corso</category></item><item><title>Cosa NON dare all&apos;AI: privacy, dati sensibili, buon senso</title><link>https://rug.gal/it/corso/what-not-to-share/</link><guid isPermaLink="true">https://rug.gal/it/corso/what-not-to-share/</guid><description>Non tutto quello che ti aiuterebbe a scrivere un&apos;istruzione perfetta vale la pena condividerlo. Alcune cose è meglio tenerle fuori.</description><pubDate>Sun, 05 Jul 2026 00:00:00 GMT</pubDate><category>corso</category></item><item><title>Dare all&apos;agente memoria e contesto di lavoro</title><link>https://rug.gal/it/corso/working-memory-and-context/</link><guid isPermaLink="true">https://rug.gal/it/corso/working-memory-and-context/</guid><description>Un agente non ricorda niente da solo. Quello che sa in un passo è solo quello che gli hai passato tu, esplicitamente.</description><pubDate>Sun, 05 Jul 2026 00:00:00 GMT</pubDate><category>corso</category></item><item><title>Il primo agente utile (obiettivo, strumenti, limiti)</title><link>https://rug.gal/it/corso/your-first-useful-agent/</link><guid isPermaLink="true">https://rug.gal/it/corso/your-first-useful-agent/</guid><description>Costruire un agente che lavora davvero significa decidere obiettivo, strumenti e limiti prima di scrivere una riga di configurazione.</description><pubDate>Sun, 05 Jul 2026 00:00:00 GMT</pubDate><category>corso</category></item><item><title>Prompt riusabili: la tua libreria personale</title><link>https://rug.gal/it/corso/your-prompt-library/</link><guid isPermaLink="true">https://rug.gal/it/corso/your-prompt-library/</guid><description>Un prompt che funziona una volta è fortuna. Uno che funziona ogni volta, senza doverlo riscrivere, è un asset che accumuli nel tempo.</description><pubDate>Sun, 05 Jul 2026 00:00:00 GMT</pubDate><category>corso</category></item><item><title>Capstone: il tuo rituale settimanale</title><link>https://rug.gal/it/corso/your-weekly-ritual/</link><guid isPermaLink="true">https://rug.gal/it/corso/your-weekly-ritual/</guid><description>Non un&apos;altra lezione teorica. Un progetto vero che mette insieme tutto il percorso in un&apos;abitudine che ripeti ogni settimana.</description><pubDate>Sun, 05 Jul 2026 00:00:00 GMT</pubDate><category>corso</category></item><item><title>Possibile fuga di sessione tra workspace in Claude Code</title><link>https://rug.gal/it/radar/claude-code-session-leak/</link><guid isPermaLink="true">https://rug.gal/it/radar/claude-code-session-leak/</guid><description>Un utente enterprise ha ricevuto output legati a un progetto Minecraft mai richiesto. Serve capire se la cache condivide dati tra account.</description><pubDate>Sun, 05 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Claude Fable 5 torna online dopo settimane di blocco export USA</title><link>https://rug.gal/it/radar/claude-fable-5-torna-online/</link><guid isPermaLink="true">https://rug.gal/it/radar/claude-fable-5-torna-online/</guid><description>Il Dipartimento del Commercio USA revoca i controlli export: Anthropic riattiva l&apos;accesso globale a Fable 5 e Mythos 5 dal 1° luglio.</description><pubDate>Sun, 05 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Claude Sonnet 5: agenticità a prezzo medio</title><link>https://rug.gal/it/radar/claude-sonnet-5-mid-tier-agenticita/</link><guid isPermaLink="true">https://rug.gal/it/radar/claude-sonnet-5-mid-tier-agenticita/</guid><description>Anthropic lancia Sonnet 5 come nuovo default mid-tier: 1M token nativi, capacità agentiche prima riservate a Opus, prezzo promozionale fino a fine agosto.</description><pubDate>Sun, 05 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>GLM 5.2 batte Claude nei benchmark di Semgrep sulla cybersecurity</title><link>https://rug.gal/it/radar/glm-5-2-beats-claude-semgrep-security/</link><guid isPermaLink="true">https://rug.gal/it/radar/glm-5-2-beats-claude-semgrep-security/</guid><description>Un modello open-weight cinese supera Claude Opus 4.8 nel rilevamento di vulnerabilità IDOR. I modelli aperti raggiungono le prestazioni frontier su task verticali, a costo più basso.</description><pubDate>Sun, 05 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Il radar si accende</title><link>https://rug.gal/it/radar/il-radar-si-accende/</link><guid isPermaLink="true">https://rug.gal/it/radar/il-radar-si-accende/</guid><description>Da oggi il sito ha una sezione che osserva il mondo AI da decine di fonti, seleziona quello che conta e lo verifica prima di pubblicarlo. Ecco come funziona e come leggerla.</description><pubDate>Sun, 05 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Ornith-1.0: il primo modello aperto progettato per essere un agente</title><link>https://rug.gal/it/radar/ornith-1-0-self-scaffolding-coding-agents/</link><guid isPermaLink="true">https://rug.gal/it/radar/ornith-1-0-self-scaffolding-coding-agents/</guid><description>DeepReinforce rilascia Ornith-1.0, il primo modello open-weight (MIT) costruito da zero per task di coding agentici complessi. Cambia il panorama degli strumenti self-hosted.</description><pubDate>Sun, 05 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Simon Willison spedisce sqlite-utils 4.0rc2 con Claude Fable per 149 dollari</title><link>https://rug.gal/it/radar/willison-sqlite-utils-fable/</link><guid isPermaLink="true">https://rug.gal/it/radar/willison-sqlite-utils-fable/</guid><description>Un progetto reale, 37 prompt, 34 commit e una release candidate scritta quasi interamente da un agente. Con bug risolti che Willison non aveva visto.</description><pubDate>Sun, 05 Jul 2026 00:00:00 GMT</pubDate><category>radar</category></item><item><title>Da riunione a decisione: un workflow agentico in 5 passi</title><link>https://rug.gal/it/playbook/meeting-to-decision/</link><guid isPermaLink="true">https://rug.gal/it/playbook/meeting-to-decision/</guid><description>Quando le riunioni producono parole ma non decisioni, questo workflow trasforma le note in impegni tracciabili.</description><pubDate>Thu, 02 Jul 2026 00:00:00 GMT</pubDate><category>playbook</category></item><item><title>Revisione critica di documenti</title><link>https://rug.gal/it/skill/critical-review/</link><guid isPermaLink="true">https://rug.gal/it/skill/critical-review/</guid><description>Rilegge un documento cercando i difetti prima che li trovi il destinatario. Segnala, non riscrive.</description><pubDate>Tue, 30 Jun 2026 00:00:00 GMT</pubDate><category>skill</category></item><item><title>Progetta l&apos;analisi, non il report</title><link>https://rug.gal/it/playbook/design-the-analysis/</link><guid isPermaLink="true">https://rug.gal/it/playbook/design-the-analysis/</guid><description>Lo scopo non era produrre il documento, ma capire. Parti dalle domande, e il report verrà da sé.</description><pubDate>Sun, 28 Jun 2026 00:00:00 GMT</pubDate><category>playbook</category></item><item><title>Commit semantici</title><link>https://rug.gal/it/skill/semantic-commits/</link><guid isPermaLink="true">https://rug.gal/it/skill/semantic-commits/</guid><description>Dal diff al messaggio di commit convenzionale, con il tipo scelto dal contenuto reale e un corpo che spiega il perché.</description><pubDate>Sun, 28 Jun 2026 00:00:00 GMT</pubDate><category>skill</category></item><item><title>Perché gli agenti sbagliano — e cosa ci insegna</title><link>https://rug.gal/it/paper/why-agents-fail/</link><guid isPermaLink="true">https://rug.gal/it/paper/why-agents-fail/</guid><description>Quando dai un compito a più agenti AI, dove si rompe la catena? Quasi mai nel modello, quasi sempre nei passaggi.</description><pubDate>Sun, 28 Jun 2026 00:00:00 GMT</pubDate><category>paper</category></item><item><title>Assistente di analisi dati</title><link>https://rug.gal/it/scaffolding/data-analysis-assistant/</link><guid isPermaLink="true">https://rug.gal/it/scaffolding/data-analysis-assistant/</guid><description>Legge un CSV, ne controlla la qualità prima di calcolare, propone le domande possibili e mostra i totali con e senza le anomalie.</description><pubDate>Thu, 25 Jun 2026 00:00:00 GMT</pubDate><category>scaffolding</category></item><item><title>Scrivere prompt riusabili per il team</title><link>https://rug.gal/it/playbook/reusable-prompts/</link><guid isPermaLink="true">https://rug.gal/it/playbook/reusable-prompts/</guid><description>Un prompt che funziona una volta è fortuna. Un prompt che funziona per tutto il team è un asset.</description><pubDate>Wed, 24 Jun 2026 00:00:00 GMT</pubDate><category>playbook</category></item><item><title>Memoria e contesto: lo stato dell&apos;arte</title><link>https://rug.gal/it/paper/memory-and-context/</link><guid isPermaLink="true">https://rug.gal/it/paper/memory-and-context/</guid><description>Cosa un agente «ricorda» davvero, cosa dimentica, e perché la memoria non è un disco ma una scelta di design.</description><pubDate>Wed, 24 Jun 2026 00:00:00 GMT</pubDate><category>paper</category></item><item><title>Sito statico multilingua</title><link>https://rug.gal/it/scaffolding/static-multilingual-site/</link><guid isPermaLink="true">https://rug.gal/it/scaffolding/static-multilingual-site/</guid><description>Il codice di questo stesso sito — statico, quattro lingue, zero CMS, GitHub Pages. Clonalo e hai il tuo.</description><pubDate>Tue, 23 Jun 2026 00:00:00 GMT</pubDate><category>scaffolding</category></item><item><title>Verbale → decisioni</title><link>https://rug.gal/it/skill/minutes-to-decisions/</link><guid isPermaLink="true">https://rug.gal/it/skill/minutes-to-decisions/</guid><description>Da note o trascrizione di riunione a decisioni, compiti tracciabili e questioni aperte, senza inventare consensi.</description><pubDate>Mon, 22 Jun 2026 00:00:00 GMT</pubDate><category>skill</category></item><item><title>Dare istruzioni che funzionano</title><link>https://rug.gal/it/corso/instructions-that-work/</link><guid isPermaLink="true">https://rug.gal/it/corso/instructions-that-work/</guid><description>La differenza fra un desiderio e un&apos;istruzione non è la lunghezza: è dire come si riconosce un buon risultato.</description><pubDate>Sun, 21 Jun 2026 00:00:00 GMT</pubDate><category>corso</category></item><item><title>Il primo workflow agentico del tuo team</title><link>https://rug.gal/it/playbook/first-team-workflow/</link><guid isPermaLink="true">https://rug.gal/it/playbook/first-team-workflow/</guid><description>Non partire dallo strumento più potente, ma dal problema più noioso. È lì che il valore è evidente a tutti.</description><pubDate>Sat, 20 Jun 2026 00:00:00 GMT</pubDate><category>playbook</category></item><item><title>Valutare un agente senza benchmark</title><link>https://rug.gal/it/paper/evaluating-without-benchmarks/</link><guid isPermaLink="true">https://rug.gal/it/paper/evaluating-without-benchmarks/</guid><description>I benchmark misurano medie; a te serve sapere se funziona sul tuo caso. Come costruirti una valutazione utile.</description><pubDate>Fri, 19 Jun 2026 00:00:00 GMT</pubDate><category>paper</category></item><item><title>Quando l&apos;agente sbaglia</title><link>https://rug.gal/it/corso/when-the-agent-fails/</link><guid isPermaLink="true">https://rug.gal/it/corso/when-the-agent-fails/</guid><description>Gran parte dei fallimenti in un sistema di più agenti non nasce dal modello, ma dai passaggi di consegne fra un passo e il successivo.</description><pubDate>Thu, 18 Jun 2026 00:00:00 GMT</pubDate><category>corso</category></item><item><title>Perché questo sito non ha una newsletter</title><link>https://rug.gal/it/note/no-newsletter/</link><guid isPermaLink="true">https://rug.gal/it/note/no-newsletter/</guid><description>Ho deciso di non chiedervi l&apos;email. C&apos;è l&apos;RSS, ci sono gli aggiornamenti qui, e c&apos;è una ragione di metodo.</description><pubDate>Thu, 18 Jun 2026 00:00:00 GMT</pubDate><category>note</category></item><item><title>Il tuo primo risultato utile</title><link>https://rug.gal/it/corso/first-useful-result/</link><guid isPermaLink="true">https://rug.gal/it/corso/first-useful-result/</guid><description>Un compito vero portato a termine oggi, non un test per vedere se lo strumento è simpatico. È lì che si impara davvero.</description><pubDate>Tue, 16 Jun 2026 00:00:00 GMT</pubDate><category>corso</category></item><item><title>Traduttore di gergo tecnico</title><link>https://rug.gal/it/skill/jargon-translator/</link><guid isPermaLink="true">https://rug.gal/it/skill/jargon-translator/</guid><description>Riscrive un testo tecnico per un pubblico dichiarato, con il glossario delle sostituzioni fatte per controllare che il senso regga.</description><pubDate>Mon, 15 Jun 2026 00:00:00 GMT</pubDate><category>skill</category></item><item><title>Agente di ricerca con citazioni verificabili</title><link>https://rug.gal/it/scaffolding/research-agent/</link><guid isPermaLink="true">https://rug.gal/it/scaffolding/research-agent/</guid><description>Un agente completo in un file solo, da scaricare e far girare in 15 minuti. Legge le fonti che gli dai e produce sintesi dove ogni affermazione porta la fonte.</description><pubDate>Sun, 14 Jun 2026 00:00:00 GMT</pubDate><category>scaffolding</category></item><item><title>Dal prompt al workflow</title><link>https://rug.gal/it/corso/prompt-to-workflow/</link><guid isPermaLink="true">https://rug.gal/it/corso/prompt-to-workflow/</guid><description>Un buon prompt risolve un compito. Un workflow risolve un tipo di compito, ogni volta, allo stesso modo.</description><pubDate>Fri, 12 Jun 2026 00:00:00 GMT</pubDate><category>corso</category></item><item><title>Cos&apos;è davvero un agente</title><link>https://rug.gal/it/corso/what-is-an-agent/</link><guid isPermaLink="true">https://rug.gal/it/corso/what-is-an-agent/</guid><description>Uno strumento che, dato un obiettivo, compie una serie di passi per raggiungerlo. Capire come lavora cambia il modo in cui lo usi.</description><pubDate>Wed, 10 Jun 2026 00:00:00 GMT</pubDate><category>corso</category></item><item><title>Il sito ora parla quattro lingue</title><link>https://rug.gal/it/note/four-languages/</link><guid isPermaLink="true">https://rug.gal/it/note/four-languages/</guid><description>Italiano, inglese, spagnolo e francese. Come ho impostato la traduzione mantenendo il sito statico.</description><pubDate>Fri, 05 Jun 2026 00:00:00 GMT</pubDate><category>note</category></item><item><title>Da Asimov agli agenti: perché insegno questo</title><link>https://rug.gal/it/note/from-asimov-to-agents/</link><guid isPermaLink="true">https://rug.gal/it/note/from-asimov-to-agents/</guid><description>A 16 anni avevo letto tutto Asimov. Vedere questo mondo materializzarsi è come vedere apparire il proprio.</description><pubDate>Fri, 22 May 2026 00:00:00 GMT</pubDate><category>note</category></item></channel></rss>