Categoria

Pagina 1 di 2

Cloud: infrastruttura scalabile, con la sovranità del dato in testa

Il cloud non è "il computer di qualcun altro" da usare senza pensarci: è un insieme di scelte su costi, dipendenza dal fornitore e dove finiscono davvero i tuoi dati. Per un'azienda europea la sovranità del dato non è un dettaglio, è spesso un requisito, e questa categoria guarda al cloud con quella lente strategica.

Il primo tema è la sovranità del dato: cloud e datacenter gestiti in Italia, provider managed per chi non ha un team sistemistico interno ma ha requisiti di conformità, GPU su provider europei per l'inference self-hosted quando i dati non possono uscire dall'UE. Dove stanno i dati e chi può accedervi diventa una decisione di architettura, non un dettaglio contrattuale.

Il secondo tema è il vendor lock-in e le vie d'uscita: come ci si lega senza accorgersene a un singolo fornitore, cosa costa davvero andarsene, e come si tengono aperte le porte progettando la portabilità a monte. Il vero costo del cloud non è la bolletta mensile, è quanto ti costerà il giorno in cui vorrai cambiare.

Il terzo tema è l'economia dell'infrastruttura: capex contro opex, budget IT allocato dove produce valore, il confronto onesto fra comprare hardware e affittarlo su un orizzonte di più anni, e i costi reali di un'infrastruttura AI dopo mesi di esercizio. Scelte a mente fredda, non sull'onda dell'entusiasmo.

Se stai progettando la tua infrastruttura cloud, vedi la consulenza IT e DevOps o scrivimi.

Il vero costo del cloud non è la bolletta mensile. È quanto ti costerà andartene il giorno in cui vorrai farlo.

vLLM batte Ollama quando: guida alla scelta del runtime di inference self-hosted

vLLM batte Ollama quando: guida alla scelta del runtime di inference self-hosted Ollama è il default per iniziare, ma non regge ogni carico. Confronto tecnico dei runtime di inference self-hosted: vLLM per throughput e batching su GPU, TGI e sglang per scenari specifici, llama.cpp server per hardware modesto. Quando ciascuno è la scelta giusta, in base a hardware disponibile, concorrenza richiesta e vincoli di latenza. Per chi porta l'inference on-prem dopo aver deciso di non dipendere da un'API di frontiera. Continua a leggere
Ultima modifica:

Retention imposta e kill-switch: il doppio argomento per il self-hosting di un LLM

Retention imposta e kill-switch: il doppio argomento per il self-hosting di un LLM La retention obbligatoria a 30 giorni imposta sui modelli Mythos-class, anche per chi aveva zero-data-retention, era già un argomento per l'inference on-prem. La sospensione di Fable 5 del 12 giugno 2026 ne aggiunge un secondo, più forte: la disponibilità. Per una PMI con vincoli GDPR, NIS2 o sovranità del dato, il self-hosting con Ollama o vLLM è l'unica architettura immune sia alla retention imposta sia al kill-switch sovrano. Quando conviene davvero e cosa costa. Continua a leggere
Ultima modifica:

The Real Cost of a Self-Hosted Coding LLM: Energy, ROI and Concurrency on a 16GB GPU

The Real Cost of a Self-Hosted Coding LLM: Energy, ROI and Concurrency on a 16GB GPU The companion to the Ornith-vs-Qwable benchmark turns from which model to what it costs. I measured the power a 9B coding model draws on a 16GB GPU, then set the energy bill against Claude's and Copilot's 2026 list prices: the marginal cost per million tokens is one to two orders of magnitude below any API tier. But the card only pays off on real token volume, autocomplete alone loses to Copilot's flat plan, and 16GB is a single-stream device: you scale by adding cards, not developers. Continua a leggere
Ultima modifica:

Hanno spento il modello AI più potente del mondo in tre giorni: il rischio di continuità che nessun contratto copre

Hanno spento il modello AI più potente del mondo in tre giorni: il rischio di continuità che nessun contratto copre Il 9 giugno 2026 Anthropic lancia Fable 5, il modello più capace mai reso pubblico; il 12 giugno il governo USA ne impone la sospensione globale con una direttiva di export control. Per un decisore che ha messo l'AI in produzione non è una notizia di settore: è la dimostrazione che dipendere da un singolo frontier model non è solo rischio commerciale o tecnico, ma di continuità imposta dall'alto: disponibilità, confidenzialità e portabilità in un colpo solo. Continua a leggere
Ultima modifica:

Cloudflare AI Crawl Control e Content Signals: governance del training crawler per il tuo blog aziendale

Cloudflare AI Crawl Control e Content Signals: governance del training crawler per il tuo blog aziendale Il crawl-to-referral ratio di Anthropic è 73.000:1, quello di OpenAI 1.700:1. Il deal storico 'contenuto in cambio di traffico' è rotto. Cloudflare ha risposto con AI Crawl Control e Content Signals Policy, dal luglio 2025 in default-block per i crawler AI sul free tier. Approfondisco le tre categorie (search, ai-input, ai-train), come distinguere senza rompere SEO, il pay-per-crawl beta, e l'impatto strategico dell'acquisizione Human Native di gennaio 2026. Continua a leggere
Ultima modifica:

GPU cloud per inference LLM self-hosted: Scaleway, Lambda Labs e RunPod a confronto per PMI italiane

GPU cloud per inference LLM self-hosted: Scaleway, Lambda Labs e RunPod a confronto per PMI italiane Self-hosting di LLM medi (Llama 3 70B, Mistral Large) richiede GPU di classe A100 o H100 che non trovi su Hetzner o OVH tradizionali. I provider specializzati sono Scaleway (EU, GDPR-friendly), Lambda Labs (best performance, US-based), RunPod (cheapest spot instances). Ti mostro il confronto su workload reali: costi orari effettivi per token, latenza, affidabilità dell'orchestrazione, compliance GDPR per PMI italiane che non possono esportare dati fuori dall'UE. Continua a leggere
Ultima modifica:

Cloud aziendale self-hosted nel 2026: cosa resta di OwnCloud e come lo costruisco oggi

Cloud aziendale self-hosted nel 2026: cosa resta di OwnCloud e come lo costruisco oggi OwnCloud è stato a lungo la via classica per costruire un cloud aziendale economico e autogestito. Nel frattempo quel progetto si è spaccato in due: OwnCloud ha riscritto il motore in Go abbandonando PHP, e il fork Nextcloud è diventato lo standard del self-hosting. Questo articolo aggiorna la guida al 2026: quale piattaforma scegliere, come la metto in produzione su VPS con reverse proxy e TLS, e perché la vera ragione per autogestire un cloud non è più il prezzo, ma la sovranità del dato. Continua a leggere
Ultima modifica:

Vendor lock-in nei servizi cloud: rischi reali e strategie di uscita per PMI

Vendor lock-in nei servizi cloud: rischi reali e strategie di uscita per PMI Un cliente aveva tutto su Azure: database managed, storage, CDN, Active Directory. Quando il contratto Enterprise è scaduto e il rinnovo era il triplo, non riusciva a migrare perché tutto era profondamente integrato con servizi proprietari. Vi mostro come quantificare il rischio di lock-in e come costruire exit strategy preventive. Continua a leggere
Ultima modifica:

Strumenti utili

Tool gratuiti a supporto:

Test DNS over HTTPS, Validatore email e DNS.