Salta al contenuto

Articoli

Scrivo articoli tecnici su sistemi LLM in produzione: integrazione dati, agenti affidabili, valutazione e recovery.

Motori di workflow AI per sistemi durevoli e auditabili

Design pratico per motori di workflow AI: stato persistente, recovery deterministica, retry, audit trail, eval riproducibili e costi sotto controllo.

17 ago 202612 min di lettura
#AI workflows#durable state#retries#audit trails#evals#orchestration

Dire che un LLM non pensa è come dire che una calcolatrice non sa fare i numeri?

Dove regge e dove si spezza l'analogia tra LLM e calcolatrice: cosa dicono interpretabilità, chain-of-thought e filosofia della mente su "pensare".

2 lug 202616 min di lettura
#LLM#AI Reasoning#Interpretability#Philosophy of Mind

Far girare uno Small Language Model su Xbox Series S

Porting di uno SLM su Xbox Series S: 71 tok/s sulla CPU Zen 2, con il verdetto GPU misurato per workload.

26 giu 202615 min di lettura
#Edge Inference#On-Device AI#ONNX Runtime#Xbox#SLM#UWP

Cosa insegna il key management bancario sugli eval harness per agenti

Cinque discipline dalla sicurezza bancaria — stato persistente, recovery deterministica, dual control, audit trail — applicate agli agenti LLM.

18 apr 20267 min di lettura
#Agent Evals#Verifiable Systems#LLM Production#Banking#MCP