Sistemi LLM dal prototipo alla produzione
Dopo la review realizzo nel tuo repository gli interventi concordati per la produzione.
Brescia · software
Ingegnere indipendente che porta sistemi LLM dal prototipo alla produzione (stato, recovery, eval, costi).
Quando c’è già un prototipo funzionante, parto dalla review di production readiness. Quella review non include modifiche al codice.
Software pubblicato e benchmark riproducibili: 1 DOI software 10.5281/zenodo.19972258 20 Progetti
Definisco confini di verifica e autorizzazione per gli output del modello e rendo verificabili stato, recovery, valutazione e costi.
Quando c’è già un prototipo funzionante, il primo passo è la review di production readiness. Quella review non include modifiche al codice. Review di production readiness · 3.500 €
Dopo la review realizzo nel tuo repository gli interventi concordati per la produzione.
Quel lavoro di produzione lo porto come incarico da fractional CTO: scelte di stack, revisione di codice e fornitori, e un piano di sviluppo.
Documento come eseguire e mantenere il sistema, con test, procedure operative e gli accessi necessari al tuo team.
Descrivo il problema affrontato e ciò che ho realizzato, con link al codice e alle fonti che documentano il risultato.
#emotional-memory
Codifico lo stato affettivo in un archivio di memoria ed eseguo un benchmark pubblicato; la matrice dei claim torna sulla codifica. L’acquisizione del dataset e gli artefatti pubblicati restano nella pagina del progetto: questa anteprima li omette.
Quando un’azienda aggiunge un assistente AI, come verifichi che ciò che ricorda oggi verrà richiamato correttamente dopo il prossimo aggiornamento di modello o software?
Su un benchmark pubblicato (DOI Zenodo), il metodo ha superato una baseline cosine sull’accuratezza delle risposte. I risultati negativi fuori da quel regime sono nel repo: evidenza per quel caso, non una superiorità generale.
#orka
L’input di canale viene instradato in una coda che esegue un workflow vincolato e scrive uno stato salvato. Un’esecuzione interrotta riprende da quello stato salvato. Gli adapter di protocollo restano nella pagina del progetto: questa anteprima li omette.
Le richieste arrivano da chat, email e strumenti interni, ma senza una coda persistente unica non c’è un percorso affidabile dall’input di canale a un workflow LLM tracciato e revisionabile.
Una coda unica porta le richieste da più canali in workflow LLM tracciati e revisionabili. (Supporto MCP/A2A: dettaglio nella pagina del progetto.)
Scrivi a info@gianlucamazza.it il problema operativo e i sistemi coinvolti. Quando c’è già un prototipo funzionante, il primo passo è la review di production readiness. Quella review non include modifiche al codice.
Sistemi spiega i pattern architetturali; Ricerca collega esperimenti e limiti. L’architettura del sito mostra come le proposte del modello passano i controlli prima della pubblicazione.