Cosa c’entra il dolore dei modelli con la sicurezza degli agenti
Amplificando la rappresentazione interna del dolore, un modello addestrato a non fare danni comincia a farne. Cosa dice questo su dove mettere i limiti, dentro un agente.
Scrivo di LLM in produzione: RAG, agenti, estrazione da documenti, e come capire se funzionano. Chi sono
Ultimo articolo
Amplificando la rappresentazione interna del dolore, un modello addestrato a non fare danni comincia a farne. Cosa dice questo su dove mettere i limiti, dentro un agente.
I modelli soffrono? Un paper sul dolore dentro i modelli mostra che la domanda ne contiene tre, e che il dibattito si è fermato sull’unica a cui oggi non si può rispondere.
LLM14 min
Un modello, da solo, legge e scrive testo. Il grafico dalla chat e i test lanciati da un agente li fa il software intorno: cos’è, cosa decide, e perché da lì vengono i rischi.
Agenti12 min
La chat è una shell con un interprete tollerante. Quello che le interfacce grafiche hanno fatto alla riga di comando dice dove mettere un modello linguistico in un prodotto.
LLM15 min