🧠 Negli ultimi mesi si è parlato molto della Distillation dei modelli closed source eseguita da provider cinesi per il training dei loro modelli. Dopo l'ennesimo blog post di Open AI, che ha accusato Moonshot AI di aver utilizzato la distillation in Kimi K3, abbiamo pensato di incentrare la puntata di questa settimana su un articolo pubblicato di recente, in cui si mostra come sia possibile 'rubare' le reasoning traces delle LLM. 🕵️ L'approccio non è particolarmente complesso ma è molto astuto: i ricercatori hanno mostrato come sia possibile utilizzarlo per rubare le reasoning races e anche per eseguire Jailbreak e Prompt Injection. 🔎 A questo punto la domanda sorge spontanea: se possiamo rubare le reasoning races possiamo anche capire se un modello è stato allenato con Distillation? Una risposta definitiva non possiamo ancora averla, ma da alcune analisi mostrate nel paper si ricavano evidenze inequivocabili.

Unisciti al nostro gruppo Telegram per discutere della puntata: https://t.me/pointerpodcastgruppo

Note Puntata

Supporta il PointerPodcast

Lascia una recensione su Spotify o Apple Podcast

Acquista il Prodotto della settimana

I nostri contatti:

Built with Hugo
Theme Stack designed by Jimmy and forked by Luca Corbucci