InMyStyle: Riscrittura di Testi AI con Piccoli Modelli Linguistici e Privacy al Primo Posto
Un articolo accademico pubblicato su arXiv (2607.29238) presenta InMyStyle, un framework incentrato sulla privacy che modifica piccoli modelli linguistici per riformulare contenuti modificati dall'IA, allineandoli allo stile di scrittura unico dell'utente senza la necessità di un prompt di istruzione durante l'inferenza. L'approccio impiega diversi LLM helper locali per generare esempi di addestramento accoppiati dai documenti dell'utente e affina gli adattatori LoRA su modelli di base con parametri che vanno da 0,5B a 7B. Supporta lunghezze di input variabili attraverso budget di generazione sensibili alla lunghezza e suddivisione automatica in blocchi. I test su 219 coppie da un dataset di articoli scientifici hanno rivelato che il punteggio composito automatico si stabilizza a 0,69 (su una scala da 0 a 1) per tutte le dimensioni del modello con decodifica greedy e campionata. Ciò suggerisce che modelli più piccoli sono adeguati per il compito di riscrittura, con la dimensione che influenza i compromessi invece di una gerarchia di qualità coerente. In una valutazione secondaria, 400 valutazioni da cinque giudici LLM hanno indicato che gli output di InMyStyle avevano un punteggio medio di percezione dell'IA superiore al 20% inferiore rispetto al baseline, riflettendo una minore rilevabilità del testo generato dall'IA. Il sistema è pensato per singoli utenti, enfatizzando la privacy, e opera esclusivamente su modelli locali.
Fatti principali
- InMyStyle è un sistema per singolo utente, incentrato sulla privacy, per riscrivere testo modificato dall'IA in modo da corrispondere allo stile dell'utente.
- Utilizza più LLM helper locali per costruire esempi di addestramento accoppiati dai documenti dell'utente.
- Affina gli adattatori LoRA su modelli di base con parametri che vanno da 0,5B a 7B.
- Usa budget di generazione sensibili alla lunghezza e suddivisione automatica in blocchi per supportare diverse lunghezze di input.
- La valutazione su 219 coppie da un corpus di articoli scientifici mostra un plateau del punteggio composito a 0,69 (scala 0-1) per tutte le dimensioni del modello.
- Il plateau suggerisce che modelli piccoli sono sufficienti per il compito di riscrittura.
- Valutazione secondaria: 400 valutazioni da cinque giudici LLM hanno dato agli output di InMyStyle un punteggio medio di percezione dell'IA superiore al 20% inferiore rispetto al baseline.
- Il sistema opera senza un prompt di istruzione durante l'inferenza.
- L'articolo è disponibile su arXiv con ID 2607.29238.
Entità
Istituzioni
- arXiv