ARTFEED — Contemporary Art Intelligence

I modelli foundation congelati per MRI cerebrale sono impronte del sito di acquisizione

ai-technology · 2026-08-13

Un recente preprint su arXiv (2608.10295) indica che gli embedding congelati di modelli foundation per MRI cerebrale rappresentano prevalentemente il sito di acquisizione piuttosto che i dettagli anatomici. La ricerca ha valutato il contenuto effettivo catturato da queste rappresentazioni standard, rivelando che in due coorti separate (ABIDE-I e ABIDE-II), tre tipi di encoder 3D congelati (pre-addestrati su cervello, pre-addestrati su TC e inizializzati casualmente), e tutte le profondità di rete, il sito di acquisizione può essere decodificato linearmente con una accuratezza bilanciata di circa 0.9 nei livelli più profondi. Questo livello di decodificabilità supera quello di qualsiasi fattore clinico o demografico (sesso, età, diagnosi di autismo) a ogni livello. La natura intrinseca di questo effetto è evidenziata da un encoder inizializzato casualmente che raggiunge una classificazione del sito di circa 0.9 in tutte e tre le famiglie di architetture (Swin, ViT, ResNet) e in entrambe le coorti. Inoltre, le immagini grezze sottocampionate possono produrre una decodificabilità del sito di circa 0.95 senza encoder, suggerendo che l'impronta riflette statistiche di basso livello dell'immagine. Questi risultati mettono in discussione l'idea che gli embedding congelati trasmettano informazioni anatomiche significative, implicando che potrebbero agire involontariamente come identificatori del sito, complicando potenzialmente gli studi multi-sito e l'apprendimento per trasferimento nell'imaging medico.

Fatti principali

  • Preprint arXiv:2608.10295
  • Gli embedding congelati di modelli foundation per MRI cerebrale codificano il sito di acquisizione
  • Due coorti: ABIDE-I e ABIDE-II
  • Tre encoder: pre-addestrato su cervello, pre-addestrato su TC, inizializzato casualmente
  • Sito decodificabile con accuratezza bilanciata di circa 0.9 nei livelli profondi
  • L'encoder inizializzato casualmente raggiunge una classificazione del sito di circa 0.9
  • Sito decodificabile con accuratezza di circa 0.95 dalle immagini grezze sottocampionate
  • Tre famiglie di architetture: Swin, ViT, ResNet

Entità

Istituzioni

  • arXiv

Fonti