ARTFEED — Contemporary Art Intelligence

AMD ROCm Abilita Pipeline di Manipolazione Robotica Visione-Linguaggio-Azione Senza CUDA

ai-technology · 2026-07-29

Un nuovo studio su arXiv (2607.22997) presenta un framework tecnologico completo per la manipolazione embodied, specificamente ottimizzato per hardware AMD. Dimostra che le politiche visione-linguaggio-azione (VLA) possono essere efficacemente addestrate al di fuori di un ambiente CUDA. La configurazione utilizza chip di training per data center AMD, GPU Radeon PRO sia per simulazione che rendering, insieme a Ryzen AI per il calcolo edge, il tutto facilitato dalla piattaforma software aperta ROCm. La ricerca include quattro dimostrazioni: (1) una pipeline Sim-to-Real con SmolVLA su un braccio Franka fisico, e (2) un compito di manipolazione semantica guidata dal linguaggio. Ciò si allinea con la tendenza della Physical AI, riecheggiando dichiarazioni di leader del settore come Jensen Huang e la Dott.ssa Lisa Su, che entrambi sottolineano l'importanza dell'IA nel mondo fisico.

Fatti principali

  • Il paper arXiv 2607.22997 presenta una pipeline accelerata AMD per la manipolazione robotica basata su VLA.
  • La pipeline utilizza silicio AMD per data center, GPU Radeon PRO e calcolo edge Ryzen AI.
  • Tutti i componenti sono unificati dallo stack software aperto ROCm.
  • Dimostra che CUDA non è necessario per addestrare e distribuire politiche di manipolazione VLA.
  • Include quattro dimostrazioni progressive: Sim-to-Real con SmolVLA su un braccio Franka e manipolazione semantica guidata dal linguaggio.
  • Jensen Huang ha dichiarato che la Physical AI è 'la prossima grande novità' al GTC Paris, giugno 2025.
  • La Dott.ssa Lisa Su ha detto 'stiamo entrando nel mondo della Physical AI' al CES 2026.
  • Il paper è classificato come cross submission arXiv.

Entità

Istituzioni

  • AMD
  • ROCm
  • Franka
  • SmolVLA
  • arXiv

Luoghi

  • Paris
  • France

Fonti