ARTFEED — Contemporary Art Intelligence

Robbyant di Ant Group rivendica una svolta nella visione robotica con il modello LingBot-Vision

ai-technology · 2026-07-07

L'unità di IA embodied di Ant Group, Robbyant, afferma che il suo nuovo modello di visione LingBot-Vision supera il DINOv3 di Meta nel riconoscimento dei bordi degli oggetti, raggiungendo una precisione più elevata sul benchmark NYUv2 con meno parametri e meno dati di addestramento. Il modello è il primo addestrato specificamente per riconoscere i bordi degli oggetti, consentendo ai robot di comprendere spazi 3D con alta precisione. LingBot-Vision alimenta LingBot-Depth 2.0.

Fatti principali

  • L'unità Robbyant di Ant Group ha sviluppato LingBot-Vision, un modello percettivo per IA embodied.
  • LingBot-Vision supera il modello DINOv3 da 7 miliardi di parametri di Meta sul benchmark di stima della profondità NYUv2.
  • LingBot-Vision utilizza un settimo dei parametri e meno di un terzo dei dati di addestramento rispetto a DINOv3.
  • È il primo modello addestrato specificamente per riconoscere i bordi degli oggetti.
  • L'IA può individuare i confini fino a una frazione di singolo pixel.
  • LingBot-Vision funge da motore per LingBot-Depth 2.0.
  • Le affermazioni si basano su un articolo di ricerca pubblicato dal team Robbyant.
  • Il modello mira a migliorare la percezione degli spazi 3D da parte dei robot.

Entità

Istituzioni

  • Ant Group
  • Robbyant
  • Meta Platforms

Fonti