Blog

Insights on robotics, AI, and data collection

SO-100 žemos kainos roboto ranka staigoje, nustatyta teleopevriui ir strategijos mokymui
DAggerSO-100Imitacinio mokymosi

DAgger ciklo paleisti SO-100 su VLA strategija

Žingsnis po žingsnio ataskaitą iš vieno žmogaus prižiūrėto DAgger raundo ant SO-100 rankos: paleisti strategiją ir įrašyti ją, perimti, kai ji nuklydsta, failą kaip pataisą, suvienybinti mišrų duomenų rinkinį ir tęsti mokymąsi iš kontrolinio taško. Apima klaviatūros ir slankiklių perėmimo kelią žmonėms be vadovaujančios rankos ir keturis klaidus, kurie daro raundą bevertę.

Aug 27, 202615 min skaitymo
Stalinės roboto darbo vieta, naudojama kaip fiksuota vertinimo sąranka kartotiniams politikos paleidimams
DAggerVertinimasImitacinis mokymas

DAgger kontūro matavimas: intervencijos dažnis, vertinimo protokolas ir spąstai tarp jų

Intervencijos dažnis - intervencijos kadrų skaičius, padalytas iš bėgimo kadrų - yra pigiausias sąžiningas progreso signalas, kurį turi žmogaus valdomas DAgger ciklas. Šiame straipsnyje jis apibrėžiamas taip, kad dvi žmonės apskaičiuotų tą pačią reikšmę, parodytas jo registravimas ir išanalizuoti keturi būdai, kaip jis jus klaidina: operatoriaus įpratimas, pasislinkęs vertinimo nustatymas, mokymas tik pataisymams ir žmogus, kuris antradienį pataisytas kitaip nei pirmadienį.

Aug 27, 202615 min skaitymas
Operatorius prižiūrinti robotinę ranką per teleooperacijos sąsają, rankos prie valdiklių ir pasirengę persigrupavimu
DAggerInteraktyvus imitacinės mokymasisHG-DAgger

HG-DAgger ir užtvertos variacijos: kas nusprendžia, kada perimti robotinio modelio valdymą

Paprastas DAgger ragina žmogų žymėti būsenas, kai robotas dar važiuoja. Realioje aparatūroje tai nesaugu ir duoda prastas žymas. Užtverti variantai blind žymėjimą pakeičia vartais, kuriuos turi laikyti kas nors: žmogus HG-DAgger, saugumo klasifikatorius SafeDAgger, ansamblio nesutarimas EnsembleDAgger, biudžetinis naujumo ir rizikos įvertis ThriftyDAgger. Šis straipsnis juos lygina pagal tai, kas valdžia vartus, kokias signalą juos atidaro, ir kokios yra kiekvieno išlaidos — ir kodėl žmogaus užtverta forma yra ta, kuri išlieka realioje rankoje.

Aug 27, 202615 min. skaitymas
Abstraktus roboto manipuliacijos scenos vaizdavimas, iliustruojantis būsenos pasiskirstymą, kurį mokytas politika aplankė vykdymo metu
DAggerImitacinis mokymasElgesio klonavimas

DAgger paaiškinta: kodėl elgesio klonavimas nusidrasko ir ką iš tiesų įrodo duomenų agregacija

Elgesio klonavimas atitinka politiką ekspertų būsenos pasiskirstymui ir tada diegiama savarankiškai. Skirtumas tarp tų dviejų pasiskirstymų yra todėl, kad politika, kuri atrodo gerai validavimo metu, nušoka nuo stalo 300-ame žingsnyje. Tai mūsų DAgger serijos teorija: iš kur atsiranda kvadratinis klaidos terminas, ką keičia duomenų agregacija, ką numano be-žalos įrodymas ir kurią sąskaitą dar turi mokėti žmonių ekspertas.

Aug 27, 202615 min skaitymo
AY-Robots viešųjų duomenų rinkinių katalogas, rodantis LeRobot duomenų rinkinius, įrašytus su SO-100 klasės robotų rankomis
Duomenų rinkiniaiOpen X-EmbodimentDROID

Naudojant DROID, BridgeData V2 ir Open X su SO-100

DROID, BridgeData V2 ir Open X-Embodiment konvertuojami į 7-D galinio efektoriaus veiksmus su 6 ir 7 laisvės laipsnių robotų rankomis. SO-100 naudoja 6 jungčių pozicijas. Kas persikelia, kas ne, ir ką daryti vietoj to.

Aug 23, 202618 min skaitymo
AY-Robots žodyno įrašas apie LeRobot duomenų rinkinio formatą, formatą, kurį vartoja kiekvienas platformos mokytojas, nepriklausomai nuo to, ar epizodai buvo įrašyti, ar sugeneruoti.
sintetiniai duomenyssimuliacija-realybėIsaac Lab

Sintetiniai duomenys robotų politikoms: kur padeda simuliacija

Simuliacija gali padauginti saujelę demonstracijų į tūkstančius. Štai ką iš tikrųjų sako paskelbti skaičiai, kur kanda simuliacijos-realybės atotrūkis ir ką dar reikia įrašyti.

Aug 23, 202631 min skaitymo
AY-Robots politikos palyginimo lentelė su parametrų skaičiumi, GPU lygiais ir išvadų delsa, skirta GR00T N1.7, GR00T N1.5, Pi0.5, SmolVLA ir ACT
SmolVLATinyVLAMažas VLA

Maži VLA modeliai: TinyVLA, SmolVLA ir atvejis iki 1 mlrd. parametrų

TinyVLA ir SmolVLA įdiegia veikiantį VLA iki 1 mlrd. parametrų. Tikri skaičiai iš abiejų straipsnių, numatytosios lerobot nuostatos, išmatuota delsa ir kiek kainuoja paleidimas su 24 GB kortele.

Aug 23, 202619 min. skaitymo
AY-Robots bandymo puslapis: trys būdai pradėti neturint roboto, įskaitant GPU nuomą politikos išvadai
GR00T N1.7Nuotolinė išvadaDebesies GPU

Vykdyti GR00T išvadą be vietinio GPU

Jūsų roboto mašina neturi GPU. Įdiekite GR00T politikos serverį nuomojamame debesies GPU, transliuokite veiksmų blokus į ranką ir sužinokite, kiek tiksliai jums kainuoja tinklas.

Aug 23, 202619 min skaitymo
AY-Robots mokymo matrica su penkiomis politikos eilutėmis ir keturiomis roboto rankos stulpeliais, kiekviena ląstelė susiejanti su konkretaus modelio ir rankos mokymo vadovu
ACTSO-100lerobot

Kaip apmokyti ACT SO-100 nuo nulio

Apmokykite Action Chunking Transformer nuo nulio SO-100 su lerobot: act konfigūracija, chunk_size ir n_action_steps, 100000 žingsnių tvarkaraštis, 20 ms išvada.

Aug 23, 202616 min. skaitymo
AY-Robots politikų palyginimo lentelė, rodanti GR00T N1.7, GR00T N1.5, Pi0.5, SmolVLA ir ACT greta su parametrų skaičiumi, GPU lygiu, išvadų vėlavimu ir minimaliu epizodų skaičiumi
vla-modelspolicy-trainingmodel-selection

Kokią VLA politiką turėtumėte treniruoti 2026 m.?

GR00T N1.7, Pi0.5, SmolVLA, ACT ar GR00T N1.5? Sprendimų lentelė, pritaikyta realioms situacijoms, su paskelbtais etaloniniais skaičiais, vėlavimu, kaina už paleidimą ir licencijomis, susijusiomis su kiekvienu pasirinkimu.

Aug 23, 202618 min. skaitymo
AY-Robots kainų lentelė, rodanti, kokio GPU reikia kiekvienai iš penkių politikų, tipinį vykdymo laiką ir kainą už vykdymą, ir kiek epizodų reikia, kol politika tampa naudinga
VLA mokymasGPU kainosSO-100

VLA mokymo kaina: kiek iš tikrųjų kainuoja smulkaus derinimo vykdymas

Realių GPU kainų vietoje, kiek laiko veikia kiekviena iš penkių politikų, kiek kainuoja ranka ir demonstracijos, ir keturios vietos, kur pinigai tyliai dingsta.

Aug 23, 202623 min. skaitymo
AY-Robots mokymo puslapis, skirtas įrašyti jūsų pirmąjį LeRobot duomenų rinkinį su SO-100 ranka
LeRobotSO-100Duomenų rinkinio įrašymas

Įrašykite savo pirmąjį LeRobot duomenų rinkinį su SO-100

Įrašykite tinkamą LeRobot duomenų rinkinį su SO-100: kalibravimas, lyderio-sekėjo teleoperacija, tikrosios lerobot-record vėliavėlės ir numatytosios reikšmės, kameros nustatymas, epizodų skaičius ir defektai, kurie sugadina vykdymą.

Aug 23, 202616 min. skaitymo
SmolVLA modelio puslapis AY-Robots platformoje, rodantis parametrų skaičių, GPU lygį, išvadų vėlavimą vienam veiksmo žingsniui ir minimalų epizodų skaičių
SmolVLALeRobotVLA apmokymas

Kaip apmokyti SmolVLA su 24 GB GPU (lerobot 0.6.1)

SmolVLA yra 450 M parametrų VLA, kuris tiksliai derinamas su viena 24 GB plokšte. Tikros lerobot 0.6.1 komandos, tikrosios numatytosios reikšmės, spąstai, kainuojantys dieną, ir kiek kainuoja paleidimas.

Aug 23, 202617 min. skaitymo
AY-Robots apmokymo matrica su penkiomis politikomis eilutėse ir keturiomis roboto rankomis stulpeliuose, kiekviena ląstelė yra nuoroda į konkretų tikslinimo vadovą
Pi0.5Srauto atitikimasVLA apmokymas

Kaip apmokyti Pi0.5 su savo roboto duomenimis

Tiksliai suderinkite Pi0.5, srauto atitikimo VLA iš Physical Intelligence, su savo roboto duomenimis. Tikros komandos openpi ir lerobot pi05, duomenų rinkinio formato spąstai, VRAM ir vėlavimo ribos.

Aug 23, 202616 min. skaitymo
AY-Robots vadovo puslapis, skirtas apmokyti GR00T N1.7 SO-100 robotą, rodantis reikalingą GPU lygį, duomenų rinkinio formatą ir treniruoklio numatytuosius nustatymus
GR00T N1.7SO-100Tikslinimas

Kaip apmokyti GR00T N1.7 savo SO-100 duomenų rinkinyje

Išbandytas vadovas, skirtas tikslinti NVIDIA GR00T N1.7 SO-100 LeRobot duomenų rinkinyje: tikrosios vėliavėlės, modality.json, v2.1 reikalavimas, kiek kainuoja paleidimas ir spąstai.

Aug 23, 202628 min. skaitymo
robotikaAItelevaldymas

RoboTurk: Robotų mokymosi per nuotolinį televaldymą sutelktinis finansavimas

Atraskite, kaip RoboTurk iš esmės keičia robotų mokymąsi, sutelktiniu būdu gaudamas aukštos kokybės duomenis per nuotolinį televaldymą, įgalindamas masto duomenų rinkinius AI modeliams robotikoje. Išnagrinėkite jo poveikį imitaciniam mokymuisi, VLA modeliams ir investicijų grąžai robotikos įmonėms.

Dec 26, 202512
RobotikaDirbtinis intelektasSrautų Derinimas

Pi-Zero Srautų Derinimo Robotų Politikos: Revoliucinis Vikrus Valdymas su VLM Inicializavimu

Atraskite, kaip Pi-Zero srautų derinimo technika, kartu su VLM inicializavimu, transformuoja generalistines robotų politikas vikriam valdymui. Sužinokite apie jo pranašumus prieš tradicinius metodus, AI mokymo duomenų efektyvumą robotikoje ir pasekmes mastelio keitimo robotų diegimui pramonėje.

Dec 26, 202512
roboticsAIteleoperation

Vision-Language-Action Models: The Future of Robot Learning

Explore how Vision-Language-Action (VLA) models are revolutionizing robot learning by integrating vision, language, and action for smarter, more efficient robotics. Discover architectures, training methods, benchmarks, and ROI for deployment in this comprehensive guide.

Nov 15, 202312
RT-2: Kodėl aukštos kokybės robotų mokymo duomenys pranoksta algoritmus – „Google DeepMind“ įžvalgos, keičiančios žaidimo taisykles
robotikaAImašininis mokymasis

RT-2: Kodėl aukštos kokybės robotų mokymo duomenys pranoksta algoritmus – „Google DeepMind“ įžvalgos, keičiančios žaidimo taisykles

Atraskite, kaip „Google DeepMind“ RT-2 modelis iš esmės keičia AI robotiką, pabrėždamas esminį aukštos kokybės mokymo duomenų vaidmenį, o ne pažangius algoritmus. Šiame straipsnyje išnagrinėjami eksperimentai, įrodantys, kodėl efektyvus duomenų rinkimas yra būtinas norint užtikrinti realaus pasaulio robotų veikimą. Sužinokite, kaip tokios platformos kaip AY-Robots gali padėti sumažinti mokymo duomenų trūkumą būsimoms inovacijoms.

Dec 24, 20257 min skaitymo
RT-2 iš Google DeepMind: Kaip šis vaizdo-kalbos-veiksmų modelis keičia robotų mokymąsi
AIRobotikaMašininis mokymasis

RT-2 iš Google DeepMind: Kaip šis vaizdo-kalbos-veiksmų modelis keičia robotų mokymąsi

Atraskite, kaip Google RT-2 vaizdo-kalbos-veiksmų (VLA) modelis keičia robotų mokymąsi integruodamas vaizdo duomenis, natūralią kalbą ir realaus laiko veiksmus. Ši novatoriška AI technologija pagerina teleoperatorių duomenų rinkimą ir padidina efektyvumą robotikos srityse. Išnagrinėkite jo potencialų poveikį ateities AI valdomiems robotams AY-Robots platformoje.

Dec 24, 20258 min skaitymo