Stefnuþjálfun
AY-Robots þjálfar hlutameðferðarstefnur á vistuðum skjákortum, svo þú kemst frá upptekinni lotu að stefnu sem keyrir á arminum þínum án þess að eiga þjálfunarvélbúnað sjálf(ur). Þessi síða fer yfir studdu stefnutegundirnar, þjálfunarkeyrslusíðuna, vistpunkta og hverju þú getur raunhæft vænst út frá lotufjölda þínum.
Síðast uppfært 2026-08-09
Þjálfun án eigin skjákorts
Að þjálfa hlutameðferðarstefnu er skjákortsverkefni, og nútíma vision-language-action líkön þurfa meira myndminni en dæmigerð vinnustöð hefur. Á AY-Robots keyrir þjálfunin á vistuðum skjákortum í skýinu sem kerfið stýrir: þú velur gagnasafn og stefnutegund, ræsir keyrsluna og fylgist með framvindu hennar úr vafranum. Engin CUDA-uppsetning, engin reklasamsvörun og ekkert umhverfi að viðhalda.
Inntakið er alltaf skýjagagnasafn úr Dashboard > Datasets. Allt sem þú hefur tekið upp í gegnum fjarstýringarsetur eða hlaðið upp á LeRobot sniði kemur til greina, þar á meðal sameinuð gagnasöfn. Veldu úr áður en þú þjálfar: lotur merktar Failure eiga yfirleitt ekki heima í þjálfunarsafninu, og tíu mínútna yfirferð í lotuvafranum sparar klukkustundir af skjákortstíma sem annars færi í að læra af lélegum sýnikennslum.
Studdar stefnur
Fjórar stefnufjölskyldur eru studdar. Þær eru ólíkar að stærð, þjálfunarkostnaði og hversu mikið þær geta tekið upp úr gögnunum þínum, svo rétta valið fer meira eftir verkefninu og gagnasafninu þínu en nokkurri almennri röðun.
| Stefna | Tegund | Einkenni |
|---|---|---|
| ACT | Transformer, aðgerðaklösun | Spáir stuttum klösum framtíðaraðgerða í stað einstakra skrefa. Þétt, þjálfast tiltölulega hratt og er traust fyrsta val fyrir eitt vel skilgreint verkefni. |
| Diffusion Policy | Diffusion yfir aðgerðaraðir | Líkir eftir fullri dreifingu sýndra aðgerða, sem hjálpar þegar sýnikennslur þínar leysa verkefnið á fleiri en einn gildan hátt. Þyngri í þjálfun og hægari í ályktun en ACT. |
| SmolVLA | Lítið vision-language-action líkan | Málstýrt: verkefnisstrengurinn úr lotunum þínum verður hluti af inntakinu. Góður millivegur þegar þú vilt málstýringu án stórs grunnlíkans. |
| GR00T-fínstilling | Fínstilling grunnlíkans | Fínstillir stórt forþjálfað grunnlíkan fyrir vélmenni á lotunum þínum. Hæsta þakið af þessum fjórum, við hæsta þjálfunarkostnaðinn, með strangri kröfu um gagnasafnssnið. |
GR00T-fínstilling tekur eingöngu við gagnasöfnum á LeRobot sniði útgáfu 2.1. Gagnasafn á v3.0 mun mistakast við gagnahleðslu, ekki við innsendingu, svo athugaðu sniðútgáfuna áður en þú byrjar keyrsluna. Gagnasöfn tekin upp á kerfinu má nota óbreytt; fyrir ytri hleðslur skaltu fyrst athuga útgáfuna í meta/info.json.
Að ræsa keyrslu
- 1Veldu gagnasafnið
Opnaðu Dashboard > Training og veldu gagnasafnið sem þjálfa á á. Lotufjöldi og vélmennitegund eru sýnd svo þú getir staðfest að þú hafir valið rétt.
- 2Veldu stefnuna
Veldu eina af studdu stefnutegundunum. Ef þú ert óviss skaltu byrja á ACT: það er ódýrasta leiðin til að komast að því hvort gagnasafnið þitt sé nógu gott til að þjálfa nokkuð yfirleitt.
- 3Ræstu
Ræstu keyrsluna. Hún fær job id og sína eigin keyrslusíðu, og þú getur lokað vafranum: þjálfunin heldur áfram á netþjóninum og síðan sýnir stöðuna í rauntíma hvenær sem þú kemur til baka.
Þjálfunarkeyrslusíðan
Hver keyrsla hefur sérstaka síðu sem svarar tveimur spurningum sem þú hefur raunverulega á meðan á þjálfun stendur: er hún að læra, og er vélin heilbrigð. Framvinda námsins birtist sem gröf af loss, learning rate áætluninni og gradient normi. Loss sem jafnar sig út strax eða gradient norm sem springur segir þér snemma að keyrslan sé ekki þess virði að bíða eftir.
Heilbrigði vélarinnar birtist við hlið: nýting og minni skjákorts, auk vélarmælinga þjálfunarvélarinnar. Fasatímalína sýnir hvar keyrslan er stödd núna, frá undirbúningi umhverfis í gegnum gagnahleðslu, þjálfunarlykkjuna sjálfa og upp í hleðslu vistpunkta. Þegar eitthvað lítur undarlega út gefur innbyggði annálaskoðarinn þér hrá þjálfunarannálana án nokkurs SSH-aðgangs, sem er yfirleitt nóg til að sjá hvort bilun tengist gagnasafninu þínu eða keyrslunni sjálfri.
Vistpunktar og áframhald
Vistpunktar eru geymdir fyrir hverja keyrslu, ekki í sameiginlegum sjóði, svo vistpunktarnir sem eru taldir upp á keyrslusíðu tilheyra alltaf nákvæmlega þeirri keyrslu og stillingum hennar. Þetta skiptir meira máli en það hljómar: að blanda saman vistpunktum úr keyrslum með ólíkum stillingum er sígild orsök stefna sem bila hljóðlega.
Ef keyrsla rofnar geturðu haldið áfram frá nýjasta vistpunkti hennar í stað þess að byrja upp á nýtt. Millivistpunktar eru líka gagnlegir í sjálfu sér: þegar löng keyrsla byrjar að ofþjálfast undir lokin virkar fyrri vistpunktur oft betur á raunverulega arminum en sá síðasti.
Að keyra þjálfaða stefnu á arminum þínum
Kláraða stefnu má setja beint aftur á vélmennið þitt. Í stjórnklefanum skaltu velja þjálfuðu stefnuna fyrir tengda arminn þinn og ræsa ályktun: stefnan framleiðir nú liðaskipanirnar sem þú framleiddir áður með fjarstýringu. Armurinn verður að vera sömu vélmennitegundar og gagnasafnið var tekið upp á, og senan ætti að líkjast þjálfunarsenunum, þar á meðal staðsetningu myndavéla.
Meðhöndlaðu fyrstu ályktunarkeyrslurnar sem tilraunir, ekki sýningar. Hafðu neyðarstoppið innan seilingar, byrjaðu frá upphafsástandi nálægt því sem þú sýndir, og búðu þig undir að stefnan sé viðkvæm fyrir hlutum sem þú tækir ekki eftir: færð myndavél, önnur lýsing eða hlutur sem var aldrei í gagnasafninu.
Hversu margar lotur þú þarft
Algengasta þjálfunarmistakið á kerfinu er ekki rangur ofurbreyta, heldur að þjálfa á of litlum gögnum og álykta að stefnutegundin virki ekki. Sem þumalputtaregla fyrir eitt borðverkefni: um það bil 50 lotur gefa þér stefnu með þröngri alhæfingu sem gengur vel frá upphafsástöndum nálægt þeim sem þú sýndir. Um það bil 100 til 200 lotur gefa nothæfan stöðugleika um allt vinnusvæðið fyrir það eina verkefni, að því gefnu að þú hafir breytt staðsetningu hluta á milli lota.
Öflugri stefnutegundir afnema ekki þessa reglu. GR00T-fínstilling á 20 lotum mun samt alhæfa illa; það sem stærri líkönin gefa þér er hærra þak um leið og gögnin eru til staðar. Ef fjárhagurinn er takmarkaður skaltu eyða honum fyrst í fleiri og fjölbreyttari lotur, svo í stærra líkan.
Algengar spurningar
Hversu lengi tekur þjálfunarkeyrsla?▾
Það fer eftir stefnutegund og stærð gagnasafns, svo það er engin heiðarleg ein tala. ACT er yfirleitt hraðast af þessum fjórum, GR00T-fínstillingar hægastar. Fasatímalínan og loss-gröfin á keyrslusíðunni sýna snemma hvort keyrsla er að miða áfram.
Get ég þjálfað á sameinuðu gagnasafni?▾
Já. Sameinuð gagnasöfn eru venjuleg gagnasöfn; sameiningarstaðfestingin tryggði nú þegar samkvæmt fps, eiginleika og vélmennitegund. Að sameina upptökur af sama verkefni er ein áhrifaríkasta leiðin til að ná 100 til 200 lotu bilinu.
GR00T-keyrslan mín mistekst við gagnahleðslu. Hvað ætti ég að athuga fyrst?▾
Sniðútgáfu gagnasafnsins. GR00T-fínstilling krefst LeRobot v2.1, og gagnasafn á v3.0 mistekst nákvæmlega þar. Athugaðu útgáfuna í meta/info.json fyrir gagnasafnið þitt.
Ætti ég að fjarlægja misheppnaðar lotur fyrir þjálfun?▾
Yfirleitt já. Lotur merktar Failure kenna stefnunni misheppnaða hegðun. Recovery lotur eru annað mál: þær sýna hvernig á að leiðrétta mistök og eru oft þess virði að halda.
Þarf ég að hafa vafrann opinn á meðan á þjálfun stendur?▾
Nei. Keyrslur framkvæmast á netþjóninum. Keyrslusíðan sýnir núverandi stöðu, gröf og annála hvenær sem þú kemur til baka, og vistpunktar eru vistaðir óháð því hvort einhver fylgist með.
Svona geymir AY-Robots fjarstýringarupptökur á LeRobot sniði: uppbygging lota, lotuvafri mælaborðsins, sameining hleðslna og markaðstorgið.
Sérhver vélarmur sem er studdur á AY-Robots með forskriftum sínum: SO-100, Koch v1.1, Franka FR3, FP3 og Panda, WidowX-250 og ALOHA ViperX-300.