Tabela e kostos AY-Robots që tregon se cilën GPU ka nevojë secila nga pesë politikat, kohën tipike të ekzekutimit dhe çmimin për ekzekutim, dhe sa episode nevojiten para se politika të jetë e dobishme
Trajnim VLAKostot e GPU-veSO-100fine-tuningmësimi i robotëvebuxhetimi

Kostoja e Trajnimit VLA: Sa Kushton Vërtet një Rul Fine-Tuning

AY-Robots ResearchAugust 23, 202623 min lexuar

Çmimet reale të GPU-ve në tregun spot, sa kohë zgjat ekzekutimi i secilës prej pesë politikave, sa kushton krahu dhe demonstrimet, dhe katër vendet ku paratë zhduken në heshtje.

Versioni i shkurtër

  • Një ekzekutim në nivelin A100 80 GB ose H100 zgjat 3 deri në 6 orë dhe kushton rreth 4 deri në 12 USD. Në nivelin RTX 4090 është 2 deri në 5 orë dhe rreth 1 deri në 3 USD.
  • Matjet në vast.ai në 13:44 UTC më 23 gusht 2026: një RTX 4090 i plotë sipas kërkesës për 0.13 deri në 0.38 USD/h, një A100 80 GB për 0.44 deri në 0.67, një H100 80 GB për 1.34 deri në 2.34. Kartat e plota 80 GB janë të pakta, respektivisht dy dhe pesë oferta me një kartë.
  • GPU është linja më e lirë. Fatura e materialeve SO-ARM100 e vendos një palë lider plus ndjekës në 229.88 USD, që është 77 deri në 230 ekzekutime në nivelin 24 GB.
  • Dy orë të një personi që regjistron 50 episode kushtojnë më shumë se ekzekutimi i trajnimit që ushqejnë ato episode.
  • Paratë zhduken në katër vende: ekzekutime me të dhëna të dëmtuara, modele 3B në detyra që trajton një politikë 80M, GPU-të që askush nuk i shkatërroi, dhe ri-ekzekutime të një rezultati që nuk arritët ta ruani.
  • AY-Robots përcakton madhësinë e kartës sipas VRAM-it që i nevojitet modelit dhe e merr me qira në të njëjtin treg spot, kështu që kostoja e ekzekutimit është kostoja e tregut.

Fatura ka katër rreshta, dhe GPU është më i vogli

Kur njerëzit pyesin sa kushton të rregullosh një model vizion-gjuhë-veprim për një SO-100, ata pothuajse gjithmonë nënkuptojnë qiranë e GPU-së. Ky është numri që shfaqet si një tarifë në një kartë, kështu që është ai që ndihet real. Është gjithashtu, me një diferencë të madhe, më i vogli nga katër numrat që vendosin se çfarë kushton në të vërtetë një politikë funksionale.

RreshtiÇfarë ështëMadhësia tipike për një politikë funksionale
Koha e GPU-sëmarrja me qira e një karte për ekzekutimin1 deri në 12 USD për ekzekutim, dhe do të bëni 3 deri në 5
Robotiservo, kornizë e printuar, kamera, kabllo, energjinjë herë, 110 deri në 500 EUR për krah
Orë njerëzorenjë person që drejton krahun për të regjistruar demo1 deri në 4 orë për grup të dhënash, përsëritur për detyrë
Humbjetë dhëna të këqija, modele të mbimadhësive, pod-e të harruarae pakufizuar, dhe e vetmja linjë që kontrolloni

Kohët e trajnimit më poshtë vijnë nga punimet dhe depozitat e pesë modeleve, kostoja e harduerit nga lista e materialeve e publikuar, numrat e platformës nga AY-Robots katalogu i politikave dhe faqja e çmimeve. Aty ku platforma nuk ndihmon, ky artikull e thekson.

Sa kushton realisht një orë GPU në tregun spot

Nuk ka një çmim të vetëm për një orë A100. Në një treg si vast.ai, çdo host vendos tarifën e tij, dhe ekzekutimi i trajnimit që nisni, bie në cilëndo makinë që është e lirë dhe e disponueshme në atë sekondë. Përgjigja e ndershme është një shpërndarje. Ja ku është, matur më 23 gusht 2026 në 13:44 UTC: karta të plota të vetme, sipas kërkesës, të filtruara sipas VRAM-it real.

Kartëvast.ai sipas kërkesës USD/h (ulët / mesatare / lartë)Oferta me kartë të plotëÇmimi minimal i vast.aiRunPod Komuniteti / I sigurtHugging Face
RTX 4090, 24 GB0.13 / 0.32 / 0.38240.110.34 / 0.74nuk ofrohet
RTX 5090, 32 GB0.34 / 0.40 / 0.47290.190.69 / 0.99nuk ofrohet
A100 80 GB, PCIe ose SXM40.44 / 0.56 / 0.6720.131.19 PCIe, 1.39 SXM / 1.39, 1.592.50 si një Hapësirë
H100 80 GB, SXM ose PCIe1.34 / 1.80 / 2.3450.441.99 PCIe, 2.69 SXM / 2.89, 3.294.50 si një pikë fundore
H100 NVL, 94 GB1.47 / 1.47 / 2.6440.402.59 / 3.19nuk ofrohet
Si u mor ky snapshot, dhe çfarë nuk është

Ofertat sipas kërkesës për një GPU të plotë të vetme (gpu_frac == 1.0) nga API publik i paketave vast.ai, i cili nuk kërkon llogari, i filtruar sipas gpu_ram në mënyrë që vetëm kartat origjinale 80 GB të bien në rreshtat 80 GB. Ky filtër ka rëndësi: në këtë lexim, të gjitha tre ofertat me një kartë A100 SXM4 ishin pjesë 40 GB, ashtu si dy nga katër ofertat A100 PCIE, kështu që bashkimi i tyre në një rresht "A100" do të kishte përgjysmuar çmimin e raportuar këtu. Kolona Hugging Face përzien dy produkte: 2.50 USD/h është hardueri Nvidia A100 - large Spaces dhe 4.50 USD/h është një H100 80 GB i vetëm nën Inference Endpoints, të cilin Spaces nuk e ofron. Trajtojini medianat si indikative: rreshti A100 80 GB bazohet në dy oferta dhe rreshti H100 në pesë, dhe kërkesa identike 36 sekonda më vonë ktheu një numër të ndryshëm 4090 dhe një çmim të ndryshëm maksimal në tre nga pesë rreshtat. Çmimet e listës së RunPod janë numri më i qëndrueshëm për t'u planifikuar.

bash
# Live, full-card, single-GPU, on-demand offers from the vast.ai public bundle API.
# No account and no API key needed. gpu_ram is in MB, so an 80 GB card is >= 80000.
python3 - <<'PY'
import json, statistics, urllib.parse, urllib.request

def offers(name, min_ram):
    q = {"rentable": {"eq": True}, "num_gpus": {"eq": 1}, "gpu_name": {"eq": name},
         "order": [["dph_total", "asc"]], "limit": 500, "type": "on-demand"}
    url = "https://console.vast.ai/api/v0/bundles/?q=" + urllib.parse.quote(json.dumps(q))
    with urllib.request.urlopen(url, timeout=60) as r:
        return [o for o in json.load(r)["offers"]
                if o["gpu_frac"] == 1.0 and o["gpu_ram"] >= min_ram]

groups = {
    "RTX 4090 24 GB": (["RTX 4090"], 24000),
    "RTX 5090 32 GB": (["RTX 5090"], 30000),
    "A100 80 GB":     (["A100 PCIE", "A100 SXM4"], 80000),
    "H100 80 GB":     (["H100 SXM", "H100 PCIE"], 80000),
    "H100 NVL 94 GB": (["H100 NVL"], 90000),
}
for label, (names, min_ram) in groups.items():
    o = [x for n in names for x in offers(n, min_ram)]
    if not o:
        print(label, "no offers"); continue
    p = sorted(x["dph_total"] for x in o)
    b = sorted(x["min_bid"] for x in o if x.get("min_bid"))
    bid = f"{b[0]:.2f}" if b else "n/a"
    print(f'{label}: n={len(p)} | {p[0]:.2f} / {statistics.median(p):.2f} / {p[-1]:.2f}'
          f' USD/h | bid floor {bid}')
PY
Kërkesa e saktë pas tabelës së mësipërme, e ekzekutuar dy herë gjatë shkrimit të kësaj seksioni. Ekzekutojeni atë përpara se t'i besoni ndonjë artikulli mbi çmimet e GPU-ve, përfshirë këtë.
Tabela e kostos së AY-Robots që tregon se cilën GPU kërkon çdo politikë, kohën tipike të ekzekutimit dhe çmimin për ekzekutim, dhe sa episode nevojiten përpara se politika të jetë e dobishme
Tabela e kostos në /try: kartë, kohë ekzekutimi, çmim për ekzekutim dhe episode minimale për politikë.

Pse modelet 3B nuk mund të përdorin kartën e lirë

Një orë 4090 dhe një orë H100 80 GB ndryshojnë afërsisht gjashtë herë në medianat e mësipërme. Ajo që ju detyron të përdorni kartën e shtrenjtë nuk është shpejtësia, por memoria. openpi vendos kufirin minimal për një Pi0.5 të plotë akordim i imët në 70 GB, dhe NVIDIA rekomandon 40 GB ose më shumë për GR00T. Vini re se çfarë nuk është numri i GR00T. Konfigurimi i tij i akordimit të imët ngrin modelin e gjuhës dhe koduesin vizual si parazgjedhje (tune_llm dhe tune_visual janë False, projektori dhe koka e difuzionit True), prandaj katalogu liston afërsisht 40 M parametra të trajnuar nga 3 B. 40 GB nuk është gjendje optimizuesi për pesha 3 B, është shtylla kurrizore e ngrirë plus aktivizimet. Varietetet me fushëveprim të reduktuar bien më poshtë: shtegu LoRA i openpi kërkon 22.5 GB dhe përmend 4090, dhe fluksi i punës Isaac Lab Arena i NVIDIA liston një opsion me një GPU 24 GB për GR00T pas trajnimit. Platforma ndahet në nivele bazuar në atë që çdo shitës publikon për konfigurimin që ai aktualisht ekzekuton. Shkrimi mbi përafrimin e fluksit të pi0 shpjegon se nga vjen ai përafrimi i fluksit gjurmë.

DetyraMemoria e kërkuar nga projekti burimorBurimi
Inferenca pi0 / pi0.5më shumë se 8 GB, shembull RTX 4090openpi
Akordim i imët LoRA pi0 / pi0.5më shumë se 22.5 GB, shembull RTX 4090openpi
Akordim i imët i plotë pi0 / pi0.5më shumë se 70 GB, shembull A100 80 GB ose H100openpi
Inferenca GR00T N1.71 GPU me 16 GB ose më shumëIsaac-GR00T
Akordim i imët GR00T N1.740 GB ose më shumë e rekomanduar, nyje H100 ose L40Isaac-GR00T
Akordim i imët GR00T, çfarë trajnonprojektor dhe kokë difuzioni; LLM dhe kodues vizual të ngrirë si parazgjedhjefinetune_config.py
GR00T pas trajnimit, i reduktuar1 GPU me 24 GB, model gjuhe i ngrirëIsaac Lab Arena
Akordim i imët SmolVLAnjë A100 e vetme për ekzekutimin referencë me 20,000 hapalerobot docs
Trajnim ACTnjë RTX 2080 Ti e vetme 11 GBACT paper

Kjo tabelë është arsyeja pse platforma i ndan pesë modelet në dy nivele. GR00T N1.7, GR00T N1.5 dhe Pi0.5 shkojnë në A100 80 GB ose H100 sepse kjo është ajo që kërkojnë shitësit. SmolVLA dhe ACT shkojnë në një RTX 4090 ose çdo kartë 24 GB sepse kjo është vërtet e mjaftueshme.

Kurthi që të ha një ditë: marrja me qira e kartës së lirë për modelin e madh

Një ekzekutim GR00T ose Pi0.5 në një kartë 24 GB nuk dështon në sekondën zero. Ai shkarkon pikën bazë të kontrollit, ndërton indeksin e grupit të të dhënave, fillon kalimin e parë përpara dhe ndërpritet pas disa qindra hapash me një gabim CUDA out-of-memory. Ju paguani për shkarkimin dhe konfigurimin dhe nuk merrni asgjë. Zgjidhje: mungesë memorie gjatë trajnimit.

Sa kohë zgjat funksionimi i secilit prej pesë modeleve

Koha e ekzekutimit është gjysma tjetër e kostos: 2.00 USD për orë është e parëndësishme nëse puna është 40 minuta dhe shkatërruese nëse është 40 orë. Këto janë parazgjedhjet që AY-Robots dërgon realisht te trajnuesi, me dritaren e ekzekutimit dhe koston për çdo nivel.

PolitikaNiveli i GPU-sëHapat maksimalë parazgjedhurBatch-i parazgjedhur (akumulimi i gradientit)Dritarja e ekzekutimitKostoja për ekzekutim
GR00T N1.7, ~3BA100 80 GB or H10020,00032, accum 1, zbatohet3 deri në 6 orë4 deri në 12 USD
GR00T N1.5, ~3BA100 80 GB or H1002,0001, accum 16, zbatohet3 deri në 6 orë4 deri në 12 USD
Pi0.5, ~3BA100 80 GB or H10030,0001, accum 16, pa efekt3 deri në 6 orë4 deri në 12 USD
SmolVLA, ~450MRTX 4090 or any 24 GB20,0002, accum 8, pa efekt2 deri në 5 orë1 deri në 3 USD
ACT, ~80MRTX 4090 or any 24 GB100,0008, accum 12 deri në 5 orë1 deri në 3 USD
Tabela krahasuese e pesë politikave të trajnueshme në AY-Robots që tregon numrin e parametrave, GPU-në e kërkuar, vonesën e inferencës dhe numrin minimal të episodeve
Pesë politikat krah për krah: parametrat, niveli i GPU-së, vonesa për hap veprimi, episodet minimale.

Nga vijnë ato dritare ekzekutimi nga burimi

  • SmolVLA: dokumentacioni i lerobot thekson se 20,000 hapa zgjasin afërsisht 4 orë në një A100 të vetme. Platforma ekzekuton të njëjtat 20,000 hapa në nivelin më të lirë 24 GB, prandaj një dritare në vend të një 4 orësh fiks.
  • ACT: punimi origjinal ALOHA raporton rreth 5 orë në një RTX 2080 Ti të vetme 11 GB për një model me 80M parametra. Një 4090 është disa breza më i ri, por platforma buxheton 100,000 hapa, kështu që dritarja bie në të njëjtin vend.
  • GR00T: fluksi i punës referencë i NVIDIA për gjeneratën N1.6 citon afërsisht 4 deri në 8 orë për 20,000 hapa me batch 24 në tetë karta L40S, dhe 2 deri në 3 orë për 30,000 hapa me batch 16 në një Ada 6000 të vetme. Fine-tuning-u me një kartë i një VLA 3B në pak orë është normale, jo optimiste.
  • Pi0.5: openpi nuk publikon asnjë shifër të kohës reale, por publikon kufirin prej 70 GB për një fine-tune të plotë, gjë që përcakton kartën dhe rrjedhimisht shpejtësinë.

Vlen të ndalemi te numri që nuk po paguani. Punimi GR00T N1 raporton afërsisht 50,000 orë GPU H100 për të pretrain-uar modelin 2.2B, në një grup deri në 1024 GPU, me një madhësi batch-i pretraining prej 16,384 për 200,000 hapa gradienti. Me 1.34 deri në 2.34 USD për orë të matur më lart, kjo është në rendin e 67,000 deri në 117,000 USD llogaritjeje të marrë me qira. Punimi SmolVLA e vendos projektin e tij në afërsisht 30,000 orë GPU mbi 481 grupe të dhënash komunitare, 22.9K episode dhe 10.6M korniza. Ju trashëgoni të gjitha këto për çmimin e një shkarkimi; 8 USD tuaja blejnë 20,000 hapat e fundit. Pse VLA-të ndërtohen në këtë mënyrë mbulon atë ndarje.

Krahu: një kosto e vetme që e zbeh faturën e GPU-së

Një ekzekutim trajnimi kushton më pak se dreka. Roboti jo. Kjo është arsyeja pse SO-100 ka rëndësi: është krahu më i lirë që i gjithë mësimi imitues zinxhir mjetesh mbështet aktualisht.

KrahServoTensioniKostoja e pjesëveMbështetje në AY-Robots
SO-100Feetech STS3215 bus servos7.4 V110 to 150 EURi plotë, krah referencë
SO-101Feetech STS32157.4 V130 to 170 EURi plotë
Koch v1.1Dynamixel XL330 / XL4305 V and 12 V rails250 to 350 EURi pajtueshëm
LeKiwiFeetech STS3215 arm, wheeled base7.4 V arm, 12 V base400 to 500 EURi pajtueshëm

Lista e materialeve në depozitën SO-ARM100 është më e detajuar dhe vlen të kontrollohet sipas rajonit tuaj: lista e saj Pjesë për Dy Krahë arrin në 229.88 USD ose 226.30 EUR për një konfigurim udhëheqës plus ndjekës, dhe lista e saj Pjesë për Një Krah Ndjekës arrin në 121.94 USD ose 124.30 EUR. Gjashtë servo STS3215 me 13.89 USD secila janë 83.34 nga ato 121.94, pra servot janë krahu. Me 1 deri në 3 USD për ekzekutim SmolVLA ose ACT, një palë krahë vlen midis 77 dhe 230 ekzekutime trajnimi. Nëse jeni ende duke zgjedhur, SO-100 kundrejt SO-101 është krahasimi që ka rëndësi, sepse të dy janë aq afër sa vendimi ka të bëjë me disponueshmërinë dhe jo me aftësinë.

7.4 V, jo 12 V

STS3215 shitet në variantin 7.4 V dhe 12 V; depozita thekson se pjesa 12 V ka nevojë gjithashtu për një furnizim 12 V 5 A në vend të atij 5 V, kështu që të dy nuk janë të këmbyeshëm. Furnizimi me 12 V në servot 7.4 V i shkatërron ato, dhe gjashtë servo janë dy të tretat e kostos së pjesëve të një krahu ndjekës. Kontrolloni etiketën në çdo servo para ndezjes së parë. Nëse servot tashmë sillen çuditshëm: servo nuk përgjigjet, krahu dridhet dhe më pas lëshohet.

Orët njerëzore: rreshti që askush nuk e vendos në fletëllogaritje

Ky është numri që e kthen diskutimin e kostos përmbys. Regjistrimi i demonstrimeve është një person që lëviz një krah roboti, një episod në të njëjtën kohë, në kohë reale. Nuk ka grupim dhe nuk ka marrje me qira për sekondë. grupi i të dhënave LeRobot regjistruesi vjen me parazgjedhje që e bëjnë aritmetikën të lehtë, të treja të konfirmuara në DatasetRecordConfig: 60 sekonda për episod, 60 sekonda për të rivendosur skenën, 50 episode. Kolona e parave më poshtë supozon 15 USD për një orë të kohës së dikujt, gjë që është një supozim dhe jo një numër platforme. Zëvendësoni normën tuaj; raporti është thelbi.

  1. 1
    Regjistroni grupin e të dhënave me parazgjedhjet për të cilat do të faturoheni realisht

    Ky është lerobot 0.6.1, versioni në PyPI që nga 3 gushti 2026. Vini re formën e CLI: regjistrimi bëhet përmes pikës së hyrjes së konsolës lerobot-record (lerobot.scripts.lerobot_record), jo rrugës së vjetër të modulit python -m lerobot.scripts.record. AY-Robots synon 0.5.1, dhe rrota 0.5.1 deklaron të njëjtat pika hyrjeje lerobot-record dhe lerobot-train, kështu që forma më poshtë është e qëndrueshme në të dyja. Tre flamujt e kohës janë parazgjedhjet e sipërme, kështu që kjo është gjithashtu komanda që supozon aritmetika në tabelën tjetër.

    bash
    lerobot-record \
        --robot.type=so100_follower \
        --robot.port=/dev/ttyACM0 \
        --robot.id=my_follower_arm \
        --robot.cameras="{ front: {type: opencv, index_or_path: 0, width: 640, height: 480, fps: 30} }" \
        --teleop.type=so100_leader \
        --teleop.port=/dev/ttyACM1 \
        --teleop.id=my_leader_arm \
        --dataset.repo_id=${HF_USER}/pick-place-cube \
        --dataset.num_episodes=50 \
        --dataset.episode_time_s=60 \
        --dataset.reset_time_s=60 \
        --dataset.single_task="Grab the black cube and put it in the bin"
  2. 2
    Shikoni çfarë keni regjistruar përpara se të merrni me qira një minutë të vetme GPU

    Inspektimi i një grupi të dhënash kushton zero USD në orë. Zbulimi i të njëjtit problem nga një kurbë humbjeje kushton 2.00 USD në orë në nivelin H100 dhe ju tregon katër orë me vonesë. Shtyjeni grupin e të dhënave dhe pastrojeni atë në shikuesin LeRobot, ose shfletoni drejtorinë e grupeve të të dhënave të AY-Robots.

    bash
    # the recorder pushes to the Hub by default; disable with --dataset.push_to_hub=False
    echo https://huggingface.co/datasets/${HF_USER}/pick-place-cube
    
    # then open https://huggingface.co/spaces/lerobot/visualize_dataset
    # and scrub through episodes: are both camera streams alive on every episode?
    # is the gripper actually closing? does the arm sit at a joint limit?
  3. 3
    Trajnoni dhe sigurohuni që pika e kontrollit të mbijetojë pod-it

    Një makinë me qira është e përkohshme sipas përkufizimit, prandaj shkruani pikat e kontrollit diku të qëndrueshme gjatë ekzekutimit. Dy flamuj vendosin nëse do të mbani atë që keni paguar. --save_freq ka parazgjedhje 20,000 hapa, kështu që një ekzekutim i parazgjedhur SmolVLA me 20,000 hapa shkruan pikën e tij të parë të kontrollit kur ekzekutimi ka mbaruar tashmë; uleni atë përpara se të merrni me qira diçka të ndërprerë. --save_checkpoint_to_hub kërkon --policy.repo_id dhe nuk ekziston në lerobot 0.5.1, kështu që në atë version ju kopjoni vetë drejtorinë e daljes nga makina. Madhësia e grupit më poshtë është shembulli i dokumentacionit të sipërm; formulari AY-Robots dërgon 2 për SmolVLA dhe shkruan në ruajtjen e objekteve ndërsa shfaqen pikat e kontrollit.

    bash
    lerobot-train \
        --policy.path=lerobot/smolvla_base \
        --dataset.repo_id=${HF_USER}/pick-place-cube \
        --batch_size=64 \
        --steps=20000 \
        --save_freq=2000 \
        --output_dir=outputs/train/my_smolvla \
        --job_name=my_smolvla_training \
        --policy.device=cuda \
        --policy.repo_id=${HF_USER}/my_smolvla \
        --save_checkpoint_to_hub=true
EpisodeRegjistrimi në 60 sRivendosja në 60 sOra realePlus 20 për qind ri-regjistrimeMe 15 USD për orë njerëzore
30, minimumi i SmolVLA30 min30 min1 h 00 min1 h 12 minrreth 18 USD
50, katër minimumet e tjera50 min50 min1 h 40 min2 h 00 minrreth 30 USD
100, një grup i dhënash i rehatshëm100 min100 min3 h 20 min4 h 00 minrreth 60 USD

Krahasoni kolonën e djathtë me koston e ekzekutimit prej 1 deri në 12 USD. Me atë normë të supozuar, një grup të dhënash me 50 episode kushton dy deri në shtatë herë më shumë për t'u regjistruar sesa kushton për t'u trajnuar, përpara kalibrimit, konfigurimit të kamerës dhe episodeve që hidhni. Kjo është arsyeja pse ka një vlerë të drejtpërdrejtë në dollarë. Udhëzuesi i lerobot sugjeron të paktën 50 episode me 10 për vendndodhje objekti; dokumentet e SmolVLA raportojnë se një version me 25 episode i të njëjtës detyrë nuk ishte i mjaftueshëm.

Ku humbasin paratë në të vërtetë

1. Ekzekutime me të dhëna që nuk do të funksiononin kurrë

Një ekzekutim GR00T me 20,000 hapa në një grup të dhënash me dy transmetime kamerash të shkëmbyera kushton njësoj si një në një grup të dhënash të pastra, merr të njëjtën kohë dhe prodhon një kurbë humbjeje që duket mirë. Dështimi shfaqet në krah, orë më vonë. faturohen me orë dhe diagnoza faturohet me ditë. Dy simptoma që ia vlen të mbahen mend: zakonisht do të thotë se vëzhgimet nuk mbartin atë që kërkon detyra, dhe do të thotë se grupi i të dhënave kishte më pak variacion sesa mendonit.

2. Pagesa e çmimeve të modelit themelor për një detyrë me kamerë fikse

ACT ka afërsisht 80M parametra dhe u projektua për t'u trajnuar nga e para me 50 demonstrime të një detyre. GR00T N1.7 ka afërsisht 3B me një shtyllë kurrizore të paratrajnuar. Për një kamerë të fiksuar, një tavolinë fikse dhe një objekt, modeli 80M shpesh arrin atje, funksionon me rreth 20 ms për hap veprimi në vend të 152 ms, dhe kushton 1 deri në 3 USD për ekzekutim në vend të 4 deri në 12. Shpenzoni 3 USD për të zbuluar nëse modeli i lirë funksionon para se të shpenzoni 12 USD për atë të shtrenjtë. ACT kundrejt SmolVLA dhe GR00T N1.7 kundrejt Pi0.5 tregojnë se ku secili pushon së qeni përgjigja e duhur; arena e modelit ka 85 modele dhe 332 rezultate krahasuese.

3. GPU-ja që harruat

Gabimi më i lirë për t'u parandaluar dhe më i zakonshmi për t'u bërë. Një instancë e nisur të premten për të rregulluar diçka faturohet gjatë fundjavës me të njëjtën normë si një ekzekutim i vërtetë.

KartëNorma mesatare në momentin e kapjesNë gjendje të lirë për 24 orëNë gjendje të lirë për 7 ditëKjo vlen
RTX 40900.32 USD/h7.68 USD53.76 USDrreth 27 ekzekutime SmolVLA ose ACT me 2 USD
A100 80 GB0.56 USD/h13.44 USD94.08 USDrreth 12 ekzekutime GR00T me 8 USD
H100 80 GB1.80 USD/h43.20 USD302.40 USDrreth 38 ekzekutime GR00T me 8 USD

Në AY-Robots, ky dështim është eliminuar për inferencë: pod-et e siguruara nga API-ja e inferencës mbajnë një mbikëqyrës të gjendjes së lirë dhe shkatërrohen pas një periudhe pasiviteti. Nëse e merrni me qira kartën vetë, ai mbikëqyrës është kujtesa juaj në kalendar.

4. Pagesa dy herë për të njëjtën përgjigje

Pika hyrëse e rregullimit të imët të GR00T është një CLI tyro që nuk ekspozon asnjë seed. Ky nuk është një kufizim i platformës, është mjeti i sipërm: nuk ka fushë seed në gr00t/configs/finetune_config.py, dhe këshillat e trajnimit të vetë depozitës paralajmërojnë se ekzekutimet ndryshojnë me 5 deri në 6 për qind sepse augmentimet e imazhit janë jo-deterministike. lerobot vendos si parazgjedhje seed 1000 si në 0.5.1 ashtu edhe në 0.6.1, kështu që ekzekutimet ACT, SmolVLA dhe Pi0.5 mund të riekzekutohen të paktën nga i njëjti inicializim dhe rend i të dhënave. Ky nuk është një premtim për pesha bit-identike në një GPU, por është ndryshimi midis një riekzekutimi dhe një eksperimenti të ri. Nëse një ekzekutim GR00T prodhon një politikë që funksionon dhe ju nuk e keni ruajtur pikën e kontrollit, ju paguani çmimin e plotë për një rezultat që mund të ndryshojë më shumë se ndryshimi që po ndiqnit. Ekziston një mënyrë e dytë për të humbur një pikë kontrolli për të cilën keni paguar: CLI vendos si parazgjedhje --save-total-limit 5, e dokumentuar si numri maksimal i pikave të kontrollit të ruajtura para se të fshihen ato më të vjetrat. Ruajtja është qindarka; një riekzekutim është 4 deri në 12 USD dhe gjashtë orë.

Kapaciteti i ndërprerë është gjysmë çmimi dhe do të ndërpresë ekzekutimin tuaj

Çmimet minimale të ofertave më lart janë një pjesë e tarifës sipas kërkesës, dhe vast.ai thotë se sistemi i ofertave mund të ulë kostot e klientëve me pesëdhjetë për qind ose më shumë. Kapja, me fjalët e veta: një instancë e ndërprerë mund të ndërpritet në çdo kohë nëse një përdorues tjetër ofron më lart ose krijohet një qira sipas kërkesës për të njëjtat burime, dhe ajo ndërprerje "ndalon të gjitha proceset që janë duke u ekzekutuar". Sipas kërkesës gjithmonë ka përparësi. Mirë për një ekzekutim që shkruan një pikë kontrolli çdo disa qindra hapa, një humbje totale për një që shkruan në fund, gjë që është pikërisht ajo që ju japin parazgjedhjet: Isaac-GR00T CLI shkruan çdo --save-steps (parazgjedhje 1000), por --save_freq e lerobot parazgjedh në 20,000 hapa, kështu që një ekzekutim parazgjedhur i SmolVLA shkruan pikë kontrolli një herë, në vijën e finishit. Uleni, ose mos bëni ofertë. Formulari i trajnimit AY-Robots ekspozon parametrin GR00T si saveSteps.

Marrja me qira e kartës vetë
Avantazhe
  • Tarifa më e ulët orare që ekziston.
  • Kontroll i plotë i imazhit, versionit CUDA, rishikimit të lerobot ose Isaac-GR00T dhe çdo flamuri.
  • Ofertat e ndërprerë përgjysmojnë tarifën nëse ekzekutimi juaj shkruan pika kontrolli shpesh sa për të mbijetuar një ndërprerje.
  • Asgjë nuk është abstraktuar, kështu që kur një ekzekutim sillet çuditërisht mund të shihni pse.
Kompromise
  • Konfigurimi faturohet me tarifat e GPU-së: drajverët, varësitë, pika e kontrollit bazë me shumë gigabajt dhe shkarkimi i grupit të të dhënave të gjitha kushtojnë njësoj për orë si trajnimi.
  • Një instancë e ndërprerë e tejkaluar në ofertë ndërpritet dhe proceset e saj ndërpriten. Një ekzekutim i pa ruajtur është para e djegur, dhe parazgjedhja e lerobot shkruan pikën e saj të parë të kontrollit në hapin 20,000.
  • Asgjë nuk e shkatërron pod-in për ju. Tabela e papunësisë më lart është fatura për harresën.
  • Furnizimi për karta të plota të vetme 80 GB është i pakët: dy oferta A100 80 GB dhe pesë H100 80 GB me kartë të plotë në këtë lexim. Lista gjithashtu ndryshon shpesh, kështu që çmimi më i lirë i listuar dhe çmimi që mund të merrni me qira nuk janë i njëjti numër.
  • Çdo orë në infrastrukturë është një orë e pa shpenzuar duke regjistruar episodet që vendosin nëse politika funksionon.

Ta bësh vetë kundrejt lënies së platformës të marrë me qira kartën

Ju zgjidhni makinën, ndërtoni mjedisin dhe shkatërroni pod-in. Tarifa orare është tarifa e tregut më lart; gjithçka tjetër është koha juaj.

  1. Gjeni një kartë që përputhet me VRAM-in që i nevojitet modelit: 24 GB për ACT dhe SmolVLA, 80 GB për GR00T dhe Pi0.5.
  2. Merrni me qira sipas kërkesës nëse ekzekutimi nuk mund të mbijetojë një ndërprerje, i ndërprerë nëse shkruan pika kontrolli shpesh.
  3. Instaloni zinxhirin e mjeteve: lerobot për ACT, SmolVLA dhe Pi0.5, depozitorin Isaac-GR00T me lëshuesin e tij tyro për GR00T.
  4. Konvertoni grupin e të dhënave nëse është e nevojshme. Një grup të dhënash LeRobot v3.0 bën që ngarkuesi GR00T të ndërpritet dhe duhet të konvertohet në v2.1.
  5. Lëshoni, shikoni humbjen, shtyni pikat e kontrollit diku të qëndrueshme ndërsa shkruhen.
  6. Shkatërroni instancën, pastaj kontrolloni që e keni shkatërruar.
bash
# GR00T N1.7, single GPU, Isaac-GR00T as of August 2026.
# Note the entry point: gr00t/experiment/launch_finetune.py, a tyro CLI.
# scripts/gr00t_finetune.py does not exist in this repository; tutorials that
# still reference it are stale. The per-embodiment walkthrough is
# getting_started/finetune_new_embodiment.md.
CUDA_VISIBLE_DEVICES=0 uv run python gr00t/experiment/launch_finetune.py \
    --base-model-path nvidia/GR00T-N1.7-3B \
    --dataset-path demo_data/cube_to_bowl_5 \
    --embodiment-tag NEW_EMBODIMENT \
    --modality-config-path examples/SO100/so100_config.py \
    --num-gpus 1 \
    --output-dir ./so100-checkpoints \
    --max-steps 20000 \
    --global-batch-size 32 \
    --dataloader-num-workers 4

# v3.0 dataset? Convert it down first or the loader will crash. The helper
# has its own pyproject and must be installed in its own environment:
cd scripts/lerobot_conversion
uv venv && source .venv/bin/activate
uv pip install -e .
python convert_v3_to_v2.py --repo-id <DATASET_REPO_ID>
Pika aktuale e hyrjes për fine-tune të Isaac-GR00T, që përputhet me komandën në README të depozitorit. Ky CLI nuk ka flamur seed, kështu që ekzekutimet e GR00T nuk janë të riprodhueshme bit-për-bit.

Kostoja realiste për një ekzekutim GR00T: 3 deri në 6 orë në një H100 80 GB me 1.34 deri në 2.34 USD për orë është 4 deri në 14 USD, plus 20 deri në 40 minuta konfigurim që gjithashtu faturohet, plus koha juaj.

Çfarë tarifon platforma dhe si e zgjedh kartën

Logjika është qëllimisht e mërzitshme. Çdo model në katalogun deklaron një nivel GPU; backend-i merr VRAM-in e kërkuar dhe merr me qira një kartë të përshtatshme në të njëjtin treg spot të matur më lart. Kjo është arsyeja pse kostoja e cituar është një interval, jo një çmim. GR00T dhe Pi0.5 janë vetëm në cloud këtu për shkak të kufijve minimalë prej 40 GB dhe 70 GB. SmolVLA dhe ACT gjithashtu funksionojnë lokalisht në kartën tuaj 24 GB, ku kostoja e cloud-it është zero dhe energjia elektrike është problemi juaj.

Faqja e çmimeve të AY-Robots që tregon koston e një ekzekutimi trajnimi dhe aksesit në platformë
Faqja e çmimeve. Shifrat për çdo ekzekutim ndjekin tregun spot dhe jo një çmim fiks të listës.

Një parametër meriton një paralajmërim. Akumulimi i gradientit vlen vërtet për të dy variantet GR00T, kështu që rritja e tij blen një grup efektiv më të madh në të njëjtën kartë. Për Pi0.5 dhe SmolVLA nuk vlen fare: lerobot 0.5.1 nuk ka asnjë opsion akumulimi gradienti në konfigurimin e tij të trajnimit, kështu që vendosja e fushës në 16 nuk kushton asgjë dhe nuk blen asgjë. Nëse një punë në radhë nuk fillon kurrë, faqja e bllokuar në radhë mbulon çfarë duhet kontrolluar; nëse grupi i të dhënave refuzohet para se të fillojë ekzekutimi, është pothuajse gjithmonë problemi i formatit v3.0.

Kufiri që kjo platformë nuk e zgjidh: vonesa

Një GPU me qira që shërben politikën tuaj përmes internetit publik shton udhëtime vajtje-ardhje në një cikël kontrolli që tashmë është 20 deri në 485 ms për hap veprimi. Mirë për marrje-vendosje të ngadaltë, jo për lëvizje të shpejtë reaktive. Inferenca në cloud vlerëson mirë një pikë kontrolli dhe kryen keq manipulimin në prodhim: nëse detyra kërkon shpejtësi, llogaritja duhet të jetë pranë servove, dhe ky është një kosto që ky artikull nuk mund ta zhdukë. Shih vonesën e inferencës.

Një buxhet i detajuar për një politikë të parë funksionale

Të katër rreshtat së bashku, duke filluar nga asgjëja. Totali i GPU-së supozon 3 deri në 5 ekzekutime: i pari vërteton se pipeline funksionon, i dyti ekspozon një problem të të dhënave, i treti ose i katërti është ai që mbani.

RreshtiRruga e kursyerRruga e rehatshme
KrahuVetëm ndjekësi SO-100, 121.94 USD në BOMudhëheqësi plus ndjekësi, 229.88 USD në BOM
ModeliSmolVLA ose ACT, niveli 24 GBGR00T N1.7, A100 80 GB ose niveli H100
Epizode të regjistruara30, minimumi i SmolVLA50 deri në 100
Koha njerëzore për të regjistruarrreth 1 orë 12 min2 deri në 4 orë
Kostoja e një ekzekutimi1 deri në 3 USD4 deri në 12 USD
Ekzekutime para se të funksionojë3 deri në 53 deri në 5
Shpenzimet totale të GPU-së3 deri në 15 USD12 deri në 60 USD
Rreshti më i madh në faturëkrahu, pastaj koha juajkrahu, pastaj koha juaj

Modeli vlen edhe për këtë madhësi roboti: llogaritja është një gabim rrumbullakimi, hardueri është një kosto reale një herë, orët njerëzore janë shpenzimi i përsëritur. Për të testuar gjysmën e trajnimit para se të blini diçka, , ju lejojnë të krahasoni modele dhe të merrni me qira një GPU pa një krah, dhe është një SO-100 fizik që mund ta drejtoni në shfletues pa regjistrim. Për të gjithë procesin nga fillimi në fund, mbulon konfigurimin, dhe trajnimin, dhe është versioni i shkurtër.

Matrica e trajnimit AY-Robots me pesë politika si rreshta dhe katër krahë robotikë si kolona, çdo qelizë lidhet me një udhëzues specifik trajnimi
Matrica /train: rreshti për buxhetin tuaj, kolona për krahun tuaj, qeliza për udhëzuesin me parazgjedhjet dhe koston e atij çiftimi.
Sa kushton një ekzekutim i rregullimit të imët të VLA nga fillimi në fund?

Rreth 4 deri në 12 USD për GR00T N1.7, GR00T N1.5 ose Pi0.5 në nivelin A100 80 GB ose H100 (3 deri në 6 orë me 1.20 deri në 2.00 USD për orë), dhe rreth 1 deri në 3 USD për SmolVLA ose ACT në nivelin RTX 4090 (2 deri në 5 orë me 0.30 deri në 0.60 USD për orë). Marrja me qira e kartës vetë bie në të njëjtin diapazon pasi të llogaritet koha e konfigurimit, pasi faturohet me normën e trajnimit.

A ia vlen të paguash për një H100 mbi një A100 80 GB?

Për një politikë të vetme SO-100, zakonisht jo. Të dyja pastrojnë kufirin e memories që GR00T dhe Pi0.5 kanë nevojë, dhe në leximin e 23 gushtit 2026, një A100 80 GB i plotë filloi me 0.44 USD për orë kundrejt 1.34 për një H100 80 GB. H100 përfundon më shpejt, kështu që një pjesë e normës kthehet si më pak orë, por totali është ende më i lartë për një ekzekutim kaq të vogël. Argumenti i vërtetë për H100 është disponueshmëria: pesë oferta të vetme H100 80 GB në atë treg kundrejt dy A100 80 GB, dhe një kartë që nuk mund ta marrësh me qira nuk ka çmim.

Sa ekzekutime duhen para se një politikë të funksionojë vërtet?

Planifikoni tre deri në pesë. I pari vërteton se procesi është lidhur saktë. I dyti zakonisht ekspozon një problem me grupin e të dhënave, si p.sh. një transmetim kamere që u ndërpre gjatë rrugës. I treti ose i katërti është ai që mbani.

A mund të trajnoj SmolVLA ose ACT në GPU-në time në vend që ta marr me qira?

Po. Të dyja mbështeten lokalisht në AY-Robots dhe të dyja përshtaten lehtësisht në 24 GB; punimi origjinal i ACT trajnoi modelin e tij 80M në rreth 5 orë në një RTX 2080 Ti me 11 GB. GR00T dhe Pi0.5 janë vetëm në cloud këtu sepse kufijtë e rregullimit të imët të dokumentuar nga shitësit janë 40 GB dhe 70 GB, dhe karta më e madhe e konsumatorit në treg është RTX 5090 me 32 GB.

Pse i njëjti numër hapash kushton shuma të ndryshme ndërmjet modeleve?

Hapat nuk janë të krahasueshëm ndërmjet politikave. ACT parazgjedh 100,000 hapa në batch 8 në një kartë 24 GB; GR00T N1.5 parazgjedh 2,000 hapa në batch 1 me akumulim gradienti 16 në një kartë 80 GB. Fatura është orët shumëzuar me normën e kartës në të cilën ju detyron gjurmë e memories, jo numëruesi i hapave.

Shikoni sa do të kushtonte ekzekutimi juaj para se ta filloni

Secila nga pesë politikat liston nivelin e saj të GPU-së, kohën e ekzekutimit dhe çmimin për ekzekutim, dhe prapavija e trajnimit merr me qira kartën në të njëjtin treg spot ku u matën këta numra.

Kontrolloni çmimet

Ready for high-quality robotics data?

AY-Robots connects your robots to skilled operators worldwide.

Get Started