Tabuľka nákladov AY-Robots ukazujúca, aké GPU potrebuje každá z piatich politík, typický čas behu a cenu za beh, a koľko epizód je potrebných, kým je politika užitočná
tréning VLAnáklady na GPUSO-100jemné doladenierobotické učenierozpočtovanie

Náklady na tréning VLA: Koľko skutočne stojí jemné doladenie

AY-Robots ResearchAugust 23, 202623 min čítania

Skutočné ceny GPU na spotovom trhu, ako dlho beží každá z piatich politík, koľko stojí rameno a demonštrácie, a štyri miesta, kde peniaze potichu miznú.

Stručná verzia

  • Spustenie na úrovni A100 80 GB alebo H100 trvá 3 až 6 hodín a stojí približne 4 až 12 USD. Na úrovni RTX 4090 je to 2 až 5 hodín a približne 1 až 3 USD.
  • Merané na vast.ai o 13:44 UTC 23. augusta 2026: plná RTX 4090 na požiadanie za 0.13 až 0.38 USD/h, A100 80 GB za 0.44 až 0.67, H100 80 GB za 1.34 až 2.34. Plné 80 GB karty sú vzácne, s dvoma a piatimi ponukami pre jednu kartu.
  • GPU je najlacnejšia položka. Rozpis materiálu SO-ARM100 uvádza pár leader plus follower na 229.88 USD, čo predstavuje 77 až 230 spustení na úrovni 24 GB.
  • Dve hodiny nahrávania 50 epizód osobou stoja viac ako tréningové spustenie, ktoré tieto epizódy napájajú.
  • Peniaze miznú na štyroch miestach: spustenia na poškodených dátach, 3B modely na úlohách, ktoré zvládne 80M policy, GPU, ktoré nikto nezničil, a opakované spustenia výsledku, ktorý ste si neuchovali.
  • AY-Robots dimenzuje kartu podľa VRAM, ktorú model potrebuje, a prenajíma ju na rovnakom spotovom trhu, takže náklady na spustenie sú trhové náklady.

Účet má štyri položky a GPU je tá najmenšia

Keď sa ľudia pýtajú, koľko stojí doladenie vizuálno-jazykovo-akčného modelu pre SO-100, takmer vždy myslia prenájom GPU. To je číslo, ktoré sa zobrazí ako poplatok na karte, takže je to to, ktoré sa zdá byť skutočné. Je to tiež, s veľkým náskokom, najmenšie zo štyroch čísel, ktoré rozhodujú o tom, koľko vás skutočne stojí funkčná policy.

PoložkaČo to jeTypická veľkosť pre jednu funkčnú policy
Čas GPUprenájom karty na spustenie1 až 12 USD za spustenie, a urobíte 3 až 5
Robotservá, tlačený rám, kamery, káble, napájaniejednorazovo, 110 až 500 EUR za rameno
Ľudské hodinyosoba ovládajúca rameno na nahrávanie ukážok1 až 4 hodiny na dátovú sadu, opakované pre každú úlohu
Odpadzlé dáta, predimenzované modely, zabudnuté podyneobmedzené, a jediná položka, ktorú kontrolujete

Časy tréningu nižšie pochádzajú z vlastných prác a repozitárov piatich modelov, náklady na hardvér z publikovaného zoznamu materiálov, čísla platformy z AY-Robots katalógu politík a stránky s cenami. Tam, kde platforma nepomáha, tento článok to uvádza.

Koľko v skutočnosti stojí hodina GPU na spotovom trhu

Neexistuje jednotná cena za hodinu A100. Na trhovisku ako vast.ai si každý hostiteľ nastavuje vlastnú sadzbu a tréningové spustenie , ktoré spustíte, pristane na akomkoľvek stroji, ktorý je v danom okamihu lacný a voľný. Úprimná odpoveď je distribúcia. Tu je, merané 23. augusta 2026 o 13:44 UTC: jednotlivé plné karty, na požiadanie, filtrované podľa skutočnej VRAM.

Kartavast.ai na požiadanie USD/h (nízka / stredná / vysoká)Ponuky plných karietvast.ai minimálna ponukaRunPod Komunita / ZabezpečenéHugging Face
RTX 4090, 24 GB0.13 / 0.32 / 0.38240.110.34 / 0.74neponúkané
RTX 5090, 32 GB0.34 / 0.40 / 0.47290.190.69 / 0.99neponúkané
A100 80 GB, PCIe alebo SXM40.44 / 0.56 / 0.6720.131.19 PCIe, 1.39 SXM / 1.39, 1.592.50 ako priestor
H100 80 GB, SXM alebo PCIe1.34 / 1.80 / 2.3450.441.99 PCIe, 2.69 SXM / 2.89, 3.294.50 ako koncový bod
H100 NVL, 94 GB1.47 / 1.47 / 2.6440.402.59 / 3.19neponúkané
Ako bol tento snímok vytvorený a čo ním nie je

Ponuky na požiadanie pre jednu plnú GPU (gpu_frac == 1.0) z verejného balíka API vast.ai, ktoré nevyžaduje účet, filtrované podľa gpu_ram tak, aby sa do riadkov s 80 GB dostali len skutočné 80 GB karty. Tento filter je dôležitý: v tomto čítaní boli všetky tri ponuky jednej karty A100 SXM4 40 GB diely, rovnako ako dve zo štyroch ponúk A100 PCIE, takže ich zlúčenie do jedného riadku „A100“ by znížilo tu uvedenú cenu na polovicu. Stĺpec Hugging Face kombinuje dva produkty: 2.50 USD/h je hardvér Nvidia A100 - large Spaces a 4.50 USD/h je jedna H100 80 GB v rámci Inference Endpoints, ktoré Spaces neponúka. Mediány považujte za orientačné: riadok A100 80 GB je založený na dvoch ponukách a riadok H100 na piatich, a identický dotaz o 36 sekúnd neskôr vrátil iný počet 4090 a inú najvyššiu cenu v troch z piatich riadkov. Ceny RunPod sú stabilnejšie čísla, s ktorými treba počítať.

bash
# Live, full-card, single-GPU, on-demand offers from the vast.ai public bundle API.
# No account and no API key needed. gpu_ram is in MB, so an 80 GB card is >= 80000.
python3 - <<'PY'
import json, statistics, urllib.parse, urllib.request

def offers(name, min_ram):
    q = {"rentable": {"eq": True}, "num_gpus": {"eq": 1}, "gpu_name": {"eq": name},
         "order": [["dph_total", "asc"]], "limit": 500, "type": "on-demand"}
    url = "https://console.vast.ai/api/v0/bundles/?q=" + urllib.parse.quote(json.dumps(q))
    with urllib.request.urlopen(url, timeout=60) as r:
        return [o for o in json.load(r)["offers"]
                if o["gpu_frac"] == 1.0 and o["gpu_ram"] >= min_ram]

groups = {
    "RTX 4090 24 GB": (["RTX 4090"], 24000),
    "RTX 5090 32 GB": (["RTX 5090"], 30000),
    "A100 80 GB":     (["A100 PCIE", "A100 SXM4"], 80000),
    "H100 80 GB":     (["H100 SXM", "H100 PCIE"], 80000),
    "H100 NVL 94 GB": (["H100 NVL"], 90000),
}
for label, (names, min_ram) in groups.items():
    o = [x for n in names for x in offers(n, min_ram)]
    if not o:
        print(label, "no offers"); continue
    p = sorted(x["dph_total"] for x in o)
    b = sorted(x["min_bid"] for x in o if x.get("min_bid"))
    bid = f"{b[0]:.2f}" if b else "n/a"
    print(f'{label}: n={len(p)} | {p[0]:.2f} / {statistics.median(p):.2f} / {p[-1]:.2f}'
          f' USD/h | bid floor {bid}')
PY
Presný dotaz za vyššie uvedenou tabuľkou, spustený dvakrát počas písania tejto sekcie. Spustite ho predtým, než budete dôverovať akémukoľvek článku o cenách GPU, vrátane tohto.
Tabuľka nákladov AY-Robots zobrazujúca, ktorú GPU potrebuje každá politika, typický čas behu a cenu za beh, a koľko epizód je potrebných, kým je politika užitočná
Tabuľka nákladov na /try: karta, čas behu, cena za beh a minimálny počet epizód na politiku.

Prečo modely 3B nemôžu používať lacnú kartu

Hodina na 4090 a hodina na H100 80 GB sa líšia približne šesťnásobne pri vyššie uvedených mediánoch. To, čo vás núti použiť drahú kartu, nie je rýchlosť, ale pamäť. openpi stanovuje spodnú hranicu pre úplné jemné doladenie Pi0.5 na 70 GB a NVIDIA odporúča 40 GB alebo viac pre GR00T. Všimnite si, čo číslo GR00T neznamená. Jeho konfigurácia jemného doladenia predvolene zmrazuje jazykový model a vizuálny kódovač (tune_llm a tune_visual sú False, projektor a difúzna hlava True), preto katalóg uvádza približne 40 M trénovaných parametrov z 3 B. 40 GB nie je stav optimalizátora pre 3 B váhy, je to zmrazená chrbtica plus aktivácie. Varianty so zníženým rozsahom klesajú nižšie: cesta LoRA od openpi vyžaduje 22.5 GB a spomína 4090, a pracovný postup NVIDIA Isaac Lab Arena uvádza možnosť 24 GB s jednou GPU pre GR00T po tréningu. Platforma sa riadi minimálnymi požiadavkami, ktoré každý dodávateľ zverejňuje pre konfiguráciu, ktorú skutočne používa. Článok o pi0 flow-matching vysvetľuje, odkiaľ pochádza táto stopa flow-matching.

ÚlohaPamäť, ktorú vyžaduje upstream projektZdroj
pi0 / pi0.5 inferenciaviac ako 8 GB, napríklad RTX 4090openpi
pi0 / pi0.5 LoRA jemné doladenieviac ako 22.5 GB, napríklad RTX 4090openpi
pi0 / pi0.5 úplné jemné doladenieviac ako 70 GB, napríklad A100 80 GB alebo H100openpi
GR00T N1.7 inferencia1 GPU s 16 GB alebo viacIsaac-GR00T
GR00T N1.7 jemné doladenieodporúča sa 40 GB alebo viac, uzly H100 alebo L40Isaac-GR00T
GR00T jemné doladenie, čo trénujeprojektor a difúzna hlava; LLM a vizuálny kódovač predvolene zmrazenéfinetune_config.py
GR00T po tréningu, znížené1 GPU s 24 GB, jazykový model zmrazenýIsaac Lab Arena
SmolVLA jemné doladeniejedna A100 pre referenčný beh s 20 000 krokmilerobot docs
ACT tréningjedna 11 GB RTX 2080 TiACT paper

Táto tabuľka je dôvodom, prečo platforma rozdeľuje päť modelov do dvoch úrovní. GR00T N1.7, GR00T N1.5 a Pi0.5 bežia na A100 80 GB alebo H100, pretože to je to, čo dodávatelia požadujú. SmolVLA a ACT bežia na RTX 4090 alebo akejkoľvek 24 GB karte, pretože to je skutočne dosť.

Pasca, ktorá pohltí deň: prenájom lacnej karty pre veľký model

Beh GR00T alebo Pi0.5 na 24 GB karte nezlyhá v prvej sekunde. Stiahne základný checkpoint, vytvorí index dátovej sady, spustí prvý forward pass a po niekoľkých stovkách krokov zomrie s chybou CUDA out-of-memory. Zaplatili ste za stiahnutie a nastavenie a nedostali ste nič. Riešenia: nedostatok pamäte počas tréningu.

Ako dlho skutočne beží každý z piatich modelov

Doba behu je druhá polovica nákladov: 2.00 USD za hodinu je irelevantné, ak úloha trvá 40 minút, a zničujúce, ak trvá 40 hodín. Toto sú predvolené hodnoty, ktoré AY-Robots skutočne posiela trénerovi, spolu s časovým oknom behu a nákladmi pre každú úroveň.

PolitikaÚroveň GPUPredvolený max. počet krokovPredvolená dávka (grad accum)Časové okno behuCena za beh
GR00T N1.7, ~3BA100 80 GB or H10020,00032, accum 1, platí3 to 6 h4 to 12 USD
GR00T N1.5, ~3BA100 80 GB or H1002,0001, accum 16, platí3 to 6 h4 to 12 USD
Pi0.5, ~3BA100 80 GB or H10030,0001, accum 16, bez efektu3 to 6 h4 to 12 USD
SmolVLA, ~450MRTX 4090 or any 24 GB20,0002, accum 8, bez efektu2 to 5 h1 to 3 USD
ACT, ~80MRTX 4090 or any 24 GB100,0008, accum 12 to 5 h1 to 3 USD
Porovnávacia tabuľka piatich trénovateľných politík na AY-Robots zobrazujúca počet parametrov, požadované GPU, latenciu inferencie a minimálny počet epizód
Päť politík vedľa seba: parametre, úroveň GPU, latencia na akčný krok, minimálny počet epizód.

Odkiaľ pochádzajú tieto časové okná behu z upstreamu

  • SmolVLA: dokumentácia lerobot uvádza, že 20 000 krokov trvá približne 4 hodiny na jednej A100. Platforma spúšťa rovnakých 20 000 krokov na lacnejšej úrovni s 24 GB, preto ide o okno a nie o fixné 4 hodiny.
  • ACT: pôvodný článok ALOHA uvádza približne 5 hodín na jednej 11 GB RTX 2080 Ti pre model s 80M parametrami. Karta 4090 je o niekoľko generácií novšia, ale platforma rozpočtuje 100 000 krokov, takže časové okno sa nachádza na rovnakom mieste.
  • GR00T: referenčný pracovný postup NVIDIA pre generáciu N1.6 uvádza približne 4 až 8 hodín pre 20 000 krokov pri dávke 24 na ôsmich kartách L40S a 2 až 3 hodiny pre 30 000 krokov pri dávke 16 na jednej Ada 6000. Jemné doladenie 3B VLA na jednej karte za niekoľko hodín je normálne, nie optimistické.
  • Pi0.5: openpi nezverejňuje žiadne údaje o reálnom čase, ale zverejňuje minimálnu požiadavku 70 GB pre úplné jemné doladenie, čo určuje kartu a tým aj rýchlosť.

Stojí za to pozastaviť sa pri čísle, ktoré neplatíte. Článok GR00T N1 uvádza približne 50 000 H100 GPU hodín na predtrénovanie 2.2B modelu, na klastri až 1024 GPU, s veľkosťou dávky predtrénovania 16 384 pre 200 000 gradientných krokov. Pri cene 1.34 až 2.34 USD za hodinu, meranej vyššie, to predstavuje rádovo 67 000 až 117 000 USD za prenajatý výpočtový výkon. Článok SmolVLA odhaduje svoj projekt na približne 30 000 GPU hodín naprieč 481 komunitnými dátovými sadami, 22.9K epizódami a 10.6M snímkami. Všetko to zdedíte za cenu stiahnutia; vašich 8 USD kúpi posledných 20 000 krokov. Prečo sú VLA modely postavené týmto spôsobom pokrýva toto rozdelenie.

Rameno: jednorazový náklad, ktorý zatieňuje účet za GPU

Tréningový beh stojí menej ako obed. Robot nie. Preto je SO-100 dôležitý: je to najlacnejšie rameno, ktoré celá učenie napodobňovaním sada nástrojov skutočne podporuje.

RamenoServáNapätieCena dielovPodpora na AY-Robots
SO-100Feetech STS3215 bus servos7.4 V110 to 150 EURplné, referenčné rameno
SO-101Feetech STS32157.4 V130 to 170 EURplné
Koch v1.1Dynamixel XL330 / XL4305 V and 12 V rails250 to 350 EURkompatibilné
LeKiwiFeetech STS3215 arm, wheeled base7.4 V arm, 12 V base400 to 500 EURkompatibilné

Zoznam materiálov v repozitári SO-ARM100 je podrobnejší a oplatí sa ho skontrolovať vzhľadom na váš región: jeho Diely pre dve ramená zoznam celkovo predstavuje 229.88 USD alebo 226.30 EUR pre nastavenie s jedným lídrom a jedným nasledovníkom, a jeho Diely pre jedno rameno nasledovníka zoznam celkovo predstavuje 121.94 USD alebo 124.30 EUR. Šesť serv STS3215 po 13.89 USD za kus tvorí 83.34 z týchto 121.94, takže servá sú rameno. Pri cene 1 až 3 USD za beh SmolVLA alebo ACT má jeden pár ramien hodnotu medzi 77 a 230 tréningovými behmi. Ak si stále vyberáte, SO-100 proti SO-101 je porovnanie, na ktorom záleží, pretože tieto dva sú si dostatočne blízke, takže rozhodnutie je skôr o dostupnosti než o schopnostiach.

7.4 V, nie 12 V

STS3215 sa dodáva vo variante 7.4 V a 12 V; repozitár uvádza, že 12 V diel potrebuje aj 12 V 5 A napájanie namiesto 5 V, takže tieto dva nie sú zameniteľné. Napájanie 12 V do 7.4 V serv ich zničí, a šesť serv predstavuje dve tretiny nákladov na diely ramena nasledovníka. Skontrolujte štítok na každom serve pred prvým zapnutím. Ak sa servá už správajú zvláštne: servo nereaguje, rameno sa trhá a potom klesá.

Ľudské hodiny: riadok, ktorý nikto neuvádza v tabuľke

Toto je číslo, ktoré prevráti diskusiu o nákladoch naruby. Nahrávanie demonštrácií znamená, že človek pohybuje robotickým ramenom, jednu epizódu za druhou, v reálnom čase. Neexistuje žiadne dávkovanie ani prenájom na sekundu. dátová sada LeRobot nahrávač sa dodáva s predvolenými nastaveniami, ktoré uľahčujú výpočty, všetky tri potvrdené v DatasetRecordConfig: 60 sekúnd na epizódu, 60 sekúnd na resetovanie scény, 50 epizód. Stĺpec s peniazmi nižšie predpokladá 15 USD za hodinu času človeka, čo je skôr predpoklad ako číslo platformy. Nahraďte si vlastnú sadzbu; dôležitý je pomer.

  1. 1
    Nahrajte dátovú sadu s predvolenými nastaveniami, za ktoré vám budú skutočne účtované poplatky

    Toto je lerobot 0.6.1, verzia na PyPI k 3. augustu 2026. Všimnite si tvar CLI: nahrávanie prebieha cez vstupný bod konzoly lerobot-record (lerobot.scripts.lerobot_record), nie starú cestu modulu python -m lerobot.scripts.record. AY-Robots cieli na verziu 0.5.1 a wheel 0.5.1 deklaruje rovnaké vstupné body lerobot-record a lerobot-train, takže tvar nižšie je stabilný pre obe verzie. Tri časovacie príznaky sú predvolené nastavenia upstreamu, takže toto je aj príkaz, ktorý predpokladá aritmetika v nasledujúcej tabuľke.

    bash
    lerobot-record \
        --robot.type=so100_follower \
        --robot.port=/dev/ttyACM0 \
        --robot.id=my_follower_arm \
        --robot.cameras="{ front: {type: opencv, index_or_path: 0, width: 640, height: 480, fps: 30} }" \
        --teleop.type=so100_leader \
        --teleop.port=/dev/ttyACM1 \
        --teleop.id=my_leader_arm \
        --dataset.repo_id=${HF_USER}/pick-place-cube \
        --dataset.num_episodes=50 \
        --dataset.episode_time_s=60 \
        --dataset.reset_time_s=60 \
        --dataset.single_task="Grab the black cube and put it in the bin"
  2. 2
    Pozrite sa, čo ste nahrali, predtým než si prenajmete jedinú minútu GPU

    Kontrola dátovej sady stojí nula USD za hodinu. Objavovanie rovnakého problému z krivky straty stojí 2.00 USD za hodinu na úrovni H100 a dozviete sa o ňom o štyri hodiny neskôr. Nahrajte dátovú sadu a prejdite si ju v prehliadači LeRobot, alebo si prezrite adresár dátových sád AY-Robots.

    bash
    # the recorder pushes to the Hub by default; disable with --dataset.push_to_hub=False
    echo https://huggingface.co/datasets/${HF_USER}/pick-place-cube
    
    # then open https://huggingface.co/spaces/lerobot/visualize_dataset
    # and scrub through episodes: are both camera streams alive on every episode?
    # is the gripper actually closing? does the arm sit at a joint limit?
  3. 3
    Trénujte a uistite sa, že kontrolný bod prežije pod

    Prenajatý stroj je podľa definície dočasný, takže počas behu zapisujte kontrolné body niekam trvalým spôsobom. Dva príznaky rozhodujú o tom, či si ponecháte to, za čo ste zaplatili. --save_freq má predvolenú hodnotu 20 000 krokov, takže predvolený beh SmolVLA s 20 000 krokmi zapíše svoj prvý kontrolný bod, keď je beh už ukončený; znížte ho predtým, než si prenajmete čokoľvek prerušiteľné. --save_checkpoint_to_hub vyžaduje --policy.repo_id a neexistuje v lerobot 0.5.1, takže v tejto verzii si musíte skopírovať výstupný adresár zo stroja sami. Veľkosť dávky nižšie je príklad z dokumentácie upstreamu; formulár AY-Robots posiela 2 pre SmolVLA a zapisuje do objektového úložiska, keď sa objavia kontrolné body.

    bash
    lerobot-train \
        --policy.path=lerobot/smolvla_base \
        --dataset.repo_id=${HF_USER}/pick-place-cube \
        --batch_size=64 \
        --steps=20000 \
        --save_freq=2000 \
        --output_dir=outputs/train/my_smolvla \
        --job_name=my_smolvla_training \
        --policy.device=cuda \
        --policy.repo_id=${HF_USER}/my_smolvla \
        --save_checkpoint_to_hub=true
EpizódyNahrávanie pri 60 sResetovanie pri 60 sReálny časPlus 20 percent opätovných nahrávokPri 15 USD za ľudskú hodinu
30, minimum pre SmolVLA30 min30 min1 h 00 min1 h 12 minpribližne 18 USD
50, ostatné štyri minimá50 min50 min1 h 40 min2 h 00 minpribližne 30 USD
100, pohodlná dátová sada100 min100 min3 h 20 min4 h 00 minpribližne 60 USD

Porovnajte pravý stĺpec s nákladmi na spustenie v rozsahu 1 až 12 USD. Pri tejto predpokladanej sadzbe stojí nahrávanie dátovej sady s 50 epizódami dva až sedemkrát viac ako jej trénovanie, a to pred kalibráciou, nastavením kamery a epizódami, ktoré vyradíte. Preto má priamu peňažnú hodnotu. Sprievodca LeRobot navrhuje minimálne 50 epizód s 10 na každé umiestnenie objektu; dokumentácia SmolVLA uvádza, že 25-epizódová verzia rovnakej úlohy nebola dostatočná.

Kde sa peniaze skutočne strácajú

1. Spustenia na dátach, ktoré nikdy nemali fungovať

Spustenie GR00T s 20 000 krokmi na dátovej sade s dvoma prehodenými kamerovými streamami stojí rovnako ako na čistej dátovej sade, trvá rovnako dlho a produkuje krivku straty, ktorá vyzerá v poriadku. Zlyhanie sa prejaví na ramene o hodiny neskôr. sú účtované hodinovou sadzbou a diagnostika je účtovaná v dňoch. Dva príznaky, ktoré si stojí za to zapamätať: zvyčajne znamená, že pozorovania neobsahujú to, čo úloha potrebuje, a znamená, že dátová sada mala menej variácií, než ste si mysleli.

2. Platenie cien základných modelov za úlohu s pevnou kamerou

ACT má približne 80M parametrov a bol navrhnutý na trénovanie od nuly na 50 demonštráciách jednej úlohy. GR00T N1.7 má približne 3B s predtrénovanou chrbticou. Pre pevnú kameru, pevný stôl a jeden objekt sa 80M model často dostane k cieľu, beží približne 20 ms na akčný krok namiesto 152 ms a stojí 1 až 3 USD za spustenie namiesto 4 až 12. Minúť 3 USD na zistenie, či lacný model funguje, predtým ako miniete 12 USD na drahý. ACT proti SmolVLA a GR00T N1.7 proti Pi0.5 ukazujú, kde každý prestáva byť správnou odpoveďou; aréna modelov má 85 modelov a 332 výsledkov benchmarkov.

3. GPU, na ktoré ste zabudli

Najlacnejšia chyba, ktorej sa dá predísť, a najčastejšia, ktorú možno urobiť. Inštancia spustená v piatok na ladenie niečoho sa účtuje cez víkend rovnakou sadzbou ako skutočné spustenie.

KartaMediánna sadzba v snímkeNečinnosť 24 hNečinnosť 7 dníTo zodpovedá
RTX 40900.32 USD/h7.68 USD53.76 USDpribližne 27 spustení SmolVLA alebo ACT za 2 USD
A100 80 GB0.56 USD/h13.44 USD94.08 USDpribližne 12 spustení GR00T za 8 USD
H100 80 GB1.80 USD/h43.20 USD302.40 USDpribližne 38 spustení GR00T za 8 USD

Na AY-Robots je táto chyba pri inferencii eliminovaná: pody poskytované inferenčným API obsahujú strážneho psa nečinnosti a po období nečinnosti sa samy zničia. Ak si kartu prenajímate sami, tento strážny pes je vašou pripomienkou v kalendári.

4. Platenie dvakrát za rovnakú odpoveď

Vstupný bod pre jemné ladenie GR00T je tyro CLI, ktoré neexponuje žiadne seed. To nie je obmedzenie platformy, je to nástroj od dodávateľa: v gr00t/configs/finetune_config.py, a vlastné tréningové tipy repozitára varujú, že spustenia sa líšia o 5 až 6 percent, pretože augmentácie obrázkov sú nedeterministické. lerobot predvolene používa seed 1000 v oboch verziách 0.5.1 a 0.6.1, takže spustenia ACT, SmolVLA a Pi0.5 môžu byť aspoň znova spustené z rovnakej inicializácie a poradia dát. To nie je prísľub bitovo identických váh na GPU, ale je to rozdiel medzi opätovným spustením a novým experimentom. Ak spustenie GR00T vytvorí funkčnú politiku a vy ste si neuchovali kontrolný bod, zaplatíte plnú cenu za výsledok, ktorý sa môže líšiť viac, než bol rozdiel, ktorý ste hľadali. Existuje druhý spôsob, ako stratiť kontrolný bod, za ktorý ste zaplatili: CLI predvolene používa --save-total-limit 5, čo je zdokumentované ako maximálny počet uchovávaných kontrolných bodov pred odstránením starších. Úložisko stojí centy; opätovné spustenie je 4 až 12 USD a šesť hodín.

Prerušiteľná kapacita je za polovičnú cenu a ukončí váš beh

Vyššie uvedené minimálne ponuky sú zlomkom ceny na požiadanie a vast.ai uvádza, že systém ponúkania cien môže znížiť náklady klientov o päťdesiat percent alebo viac. Háček, podľa ich vlastných slov: prerušiteľná inštancia môže byť kedykoľvek pozastavená, ak iný používateľ ponúkne vyššiu cenu alebo ak sa vytvorí prenájom na požiadanie pre rovnaké zdroje, a toto pozastavenie „zastaví všetky bežiace procesy“. Na požiadanie má vždy prednosť. Je to v poriadku pre beh, ktorý zapisuje kontrolný bod každých pár stoviek krokov, ale úplná strata pre ten, ktorý zapisuje na konci, čo je presne to, čo vám poskytujú predvolené nastavenia: Isaac-GR00T CLI zapisuje každých --save-steps (predvolene 1000), ale --save_freq v lerobot má predvolenú hodnotu 20 000 krokov, takže predvolený beh SmolVLA vytvorí kontrolný bod iba raz, na konci. Znížte to, alebo neponúkajte. Tréningový formulár AY-Robots sprístupňuje nastavenie GR00T ako saveSteps.

Prenájom karty svojpomocne
Výhody
  • Najnižšia hodinová sadzba, aká existuje.
  • Plná kontrola nad obrazom, verziou CUDA, revíziou lerobot alebo Isaac-GR00T a každým príznakom.
  • Prerušiteľné ponúkanie znižuje sadzbu na polovicu, ak váš beh vytvára kontrolné body dostatočne často na to, aby prežil pozastavenie.
  • Nič nie je abstrahované, takže keď sa beh správa zvláštne, môžete vidieť prečo.
Kompromisy
  • Nastavenie sa účtuje sadzbami GPU: ovládače, závislosti, viacgigabajtový základný kontrolný bod a stiahnutie dátovej sady stoja za hodinu rovnako ako tréning.
  • Prekonaná prerušiteľná inštancia je pozastavená a jej procesy sú ukončené. Neuložený beh sú spálené peniaze a predvolené nastavenie lerobot zapisuje svoj prvý kontrolný bod v kroku 20 000.
  • Nič za vás nezničí pod. Vyššie uvedená tabuľka nečinnosti je účtom za zabudnutie.
  • Ponuka pre jednotlivé plné 80 GB karty je tenká: v tomto čítaní dve ponuky A100 80 GB a päť H100 80 GB plných kariet. Zoznam sa tiež mení, takže najlacnejšia uvedená cena a cena, za ktorú si môžete skutočne prenajať, nie sú rovnaké čísla.
  • Každá hodina strávená na infraštruktúre je hodina, ktorá nebola venovaná nahrávaniu epizód, ktoré rozhodujú o tom, či politika funguje.

Robíte to sami verzus necháte platformu prenajať kartu

Vyberiete si stroj, vytvoríte prostredie a zničíte pod. Hodinová sadzba je vyššie uvedená trhová sadzba; všetko ostatné je váš čas.

  1. Nájdite kartu zodpovedajúcu VRAM, ktorú model potrebuje: 24 GB pre ACT a SmolVLA, 80 GB pre GR00T a Pi0.5.
  2. Prenajmite si na požiadanie, ak beh nemôže prežiť pozastavenie, prerušiteľné, ak často vytvára kontrolné body.
  3. Nainštalujte nástroje: lerobot pre ACT, SmolVLA a Pi0.5, repozitár Isaac-GR00T s vlastným spúšťačom tyro pre GR00T.
  4. V prípade potreby konvertujte dátovú sadu. Dátová sada LeRobot v3.0 spôsobí pád GR00T loadera a musí byť konvertovaná na v2.1.
  5. Spustite, sledujte stratu, ukladajte kontrolné body na trvalé úložisko, keď sú zapisované.
  6. Zničte inštanciu a potom skontrolujte, či ste ju zničili.
bash
# GR00T N1.7, single GPU, Isaac-GR00T as of August 2026.
# Note the entry point: gr00t/experiment/launch_finetune.py, a tyro CLI.
# scripts/gr00t_finetune.py does not exist in this repository; tutorials that
# still reference it are stale. The per-embodiment walkthrough is
# getting_started/finetune_new_embodiment.md.
CUDA_VISIBLE_DEVICES=0 uv run python gr00t/experiment/launch_finetune.py \
    --base-model-path nvidia/GR00T-N1.7-3B \
    --dataset-path demo_data/cube_to_bowl_5 \
    --embodiment-tag NEW_EMBODIMENT \
    --modality-config-path examples/SO100/so100_config.py \
    --num-gpus 1 \
    --output-dir ./so100-checkpoints \
    --max-steps 20000 \
    --global-batch-size 32 \
    --dataloader-num-workers 4

# v3.0 dataset? Convert it down first or the loader will crash. The helper
# has its own pyproject and must be installed in its own environment:
cd scripts/lerobot_conversion
uv venv && source .venv/bin/activate
uv pip install -e .
python convert_v3_to_v2.py --repo-id <DATASET_REPO_ID>
Aktuálny vstupný bod pre jemné doladenie Isaac-GR00T, zodpovedajúci príkazu v README repozitára. Toto CLI nemá príznak seed, takže behy GR00T nie sú bitovo reprodukovateľné.

Realistické náklady na jeden beh GR00T: 3 až 6 hodín na H100 80 GB pri 1.34 až 2.34 USD za hodinu je 4 až 14 USD, plus 20 až 40 minút nastavenia, ktoré sa tiež účtuje, plus váš vlastný čas.

Čo platforma účtuje a ako vyberá kartu

Logika je zámerne nudná. Každý model v katalógu, deklaruje úroveň GPU; backend vezme požadovanú VRAM a prenajme zodpovedajúcu kartu na rovnakom spotovom trhu, ako je uvedené vyššie. Preto je uvedená cena rozsah, nie pevná cena. GR00T a Pi0.5 sú tu len pre cloud kvôli minimálnym požiadavkám 40 GB a 70 GB. SmolVLA a ACT bežia aj lokálne na vašej vlastnej 24 GB karte, kde sú náklady na cloud nulové a elektrina je váš problém.

Stránka s cenami AY-Robots zobrazujúca náklady na tréningové spustenie a prístup k platforme
Stránka s cenami. Údaje za spustenie sledujú spotový trh, nie pevnú cenníkovú cenu.

Jedno nastavenie si zaslúži upozornenie. Akumulácia gradientu sa skutočne vzťahuje na oba varianty GR00T, takže jej zvýšenie kúpi väčšiu efektívnu dávku na rovnakej karte. Pre Pi0.5 a SmolVLA sa vôbec neuplatňuje: lerobot 0.5.1 nemá vo svojej tréningovej konfigurácii možnosť akumulácie gradientu, takže nastavenie poľa na 16 nič nestojí a nič nekúpi. Ak sa úloha vo fronte nikdy nespustí, stránka o úlohách zaseknutých vo fronte, pokrýva, čo skontrolovať; ak je dátový súbor odmietnutý pred spustením, je to takmer vždy problém s formátom v3.0.

Limit, ktorý táto platforma nerieši: latencia

Prenajatá GPU obsluhujúca vašu politiku cez verejný internet pridáva oneskorenia do riadiacej slučky, ktorá už má 20 až 485 ms na krok akcie. Vhodné pre pomalé pick-and-place, nie pre rýchly reaktívny pohyb. Cloudová inferencia dobre vyhodnocuje kontrolný bod, ale zle vykonáva produkčnú manipuláciu: ak úloha vyžaduje rýchlosť, výpočty musia byť umiestnené vedľa servomotorov, a to sú náklady, ktoré tento článok nemôže odstrániť. Pozri latencia inferencie.

Vypracovaný rozpočet pre prvú funkčnú politiku

Všetky štyri riadky spolu, začínajúc od nuly. Celková suma za GPU predpokladá 3 až 5 spustení: prvé preukáže funkčnosť pipeline, druhé odhalí problém s dátami, tretie alebo štvrté je to, ktoré si ponecháte.

PoložkaŠetrná cestaKomfortná cesta
RamenoLen SO-100 follower, 121.94 USD v BOMleader plus follower, 229.88 USD v BOM
ModelSmolVLA alebo ACT, 24 GB úroveňGR00T N1.7, A100 80 GB alebo H100 úroveň
Nahrávané epizódy30, minimum pre SmolVLA50 až 100
Čas človeka na nahrávaniepribližne 1 h 12 min2 až 4 hodiny
Náklady na jedno spustenie1 až 3 USD4 až 12 USD
Spustenia pred funkčnosťou3 až 53 až 5
Celkové výdavky za GPU3 až 15 USD12 až 60 USD
Najväčšia položka na účterameno, potom váš časrameno, potom váš čas

Tento vzor platí aj pre túto veľkosť robota: výpočty sú zaokrúhľovacia chyba, hardvér je skutočný jednorazový náklad, ľudské hodiny sú opakujúce sa výdavky. Ak chcete otestovať tréningovú časť pred kúpou čohokoľvek, vstupné body bez hardvéru vám umožnia porovnať modely a prenajať si GPU bez ramena, a živé rameno je fyzický SO-100, ktorý môžete ovládať v prehliadači bez registrácie. Pre celý end-to-end pipeline, kompletný sprievodca SO-100 pokrýva nastavenie, teleoperáciu a tréning, a natrénujte svoju prvú politiku je krátka verzia.

The AY-Robots training matrix with five policies as rows and four robot arms as columns, every cell linking to a specific training guide
Matica /train: riadok pre váš rozpočet, stĺpec pre vaše rameno, bunka pre sprievodcu s predvolenými nastaveniami a nákladmi pre danú kombináciu.
Koľko stojí jeden end-to-end beh jemného ladenia VLA?

Približne 4 až 12 USD pre GR00T N1.7, GR00T N1.5 alebo Pi0.5 na úrovni A100 80 GB alebo H100 (3 až 6 hodín pri 1.20 až 2.00 USD za hodinu) a približne 1 až 3 USD pre SmolVLA alebo ACT na úrovni RTX 4090 (2 až 5 hodín pri 0.30 až 0.60 USD za hodinu). Prenájom karty samostatne sa pohybuje v rovnakom rozsahu, akonáhle sa započíta čas nastavenia, pretože sa účtuje podľa tréningovej sadzby.

Oplatí sa platiť za H100 namiesto A100 80 GB?

Pre jednu politiku SO-100 zvyčajne nie. Obe spĺňajú minimálne požiadavky na pamäť, ktoré GR00T a Pi0.5 potrebujú, a k 23. augustu 2026 sa plná A100 80 GB začínala na 0.44 USD za hodinu oproti 1.34 USD za H100 80 GB. H100 dokončí prácu skôr, takže časť sadzby sa vráti v podobe menšieho počtu hodín, ale celková suma je pre takýto malý beh stále vyššia. Skutočným argumentom pre H100 je dostupnosť: päť ponúk na jednu H100 80 GB na tomto trhu oproti dvom A100 80 GB, a karta, ktorú si nemôžete prenajať, nemá žiadnu cenu.

Koľko behov je potrebných, kým politika skutočne funguje?

Plánujte tri až päť. Prvý preukáže, že pipeline je správne zapojený. Druhý bežne odhalí problém s dátovou sadou, napríklad stream z kamery, ktorý sa v polovici prerušil. Tretí alebo štvrtý je ten, ktorý si ponecháte.

Môžem trénovať SmolVLA alebo ACT na vlastnom GPU namiesto prenájmu?

Áno. Obe sú lokálne podporované na AY-Robots a obe sa pohodlne zmestia do 24 GB; pôvodný článok o ACT trénoval svoj 80M model za približne 5 hodín na 11 GB RTX 2080 Ti. GR00T a Pi0.5 sú tu len pre cloud, pretože dokumentované minimálne požiadavky dodávateľov na jemné ladenie sú 40 GB a 70 GB, a najväčšia spotrebiteľská karta na trhu je 32 GB RTX 5090.

Prečo rovnaký počet krokov stojí rôzne sumy naprieč modelmi?

Kroky nie sú porovnateľné naprieč politikami. ACT predvolene používa 100,000 krokov pri dávke 8 na 24 GB karte; GR00T N1.5 predvolene používa 2,000 krokov pri dávke 1 s akumuláciou gradientu 16 na 80 GB karte. Účet je hodiny vynásobené sadzbou karty, na ktorú vás núti pamäťová stopa, nie počítadlo krokov.

Zistite, koľko by stál váš beh, predtým než ho spustíte

Každá z piatich politík uvádza svoju úroveň GPU, čas behu a cenu za beh, a tréningový backend si prenajíma kartu na rovnakom spotovom trhu, na ktorom boli tieto čísla merané.

Skontrolovať ceny

Ready for high-quality robotics data?

AY-Robots connects your robots to skilled operators worldwide.

Get Started