
Skutočné ceny GPU na spotovom trhu, ako dlho beží každá z piatich politík, koľko stojí rameno a demonštrácie, a štyri miesta, kde peniaze potichu miznú.
Stručná verzia
- •Spustenie na úrovni A100 80 GB alebo H100 trvá 3 až 6 hodín a stojí približne 4 až 12 USD. Na úrovni RTX 4090 je to 2 až 5 hodín a približne 1 až 3 USD.
- •Merané na vast.ai o 13:44 UTC 23. augusta 2026: plná RTX 4090 na požiadanie za 0.13 až 0.38 USD/h, A100 80 GB za 0.44 až 0.67, H100 80 GB za 1.34 až 2.34. Plné 80 GB karty sú vzácne, s dvoma a piatimi ponukami pre jednu kartu.
- •GPU je najlacnejšia položka. Rozpis materiálu SO-ARM100 uvádza pár leader plus follower na 229.88 USD, čo predstavuje 77 až 230 spustení na úrovni 24 GB.
- •Dve hodiny nahrávania 50 epizód osobou stoja viac ako tréningové spustenie, ktoré tieto epizódy napájajú.
- •Peniaze miznú na štyroch miestach: spustenia na poškodených dátach, 3B modely na úlohách, ktoré zvládne 80M policy, GPU, ktoré nikto nezničil, a opakované spustenia výsledku, ktorý ste si neuchovali.
- •AY-Robots dimenzuje kartu podľa VRAM, ktorú model potrebuje, a prenajíma ju na rovnakom spotovom trhu, takže náklady na spustenie sú trhové náklady.
Účet má štyri položky a GPU je tá najmenšia
Keď sa ľudia pýtajú, koľko stojí doladenie vizuálno-jazykovo-akčného modelu pre SO-100, takmer vždy myslia prenájom GPU. To je číslo, ktoré sa zobrazí ako poplatok na karte, takže je to to, ktoré sa zdá byť skutočné. Je to tiež, s veľkým náskokom, najmenšie zo štyroch čísel, ktoré rozhodujú o tom, koľko vás skutočne stojí funkčná policy.
| Položka | Čo to je | Typická veľkosť pre jednu funkčnú policy |
|---|---|---|
| Čas GPU | prenájom karty na spustenie | 1 až 12 USD za spustenie, a urobíte 3 až 5 |
| Robot | servá, tlačený rám, kamery, káble, napájanie | jednorazovo, 110 až 500 EUR za rameno |
| Ľudské hodiny | osoba ovládajúca rameno na nahrávanie ukážok | 1 až 4 hodiny na dátovú sadu, opakované pre každú úlohu |
| Odpad | zlé dáta, predimenzované modely, zabudnuté pody | neobmedzené, a jediná položka, ktorú kontrolujete |
Časy tréningu nižšie pochádzajú z vlastných prác a repozitárov piatich modelov, náklady na hardvér z publikovaného zoznamu materiálov, čísla platformy z AY-Robots katalógu politík a stránky s cenami. Tam, kde platforma nepomáha, tento článok to uvádza.
Koľko v skutočnosti stojí hodina GPU na spotovom trhu
Neexistuje jednotná cena za hodinu A100. Na trhovisku ako vast.ai si každý hostiteľ nastavuje vlastnú sadzbu a tréningové spustenie , ktoré spustíte, pristane na akomkoľvek stroji, ktorý je v danom okamihu lacný a voľný. Úprimná odpoveď je distribúcia. Tu je, merané 23. augusta 2026 o 13:44 UTC: jednotlivé plné karty, na požiadanie, filtrované podľa skutočnej VRAM.
| Karta | vast.ai na požiadanie USD/h (nízka / stredná / vysoká) | Ponuky plných kariet | vast.ai minimálna ponuka | RunPod Komunita / Zabezpečené | Hugging Face |
|---|---|---|---|---|---|
| RTX 4090, 24 GB | 0.13 / 0.32 / 0.38 | 24 | 0.11 | 0.34 / 0.74 | neponúkané |
| RTX 5090, 32 GB | 0.34 / 0.40 / 0.47 | 29 | 0.19 | 0.69 / 0.99 | neponúkané |
| A100 80 GB, PCIe alebo SXM4 | 0.44 / 0.56 / 0.67 | 2 | 0.13 | 1.19 PCIe, 1.39 SXM / 1.39, 1.59 | 2.50 ako priestor |
| H100 80 GB, SXM alebo PCIe | 1.34 / 1.80 / 2.34 | 5 | 0.44 | 1.99 PCIe, 2.69 SXM / 2.89, 3.29 | 4.50 ako koncový bod |
| H100 NVL, 94 GB | 1.47 / 1.47 / 2.64 | 4 | 0.40 | 2.59 / 3.19 | neponúkané |
Ponuky na požiadanie pre jednu plnú GPU (gpu_frac == 1.0) z verejného balíka API vast.ai, ktoré nevyžaduje účet, filtrované podľa gpu_ram tak, aby sa do riadkov s 80 GB dostali len skutočné 80 GB karty. Tento filter je dôležitý: v tomto čítaní boli všetky tri ponuky jednej karty A100 SXM4 40 GB diely, rovnako ako dve zo štyroch ponúk A100 PCIE, takže ich zlúčenie do jedného riadku „A100“ by znížilo tu uvedenú cenu na polovicu. Stĺpec Hugging Face kombinuje dva produkty: 2.50 USD/h je hardvér Nvidia A100 - large Spaces a 4.50 USD/h je jedna H100 80 GB v rámci Inference Endpoints, ktoré Spaces neponúka. Mediány považujte za orientačné: riadok A100 80 GB je založený na dvoch ponukách a riadok H100 na piatich, a identický dotaz o 36 sekúnd neskôr vrátil iný počet 4090 a inú najvyššiu cenu v troch z piatich riadkov. Ceny RunPod sú stabilnejšie čísla, s ktorými treba počítať.
# Live, full-card, single-GPU, on-demand offers from the vast.ai public bundle API.
# No account and no API key needed. gpu_ram is in MB, so an 80 GB card is >= 80000.
python3 - <<'PY'
import json, statistics, urllib.parse, urllib.request
def offers(name, min_ram):
q = {"rentable": {"eq": True}, "num_gpus": {"eq": 1}, "gpu_name": {"eq": name},
"order": [["dph_total", "asc"]], "limit": 500, "type": "on-demand"}
url = "https://console.vast.ai/api/v0/bundles/?q=" + urllib.parse.quote(json.dumps(q))
with urllib.request.urlopen(url, timeout=60) as r:
return [o for o in json.load(r)["offers"]
if o["gpu_frac"] == 1.0 and o["gpu_ram"] >= min_ram]
groups = {
"RTX 4090 24 GB": (["RTX 4090"], 24000),
"RTX 5090 32 GB": (["RTX 5090"], 30000),
"A100 80 GB": (["A100 PCIE", "A100 SXM4"], 80000),
"H100 80 GB": (["H100 SXM", "H100 PCIE"], 80000),
"H100 NVL 94 GB": (["H100 NVL"], 90000),
}
for label, (names, min_ram) in groups.items():
o = [x for n in names for x in offers(n, min_ram)]
if not o:
print(label, "no offers"); continue
p = sorted(x["dph_total"] for x in o)
b = sorted(x["min_bid"] for x in o if x.get("min_bid"))
bid = f"{b[0]:.2f}" if b else "n/a"
print(f'{label}: n={len(p)} | {p[0]:.2f} / {statistics.median(p):.2f} / {p[-1]:.2f}'
f' USD/h | bid floor {bid}')
PY
Prečo modely 3B nemôžu používať lacnú kartu
Hodina na 4090 a hodina na H100 80 GB sa líšia približne šesťnásobne pri vyššie uvedených mediánoch. To, čo vás núti použiť drahú kartu, nie je rýchlosť, ale pamäť. openpi stanovuje spodnú hranicu pre úplné jemné doladenie Pi0.5 na 70 GB a NVIDIA odporúča 40 GB alebo viac pre GR00T. Všimnite si, čo číslo GR00T neznamená. Jeho konfigurácia jemného doladenia predvolene zmrazuje jazykový model a vizuálny kódovač (tune_llm a tune_visual sú False, projektor a difúzna hlava True), preto katalóg uvádza približne 40 M trénovaných parametrov z 3 B. 40 GB nie je stav optimalizátora pre 3 B váhy, je to zmrazená chrbtica plus aktivácie. Varianty so zníženým rozsahom klesajú nižšie: cesta LoRA od openpi vyžaduje 22.5 GB a spomína 4090, a pracovný postup NVIDIA Isaac Lab Arena uvádza možnosť 24 GB s jednou GPU pre GR00T po tréningu. Platforma sa riadi minimálnymi požiadavkami, ktoré každý dodávateľ zverejňuje pre konfiguráciu, ktorú skutočne používa. Článok o pi0 flow-matching vysvetľuje, odkiaľ pochádza táto stopa flow-matching.
| Úloha | Pamäť, ktorú vyžaduje upstream projekt | Zdroj |
|---|---|---|
| pi0 / pi0.5 inferencia | viac ako 8 GB, napríklad RTX 4090 | openpi |
| pi0 / pi0.5 LoRA jemné doladenie | viac ako 22.5 GB, napríklad RTX 4090 | openpi |
| pi0 / pi0.5 úplné jemné doladenie | viac ako 70 GB, napríklad A100 80 GB alebo H100 | openpi |
| GR00T N1.7 inferencia | 1 GPU s 16 GB alebo viac | Isaac-GR00T |
| GR00T N1.7 jemné doladenie | odporúča sa 40 GB alebo viac, uzly H100 alebo L40 | Isaac-GR00T |
| GR00T jemné doladenie, čo trénuje | projektor a difúzna hlava; LLM a vizuálny kódovač predvolene zmrazené | finetune_config.py |
| GR00T po tréningu, znížené | 1 GPU s 24 GB, jazykový model zmrazený | Isaac Lab Arena |
| SmolVLA jemné doladenie | jedna A100 pre referenčný beh s 20 000 krokmi | lerobot docs |
| ACT tréning | jedna 11 GB RTX 2080 Ti | ACT paper |
Táto tabuľka je dôvodom, prečo platforma rozdeľuje päť modelov do dvoch úrovní. GR00T N1.7, GR00T N1.5 a Pi0.5 bežia na A100 80 GB alebo H100, pretože to je to, čo dodávatelia požadujú. SmolVLA a ACT bežia na RTX 4090 alebo akejkoľvek 24 GB karte, pretože to je skutočne dosť.
Beh GR00T alebo Pi0.5 na 24 GB karte nezlyhá v prvej sekunde. Stiahne základný checkpoint, vytvorí index dátovej sady, spustí prvý forward pass a po niekoľkých stovkách krokov zomrie s chybou CUDA out-of-memory. Zaplatili ste za stiahnutie a nastavenie a nedostali ste nič. Riešenia: nedostatok pamäte počas tréningu.
Ako dlho skutočne beží každý z piatich modelov
Doba behu je druhá polovica nákladov: 2.00 USD za hodinu je irelevantné, ak úloha trvá 40 minút, a zničujúce, ak trvá 40 hodín. Toto sú predvolené hodnoty, ktoré AY-Robots skutočne posiela trénerovi, spolu s časovým oknom behu a nákladmi pre každú úroveň.
| Politika | Úroveň GPU | Predvolený max. počet krokov | Predvolená dávka (grad accum) | Časové okno behu | Cena za beh |
|---|---|---|---|---|---|
| GR00T N1.7, ~3B | A100 80 GB or H100 | 20,000 | 32, accum 1, platí | 3 to 6 h | 4 to 12 USD |
| GR00T N1.5, ~3B | A100 80 GB or H100 | 2,000 | 1, accum 16, platí | 3 to 6 h | 4 to 12 USD |
| Pi0.5, ~3B | A100 80 GB or H100 | 30,000 | 1, accum 16, bez efektu | 3 to 6 h | 4 to 12 USD |
| SmolVLA, ~450M | RTX 4090 or any 24 GB | 20,000 | 2, accum 8, bez efektu | 2 to 5 h | 1 to 3 USD |
| ACT, ~80M | RTX 4090 or any 24 GB | 100,000 | 8, accum 1 | 2 to 5 h | 1 to 3 USD |

Odkiaľ pochádzajú tieto časové okná behu z upstreamu
- SmolVLA: dokumentácia lerobot uvádza, že 20 000 krokov trvá približne 4 hodiny na jednej A100. Platforma spúšťa rovnakých 20 000 krokov na lacnejšej úrovni s 24 GB, preto ide o okno a nie o fixné 4 hodiny.
- ACT: pôvodný článok ALOHA uvádza približne 5 hodín na jednej 11 GB RTX 2080 Ti pre model s 80M parametrami. Karta 4090 je o niekoľko generácií novšia, ale platforma rozpočtuje 100 000 krokov, takže časové okno sa nachádza na rovnakom mieste.
- GR00T: referenčný pracovný postup NVIDIA pre generáciu N1.6 uvádza približne 4 až 8 hodín pre 20 000 krokov pri dávke 24 na ôsmich kartách L40S a 2 až 3 hodiny pre 30 000 krokov pri dávke 16 na jednej Ada 6000. Jemné doladenie 3B VLA na jednej karte za niekoľko hodín je normálne, nie optimistické.
- Pi0.5: openpi nezverejňuje žiadne údaje o reálnom čase, ale zverejňuje minimálnu požiadavku 70 GB pre úplné jemné doladenie, čo určuje kartu a tým aj rýchlosť.
Stojí za to pozastaviť sa pri čísle, ktoré neplatíte. Článok GR00T N1 uvádza približne 50 000 H100 GPU hodín na predtrénovanie 2.2B modelu, na klastri až 1024 GPU, s veľkosťou dávky predtrénovania 16 384 pre 200 000 gradientných krokov. Pri cene 1.34 až 2.34 USD za hodinu, meranej vyššie, to predstavuje rádovo 67 000 až 117 000 USD za prenajatý výpočtový výkon. Článok SmolVLA odhaduje svoj projekt na približne 30 000 GPU hodín naprieč 481 komunitnými dátovými sadami, 22.9K epizódami a 10.6M snímkami. Všetko to zdedíte za cenu stiahnutia; vašich 8 USD kúpi posledných 20 000 krokov. Prečo sú VLA modely postavené týmto spôsobom pokrýva toto rozdelenie.
Rameno: jednorazový náklad, ktorý zatieňuje účet za GPU
Tréningový beh stojí menej ako obed. Robot nie. Preto je SO-100 dôležitý: je to najlacnejšie rameno, ktoré celá učenie napodobňovaním sada nástrojov skutočne podporuje.
| Rameno | Servá | Napätie | Cena dielov | Podpora na AY-Robots |
|---|---|---|---|---|
| SO-100 | Feetech STS3215 bus servos | 7.4 V | 110 to 150 EUR | plné, referenčné rameno |
| SO-101 | Feetech STS3215 | 7.4 V | 130 to 170 EUR | plné |
| Koch v1.1 | Dynamixel XL330 / XL430 | 5 V and 12 V rails | 250 to 350 EUR | kompatibilné |
| LeKiwi | Feetech STS3215 arm, wheeled base | 7.4 V arm, 12 V base | 400 to 500 EUR | kompatibilné |
Zoznam materiálov v repozitári SO-ARM100 je podrobnejší a oplatí sa ho skontrolovať vzhľadom na váš región: jeho Diely pre dve ramená zoznam celkovo predstavuje 229.88 USD alebo 226.30 EUR pre nastavenie s jedným lídrom a jedným nasledovníkom, a jeho Diely pre jedno rameno nasledovníka zoznam celkovo predstavuje 121.94 USD alebo 124.30 EUR. Šesť serv STS3215 po 13.89 USD za kus tvorí 83.34 z týchto 121.94, takže servá sú rameno. Pri cene 1 až 3 USD za beh SmolVLA alebo ACT má jeden pár ramien hodnotu medzi 77 a 230 tréningovými behmi. Ak si stále vyberáte, SO-100 proti SO-101 je porovnanie, na ktorom záleží, pretože tieto dva sú si dostatočne blízke, takže rozhodnutie je skôr o dostupnosti než o schopnostiach.
STS3215 sa dodáva vo variante 7.4 V a 12 V; repozitár uvádza, že 12 V diel potrebuje aj 12 V 5 A napájanie namiesto 5 V, takže tieto dva nie sú zameniteľné. Napájanie 12 V do 7.4 V serv ich zničí, a šesť serv predstavuje dve tretiny nákladov na diely ramena nasledovníka. Skontrolujte štítok na každom serve pred prvým zapnutím. Ak sa servá už správajú zvláštne: servo nereaguje, rameno sa trhá a potom klesá.
Ľudské hodiny: riadok, ktorý nikto neuvádza v tabuľke
Toto je číslo, ktoré prevráti diskusiu o nákladoch naruby. Nahrávanie demonštrácií znamená, že človek pohybuje robotickým ramenom, jednu epizódu za druhou, v reálnom čase. Neexistuje žiadne dávkovanie ani prenájom na sekundu. dátová sada LeRobot nahrávač sa dodáva s predvolenými nastaveniami, ktoré uľahčujú výpočty, všetky tri potvrdené v DatasetRecordConfig: 60 sekúnd na epizódu, 60 sekúnd na resetovanie scény, 50 epizód. Stĺpec s peniazmi nižšie predpokladá 15 USD za hodinu času človeka, čo je skôr predpoklad ako číslo platformy. Nahraďte si vlastnú sadzbu; dôležitý je pomer.
- 1Nahrajte dátovú sadu s predvolenými nastaveniami, za ktoré vám budú skutočne účtované poplatky
Toto je lerobot 0.6.1, verzia na PyPI k 3. augustu 2026. Všimnite si tvar CLI: nahrávanie prebieha cez vstupný bod konzoly
lerobot-record(lerobot.scripts.lerobot_record), nie starú cestu modulupython -m lerobot.scripts.record. AY-Robots cieli na verziu 0.5.1 a wheel 0.5.1 deklaruje rovnaké vstupné bodylerobot-recordalerobot-train, takže tvar nižšie je stabilný pre obe verzie. Tri časovacie príznaky sú predvolené nastavenia upstreamu, takže toto je aj príkaz, ktorý predpokladá aritmetika v nasledujúcej tabuľke.bashlerobot-record \ --robot.type=so100_follower \ --robot.port=/dev/ttyACM0 \ --robot.id=my_follower_arm \ --robot.cameras="{ front: {type: opencv, index_or_path: 0, width: 640, height: 480, fps: 30} }" \ --teleop.type=so100_leader \ --teleop.port=/dev/ttyACM1 \ --teleop.id=my_leader_arm \ --dataset.repo_id=${HF_USER}/pick-place-cube \ --dataset.num_episodes=50 \ --dataset.episode_time_s=60 \ --dataset.reset_time_s=60 \ --dataset.single_task="Grab the black cube and put it in the bin" - 2Pozrite sa, čo ste nahrali, predtým než si prenajmete jedinú minútu GPU
Kontrola dátovej sady stojí nula USD za hodinu. Objavovanie rovnakého problému z krivky straty stojí 2.00 USD za hodinu na úrovni H100 a dozviete sa o ňom o štyri hodiny neskôr. Nahrajte dátovú sadu a prejdite si ju v prehliadači LeRobot, alebo si prezrite adresár dátových sád AY-Robots.
bash# the recorder pushes to the Hub by default; disable with --dataset.push_to_hub=False echo https://huggingface.co/datasets/${HF_USER}/pick-place-cube # then open https://huggingface.co/spaces/lerobot/visualize_dataset # and scrub through episodes: are both camera streams alive on every episode? # is the gripper actually closing? does the arm sit at a joint limit? - 3Trénujte a uistite sa, že kontrolný bod prežije pod
Prenajatý stroj je podľa definície dočasný, takže počas behu zapisujte kontrolné body niekam trvalým spôsobom. Dva príznaky rozhodujú o tom, či si ponecháte to, za čo ste zaplatili.
--save_freqmá predvolenú hodnotu 20 000 krokov, takže predvolený beh SmolVLA s 20 000 krokmi zapíše svoj prvý kontrolný bod, keď je beh už ukončený; znížte ho predtým, než si prenajmete čokoľvek prerušiteľné.--save_checkpoint_to_hubvyžaduje--policy.repo_ida neexistuje v lerobot 0.5.1, takže v tejto verzii si musíte skopírovať výstupný adresár zo stroja sami. Veľkosť dávky nižšie je príklad z dokumentácie upstreamu; formulár AY-Robots posiela 2 pre SmolVLA a zapisuje do objektového úložiska, keď sa objavia kontrolné body.bashlerobot-train \ --policy.path=lerobot/smolvla_base \ --dataset.repo_id=${HF_USER}/pick-place-cube \ --batch_size=64 \ --steps=20000 \ --save_freq=2000 \ --output_dir=outputs/train/my_smolvla \ --job_name=my_smolvla_training \ --policy.device=cuda \ --policy.repo_id=${HF_USER}/my_smolvla \ --save_checkpoint_to_hub=true
| Epizódy | Nahrávanie pri 60 s | Resetovanie pri 60 s | Reálny čas | Plus 20 percent opätovných nahrávok | Pri 15 USD za ľudskú hodinu |
|---|---|---|---|---|---|
| 30, minimum pre SmolVLA | 30 min | 30 min | 1 h 00 min | 1 h 12 min | približne 18 USD |
| 50, ostatné štyri minimá | 50 min | 50 min | 1 h 40 min | 2 h 00 min | približne 30 USD |
| 100, pohodlná dátová sada | 100 min | 100 min | 3 h 20 min | 4 h 00 min | približne 60 USD |
Porovnajte pravý stĺpec s nákladmi na spustenie v rozsahu 1 až 12 USD. Pri tejto predpokladanej sadzbe stojí nahrávanie dátovej sady s 50 epizódami dva až sedemkrát viac ako jej trénovanie, a to pred kalibráciou, nastavením kamery a epizódami, ktoré vyradíte. Preto má priamu peňažnú hodnotu. Sprievodca LeRobot navrhuje minimálne 50 epizód s 10 na každé umiestnenie objektu; dokumentácia SmolVLA uvádza, že 25-epizódová verzia rovnakej úlohy nebola dostatočná.
Kde sa peniaze skutočne strácajú
1. Spustenia na dátach, ktoré nikdy nemali fungovať
Spustenie GR00T s 20 000 krokmi na dátovej sade s dvoma prehodenými kamerovými streamami stojí rovnako ako na čistej dátovej sade, trvá rovnako dlho a produkuje krivku straty, ktorá vyzerá v poriadku. Zlyhanie sa prejaví na ramene o hodiny neskôr. sú účtované hodinovou sadzbou a diagnostika je účtovaná v dňoch. Dva príznaky, ktoré si stojí za to zapamätať: zvyčajne znamená, že pozorovania neobsahujú to, čo úloha potrebuje, a znamená, že dátová sada mala menej variácií, než ste si mysleli.
2. Platenie cien základných modelov za úlohu s pevnou kamerou
ACT má približne 80M parametrov a bol navrhnutý na trénovanie od nuly na 50 demonštráciách jednej úlohy. GR00T N1.7 má približne 3B s predtrénovanou chrbticou. Pre pevnú kameru, pevný stôl a jeden objekt sa 80M model často dostane k cieľu, beží približne 20 ms na akčný krok namiesto 152 ms a stojí 1 až 3 USD za spustenie namiesto 4 až 12. Minúť 3 USD na zistenie, či lacný model funguje, predtým ako miniete 12 USD na drahý. ACT proti SmolVLA a GR00T N1.7 proti Pi0.5 ukazujú, kde každý prestáva byť správnou odpoveďou; aréna modelov má 85 modelov a 332 výsledkov benchmarkov.
3. GPU, na ktoré ste zabudli
Najlacnejšia chyba, ktorej sa dá predísť, a najčastejšia, ktorú možno urobiť. Inštancia spustená v piatok na ladenie niečoho sa účtuje cez víkend rovnakou sadzbou ako skutočné spustenie.
| Karta | Mediánna sadzba v snímke | Nečinnosť 24 h | Nečinnosť 7 dní | To zodpovedá |
|---|---|---|---|---|
| RTX 4090 | 0.32 USD/h | 7.68 USD | 53.76 USD | približne 27 spustení SmolVLA alebo ACT za 2 USD |
| A100 80 GB | 0.56 USD/h | 13.44 USD | 94.08 USD | približne 12 spustení GR00T za 8 USD |
| H100 80 GB | 1.80 USD/h | 43.20 USD | 302.40 USD | približne 38 spustení GR00T za 8 USD |
Na AY-Robots je táto chyba pri inferencii eliminovaná: pody poskytované inferenčným API obsahujú strážneho psa nečinnosti a po období nečinnosti sa samy zničia. Ak si kartu prenajímate sami, tento strážny pes je vašou pripomienkou v kalendári.
4. Platenie dvakrát za rovnakú odpoveď
Vstupný bod pre jemné ladenie GR00T je tyro CLI, ktoré neexponuje žiadne seed. To nie je obmedzenie platformy, je to nástroj od dodávateľa: v gr00t/configs/finetune_config.py, a vlastné tréningové tipy repozitára varujú, že spustenia sa líšia o 5 až 6 percent, pretože augmentácie obrázkov sú nedeterministické. lerobot predvolene používa seed 1000 v oboch verziách 0.5.1 a 0.6.1, takže spustenia ACT, SmolVLA a Pi0.5 môžu byť aspoň znova spustené z rovnakej inicializácie a poradia dát. To nie je prísľub bitovo identických váh na GPU, ale je to rozdiel medzi opätovným spustením a novým experimentom. Ak spustenie GR00T vytvorí funkčnú politiku a vy ste si neuchovali kontrolný bod, zaplatíte plnú cenu za výsledok, ktorý sa môže líšiť viac, než bol rozdiel, ktorý ste hľadali. Existuje druhý spôsob, ako stratiť kontrolný bod, za ktorý ste zaplatili: CLI predvolene používa --save-total-limit 5, čo je zdokumentované ako maximálny počet uchovávaných kontrolných bodov pred odstránením starších. Úložisko stojí centy; opätovné spustenie je 4 až 12 USD a šesť hodín.
Vyššie uvedené minimálne ponuky sú zlomkom ceny na požiadanie a vast.ai uvádza, že systém ponúkania cien môže znížiť náklady klientov o päťdesiat percent alebo viac. Háček, podľa ich vlastných slov: prerušiteľná inštancia môže byť kedykoľvek pozastavená, ak iný používateľ ponúkne vyššiu cenu alebo ak sa vytvorí prenájom na požiadanie pre rovnaké zdroje, a toto pozastavenie „zastaví všetky bežiace procesy“. Na požiadanie má vždy prednosť. Je to v poriadku pre beh, ktorý zapisuje kontrolný bod každých pár stoviek krokov, ale úplná strata pre ten, ktorý zapisuje na konci, čo je presne to, čo vám poskytujú predvolené nastavenia: Isaac-GR00T CLI zapisuje každých --save-steps (predvolene 1000), ale --save_freq v lerobot má predvolenú hodnotu 20 000 krokov, takže predvolený beh SmolVLA vytvorí kontrolný bod iba raz, na konci. Znížte to, alebo neponúkajte. Tréningový formulár AY-Robots sprístupňuje nastavenie GR00T ako saveSteps.
- Najnižšia hodinová sadzba, aká existuje.
- Plná kontrola nad obrazom, verziou CUDA, revíziou lerobot alebo Isaac-GR00T a každým príznakom.
- Prerušiteľné ponúkanie znižuje sadzbu na polovicu, ak váš beh vytvára kontrolné body dostatočne často na to, aby prežil pozastavenie.
- Nič nie je abstrahované, takže keď sa beh správa zvláštne, môžete vidieť prečo.
- Nastavenie sa účtuje sadzbami GPU: ovládače, závislosti, viacgigabajtový základný kontrolný bod a stiahnutie dátovej sady stoja za hodinu rovnako ako tréning.
- Prekonaná prerušiteľná inštancia je pozastavená a jej procesy sú ukončené. Neuložený beh sú spálené peniaze a predvolené nastavenie lerobot zapisuje svoj prvý kontrolný bod v kroku 20 000.
- Nič za vás nezničí pod. Vyššie uvedená tabuľka nečinnosti je účtom za zabudnutie.
- Ponuka pre jednotlivé plné 80 GB karty je tenká: v tomto čítaní dve ponuky A100 80 GB a päť H100 80 GB plných kariet. Zoznam sa tiež mení, takže najlacnejšia uvedená cena a cena, za ktorú si môžete skutočne prenajať, nie sú rovnaké čísla.
- Každá hodina strávená na infraštruktúre je hodina, ktorá nebola venovaná nahrávaniu epizód, ktoré rozhodujú o tom, či politika funguje.
Robíte to sami verzus necháte platformu prenajať kartu
Vyberiete si stroj, vytvoríte prostredie a zničíte pod. Hodinová sadzba je vyššie uvedená trhová sadzba; všetko ostatné je váš čas.
- Nájdite kartu zodpovedajúcu VRAM, ktorú model potrebuje: 24 GB pre ACT a SmolVLA, 80 GB pre GR00T a Pi0.5.
- Prenajmite si na požiadanie, ak beh nemôže prežiť pozastavenie, prerušiteľné, ak často vytvára kontrolné body.
- Nainštalujte nástroje: lerobot pre ACT, SmolVLA a Pi0.5, repozitár Isaac-GR00T s vlastným spúšťačom tyro pre GR00T.
- V prípade potreby konvertujte dátovú sadu. Dátová sada LeRobot v3.0 spôsobí pád GR00T loadera a musí byť konvertovaná na v2.1.
- Spustite, sledujte stratu, ukladajte kontrolné body na trvalé úložisko, keď sú zapisované.
- Zničte inštanciu a potom skontrolujte, či ste ju zničili.
# GR00T N1.7, single GPU, Isaac-GR00T as of August 2026.
# Note the entry point: gr00t/experiment/launch_finetune.py, a tyro CLI.
# scripts/gr00t_finetune.py does not exist in this repository; tutorials that
# still reference it are stale. The per-embodiment walkthrough is
# getting_started/finetune_new_embodiment.md.
CUDA_VISIBLE_DEVICES=0 uv run python gr00t/experiment/launch_finetune.py \
--base-model-path nvidia/GR00T-N1.7-3B \
--dataset-path demo_data/cube_to_bowl_5 \
--embodiment-tag NEW_EMBODIMENT \
--modality-config-path examples/SO100/so100_config.py \
--num-gpus 1 \
--output-dir ./so100-checkpoints \
--max-steps 20000 \
--global-batch-size 32 \
--dataloader-num-workers 4
# v3.0 dataset? Convert it down first or the loader will crash. The helper
# has its own pyproject and must be installed in its own environment:
cd scripts/lerobot_conversion
uv venv && source .venv/bin/activate
uv pip install -e .
python convert_v3_to_v2.py --repo-id <DATASET_REPO_ID>Realistické náklady na jeden beh GR00T: 3 až 6 hodín na H100 80 GB pri 1.34 až 2.34 USD za hodinu je 4 až 14 USD, plus 20 až 40 minút nastavenia, ktoré sa tiež účtuje, plus váš vlastný čas.
Vyberiete si model, dátovú sadu a hyperparametre vo formulári. Backend prenajme spot GPU dimenzované podľa VRAM, ktorú model potrebuje, spustí tréner a zapisuje kontrolné body do objektového úložiska.
- Vyberte si svoju kombináciu na tréningovej matici: päť modelov, štyri ramená, jeden sprievodca na bunku.
- Nasmerujte ho na dátovú sadu: zaznamenanú pomocou desktopového klienta, ID repozitára Hugging Face, alebo jednu z vášho vlastného počítača.
- Prijmite predvolené nastavenia alebo ich upravte. Vyššie uvedená tabuľka je to, čo sa skutočne odošle trénerovi.
- Backend vyberie kartu podľa požadovanej VRAM, takže nikdy nemusíte hľadať GPU.
- Kontrolné body sa ukladajú do objektového úložiska, keď sú zapisované, takže prerušený beh nie je stratený beh.
| Úroveň | Modely | Čas behu | Náklady na beh |
|---|---|---|---|
| A100 80 GB alebo H100 | GR00T N1.7, GR00T N1.5, Pi0.5 | 3 až 6 hodín | približne 4 až 12 USD |
| RTX 4090 alebo akákoľvek 24 GB karta | SmolVLA, ACT | 2 až 5 hodín | približne 1 až 3 USD |
Čo nerobí: neurobí zlú dátovú sadu dobrou, nedá GR00T seed, ktorý nikdy nemal, ani neodstráni limit latencie popísaný nižšie. Odstraňuje hľadanie GPU, vytváranie prostredia a pod, ktorý ste zabudli zničiť. Mechanika je v dokumentácii k tréningu.
Čo platforma účtuje a ako vyberá kartu
Logika je zámerne nudná. Každý model v katalógu, deklaruje úroveň GPU; backend vezme požadovanú VRAM a prenajme zodpovedajúcu kartu na rovnakom spotovom trhu, ako je uvedené vyššie. Preto je uvedená cena rozsah, nie pevná cena. GR00T a Pi0.5 sú tu len pre cloud kvôli minimálnym požiadavkám 40 GB a 70 GB. SmolVLA a ACT bežia aj lokálne na vašej vlastnej 24 GB karte, kde sú náklady na cloud nulové a elektrina je váš problém.

Jedno nastavenie si zaslúži upozornenie. Akumulácia gradientu sa skutočne vzťahuje na oba varianty GR00T, takže jej zvýšenie kúpi väčšiu efektívnu dávku na rovnakej karte. Pre Pi0.5 a SmolVLA sa vôbec neuplatňuje: lerobot 0.5.1 nemá vo svojej tréningovej konfigurácii možnosť akumulácie gradientu, takže nastavenie poľa na 16 nič nestojí a nič nekúpi. Ak sa úloha vo fronte nikdy nespustí, stránka o úlohách zaseknutých vo fronte, pokrýva, čo skontrolovať; ak je dátový súbor odmietnutý pred spustením, je to takmer vždy problém s formátom v3.0.
Prenajatá GPU obsluhujúca vašu politiku cez verejný internet pridáva oneskorenia do riadiacej slučky, ktorá už má 20 až 485 ms na krok akcie. Vhodné pre pomalé pick-and-place, nie pre rýchly reaktívny pohyb. Cloudová inferencia dobre vyhodnocuje kontrolný bod, ale zle vykonáva produkčnú manipuláciu: ak úloha vyžaduje rýchlosť, výpočty musia byť umiestnené vedľa servomotorov, a to sú náklady, ktoré tento článok nemôže odstrániť. Pozri latencia inferencie.
Vypracovaný rozpočet pre prvú funkčnú politiku
Všetky štyri riadky spolu, začínajúc od nuly. Celková suma za GPU predpokladá 3 až 5 spustení: prvé preukáže funkčnosť pipeline, druhé odhalí problém s dátami, tretie alebo štvrté je to, ktoré si ponecháte.
| Položka | Šetrná cesta | Komfortná cesta |
|---|---|---|
| Rameno | Len SO-100 follower, 121.94 USD v BOM | leader plus follower, 229.88 USD v BOM |
| Model | SmolVLA alebo ACT, 24 GB úroveň | GR00T N1.7, A100 80 GB alebo H100 úroveň |
| Nahrávané epizódy | 30, minimum pre SmolVLA | 50 až 100 |
| Čas človeka na nahrávanie | približne 1 h 12 min | 2 až 4 hodiny |
| Náklady na jedno spustenie | 1 až 3 USD | 4 až 12 USD |
| Spustenia pred funkčnosťou | 3 až 5 | 3 až 5 |
| Celkové výdavky za GPU | 3 až 15 USD | 12 až 60 USD |
| Najväčšia položka na účte | rameno, potom váš čas | rameno, potom váš čas |
Tento vzor platí aj pre túto veľkosť robota: výpočty sú zaokrúhľovacia chyba, hardvér je skutočný jednorazový náklad, ľudské hodiny sú opakujúce sa výdavky. Ak chcete otestovať tréningovú časť pred kúpou čohokoľvek, vstupné body bez hardvéru vám umožnia porovnať modely a prenajať si GPU bez ramena, a živé rameno je fyzický SO-100, ktorý môžete ovládať v prehliadači bez registrácie. Pre celý end-to-end pipeline, kompletný sprievodca SO-100 pokrýva nastavenie, teleoperáciu a tréning, a natrénujte svoju prvú politiku je krátka verzia.

Koľko stojí jeden end-to-end beh jemného ladenia VLA?▾
Približne 4 až 12 USD pre GR00T N1.7, GR00T N1.5 alebo Pi0.5 na úrovni A100 80 GB alebo H100 (3 až 6 hodín pri 1.20 až 2.00 USD za hodinu) a približne 1 až 3 USD pre SmolVLA alebo ACT na úrovni RTX 4090 (2 až 5 hodín pri 0.30 až 0.60 USD za hodinu). Prenájom karty samostatne sa pohybuje v rovnakom rozsahu, akonáhle sa započíta čas nastavenia, pretože sa účtuje podľa tréningovej sadzby.
Oplatí sa platiť za H100 namiesto A100 80 GB?▾
Pre jednu politiku SO-100 zvyčajne nie. Obe spĺňajú minimálne požiadavky na pamäť, ktoré GR00T a Pi0.5 potrebujú, a k 23. augustu 2026 sa plná A100 80 GB začínala na 0.44 USD za hodinu oproti 1.34 USD za H100 80 GB. H100 dokončí prácu skôr, takže časť sadzby sa vráti v podobe menšieho počtu hodín, ale celková suma je pre takýto malý beh stále vyššia. Skutočným argumentom pre H100 je dostupnosť: päť ponúk na jednu H100 80 GB na tomto trhu oproti dvom A100 80 GB, a karta, ktorú si nemôžete prenajať, nemá žiadnu cenu.
Koľko behov je potrebných, kým politika skutočne funguje?▾
Plánujte tri až päť. Prvý preukáže, že pipeline je správne zapojený. Druhý bežne odhalí problém s dátovou sadou, napríklad stream z kamery, ktorý sa v polovici prerušil. Tretí alebo štvrtý je ten, ktorý si ponecháte.
Môžem trénovať SmolVLA alebo ACT na vlastnom GPU namiesto prenájmu?▾
Áno. Obe sú lokálne podporované na AY-Robots a obe sa pohodlne zmestia do 24 GB; pôvodný článok o ACT trénoval svoj 80M model za približne 5 hodín na 11 GB RTX 2080 Ti. GR00T a Pi0.5 sú tu len pre cloud, pretože dokumentované minimálne požiadavky dodávateľov na jemné ladenie sú 40 GB a 70 GB, a najväčšia spotrebiteľská karta na trhu je 32 GB RTX 5090.
Prečo rovnaký počet krokov stojí rôzne sumy naprieč modelmi?▾
Kroky nie sú porovnateľné naprieč politikami. ACT predvolene používa 100,000 krokov pri dávke 8 na 24 GB karte; GR00T N1.5 predvolene používa 2,000 krokov pri dávke 1 s akumuláciou gradientu 16 na 80 GB karte. Účet je hodiny vynásobené sadzbou karty, na ktorú vás núti pamäťová stopa, nie počítadlo krokov.
Zistite, koľko by stál váš beh, predtým než ho spustíte
Každá z piatich politík uvádza svoju úroveň GPU, čas behu a cenu za beh, a tréningový backend si prenajíma kartu na rovnakom spotovom trhu, na ktorom boli tieto čísla merané.
Skontrolovať cenySources
- SmolVLA: A Vision-Language-Action Model for Affordable and Efficient Robotics
- GR00T N1: An Open Foundation Model for Generalist Humanoid Robots
- Learning Fine-Grained Bimanual Manipulation with Low-Cost Hardware (ACT / ALOHA)
- pi-0.5: a Vision-Language-Action Model with Open-World Generalization
- NVIDIA Isaac-GR00T: hardware requirements, launch_finetune.py and finetune_config.py defaults
- huggingface/lerobot: CLI entry points, policies and LeRobotDataset v3
- Physical Intelligence openpi: GPU memory requirements for pi0 and pi0.5
- SO-ARM100 / SO-101 bill of materials and STS3215 voltage variants
- LeRobot docs: fine-tuning SmolVLA, 20k steps in about 4 hours on one A100
- LeRobot docs: lerobot-record defaults, episode and reset times, dataset advice
- RunPod GPU pricing: Community Cloud and Secure Cloud hourly rates per card
- Vast.ai: on-demand versus interruptible rentals, bidding and what a pause does to your processes
- Hugging Face pricing: Spaces hardware hourly rates, A100 80 GB at 2.50 USD/h
- Isaac Lab Arena: GR00T N1.6 post-training hardware options and wall-clock reference figures
- lerobot on PyPI, version 0.6.1 released 3 August 2026
Ready for high-quality robotics data?
AY-Robots connects your robots to skilled operators worldwide.
Get Started