
Raunverulegt verð á GPU á spot-markaði, hversu lengi hver af fimm stefnum keyrir, hvað armurinn og sýnikennslurnar kosta, og fjórir staðir þar sem peningarnir hverfa hljóðlega.
Stutta útgáfan
- •Keyrsla á A100 80 GB eða H100 flokki tekur 3 til 6 klukkustundir og kostar um 4 til 12 USD. Á RTX 4090 flokki er það 2 til 5 klukkustundir og um 1 til 3 USD.
- •Mælt á vast.ai kl. 13:44 UTC þann 23. ágúst 2026: fullt RTX 4090 eftirspurn fyrir 0.13 til 0.38 USD/klst, A100 80 GB fyrir 0.44 til 0.67, H100 80 GB fyrir 1.34 til 2.34. Full 80 GB kort eru af skornum skammti, tvö og fimm tilboð fyrir stök kort í sömu röð.
- •GPU er ódýrasta línan. Efnisreikningur SO-ARM100 setur leiðtoga plús fylgjanda par á 229.88 USD, sem er 77 til 230 keyrslur á 24 GB flokki.
- •Tvær klukkustundir af manneskju sem tekur upp 50 þætti kostar meira en þjálfunarkeyrslan sem þessir þættir næra.
- •Peningar hverfa á fjórum stöðum: keyrslur á gölluðum gögnum, 3B líkön á verkefnum sem 80M stefna ræður við, GPU sem enginn eyðilagði, og endurkeyrslur á niðurstöðu sem þú tókst ekki að varðveita.
- •AY-Robots stærðar kortið eftir VRAM sem líkanið þarf og leigir það á sama spottmarkaði, svo keyrslukostnaðurinn er markaðskostnaðurinn.
Reikningurinn hefur fjórar línur, og GPU er sú minnsta
Þegar fólk spyr hvað það kostar að fínstilla sjón-tungumál-aðgerð líkan fyrir SO-100, þá meina þeir næstum alltaf GPU leiguna. Það er sú tala sem birtist sem gjald á korti, svo það er sú sem virðist raunveruleg. Það er líka, með miklum mun, sú minnsta af fjórum tölum sem ákvarða hvað virk stefna raunverulega kostar þig.
| Lína | Hvað það er | Dæmigerð stærð fyrir eina virka stefnu |
|---|---|---|
| GPU tími | að leigja kort fyrir keyrsluna | 1 til 12 USD á keyrslu, og þú munt gera 3 til 5 |
| Vélmennið | servó, prentaður rammi, myndavélar, snúrur, afl | einu sinni, 110 til 500 EUR eftir armi |
| Mannstundir | manneskja sem stýrir arminum til að taka upp kynningar | 1 til 4 klukkustundir á gagnasafn, endurtekið fyrir hvert verkefni |
| Sóun | slæm gögn, of stór líkön, gleymdir kubbar | ótakmarkað, og eina línan sem þú stjórnar |
Þjálfunartímar hér að neðan koma frá eigin greinum og geymslum fimm líkananna, vélbúnaðarkostnaður frá birtum efnislistum, vettvangsnúmer frá AY-Robots stefnuskrá og verðsíðu. Þar sem vettvangurinn hjálpar ekki, segir þessi grein svo frá.
Hvað GPU klukkustund kostar raunverulega á skyndimarkaði
Það er ekkert eitt verð fyrir A100 klukkustund. Á markaðstorgi eins og vast.ai setur hver gestgjafi sitt eigið verð, og þjálfunaraksturinn sem þú ræsir lendir á þeirri vél sem er ódýr og laus á þeirri sekúndu. Heiðarlegt svar er dreifing. Hér er hún, mæld 23. ágúst 2026 kl. 13:44 UTC: stök full kort, eftirspurn, síað eftir raunverulegu VRAM.
| Kort | vast.ai eftirspurn USD/klst (lágt / miðgildi / hátt) | Tilboð á fullum kortum | vast.ai lágmarksboð | RunPod Community / Secure | Hugging Face |
|---|---|---|---|---|---|
| RTX 4090, 24 GB | 0.13 / 0.32 / 0.38 | 24 | 0.11 | 0.34 / 0.74 | not offered |
| RTX 5090, 32 GB | 0.34 / 0.40 / 0.47 | 29 | 0.19 | 0.69 / 0.99 | not offered |
| A100 80 GB, PCIe or SXM4 | 0.44 / 0.56 / 0.67 | 2 | 0.13 | 1.19 PCIe, 1.39 SXM / 1.39, 1.59 | 2.50 as a Space |
| H100 80 GB, SXM or PCIe | 1.34 / 1.80 / 2.34 | 5 | 0.44 | 1.99 PCIe, 2.69 SXM / 2.89, 3.29 | 4.50 as an endpoint |
| H100 NVL, 94 GB | 1.47 / 1.47 / 2.64 | 4 | 0.40 | 2.59 / 3.19 | not offered |
Eftirspurnartilboð fyrir eitt fullt GPU (gpu_frac == 1.0) frá vast.ai opinbera búnt API, sem krefst engra reiknings, síað eftir gpu_ram svo að aðeins ósvikin 80 GB kort lendi í 80 GB röðunum. Sú sía skiptir máli: í þessari lestri voru öll þrjú stak-korta A100 SXM4 tilboðin 40 GB hlutar, eins og tvö af fjórum A100 PCIE tilboðum, svo að sameining þeirra í eina „A100“ röð hefði helmingað verðið sem hér er gefið upp. Hugging Face dálkurinn blandar saman tveimur vörum: 2.50 USD/h er Nvidia A100 - large Spaces vélbúnaður og 4.50 USD/h er eitt H100 80 GB undir Inference Endpoints, sem Spaces býður ekki upp á. Líttu á miðgildin sem vísbendingu: A100 80 GB röðin byggir á tveimur tilboðum og H100 röðin á fimm, og sams konar fyrirspurn 36 sekúndum síðar skilaði mismunandi 4090 fjölda og mismunandi hæsta verði á þremur af fimm röðum. RunPod listaverð eru stöðugri tala til að skipuleggja út frá.
# Live, full-card, single-GPU, on-demand offers from the vast.ai public bundle API.
# No account and no API key needed. gpu_ram is in MB, so an 80 GB card is >= 80000.
python3 - <<'PY'
import json, statistics, urllib.parse, urllib.request
def offers(name, min_ram):
q = {"rentable": {"eq": True}, "num_gpus": {"eq": 1}, "gpu_name": {"eq": name},
"order": [["dph_total", "asc"]], "limit": 500, "type": "on-demand"}
url = "https://console.vast.ai/api/v0/bundles/?q=" + urllib.parse.quote(json.dumps(q))
with urllib.request.urlopen(url, timeout=60) as r:
return [o for o in json.load(r)["offers"]
if o["gpu_frac"] == 1.0 and o["gpu_ram"] >= min_ram]
groups = {
"RTX 4090 24 GB": (["RTX 4090"], 24000),
"RTX 5090 32 GB": (["RTX 5090"], 30000),
"A100 80 GB": (["A100 PCIE", "A100 SXM4"], 80000),
"H100 80 GB": (["H100 SXM", "H100 PCIE"], 80000),
"H100 NVL 94 GB": (["H100 NVL"], 90000),
}
for label, (names, min_ram) in groups.items():
o = [x for n in names for x in offers(n, min_ram)]
if not o:
print(label, "no offers"); continue
p = sorted(x["dph_total"] for x in o)
b = sorted(x["min_bid"] for x in o if x.get("min_bid"))
bid = f"{b[0]:.2f}" if b else "n/a"
print(f'{label}: n={len(p)} | {p[0]:.2f} / {statistics.median(p):.2f} / {p[-1]:.2f}'
f' USD/h | bid floor {bid}')
PY
Af hverju 3B módelin geta ekki notað ódýra kortið
4090 klukkustund og H100 80 GB klukkustund eru um það bil sexfalt ólíkar miðað við miðgildin hér að ofan. Það sem neyðir þig til að nota dýra kortið er ekki hraði, heldur minni. openpi setur lágmarkið fyrir fulla Pi0.5 fínstilling við 70 GB, og NVIDIA mælir með 40 GB eða meira fyrir GR00T. Athugaðu hvað GR00T talan er ekki. Fínstillingarstilling þess frystir tungumálalíkanið og sjónræna kóðarann sjálfgefið (tune_llm og tune_visual eru False, en skjávarpinn og dreifingarhausinn True), þess vegna sýnir vörulistinn um það bil 40 M þjálfaða færibreytur af 3 B. 40 GB er ekki fínstillingarstaða fyrir 3 B þyngdir, heldur frosinn burðarás ásamt virkjunum. Afbrigði með minni umfang falla lægra: LoRA leið openpi krefst 22.5 GB og nefnir 4090, og vinnuflæði NVIDIA's Isaac Lab Arena sýnir 24 GB ein-GPU valkost fyrir GR00T eftirþjálfun. Vettvangurinn flokkar eftir því lágmarki sem hver seljandi birtir fyrir þá stillingu sem hann raunverulega keyrir. Greinin um pi0 flæðisjöfnun útskýrir hvaðan þetta flæðisjöfnun fótspor kemur.
| Verkefni | Minni sem upprunaverkefnið krefst | Heimild |
|---|---|---|
| pi0 / pi0.5 ályktun | more than 8 GB, example RTX 4090 | openpi |
| pi0 / pi0.5 LoRA fínstilling | more than 22.5 GB, example RTX 4090 | openpi |
| pi0 / pi0.5 full fínstilling | more than 70 GB, example A100 80 GB or H100 | openpi |
| GR00T N1.7 ályktun | 1 GPU with 16 GB or more | Isaac-GR00T |
| GR00T N1.7 fínstilling | 40 GB or more recommended, H100 or L40 nodes | Isaac-GR00T |
| GR00T fínstilling, hvað það þjálfar | skjávarpi og dreifingarhaus; LLM og sjónrænn kóðari frosnir sjálfgefið | finetune_config.py |
| GR00T eftirþjálfun, minnkað | 1 GPU with 24 GB, tungumálalíkan frosið | Isaac Lab Arena |
| SmolVLA fínstilling | einn A100 fyrir viðmiðunarkeyrsluna með 20.000 skrefum | lerobot docs |
| ACT þjálfun | eitt 11 GB RTX 2080 Ti | ACT paper |
Þessi tafla er ástæðan fyrir því að vettvangurinn skiptir fimm líkönunum í tvö stig. GR00T N1.7, GR00T N1.5 og Pi0.5 fara á A100 80 GB eða H100 vegna þess að það er það sem seljendurnir biðja um. SmolVLA og ACT fara á RTX 4090 eða hvaða 24 GB kort sem er vegna þess að það er sannarlega nóg.
GR00T eða Pi0.5 keyrsla á 24 GB korti bilar ekki strax. Hún sækir grunnathugunarpunktinn, byggir gagnasafnsvísitöluna, byrjar fyrstu framsendinguna og deyr eftir nokkur hundruð skref með CUDA minnisvillu. Þú borgaðir fyrir niðurhal og uppsetningu og fékkst ekkert. Lagfæringar: minnisleysi við þjálfun.
Hversu lengi hvert af fimm líkönunum raunverulega keyrir
Keyrslutími er hinn helmingur kostnaðarins: 2.00 USD á klukkustund er óviðkomandi ef verkið er 40 mínútur og eyðileggjandi ef það er 40 klukkustundir. Þetta eru sjálfgefnu stillingarnar sem AY-Robots sendir þjálfaranum, ásamt keyrsluglugganum og kostnaði fyrir hvert stig.
| Stefna | GPU stig | Sjálfgefin hámarksþrep | Sjálfgefin lota (grad uppsöfnun) | Keyrslugluggi | Kostnaður á keyrslu |
|---|---|---|---|---|---|
| GR00T N1.7, ~3B | A100 80 GB or H100 | 20,000 | 32, uppsöfnun 1, á við | 3 to 6 h | 4 to 12 USD |
| GR00T N1.5, ~3B | A100 80 GB or H100 | 2,000 | 1, uppsöfnun 16, á við | 3 to 6 h | 4 to 12 USD |
| Pi0.5, ~3B | A100 80 GB or H100 | 30,000 | 1, uppsöfnun 16, engin áhrif | 3 to 6 h | 4 to 12 USD |
| SmolVLA, ~450M | RTX 4090 or any 24 GB | 20,000 | 2, uppsöfnun 8, engin áhrif | 2 to 5 h | 1 to 3 USD |
| ACT, ~80M | RTX 4090 or any 24 GB | 100,000 | 8, uppsöfnun 1 | 2 to 5 h | 1 to 3 USD |

Hvaðan þessir keyrslutímagluggar koma uppstreymis
- SmolVLA: skjöl lerobot segja að 20.000 skref taki um það bil 4 klukkustundir á einu A100. Vettvangurinn keyrir sömu 20.000 skrefin á ódýrari 24 GB flokki, því er um að ræða tímaglugga frekar en fastar 4 klukkustundir.
- ACT: upprunalega ALOHA ritgerðin greinir frá um 5 klukkustundum á einu 11 GB RTX 2080 Ti fyrir 80M-færibreytulíkan. 4090 er nokkrum kynslóðum nýrra en vettvangurinn gerir ráð fyrir 100.000 skrefum, svo tímaglugginn lendir á sama stað.
- GR00T: viðmiðunarvinnuflæði NVIDIA fyrir N1.6 kynslóðina gefur til kynna um það bil 4 til 8 klukkustundir fyrir 20.000 skref með lotustærð 24 á átta L40S kortum, og 2 til 3 klukkustundir fyrir 30.000 skref með lotustærð 16 á einu Ada 6000. Fínstilling 3B VLA á einu korti á nokkrum klukkustundum er eðlileg, ekki bjartsýn.
- Pi0.5: openpi birtir engar rauntímatölur, en það birtir 70 GB lágmarkið fyrir fulla fínstillingu, sem ákvarðar kortið og þar með hraðann.
Þess virði að staldra við töluna sem þú ert ekki að borga. GR00T N1 ritgerðin greinir frá um það bil 50.000 H100 GPU klukkustundum til að forþjálfa 2.2B líkanið, á klasa allt að 1024 GPUum, með forþjálfunarlotustærð 16.384 fyrir 200.000 hallaskref. Á 1,34 til 2,34 USD á klukkustund sem mælt var hér að ofan er það í stærðargráðunni 67.000 til 117.000 USD í leigðri tölvuorku. SmolVLA ritgerðin setur verkefni sitt á um það bil 30.000 GPU klukkustundir yfir 481 samfélagsgagnasöfn, 22.9K þætti og 10.6M ramma. Þú erfir allt þetta fyrir verð á niðurhali; 8 USD þín kaupa síðustu 20.000 skrefin. Af hverju VLA eru byggð svona fjallar um þá skiptingu.
Armurinn: eingreiðslukostnaður sem skyggir á GPU reikninginn
Þjálfunarkeyrsla kostar minna en hádegismatur. Vélmennið gerir það ekki. Þess vegna skiptir SO-100 máli: það er ódýrasti armurinn sem öll herminám verkfærakeðjan styður í raun.
| Armur | Servó | Spenna | Hlutaverð | Stuðningur á AY-Robots |
|---|---|---|---|---|
| SO-100 | Feetech STS3215 bus servos | 7.4 V | 110 to 150 EUR | fullur, viðmiðunararmur |
| SO-101 | Feetech STS3215 | 7.4 V | 130 to 170 EUR | fullur |
| Koch v1.1 | Dynamixel XL330 / XL430 | 5 V and 12 V rails | 250 to 350 EUR | samhæfður |
| LeKiwi | Feetech STS3215 arm, wheeled base | 7.4 V arm, 12 V base | 400 to 500 EUR | samhæfður |
Efnislistinn í SO-ARM100 geymslunni er nákvæmari og vert að athuga hann miðað við þitt svæði: listinn yfir Hlutar fyrir tvo arma nemur samtals 229.88 USD eða 226.30 EUR fyrir leiðara- og fylgjarauppsetningu, og listinn yfir Hlutar fyrir einn fylgjararma nemur samtals 121.94 USD eða 124.30 EUR. Sex STS3215 servó á 13.89 USD hvert eru 83.34 af þeim 121.94, svo servóin eru armurinn. Á 1 til 3 USD á hverja SmolVLA eða ACT keyrslu er eitt par af örmum virði á milli 77 og 230 þjálfunarkeyrslna. Ef þú ert enn að velja, SO-100 á móti SO-101 er samanburðurinn sem skiptir máli, því þeir tveir eru nógu líkir til að ákvörðunin snýst um framboð frekar en getu.
STS3215 er fáanlegt í 7.4 V og 12 V útgáfu; geymslan bendir á að 12 V hluturinn þarf einnig 12 V 5 A aflgjafa í stað 5 V, svo þeir tveir eru ekki skiptanlegir. Að gefa 12 V í 7.4 V servó eyðileggur þau, og sex servó eru tveir þriðju af hlutaverði fylgjararma. Athugaðu merkimiðann á hverju servói fyrir fyrstu ræsingu. Ef servó hegða sér nú þegar undarlega: servó svarar ekki, armur kippist og sígur svo.
Mannstundir: línan sem enginn setur í töflureikninn
Þetta er talan sem snýr kostnaðarumræðunni á hvolf. Að taka upp sýnikennslu felur í sér að manneskja færir vélmennaarm, einn þátt í einu, í rauntíma. Það er engin lotuvinnsla og engin leiga á sekúndu. LeRobot gagnasafnið upptökutækið kemur með sjálfgefnum stillingum sem gera útreikningana auðvelda, allar þrjár staðfestar í DatasetRecordConfig: 60 sekúndur á þátt, 60 sekúndur til að endurstilla sviðið, 50 þættir. Peningadálkurinn hér að neðan gerir ráð fyrir 15 USD fyrir klukkustund af tíma einhvers, sem er forsenda frekar en vettvangsnúmer. Skiptu út þínu eigin gjaldi; hlutfallið er málið.
- 1Taktu upp gagnasafnið með sjálfgefnum stillingum sem þú verður í raun rukkaður fyrir
Þetta er lerobot 0.6.1, útgáfan á PyPI frá 3. ágúst 2026. Athugið CLI lögunina: upptaka fer í gegnum
lerobot-recordinngangspunkt stjórnlínunnar (lerobot.scripts.lerobot_record), ekki gamlapython -m lerobot.scripts.recordeiningarslóðina. AY-Robots miðar við 0.5.1, og 0.5.1 hjólið lýsir yfir sömulerobot-recordoglerobot-traininngangspunktum, svo lögunin hér að neðan er stöðug á báðum. Tímastillingarflaggarnir þrír eru sjálfgefnar stillingar frá uppruna, svo þetta er líka skipunin sem útreikningarnir í næstu töflu gera ráð fyrir.bashlerobot-record \ --robot.type=so100_follower \ --robot.port=/dev/ttyACM0 \ --robot.id=my_follower_arm \ --robot.cameras="{ front: {type: opencv, index_or_path: 0, width: 640, height: 480, fps: 30} }" \ --teleop.type=so100_leader \ --teleop.port=/dev/ttyACM1 \ --teleop.id=my_leader_arm \ --dataset.repo_id=${HF_USER}/pick-place-cube \ --dataset.num_episodes=50 \ --dataset.episode_time_s=60 \ --dataset.reset_time_s=60 \ --dataset.single_task="Grab the black cube and put it in the bin" - 2Skoðaðu það sem þú tókst upp áður en þú leigir eina GPU mínútu
Að skoða gagnasafn kostar núll USD á klukkustund. Að uppgötva sama vandamál út frá tapferli kostar 2.00 USD á klukkustund á H100 flokki og segir þér fjórum tímum of seint. Sendu gagnasafnið og skoðaðu það í LeRobot áhorfandanum, eða skoðaðu AY-Robots gagnasafnaskrána.
bash# the recorder pushes to the Hub by default; disable with --dataset.push_to_hub=False echo https://huggingface.co/datasets/${HF_USER}/pick-place-cube # then open https://huggingface.co/spaces/lerobot/visualize_dataset # and scrub through episodes: are both camera streams alive on every episode? # is the gripper actually closing? does the arm sit at a joint limit? - 3Þjálfaðu og tryggðu að gátpunkturinn lifi lengur en podinn
Leigð vél er tímabundin samkvæmt skilgreiningu, svo skrifaðu gátpunkta á varanlegan stað meðan á keyrslu stendur. Tveir fánar ákveða hvort þú heldur því sem þú borgaðir fyrir.
--save_freqer sjálfgefið 20.000 skref, svo sjálfgefin 20.000 skrefa SmolVLA keyrsla skrifar fyrsta gátpunktinn sinn þegar keyrslunni er þegar lokið; lækkaðu það áður en þú leigir eitthvað sem hægt er að trufla.--save_checkpoint_to_hubkrefst--policy.repo_idog er ekki til í lerobot 0.5.1, svo á þeirri útgáfu afritarðu úttaksskrána af vélinni sjálfur. Lotustærðin hér að neðan er dæmi úr upprunalegum skjölum; AY-Robots eyðublaðið sendir 2 fyrir SmolVLA og skrifar í hlutageymslu eftir því sem gátpunktar birtast.bashlerobot-train \ --policy.path=lerobot/smolvla_base \ --dataset.repo_id=${HF_USER}/pick-place-cube \ --batch_size=64 \ --steps=20000 \ --save_freq=2000 \ --output_dir=outputs/train/my_smolvla \ --job_name=my_smolvla_training \ --policy.device=cuda \ --policy.repo_id=${HF_USER}/my_smolvla \ --save_checkpoint_to_hub=true
| Þættir | Upptaka á 60 s | Endurstilling á 60 s | Veggklukka | Plús 20 prósent endurupptökur | Á 15 USD á mannstund |
|---|---|---|---|---|---|
| 30, lágmark SmolVLA | 30 min | 30 min | 1 h 00 min | 1 h 12 min | about 18 USD |
| 50, hin fjögur lágmörkin | 50 min | 50 min | 1 h 40 min | 2 h 00 min | about 30 USD |
| 100, þægilegt gagnasafn | 100 min | 100 min | 3 h 20 min | 4 h 00 min | about 60 USD |
Berðu saman hægri dálkinn við 1 til 12 USD sem keyrslan kostar. Á þeim forsendum kostar gagnasafn með 50 þáttum tvisvar til sjö sinnum meira að taka upp en að þjálfa á, áður en kvörðun, uppsetning myndavéla og þættir sem þú hendir eru taldir með. Þess vegna hefur beint fjárhagslegt gildi. Leiðbeiningar lerobot benda til að minnsta kosti 50 þátta með 10 á hvern staðsetningu hlutar; skjöl SmolVLA greina frá því að 25 þátta útgáfa af sama verkefni hafi ekki verið nægjanleg.
Hvar peningarnir raunverulega tapast
1. Keyrslur á gögnum sem aldrei áttu eftir að virka
20.000 skrefa GR00T keyrsla á gagnasafni með tveimur víxluðum myndavélarstraumum kostar það sama og keyrsla á hreinu gagnasafni, tekur sama tíma og framleiðir tapferil sem lítur vel út. Bilunin kemur í ljós á arminum, klukkustundum síðar. eru reiknuð á klukkustund og greining er reiknuð í dögum. Tvö einkenni sem vert er að muna: þýðir venjulega að athuganirnar bera ekki það sem verkefnið þarf, og þýðir að gagnasafnið hafði minni breytileika en þú hélst.
2. Að borga grunnlíkanverð fyrir verkefni með fastri myndavél
ACT er um það bil 80M færibreytur og var hannað til að þjálfa frá grunni á 50 sýnikennslum af einu verkefni. GR00T N1.7 er um það bil 3B með forþjálfaðan burðarás. Fyrir fasta myndavél, fast borð og einn hlut, nær 80M líkanið oft markmiðinu, keyrir á um 20 ms á hverju aðgerðarskrefi í stað 152 ms, og kostar 1 til 3 USD á keyrslu í stað 4 til 12. Eyddu 3 USD í að komast að því hvort ódýra líkanið virkar áður en þú eyðir 12 USD í það dýra. ACT á móti SmolVLA og GR00T N1.7 á móti Pi0.5 sýna hvar hvert hættir að vera rétta svarið; líkanasviðið hefur 85 líkön og 332 viðmiðunarniðurstöður.
3. GPU-ið sem þú gleymdir
Ódýrustu mistökin til að koma í veg fyrir og þau algengustu til að gera. Tilvik sem er ræst á föstudegi til að kemba eitthvað rukkar yfir helgina á sama verði og raunveruleg keyrsla.
| Skjákort | Miðgildi verðs í skyndimynd | Óvirkt í 24 klst | Óvirkt í 7 daga | Það jafngildir |
|---|---|---|---|---|
| RTX 4090 | 0.32 USD/h | 7.68 USD | 53.76 USD | um 27 SmolVLA eða ACT keyrslur á 2 USD |
| A100 80 GB | 0.56 USD/h | 13.44 USD | 94.08 USD | um 12 GR00T keyrslur á 8 USD |
| H100 80 GB | 1.80 USD/h | 43.20 USD | 302.40 USD | um 38 GR00T keyrslur á 8 USD |
Á AY-Robots er þessi galli hannaður út fyrir ályktun: einingar sem eru úthlutaðar af ályktunarforritunarviðmótinu bera óvirkan vaktara og eyðileggja sig eftir óvirknistímabil. Ef þú leigir skjákortið sjálfur, er sá vaktari dagatalsáminningin þín.
4. Að borga tvisvar fyrir sama svarið
Inngangspunktur GR00T fyrir fínstillingu er tyro CLI sem sýnir ekkert seed. Það er ekki takmörkun á vettvangi, heldur er það uppstreymisverkfærið: það er ekkert seed svið í gr00t/configs/finetune_config.py, og eigin þjálfunarráð geymslunnar vara við því að keyrslur geta verið mismunandi um 5 til 6 prósent vegna þess að myndaukningar eru óákveðnar. lerobot notar sjálfgefið seed 1000 í bæði 0.5.1 og 0.6.1, svo ACT, SmolVLA og Pi0.5 keyrslur er að minnsta kosti hægt að endurkeyra frá sömu frumstillingu og gagnaröð. Það er ekki loforð um bit-eins þyngdir á GPU, en það er munurinn á endurkeyrslu og nýrri tilraun. Ef GR00T keyrsla framleiðir stefnu sem virkar og þú geymdir ekki eftirlitsstaðinn, borgar þú fullt verð fyrir niðurstöðu sem gæti verið frábrugðin meira en munurinn sem þú varst að leita að. Það er önnur leið til að missa eftirlitsstað sem þú borgaðir fyrir: CLI notar sjálfgefið --save-total-limit 5, sem er skjalfest sem hámarksfjöldi eftirlitsstaða sem geymdir eru áður en eldri eru eytt. Geymsla kostar sent; endurkeyrsla er 4 til 12 USD og sex klukkustundir.
Lágmarksboðin hér að ofan eru brot af eftirspurnarverði, og vast.ai segir að boðkerfið geti lækkað kostnað viðskiptavina um fimmtíu prósent eða meira. Gallinn, með þeirra eigin orðum: hægt er að gera hlé á truflanlegri tilvísun hvenær sem er ef annar notandi býður hærra eða eftirspurnarleiga er búin til fyrir sömu auðlindir, og það hlé "stöðvar öll ferli sem eru í gangi". Eftirspurn hefur alltaf forgang. Í lagi fyrir keyrslu sem skrifar eftirlitsstöð á nokkur hundruð skrefa fresti, algjört tap fyrir keyrslu sem skrifar í lokin, sem er nákvæmlega það sem sjálfgefnar stillingar gefa þér: Isaac-GR00T CLI skrifar á --save-steps fresti (sjálfgefið 1000), en --save_freq í lerobot er sjálfgefið 20.000 skref, svo sjálfgefin SmolVLA keyrsla skrifar eftirlitsstöð einu sinni, í lokin. Lækkaðu það, eða ekki bjóða. AY-Robots þjálfunarformið sýnir GR00T hnappinn sem saveSteps.
- Lægsta tímagjaldið sem er til.
- Full stjórn á myndinni, CUDA útgáfu, lerobot eða Isaac-GR00T endurskoðun og hverjum fána.
- Truflanleg boð lækka verðið um helming ef keyrslan þín skrifar eftirlitsstöðvar nógu oft til að lifa af hlé.
- Ekkert er falið, svo þegar keyrsla hegðar sér undarlega geturðu séð hvers vegna.
- Uppsetning er reiknuð á GPU verði: rekla, ósjálfstæði, grunn eftirlitsstöðin sem er margra gígabæta og niðurhal gagna setts kosta allt það sama á klukkustund og þjálfun.
- Truflanleg tilvísun sem er boðin út er sett í bið og ferlum hennar er slátrað. Óvistuð keyrsla er peningar brenndir, og sjálfgefin stilling lerobot skrifar fyrstu eftirlitsstöðina sína á skrefi 20.000.
- Ekkert eyðileggur podinn fyrir þig. Aðgerðalausa taflan hér að ofan er reikningurinn fyrir að gleyma.
- Framboð á einum fullum 80 GB kortum er lítið: tvö A100 80 GB og fimm H100 80 GB tilboð á fullum kortum í þessari lestri. Skráningin breytist einnig, svo ódýrasta skráða verðið og verðið sem þú getur í raun leigt eru ekki sama talan.
- Hver klukkustund á innviðum er klukkustund sem ekki er varið í að taka upp þætti sem ákvarða hvort stefnan virkar.
Að gera það sjálfur á móti því að láta pallinn leigja kortið
Þú velur vélina, byggir umhverfið og eyðileggur podinn. Tímagjaldið er markaðsverðið hér að ofan; allt annað er þinn tími.
- Finndu kort sem passar við VRAM sem líkanið þarf: 24 GB fyrir ACT og SmolVLA, 80 GB fyrir GR00T og Pi0.5.
- Leigðu eftirspurn ef keyrslan þolir ekki hlé, truflanlegt ef hún skrifar eftirlitsstöðvar oft.
- Settu upp verkfærakeðjuna: lerobot fyrir ACT, SmolVLA og Pi0.5, Isaac-GR00T geymsluna með eigin tyro ræsiforriti fyrir GR00T.
- Umbreyttu gagnasafninu ef þörf krefur. LeRobot v3.0 gagnasafn veldur því að GR00T hleðslutækið hrynur og verður að umbreyta niður í v2.1.
- Ræstu, fylgstu með tapi, ýttu eftirlitsstöðvum á varanlegan stað eftir því sem þær eru skrifaðar.
- Eyðileggðu tilvísunina, athugaðu síðan að þú hafir eyðilagt hana.
# GR00T N1.7, single GPU, Isaac-GR00T as of August 2026.
# Note the entry point: gr00t/experiment/launch_finetune.py, a tyro CLI.
# scripts/gr00t_finetune.py does not exist in this repository; tutorials that
# still reference it are stale. The per-embodiment walkthrough is
# getting_started/finetune_new_embodiment.md.
CUDA_VISIBLE_DEVICES=0 uv run python gr00t/experiment/launch_finetune.py \
--base-model-path nvidia/GR00T-N1.7-3B \
--dataset-path demo_data/cube_to_bowl_5 \
--embodiment-tag NEW_EMBODIMENT \
--modality-config-path examples/SO100/so100_config.py \
--num-gpus 1 \
--output-dir ./so100-checkpoints \
--max-steps 20000 \
--global-batch-size 32 \
--dataloader-num-workers 4
# v3.0 dataset? Convert it down first or the loader will crash. The helper
# has its own pyproject and must be installed in its own environment:
cd scripts/lerobot_conversion
uv venv && source .venv/bin/activate
uv pip install -e .
python convert_v3_to_v2.py --repo-id <DATASET_REPO_ID>Raunhæfur kostnaður fyrir eina GR00T keyrslu: 3 til 6 klukkustundir á H100 80 GB á 1.34 til 2.34 USD á klukkustund er 4 til 14 USD, auk 20 til 40 mínútna uppsetningar sem einnig er reiknuð, auk þíns eigin tíma.
Þú velur líkanið, gagnasafnið og ofurbreyturnar í formi. Bakendinn leigir spot GPU sem er stærðar eftir VRAM sem líkanið þarf, keyrir þjálfarann og skrifar eftirlitsstöðvar í hlutageymslu.
- Veldu samsetningu þína á þjálfunarfylkinu: fimm líkön, fjórir armar, ein leiðbeining á hverja reit.
- Beindu því á gagnasafn: eitt tekið upp með skjáborðsforritinu, Hugging Face repo id, eða eitt frá þinni eigin vél.
- Samþykktu sjálfgefnar stillingar eða stilltu þær. Taflan hér að ofan er það sem í raun er sent til þjálfarans.
- Bakendinn velur kortið eftir nauðsynlegu VRAM, svo þú þarft aldrei að versla fyrir GPU.
- Eftirlitsstöðvar lenda í hlutageymslu eftir því sem þær eru skrifaðar, svo trufluð keyrsla er ekki glötuð keyrsla.
| Flokkur | Líkön | Keyrslutími | Kostnaður á keyrslu |
|---|---|---|---|
| A100 80 GB eða H100 | GR00T N1.7, GR00T N1.5, Pi0.5 | 3 til 6 klukkustundir | um 4 til 12 USD |
| RTX 4090 eða hvaða 24 GB kort sem er | SmolVLA, ACT | 2 til 5 klukkustundir | um 1 til 3 USD |
Það sem það gerir ekki: gera slæmt gagnasafn gott, gefa GR00T fræ sem það hafði aldrei, eða fjarlægja seinkunarmörkin sem lýst er hér að neðan. Það fjarlægir GPU verslunina, umhverfisbygginguna og podinn sem þú gleymdir að eyðileggja. Virkni er í þjálfunarskjölunum.
Hvað pallurinn rukkar og hvernig hann velur kortið
Rökfræðin er vísvitandi leiðinleg. Sérhver gerð í vörulistanum lýsir yfir GPU-flokki; bakendinn tekur nauðsynlegt VRAM og leigir samsvarandi kort á sama sprotamarkaði sem mældur er hér að ofan. Þess vegna er uppgefin kostnaður svið, ekki verð. GR00T og Pi0.5 eru eingöngu í skýinu hér vegna 40 GB og 70 GB lágmarkanna. SmolVLA og ACT keyra einnig staðbundið á þínu eigin 24 GB korti, þar sem skýkostnaður er núll og rafmagn er þitt vandamál.

Einn hnappur á skilið viðvörun. Hallauppsöfnun á sannarlega við um báðar GR00T afbrigðin, svo að hækka hana kaupir stærri virka lotu á sama korti. Fyrir Pi0.5 og SmolVLA á það alls ekki við: lerobot 0.5.1 hefur engan hallauppsöfnunarvalkost í þjálfunarstillingum sínum, svo að stilla reitinn á 16 kostar ekkert og kaupir ekkert. Ef biðraðarstarf byrjar aldrei, síðan um föst störf í biðröð fjallar um hvað á að athuga; ef gagnasafni er hafnað áður en keyrsla hefst, er það næstum alltaf vandamálið með v3.0 sniðið.
Leigð GPU sem þjónar stefnu þinni yfir almenningsnetið bætir við ferðatímum í stjórnlykkju sem er nú þegar 20 til 485 ms á hverju aðgerðarskrefi. Í lagi fyrir hæga val-og-setja aðgerðir, ekki fyrir hraðvirka viðbragðshreyfingu. Skýjaálagning metur gátpunkt vel en keyrir framleiðslustýringu illa: ef verkefnið þarf hraða verður útreikningurinn að vera við hliðina á servóunum, og það er kostnaður sem þessi grein getur ekki látið hverfa. Sjá biðtíma ályktunar.
Útreiknað fjárhagsáætlun fyrir fyrstu virku stefnuna
Allar fjórar línurnar saman, byrjað frá grunni. Heildar GPU kostnaður gerir ráð fyrir 3 til 5 keyrslum: sú fyrsta sannar að pípan virkar, sú önnur afhjúpar gagnagvandamál, sú þriðja eða fjórða er sú sem þú heldur.
| Liður | Hagkvæm leið | Þægileg leið |
|---|---|---|
| Armur | SO-100 fylgjandi eingöngu, 121.94 USD í efnislista | leiðtogi plús fylgjandi, 229.88 USD í efnislista |
| Líkan | SmolVLA eða ACT, 24 GB flokkur | GR00T N1.7, A100 80 GB eða H100 flokkur |
| Upptökur af þáttum | 30, lágmark SmolVLA | 50 to 100 |
| Mannlegur tími til upptöku | um 1 klst 12 mín | 2 til 4 klukkustundir |
| Kostnaður við eina keyrslu | 1 to 3 USD | 4 to 12 USD |
| Keyrslur áður en það virkar | 3 to 5 | 3 to 5 |
| Heildar GPU útgjöld | 3 to 15 USD | 12 to 60 USD |
| Stærsti liður á reikningnum | armurinn, síðan tími þinn | armurinn, síðan tími þinn |
Mynstrið heldur við þessa stærð vélmennis: útreikningar eru námundunarvilla, vélbúnaður er raunverulegur eingreiðslukostnaður, mannstundir eru endurtekin útgjöld. Til að prófa þjálfunarhlutann áður en nokkuð er keypt, gera þér kleift að bera saman líkön og leigja GPU án þess að þurfa vélmennisarm, og er líkamlegur SO-100 sem þú getur stýrt í vafranum án skráningar. Fyrir alla ferlið frá upphafi til enda, þá er fjallar um uppsetningu, og þjálfun, og er styttri útgáfan.

Hvað kostar ein VLA fínstillingar keyrsla frá upphafi til enda?▾
Um 4 til 12 USD fyrir GR00T N1.7, GR00T N1.5 eða Pi0.5 á A100 80 GB eða H100 flokki (3 til 6 klukkustundir á 1.20 til 2.00 USD á klukkustund), og um 1 til 3 USD fyrir SmolVLA eða ACT á RTX 4090 flokki (2 til 5 klukkustundir á 0.30 til 0.60 USD á klukkustund). Að leigja kortið sjálfur lendir í sama verðbili þegar uppsetningartími er talinn, þar sem það er rukkað á þjálfunarverði.
Er H100 þess virði að borga fyrir fram yfir A100 80 GB?▾
Fyrir eina SO-100 stefnu, venjulega ekki. Bæði uppfylla minniskröfur GR00T og Pi0.5, og í lestri 23. ágúst 2026 byrjaði full A100 80 GB á 0.44 USD á klukkustund á móti 1.34 fyrir H100 80 GB. H100 lýkur fyrr, svo hluti af verðinu kemur til baka sem færri klukkustundir, en heildarkostnaðurinn er samt hærri fyrir svona litla keyrslu. Raunveruleg rök fyrir H100 eru framboð: fimm stakar H100 80 GB tilboð á þeim markaði á móti tveimur A100 80 GB, og kort sem þú getur ekki leigt hefur ekkert verð.
Hversu margar keyrslur þarf áður en stefna virkar í raun?▾
Gerðu ráð fyrir þremur til fimm. Sú fyrsta sannar að ferlið er rétt tengt. Önnur afhjúpar oft vandamál með gagnasafnið, eins og myndavélarstraum sem dó í miðri keyrslu. Þriðja eða fjórða er sú sem þú heldur.
Get ég þjálfað SmolVLA eða ACT á eigin GPU í stað þess að leigja?▾
Já. Bæði eru studd staðbundið á AY-Robots og bæði passa vel í 24 GB; upprunalega ACT ritgerðin þjálfaði 80M líkanið sitt á um 5 klukkustundum á 11 GB RTX 2080 Ti. GR00T og Pi0.5 eru eingöngu í skýinu hér vegna þess að skjalfestar fínstillingarminniskröfur söluaðila eru 40 GB og 70 GB, og stærsta neytendakortið á markaðnum er 32 GB RTX 5090.
Hvers vegna kostar sami fjöldi skrefa mismunandi mikið eftir líkönum?▾
Skref eru ekki sambærileg milli stefna. ACT er sjálfgefið 100.000 skref við lotu 8 á 24 GB korti; GR00T N1.5 er sjálfgefið 2.000 skref við lotu 1 með hallasöfnun 16 á 80 GB korti. Reikningurinn er klukkustundir margfaldaðar með verði kortsins sem minnisnotkunin neyðir þig til að nota, ekki skrefateljarinn.
Sjáðu hvað keyrslan þín myndi kosta áður en þú byrjar hana
Hver af fimm stefnum listar GPU flokk sinn, keyrslutíma og verð á keyrslu, og þjálfunarbakendinn leigir kortið á sama staðmarkaði og þessar tölur voru mældar á.
Skoða verðlagninguSources
- SmolVLA: A Vision-Language-Action Model for Affordable and Efficient Robotics
- GR00T N1: An Open Foundation Model for Generalist Humanoid Robots
- Learning Fine-Grained Bimanual Manipulation with Low-Cost Hardware (ACT / ALOHA)
- pi-0.5: a Vision-Language-Action Model with Open-World Generalization
- NVIDIA Isaac-GR00T: hardware requirements, launch_finetune.py and finetune_config.py defaults
- huggingface/lerobot: CLI entry points, policies and LeRobotDataset v3
- Physical Intelligence openpi: GPU memory requirements for pi0 and pi0.5
- SO-ARM100 / SO-101 bill of materials and STS3215 voltage variants
- LeRobot docs: fine-tuning SmolVLA, 20k steps in about 4 hours on one A100
- LeRobot docs: lerobot-record defaults, episode and reset times, dataset advice
- RunPod GPU pricing: Community Cloud and Secure Cloud hourly rates per card
- Vast.ai: on-demand versus interruptible rentals, bidding and what a pause does to your processes
- Hugging Face pricing: Spaces hardware hourly rates, A100 80 GB at 2.50 USD/h
- Isaac Lab Arena: GR00T N1.6 post-training hardware options and wall-clock reference figures
- lerobot on PyPI, version 0.6.1 released 3 August 2026
Ready for high-quality robotics data?
AY-Robots connects your robots to skilled operators worldwide.
Get Started