AY-Robots proovileht: kolm võimalust alustamiseks ilma robotit omamata, sealhulgas GPU rentimine poliitika järeldamiseks
GR00T N1.7KaugjäreldaminePilve-GPULeRobotSO-100Latentsus

Käivita GR00T järeldamine ilma kohaliku GPUta

AY-Robots ResearchAugust 23, 202619 min lugemist

Sinu robotmasinal pole GPU-d. Paigalda GR00T poliitikaserver renditud pilve-GPU-le, voogedasta tegevusplokke käele ja saa teada, mida võrk sulle täpselt maksma läheb.

Raspberry Pi on piisav, et juhtida SO-100 üle jadasiini ja tõmmata kaadreid kahest USB-kaamerast. See ei ole piisav kolme miljardi parameetriga nägemis-keele-tegevuse mudeli käitamiseks: NVIDIA README paigutab GR00T N1.7 järelduse ühele GPU-le 16 GB või enama VRAM-iga. Et näha, mida teie peenhäälestatud GR00T N1.7 kontrollpunkt teeb käel ilma kaarti ostmata, pange poliitika renditud pilve-GPU-le, hoidke roboti silmus USB-portidega masinas ja saatke vaatlused ja tegevustükid võrgu kaudu.

See töötab, see ei ole tasuta ja hind ei jaotu ülesannete vahel ühtlaselt. Allpool: NVIDIA enda poliitikaserver, leroboti asünkroonne virn, aritmeetika, mis ütleb ette, kas teie üleslaadimiskiirus on piisav, ja platvormi marsruut. Kõik see on kontrollitud Isaac-GR00T põhiharu (N1.7 GA) ja lerobot 0.6.1 vastu 23. augustil 2026.

Mida peate teadma

  • GR00T N1.7, GR00T N1.5 ja Pi0.5 on ligikaudu 3 miljardi parameetriga mudelid. Ükski neist ei mahu robotikontrollerile ilma diskreetse GPU-ta.
  • Isaac-GR00T ja lerobot tarnivad mõlemad kliendi-serveri jaotuse. Te ei kirjuta transporti.
  • Vaatlused domineerivad võrgukulu, mitte tegevused: kaks pakkimata 640x480 RGB kaadrit on 1 843 200 baiti, umbes 14,7 Mbit kõne kohta, ja kumbki virn neid ei paki.
  • AY-Robots loetleb 20 kuni 485 ms tegevussammu kohta mudeli järgi. Interneti edasi-tagasi reisid lisanduvad sellele.
  • Kaugjäreldus sobib aeglaseks valimiseks ja paigutamiseks, mitte kiireks reaktiivseks liikumiseks. Pikem täitmisperiood ostab aega ja maksab vaatluste värskuse arvelt.
  • Kumbki server ei ole avalikul IP-l tarnituna turvaline ja leroboti oma sisaldab parandamata RCE-d. Tunneldage see.

Miks poliitika robotimasinasse ei mahu

Kaks viiest AY-Robotsi poolt treenitavast poliitikast töötavad tööjaama kaardil, kolm mitte. veerg allpool on tegevussammu kohta ja see on number, mis konkureerib teie võrgu edasi-tagasi reisi ajaga.

PoliitikaParameetridJäreldamine tegevussammu kohtaGPU tase treenimiseksMinimaalsed episoodidAndmestiku formaat
GR00T N1.7~3 B, ~40 M trained during fine-tuning152 msA100 80 GB or H100 80 GB50LeRobot v2.0 or v2.1
GR00T N1.5~3 B165 msA100 80 GB or H100 80 GB50LeRobot v2.0 or v2.1
Pi0.5~3 B, PaliGemma backbone485 msA100 80 GB or H100 80 GB50LeRobot v3.0
SmolVLA~450 M245 msRTX 4090 or any 24 GB card30LeRobot v3.0
ACT~80 M20 msRTX 4090 or any 24 GB card50LeRobot v3.0
AY-Robotsi poliitikate leht, mis võrdleb viit treenitavat poliitikat parameetrite, GPU taseme, järeldamise latentsuse ja minimaalsete episoodide järgi
Samad viis rida lehel /policies. Latentsuse veerg otsustab, kas poliitika elab võrguhüppe üle.

Lugege seda otsusena, mitte tühisena. kiirusega 20 ms sammu kohta töötab robotmasinal ja te ei pea sellele enam kunagi mõtlema. kiirusega 485 ms on kulutanud kolmandiku sekundist enne, kui pakett teie hoonest lahkub. ja lisavad täpsuse poole.

ACT-il pole baasmudelit

GR00T N1.7, GR00T N1.5 ja Pi0.5 alustavad tarnija kontrollpunktist (nvidia/GR00T-N1.7-3B, nvidia/GR00T-N1.5-3B, lerobot/pi05_base). ACT-i ei eksisteeri enne, kui olete selle oma ülesande jaoks treeninud, seega pole midagi kaugteenindada enne, kui treeningtöö on käivitatud. Vaata ACT on SO-100.

Kaks juba eksisteerivat kliendi-serveri virna

Isaac-GR00T tarnib ZeroMQ päringu-vastuse serveri; lerobot tarnib gRPC serveri, mis on ehitatud asünkroonse järeldamise ümber. Mõlemad aktsepteerivad GR00T kontrollpunkt. lerobot'i toetatud poliitikate loend asukohas async_inference/constants.py on act, smolvla, diffusion, tdmpc, vqbet, pi0, pi05 ja groot; selle robotite loend on so100_follower, so101_follower, bi_so_follower ja omx_follower.

Isaac-GR00T PolicyServerlerobot async inference
Sisendpunktgr00t/eval/run_gr00t_server.pypython -m lerobot.async_inference.policy_server
TransportZeroMQ REQ/REPgRPC, add_insecure_port / insecure_channel
Serialiseeriminemsgpack + msgpack_numpy, allow_pickle=False enforcedpickle.dumps / pickle.loads, marked # nosec
Vaikimisi port55558080
Vaikimisi sidumine0.0.0.0, kõik liidesedlocalhost
Autentimineapi_token supported by the class, not passed by the CLIpuudub
Kliendi ajalõpp15000 ms (PolicyClient timeout_ms)2 s observation queue timeout
Täitmismudelsünkroonne: blokeeri, seejärel täida tükkasünkroonne: täida, samal ajal kui järgmine tükk arvutab

Serialiseerimisrida on olulisem, kui esmapilgul paistab. GR00T-i MsgSerializer keeldub objekt-tüüpi ndarray andmekogumitest mõlemas suunas, sest msgpack_numpy annaks need muidu pickle'ile. lerobot kasutab selle asemel pickle'it: policy_server.py kutsub pickle.loads päringuandmetel, robot_client.py pakib saadetud vaatluse pickle'isse. Kaitstav usaldusväärses LAN-is, kaitsetu, kui port on internetist ligipääsetav.

Tee A: NVIDIA enda GR00T poliitikaserver

See on tee, mida NVIDIA dokumenteerib SO-100 ja SO-101 riistvara jaoks, ja see, mida kasutada, kui teie kontrollpunkt pärineb examples/finetune.sh koos --embodiment-tag NEW_EMBODIMENT. Need sammud lisavad selle, mida ülesvoolu README välja jätab: pordi viimine robotini ilma seda kõigile teistele paljastamata.

  1. 1
    Installige GR00T renditud GPU-arvutisse

    Alamoodulid on vajalikud ja git-lfs peab eksisteerima enne kloonimist, vastasel juhul saabuvad parquet-failid kaustas demo_data viitadena. flash-attn ja TensorRT tulevad vaikimisi installiga. Värske podi kujutise puhul on probleemiks: torchcodec 0.8.0 on ainus toetatud videotaustsüsteem ja laadib ainult FFmpeg 4 kuni 7. Ubuntu 25.10 ja 26.04 tarnivad FFmpeg 8, seega GR00T ebaõnnestub veaga Could not load libtorchcodec. Installige FFmpeg, mis on vanem kui 8, ja lisage selle teegid LD_LIBRARY_PATH-i.

    bash
    sudo apt install git-lfs && git lfs install
    curl -LsSf https://astral.sh/uv/install.sh | sh
    sudo apt-get update && sudo apt-get install -y ffmpeg
    
    git clone --recurse-submodules https://github.com/NVIDIA/Isaac-GR00T
    cd Isaac-GR00T
    uv sync --python 3.12
    uv run python -c "import gr00t; print('GR00T installed successfully')"
  2. 2
    Autentimine piiratud taustsüsteemi vastu

    Iga GR00T N1.7 kontrollpunkt, sealhulgas teie enda peenhäälestus, laadib esmakordsel kasutamisel piiratud nvidia/Cosmos-Reason2-2B. Taotlege juurdepääsu mudeli lehel ja logige sisse podi, vastasel juhul ebaõnnestub laadimine veaga GatedRepoError.

    bash
    uv run huggingface-cli login
    # or:  export HF_TOKEN=<your_token>
  3. 3
    Käivitage poliitikaserver

    Suunake --model-path oma kontrollpunkti kataloogile; sellel teel ignoreerib server --modality-config-path-i, mida loetakse ainult taasesituse teel. Jätke --model-path välja ja edastage selle asemel --dataset-path pluss --execution-horizon ReplayPolicy jaoks, mis taasesitab salvestatud toiminguid – see on odavaim viis tõestada, et ühendus töötab.

    bash
    uv run python gr00t/eval/run_gr00t_server.py \
      --model-path /workspace/so100_finetune/checkpoint-10000 \
      --embodiment-tag NEW_EMBODIMENT \
      --device cuda:0 \
      --host 127.0.0.1 --port 5555
  4. 4
    Tunneldage port 5555 robotmasinasse

    Siduge tagasisideaadressiga, nagu ülal, ja edastage port üle SSH või WireGuard-stiilis võrgu. See pakub krüpteerimist ja autentimist, mida ZeroMQ pesa ei paku, umbes millisekundi jooksul.

    bash
    # on the robot machine
    ssh -N -L 5555:127.0.0.1:5555 root@<pod-host> -p <pod-ssh-port>
    
    # sanity check that something answers
    nc -vz 127.0.0.1 5555
  5. 5
    Käivitage robotiklient servode kõrval

    Klient vajab oma uv-keskkonda: see soovib lerobot'i robotidraivereid, mitte treeningvirna. eval_so100.py impordib so100_follower, so101_follower ja koch_follower, seega edastage oma käele vastav --robot.type (ülesvoolu README kasutab so101_follower). Kaamera võtmed peavad vastama treeningule: adapter loeb täpselt front ja wrist, ja nende vahetamine näitab poliitikale vale vaadet.

    bash
    cd gr00t/eval/real_robot/SO100
    uv sync
    uv pip install --no-deps -e ../../../../
    
    uv run --no-sync python eval_so100.py \
      --robot.type=so100_follower \
      --robot.port=/dev/ttyACM0 \
      --robot.id=orange_follower \
      --robot.cameras="{ front: {type: opencv, index_or_path: 6, width: 640, height: 480, fps: 30}, wrist: {type: opencv, index_or_path: 2, width: 640, height: 480, fps: 30}}" \
      --policy_host=127.0.0.1 \
      --policy_port=5555 \
      --lang_instruction="pick up the red block and put it in the bin"
Kaks vaikeseadet, mis teile probleeme tekitavad

run_gr00t_server.py vaikeseade on --host 0.0.0.0, sidudes iga liidese: avaliku IP-ga podis on see avatud järelduspunkt. Ja klass PolicyServer aktsepteerib api_token'i ja valideerib seda iga päringu kohta, kuid run_gr00t_server.py ei edasta seda kunagi, seega on CLI server autentimata, olenemata teie konfiguratsioonist. Siduge 127.0.0.1-ga ja looge tunnel. ZMQError: Address already in use tähendab, et port 5555 on hõivatud; edastage --port.

Tee B: lerobot asünkroonne järeldamine

lerobot lahendab teistsuguse probleemi. Selle asemel, et robotit blokeerida, kuni mudel mõtleb, jätkab klient juba olemasoleva järjekorra läbimist, samal ajal kui server arvutab järgmise tüki. See on tegevuste tükeldamine, edasi arendatud, asünkroonne virn, mis võeti kasutusele koos SmolVLA-ga. See töötab ka GR00T kontrollpunktiga.

bash
# GPU machine
pip install -e ".[async]"
python -m lerobot.async_inference.policy_server \
     --host=127.0.0.1 \
     --port=8080

# robot machine, after tunnelling 8080
python -m lerobot.async_inference.robot_client \
    --server_address=127.0.0.1:8080 \
    --robot.type=so100_follower \
    --robot.port=/dev/ttyACM0 \
    --robot.id=follower_so100 \
    --robot.cameras="{ front: {type: opencv, index_or_path: 0, width: 640, height: 480, fps: 30}, wrist: {type: opencv, index_or_path: 1, width: 640, height: 480, fps: 30}}" \
    --task="pick up the red block and put it in the bin" \
    --policy_type=groot \
    --pretrained_name_or_path=<user>/my_groot_finetune \
    --policy_device=cuda \
    --actions_per_chunk=50 \
    --chunk_size_threshold=0.5 \
    --debug_visualize_queue_size=True
Poliitikaserver GPU-l, roboti klient USB-portidega masinas

Server käivitub tühjana: see ei tea, millist poliitikat see teenindab, enne kui kliendi esimene käepigistus seda talle ütleb, mis on renditud podi puhul mugav. Kaks nuppu, mis otsustavad, kas käsi liigub sujuvalt, on actions_per_chunk ja chunk_size_threshold (leroboti dokumendid nimetavad teist g-ks, SmolVLA paberi järgi), ja dokumenteeritud väärtused ning tarnitud väärtused ei ühti.

ParameeterVäärtus lerobot 0.6.1 koodisMida see teebMärkus
actions_per_chunkvaikimisi puudub, nõutavTagastatud toimingud kutse kohtaDokumentide tabelis on 50; andmeklassi väljal puudub vaikimisi väärtus, seega nõuab CLI väärtust
chunk_size_threshold0.5Järjekorra täituvuse suhe, mille juures või all klient saadab uue vaatluseDokumentide tabelis on 0.7; kood ja dokumentide enda näide ütlevad 0.5
fps30Kliendi juhtimiskiirus, määrab environment_dt = 1/fpsVähendage seda, kui järjekord tühjeneb pidevalt
inference_latency1/30 s (33.3 ms)Sihtjärelduse latentsus serverisSiht, mitte mõõtmine
obs_queue_timeout2 sKui kaua server vaatluste järjekorras ootabAeglane üleslaadimine ilmneb siin esimesena
aggregate_fn_nameweighted_averageKuidas kattuvad tükipiirkonnad segatakse0.3 vana + 0.7 uus; tarnitakse ka latest_only, average ja conservative. Register on AGGREGATE_FUNCTIONS failis configs.py, mitte robot_client.py, nagu dokumendid väidavad
Leroboti poliitikaserveril on parandamata RCE

CVE-2026-25874 on autentimata koodi kaugkäivitus leroboti asünkroonses järeldusliinis: pickle.loads() andmetel, mis on saadud autentimata gRPC kanali kaudu ilma TLS-ita, ligipääsetav läbi SendPolicyInstructions, SendObservations ja GetActions kutsete. CWE-502, CVSS 3.1 baasskoor 9.8 NVD-st, 4.0 baasskoor 9.3 määravast CNA-st. Kirje loetleb LeRoboti kuni 0.5.1 mõjutatuna ja nimetab nii poliitikaserveri kui ka robotkliendi, seega on teie käe kõrval olev masin haardeulatuses. Uuendamine ei ole lahendus: kirje viitab ülesvoolu probleemile 3047 ja parandusele, PR 3048, mis vahetab pickle'i safetensors'i ja JSON-i vastu, ning 23. augustil 2026 on mõlemad endiselt avatud. policy_server.py peaharus kutsub endiselt pickle.loads päringuandmetel, samal ajal kui serve() seob add_insecure_port. Siduge loopbackiga ja ärge kunagi suunake porti 8080.

Aritmeetika, mis otsustab, kas teie ühendus on piisavalt kiire

Inimesed jätavad selle vahele ja kulutavad siis päeva . See võtab kaks minutit ja on peaaegu alati otsustav.

NVIDIA eval_so100.py kommenteeritud vaatlusandmete sõnastik ütleb, mis traadile läheb: kaks massiivi kujuga (480, 640, 3) uint8-s, kuus liigese ujukomaarvu, keele string. See on 921 600 baiti kaadri kohta, 1 843 200 baiti kahe kaamera kohta, umbes 14,7 Mbit, ja kumbki pinu seda JPEG-vormingus ei tihenda. Tagasi tulev andmeplokk on paarkümmend sammu 6 ujukomaarvuga. Teie üleslaadimine otsustab kõik, mitte teie allalaadimine.

Üleslaadimise ribalaiusAeg ühe vaatluse edastamiseks (14,7 Mbit)Otsus 30 FPS käe kohta
10 Mbit/s, tüüpiline kodune üleslaadimine~1.47 sKasutamatu. Käsi peatub iga andmeploki vahel.
25 Mbit/s~0.59 sAinult aeglane valimine ja paigutamine, pika täitmishorisondiga.
50 Mbit/s~0.29 sTöötav tahtlike ülesannete jaoks.
100 Mbit/s~0.15 sSobib valimiseks ja paigutamiseks, märgatav kiirel liikumisel.
1 Gbit/s fiiber või andmekeskus~0.015 sMudel muutub hoopis kitsaskohaks.

Eelarve, millesse peate mahtuma

GR00T SO-100 klient on sünkroonne: see kutsub välja policy.get_action(obs), täidab esimesed action_horizon sammu tükist 30 FPS juures, seejärel kutsub uuesti. Tüki suurus ja horisont on erinevad numbrid: NVIDIA juurutusjuhend soovitab tegevustüki suuruseks 16, vähemalt 32, kui seda kombineerida reaalajas tükeldamisega, samas kui eval_so100.py pakub täitmishorisonti 8. Kaheksa sammu 30 FPS juures on 267 ms liikumist ühe kutse kohta ja kõik muu peab sellesse mahtuma.

text
observation upload   14.7 Mbit / 100 Mbit/s   = 147 ms
network round trip                            =  30 ms
model inference (AY-Robots figure, N1.7)      = 152 ms
action chunk return + deserialize             =  ~2 ms
                                                -------
total per call                                  331 ms

budget at action_horizon = 8   ->  267 ms   FAIL, arm pauses ~64 ms per chunk
budget at action_horizon = 16  ->  533 ms   fits, with headroom
budget at action_horizon = 32  -> 1067 ms   fits, observations now ~1 s stale
Töötav näide: 100 Mbit/s üleslaadimine, 30 ms edasi-tagasi viivitus, GR00T N1.7

Horisondi tõstmine on jäme lahendus ja mitte tasuta: käsi tegutseb vaatluse põhjal, mis on nüüd vana. Põhimõtteline lahendus on reaalajas tükeldamine (real-time chunking), mis arvutab järgmise tüki, samal ajal kui praegune töötab, külmutab garanteeritult täidetavad tegevused ja täiendab ülejäänud; RTC artikkel teatab, et see on vastupidav järeldusviivitusele ilma ümberõppeta. Kontrollige esmalt, kuidas sellega lood on. NVIDIA märgib RTC eksperimentaalseks, madala taseme mudeli primitiiviks, mis on ligipääsetav läbi action_head.get_action(..., options={"rtc_overlap_steps": ..., "rtc_frozen_steps": ...}), mis ei ole ühendatud Gr00tPolicy'sse ega serveri-kliendi teekonda, kus options on kasutamata, ilma testide ja näideteta. Poliitikaserveri kaudu saate asünkroonse täitmise, mitte RTC.

Mida mudel maksab enne võrku

NVIDIA võrdleb GR00T N1.7-t otsast lõpuni 4 müravähendussammuga ühe kaameraga. H100 80GB HBM3-l: 85.8 ms (11.7 Hz) PyTorch eager režiimis, 48.6 ms (20.6 Hz) koos torch.compile'iga, 27.9 ms (35.9 Hz) koos TensorRT täieliku torujuhtmega. L40 eager režiimis võtab 128.3 ms (7.8 Hz). NVIDIA nimetab 10 Hz-i tüüpilise manipuleerimise soovitatavaks miinimumiks ja alla 10 Hz sobib ainult aeglasteks, mitte-reaktiivseteks ülesanneteks. Need on ümberplaneerimise kiirused: 10 Hz poliitika suudab ikkagi juhtida 30 FPS kätt tegevustükeldamise kaudu. Teine kaamera viib teid valele teele.

Mõõda enne, kui usaldad

Iga ülaltoodud number on ennustus. Neli käsku muudavad selle mõõtmiseks, mida tasub käivitada enne, kui pühendada pod-tund ülesandele, mis poleks kunagi toiminud.

  1. 1
    Hangi toor-edasi-tagasi aeg

    Podi vastu, mitte CDN-i vastu. Jälgi hälvet sama tähelepanelikult kui keskmist: värin paneb käe kokutama, mitte keskmine latentsus.

    bash
    ping -c 50 <pod-host>
    # the mdev column is the number that predicts stutter
  2. 2
    Mõõda üleslaadimiskiirust, mis sul on, mitte seda, mille eest maksad

    Elamuühenduse üleslaadimiskiirus on tavaliselt murdosa allalaadimiskiirusest ja see on ülaltoodud ribalaiuse tabelis olev number.

    bash
    # on the pod
    iperf3 -s
    
    # on the robot machine, -R omitted so this measures upload
    iperf3 -c <pod-host> -t 30
  3. 3
    Loe kliendi enda latentsuse logi

    LeRobot roboti klient logib iga tüki serveri-kliendi latentsuse ja deserialiseerimise aja. Marsruudil B ei vaja sa välist tööriista.

    text
    Received action chunk for step #240 | Latest action: #232 |
      Incoming actions: 240:289 |
      Network latency (server->client): 187.44ms |
      Deserialization time: 3.10ms
  4. 4
    Jälgi tegevuste järjekorra tühjenemist

    Edasta --debug_visualize_queue_size=True ja klient joonistab järjekorra suuruse käitusajal. Kui see korduvalt nulli jõuab, oled eelarvest väljas: alanda kaadrisagedust, suurenda actions_per_chunk või suurenda chunk_size_threshold, et vaatlused sagedamini välja saadetaks.

    bash
    python -m lerobot.async_inference.robot_client \
        ... \
        --debug_visualize_queue_size=True

Milleks kaugjäreldamine tegelikult hea on

Poliitika renditud GPU-l, käsi teie laual
Eelised
  • Saate hinnata 3 B parameetriga poliitikat reaalsel riistvaral, omamata kaarti, mis maksab rohkem kui käsi.
  • GPU-d renditakse tunni kaupa, nii et ebaõnnestunud kontrollpunkt maksab paar dollarit.
  • Roboti pool jääb väikeseks: lerobot draiverid, kaks kaamerat, jadaport ja saate kontrollpunkte vahetada seda puudutamata.
Kompromissid
  • Pakkimata vaatlused domineerivad võrgukulu ja kodune üleslaadimine on piirav tegur.
  • Jitter teeb rohkem kahju kui latentsus: link, mille keskmine on 40 ms ja tipud 300 ms-ni, hakkib, kus stabiilne 120 ms link seda ei tee.
  • Kiired reaktiivsed ülesanded ei ela edasi-tagasi reisi üle ühelgi horisondil.
  • Mõlemad serverid tarnitakse autentimata CLI-vormis, seega tunneldamise töö on teie.
  • Katkenud ühendus tüki keskel jätab käe hoidma aegunud tegevust. Lisage oma valvekoer roboti poolele.
ÜlesanneTöötab avaliku interneti kaudu?Miks
Vali staatiline objekt, aseta see kastiJahVaatluse ja tegevuse vahel ei liigu midagi.
Laota klotse tahtlikus temposJah, at action_horizon 16 or moreVead kogunevad piisavalt aeglaselt, et neid järgmises tükis parandada.
Ava sahtel, sisesta objektTavaliseltKontaktirikas, kuid aeglane. Jälgi peatumisi ja liikumisi kontakti korral.
Jälgi liikuvat objektiEiPoliitika tegutseb 300 ms kuni 1 s vanuse vaatluse põhjal.
Püüa, tasakaalusta või taastu libisemisestEiParandusaken on lühem kui üks edasi-tagasi reis.
30 Hz sünkroonne suletud ahelEiEelarve on 33 ms otsast otsani. Isegi LAN-il on raskusi.

Kui kaugkäivitus hakkib igas episoodis samas punktis, ei ole võrk tõenäoliselt põhjus. Poliitika, mis iga kord samas liigese nurgas kõhkleb, on tavaliselt andmeprobleem; vaadake vearežiimide lehti, eriti poliitika, mis töötab ainult ühes seadistuses ja kaotus langeb, kuid poliitika ei tee midagi.

Ise tegemine vs AY-Robotsis tegemine

  1. Rendi GPU hetketurult ja oota piisavalt VRAM-i sulle sobiva hinnaga.
  2. Installi CUDA, uv, ffmpeg torchcodec, mis aktsepteerib, ja GR00T virn koos alamoodulitega.
  3. Taotle juurdepääsu piiratud nvidia/Cosmos-Reason2-2B selgroole ja paigalda token podile.
  4. Tõmba oma kontrollpunkt podile.
  5. Käivita server loopback-režiimis, seejärel loo SSH tunnel robotmasinast.
  6. Installi robotmasinasse teine keskkond kliendi ja draiverite jaoks.
  7. Vasta kaamera võtmed, liigeste nimed ja keeleline juhis sellele, mida kontrollpunkt nägi.
  8. Jälgi podi. Unustatud A100, mis töötab üleöö, maksab rohkem kui eksperiment.
Tühikäigul olev pod on tegelik kulu

GPU arve ei peatu, kui robot peatub. Enamik kaugjäreldustel kaotatud rahast läheb serverile, mis jäi tööle pärast seda, kui kõik lahkusid. Sea äratus või automatiseeri mahavõtmine.

AY-Robots MCP serveri leht, mis loetleb platvormi toimingud, mis on esitatud tööriistadena tehisintellekti agentidele
MCP leht: varustamise ja järelduste tegemise toimingud, mis on esitatud tööriistadena, mida agent saab kutsuda.

Mida kaugjärelduste sessioon maksab

Olulised on kaks numbrit: kaardi tunnitasu ja see, kui kaua te seda töös hoiate. Esimene on avaldatud; teine üllatab inimesi.

KaartRunpod kogukonnapilvRunpod turvaline pilvSobib
A100 PCIe 80 GB1.19 USD/h1.39 USD/hGR00T N1.7, GR00T N1.5, Pi0.5
A100 SXM 80 GB1.39 USD/h1.59 USD/hSama, veidi kiirem
H100 PCIe 80 GB1.99 USD/h2.89 USD/hKiireim tase; NVIDIA 11,7 Hz eager-näitaja on H100 80GB HBM3 jaoks
L40S 48 GB0.79 USD/h0.99 USD/hAinult järeldamine, üle 16 GB piiri
RTX 4090 24 GB0.34 USD/h0.74 USD/hSmolVLA, ACT

Need hinnad loeti Runpodi hinnalehelt 23. augustil 2026 ja hetketurud liiguvad. AY-Robots pakub terve käivituse asemel: 3 kuni 6 tundi hinnaga 1,20 kuni 2,00 USD tunnis A100 või H100 tasemel, umbes 4 kuni 12 USD GR00T või Pi0.5 käivituse eest; 2 kuni 5 tundi hinnaga 0,30 kuni 0,60 USD tunnis 24 GB tasemel, 1 kuni 3 USD SmolVLA või ACT jaoks. Järeldamise sessioon on treeningkäivitusest odavam ainult siis, kui selle peatate, milleks ongi tühikäigu valvekoer. Vaata arvelduse dokumente ja hinnalehte.

AY-Robotsi kulutabel, mis näitab, millist GPU-d iga poliitika vajab, tüüpilist käivitusaega ja hinda ning episoode enne, kui poliitika on kasulik
Kulutabel lehel /try: millist kaarti iga mudel vajab ja mida käivitus tavaliselt maksab.

Kui eelistate, et võrk ei oleks ahelas

Kaugjäreldamine lahendab riistvaraprobleemi ja tekitab latentsusprobleemi. Mõnikord on parem vastus poliitika, mis sobib teie olemasoleva riistvaraga.

  • ACT, ligikaudu 80 M parameetrit ja 20 ms tegevussammu kohta, minimaalselt 50 episoodi, mis tahes 24 GB kaart. Korduva ühe ülesande seadistuse korral edestab see sageli kaugjuhtimisega 3 B mudelit, sest see ei oota kunagi paketti.
  • SmolVLA, ligikaudu 450 M parameetrit ja 245 ms tegevussammu kohta, minimaalselt 30 episoodi. See säilitab keelelise tingimise, mis ACT-l puudub, ja lerobot docs hindab selle järeldamise ajal umbes 2 GB-le, võrreldes PI0 ligikaudu 14 GB-ga.
  • ACT vs GR00T N1.7 tehingu täpsuse poole jaoks.

On ka kesktee: treenida pilves, hinnata lokaalselt. Peenhäälestus vajab 80 GB kaarti ja ei hooli latentsusest, seega GR00T N1.7 treenimine SO-100-l eemalt on vaieldamatu. Ainult hindamistsüklil on reaalajas piirang; treeningu dokumendid ja mudeli- ja käe maatriks katavad selle poole.

Kätt veel laual pole?

Juhtige päris SO-100 brauseris ilma registreerimata, võrrelge viit treenitavat poliitikat nende tegelike latentsusnumbritega või rentige GPU ja treenige üks. Kolm võimalust alustamiseks, millest ükski ei vaja riistvara, mis teile ei kuulu.

Proovige seda ilma riistvarata

Korduma kippuvad küsimused

Kas ma saan käitada GR00T N1.7 Raspberry Pi-l, kui GPU on kaugel?

Jah, selleks ongi kliendi-serveri jaotus. Pi käitab lerobot draivereid, loeb kahte kaamerat ja jadasiini ning saadab vaatlused poliitikaserverile; see ei laadi kunagi mudelit. Piirang liigub VRAM-ilt üleslaadimise ribalaiusele: kaks pakkimata 640x480 RGB kaadrit on 1 843 200 baiti kõne kohta ja kumbki pinu neid ei paki.

Kui palju latentsust võrk tegelikult lisab?

Edasi-tagasi aeg pluss vaatluse edastamise aeg. Edastusaeg on 14.7 Mbit jagatud teie üleslaadimise ribalaiusega: ligikaudu 147 ms 100 Mbit/s lingil, 1.47 s 10 Mbit/s lingil. Mõlemad lisanduvad mudeli enda järeldusajale, mille AY-Robots loetleb GR00T N1.7 puhul 152 ms ja Pi0.5 puhul 485 ms. Mõõtke pingi ja iperf3-ga podi vastu, mitte kiirustesti serveri vastu.

Kas kauglaiendus on piisavalt hea reaalse ülesande jaoks?

Aeglase, kaalutletud valimise ja paigutamise jaoks jah. Kõige reaktiivse jaoks ei. NVIDIA juurutusjuhend seab sünkroonse üheastmelise nõude ligikaudu 33 ms otsast lõpuni 30 FPS juures ja märgib, et jäädvustamine, võrk, järeldamine ja järeltöötlus ületavad seda rutiinselt ilma internetita.

Millist porti serverid kasutavad ja kas seda on ohutu avada?

Isaac-GR00T PolicyServer kasutab vaikimisi porti 5555 üle ZeroMQ ja seob 0.0.0.0 oma CLI-s. lerobot kasutab vaikimisi porti 8080 üle gRPC ja seob localhosti. Kumbagi pole ohutu eksponeerida: GR00T klass toetab api_tokenit, kuid run_gr00t_server.py ei edasta seda kunagi, ja lerobot marineerib andmeid ebaturvalise gRPC kanali kaudu, mis on CVE-2026-25874. Siduge loopbackiga ja kasutage SSH tunnelit.

Kas leroboti uuendamine parandab CVE-2026-25874?

Mitte seisuga 23. august 2026. CVE kirje loetleb LeRoboti kuni versioonini 0.5.1 mõjutatuna ja PyPI tarnib 0.6.1, kuid tõmbepäring, mis eemaldaks pickle'i asünkroonsest torujuhtmest, on endiselt avatud, ja policy_server.py peaharus kutsub endiselt pickle.loads välja päringuandmetel. Käsitsege võrgu isolatsiooni leevendusena, mitte versiooniuuendusena, ja eeldage, et ka roboti-poolne klient on haardes.

Kas ma saan kasutada leroboti asünkroonset klienti GR00T kontrollpunktiga?

Jah. lerobot 0.6.1 loetleb groot'i SUPPORTED_POLICIES-is koos act, smolvla, diffusion, tdmpc, vqbet, pi0 ja pi05-ga, ning nii so100_follower kui ka so101_follower on SUPPORTED_ROBOTS-is. Edastage --policy_type=groot ja suunake --pretrained_name_or_path oma kontrollpunktile. Saate asünkroonse täitmise, mida GR00T SO-100 näide ei rakenda, pickle transpordi hinnaga.

Lühiversioon

Kaugjäreldus 3 B poliitika on lahendatud inseneriprobleem, millele on lisatud lahendamata füüsikaprobleem. Inseneritöö on kaks käsku ja SSH tunnel. Füüsika on see, et 1.8 MB vaatlus peab jõudma teises riigis asuvasse GPU-sse ja tagasi tulema enne, kui käel tegevused otsa saavad. Tehke arvutused enne midagi rentimist, valige ülesanne, mis talub aegunud vaatlust, ja tõstke täitmise horisonti, selle asemel et loota lingi paranemisele.

Kui te pole veel andmestikku salvestanud, salvestage oma esimene andmestik ja SO-100 seadistusjuhend on esikohal ning LeRoboti andmestiku formaadi kirje selgitab, mida salvestaja kirjutab. Taust on nägemis-keele-tegevuse mudelites ja voolu sobitamise poliitika töös; arena kirje lingib iga võrdlusnumbri allikaga.

Sources

Sources

Ready for high-quality robotics data?

AY-Robots connects your robots to skilled operators worldwide.

Get Started