Large-Scale Data Packages

Robotik-Datensätze nach Spezifikation.Geprüft bis auf Frame-Ebene.

Für Forschungslabore, Robotik-Firmen und Foundation-Model-Teams: Imitation-Learning-Daten im Lab-Maßstab - mehrere Arme, mehrere Szenen, volles QA-Programm, Exklusivität und Liefer-SLA.

8
QA-Prüfungen pro Lieferung
Multi-Arm
parallele Aufnahme
LeRobot
oder euer Schema
SLA
Liefertermin garantiert

So sieht eine Lieferung aus

Als Referenz: unser eigener Trainingsdatensatz, mit dem wir GR00T, Pi0.5, SmolVLA und ACT auf dem SO-100 trainieren - öffentlich einsehbar, im selben Format wie eure Lieferung.

  • Aufgenommen mit derselben Pipeline, die eure Daten produziert
  • Direkt trainierbar - kein Umverpacken, keine Konvertierung
  • Jede Episode einzeln sichtbar und prüfbar
Referenz: GrosseCollectionQA bestanden
Episoden
111
Roboter
SO-100 (SO-ARM100)
Kameras
2 Perspektiven - Szene + Handgelenk
Format
LeRobot v2.1 (Parquet + MP4)
Annotation
Task-Beschreibung pro Episode
Lieferung
S3-Bucket oder Hugging Face, nach Wunsch

Brauchbar oder nicht? Wir messen es.

Bauchgefühl reicht nicht: Ob ein Datensatz ein Training trägt, entscheiden Zeitstempel, Synchronität und Labels - nicht die Anzahl der Episoden. Starte die Beispiel-Analyse und sieh dem QA-Programm bei der Arbeit zu.

  • Jede Episode einzeln geprüft, nicht nur Stichproben
  • Warnungen werden ausgewiesen, nicht weggemittelt
  • Aussortierte Episoden werden nachproduziert, nicht berechnet
QA-AnalyseDemo mit Beispieldatensatz (111 Episoden)

Sieh dir an, wie wir einen Datensatz prüfen

Acht Prüfungen, ein Urteil: brauchbar oder nicht. Die Demo läuft mit den Kennzahlen unseres Referenz-Datensatzes.

QA: das volle Programm

Jede dieser Prüfungen existiert, weil der Fehler dahinter in echten Aufnahme-Pipelines wirklich passiert - und Trainings still ruiniert, wenn ihn niemand sucht.

Framedrop-Erkennung

Zeitstempel-Analyse pro Kamera - synthetisch aufgefüllte Frames und Aussetzer fliegen auf, statt sich im Datensatz zu verstecken.

Duplikat-Prüfung

Doppelte Episoden und wiederholte Frames werden erkannt und aussortiert - kein Datensatz zählt zweimal.

Label- & Task-Konsistenz

Jede Episode trägt das korrekte Task-Label; Stichproben-Review gegen das Videomaterial.

Kamera-Zuordnung

Szene- und Handgelenkkamera werden pro Episode verifiziert - Vertauschungen ruinieren sonst still das Training.

Bild-Aktions-Synchronität

Lag-Messung zwischen Bild und Gelenkzustand - Versatz wird gemessen und ausgewiesen, nicht verschwiegen.

Standbild- & Stall-Erkennung

Eingefrorene Kamerastreams und bewegungslose Episoden werden markiert und ersetzt.

Gelenk-Limits & Anschläge

Episoden mit Servo-Anschlägen oder Grenzverletzungen werden erkannt - solche Daten vergiften Policies.

Vollständigkeit & Episodenlängen

Längenverteilung, fehlende Frames, kaputte Dateien - der Lieferreport weist jede Kennzahl aus.

Pakete und Richtpreise

Drei Startpunkte - das finale Angebot richtet sich nach Tasks, Szenen und Exklusivität.

Pilot

250 Episoden

ab 1.900 €

  • 1 Task, 1 Szene
  • Voller QA-Report
  • Lieferung in 2 Wochen
  • Anrechnung aufs Folgepaket
Anfrage stellen
Meistgewählt

Scale

1.000 Episoden

ab 6.500 €

  • Bis 4 Tasks, mehrere Szenen
  • Multi-Arm-Aufnahme parallel
  • Pilot-Batch zur Freigabe
  • Liefer-SLA vertraglich
Anfrage stellen

Lab

5.000+ Episoden

individuell

  • Euer Schema, eure Tasks
  • Exklusivität und NDA
  • Laufende Lieferung in Tranchen
  • Dedizierte Aufnahme-Kapazität
Anfrage stellen

Richtpreise für SO-100-Aufnahmen mit zwei Kameraperspektiven. Andere Arme, Spezial-Setups und Exklusivrechte werden in der Spezifikation bepreist.

Welche Daten wir produzieren

Von Standard-Manipulation bis zu Korrekturdaten für eure bestehende Policy.

Pick & Place

Greifen, Umsetzen, Ablegen - der Grundstock jedes Manipulations-Trainings.

Multi-Task-Szenen

Mehrere Aufgaben in einer Umgebung, sprachannotiert pro Episode.

Langzeit-Aufgaben

Mehrstufige Abläufe mit Zwischenzielen - für Policies mit Planungsanteil.

Sim-Pretraining

Synthetische MuJoCo-Episoden in großer Zahl als Vortrainings-Fundament.

Korrekturdaten

Operator korrigiert eure laufende Policy - gezielte Daten genau dort, wo sie scheitert.

Von der Spezifikation zur Lieferung

01

Spezifikation

Tasks, Objekte, Szenen, Kameras, Format - wir schreiben gemeinsam das Datenblatt, ihr gebt es frei.

02

Pilot-Batch

Ein kleiner Batch vorab: ihr prüft Struktur und Qualität an echten Episoden, bevor skaliert wird.

03

Skalierte Aufnahme

Mehrere Arme, mehrere Operatoren, mehrere Szenen parallel - mit laufender QA statt Endkontrolle.

04

QA-Report & Lieferung

Voller Prüfbericht pro Lieferung, Übergabe nach Vereinbarung - mit Liefer-SLA und auf Wunsch exklusiv.

Exklusivität, NDA und euer eigenes Datenschema sind Teil der Spezifikation - nicht ein Aufpreis-Sternchen.

Kurz gefragt

In welchem Format wird geliefert?

Standard ist LeRobot v2.1 (Parquet + MP4) - trainierbar ohne Konvertierung. Euer eigenes Schema ist Teil der Spezifikation, kein Aufpreis-Thema.

Wem gehören die Daten?

Euch. Bei Exklusiv-Paketen verpflichten wir uns vertraglich, die Daten weder weiterzuverkaufen noch selbst zu verwenden.

Wie schnell bekommen wir den Pilot-Batch?

Für ein Pilot-Paket auf dem SO-100 in der Regel innerhalb von zwei Wochen nach freigegebener Spezifikation.

Was passiert mit aussortierten Episoden?

Sie werden nachproduziert, nicht berechnet. Ihr bezahlt die spezifizierte Menge an Episoden, die das QA-Programm bestanden hat.

Könnt ihr auf unserer Hardware aufnehmen?

Ja - entweder remote per Teleoperation auf euren Armen oder auf unserer Flotte. Beides steht in der Spezifikation.

Sprecht mit uns über euer Datenpaket

Schickt uns eure Anforderungen - Tasks, Umfang, Zeitrahmen - und ihr bekommt binnen 48 Stunden eine erste Einschätzung mit Pilot-Vorschlag.