Redaktionelles Bewertungs- und Prüfprotokoll seit 17.07.2026 — keine Firmen- oder
Produktchronik. Es enthält auch Methodik-, Beleg- und Evidenzkorrekturen ohne Wertwechsel.
Neueste Einträge zuerst.
-
03.08.2026 Mobilität: C → A
Die Produktionsversion zeigte Stufe 2 bei einem frei zugaenglichen WM-Live-Event; nach Methodik ist das beobachtbare Publikumsevent Evidenz A.
Quelle: Reuters via CNA — Atlas at the World Cup, 06.07.2026
-
03.08.2026 Feinmotorik: C → A
Halten, Praesentieren und Übergeben des Matchballs wurden beim frei zugaenglichen WM-Live-Event gezeigt; eine vorherige Ballaufnahme wird nicht beansprucht.
Quelle: Reuters via CNA — Atlas at the World Cup, 06.07.2026
-
03.08.2026 Autonomie: 0 → 1
Basisevidenz Stufe 0 aus der öffentlichen, nicht autonom ausgewiesenen WM-Show plus modellscharfer C-Claim Stufe 3 für Navigation zur Ladestation und selbstständigen Akkuwechsel.
Quelle: Reuters via CNA — WM-Auftritt + Boston Dynamics — Produktionsversion-Blog
-
03.08.2026 Autonomie: C → A
Der frei zugaengliche WM-Live-Auftritt trägt die Basisevidenz der Produktionsversion unabhängig; der Akkuwechsel bleibt davon getrennt ein Herstellerclaim.
Quelle: Reuters via CNA — Atlas at the World Cup, 06.07.2026
-
03.08.2026 Verfügbarkeit: 1 → 1
Wert unverändert: Reuters dokumentiert die Produktionsversion beim frei zugaenglichen WM-Live-Auftritt jetzt als eigenen Achsenbeleg. Das trägt Stufe 1, aber keinen Bestellweg und keinen laufenden externen Pilot.
Quelle: Reuters via CNA — Atlas at the World Cup, 06.07.2026
-
31.07.2026 Mobilität: B → C
Die Stufenträger sind ausschließlich Boston-Dynamics-Blogbeitraege. Herstellermaterial ist C.
Quelle: _zenodo/methodology-radarscore-2.0.md
-
31.07.2026 Feinmotorik: B → C
Stufenträger ist erneut der Herstellerblog; der zweite Beleg bezeichnet sich selbst als BD-Promomaterial.
Quelle: _zenodo/methodology-radarscore-2.0.md
-
31.07.2026 Mobilität: 3 → 2
cClaim entfernt: Der Claim-Beleg nennt DoF, Reichweite, Hublast und Ladestation — keines davon ist das Stufe-5-Kriterium Treppen ODER Gelände.
Quelle: _zenodo/methodology-radarscore-2.0.md
-
31.07.2026 alle: 7/2/3/2/n. b./2 → 3/2/0/1/n. b./2
Aufspaltung nach externer Gegenprüfung. Diese Akte weist sich als Produktionsversion aus, ihre Fähigkeitsachsen ruhten aber auf vier Belegen von CBS 60 Minutes - und die Akte hielt an vier Stellen selbst fest, dass CBS die Testeinheit vom Oktober 2025 beobachtet hat (rund 175 cm, 90 kg), nicht die größere Produktionsversion. Das CODEBOOK verlangt für wesentlich unterschiedliche Hardware eigene IDs. Die vier CBS-Belege stehen unverändert in der neuen Akte boston-dynamics-atlas-2025; hier bleibt, was die Produktionsversion selbst belegt: die Vorstellung im Januar 2026, der WM-Halbzeitauftritt, das BD-Promomaterial zur Schwerlast-Manipulation, der Hyundai-Fahrplan. Ergebnis: mobilitaet 7 -> 3 (Stufe 2 plus C-Claim), autonomie 3 -> 0 (keine dokumentierte autonome Aufgabe), verfuegbarkeit 2 -> 1 (kein laufender Pilot der Produktionsversion belegt, nur ein Termin), feinmotorik und reifegrad unverändert bei 2. Gesamtwert 3,2 -> 1,6. Das ist kein neues Urteil über Atlas, sondern die Trennung zweier Geräte, die bisher voneinander gezehrt haben.
Quelle: CBS 60 Minutes 04.01.2026, The Decoder 06.01.2026, CODEBOOK-Regel zu Varianten
-
31.07.2026 Autonomie: 0 → 1
cClaim 3 aufgenommen: Die Akte führt selbst die selbstständige Fahrt zur Ladestation samt Akkuwechsel — eine definierte Aufgabe. Herstellerangabe, also +1.
Quelle: _zenodo/methodology-radarscore-2.0.md
-
30.07.2026 Autonomie: 4 → 3
Zitat-Audit: Der cClaim 6 wurde am 28.07. im Beleg-Text ausdrücklich für erledigt erklärt (die Gemini-Ankündigung enthält weder natural language noch multi-step, instruction, speech, voice, verbal oder command), stand aber weiter im Bewertungsblock und hob den Wert um einen Punkt. cClaim entfernt - belegt bleibt die unabhängig gefilmte Aufgaben-Autonomie beim Dachträger-Sortieren, Stufe 3 mit Evidenz A
Quelle: Boston Dynamics/Google-DeepMind-Blog 05.01.2026 (Nullbefund) + CBS 60 Minutes
-
30.07.2026 Feinmotorik: 3 → 3
Zitat-Audit: cClaim von 4 auf 3 gesenkt, Wert unverändert. Die Begründung ‚beidhändige Koordination' ist durch die Quelle widerlegt - Robotics & Automation News zitiert Boston Dynamics mit ‚using whole-body control, not just hands to maneuver' und stellt die Ganzkörper-Kontrolle ausdrücklich gegen Fingerfertigkeit. Ausserdem gestrichen: ‚sprachgesteuert' (im Artikel nicht vorhanden) und ‚Waschmaschine' (nur in der Überschrift, nicht im Text)
Quelle: Robotics & Automation News 20.05.2026, geprueft 30.07.2026
-
30.07.2026 Feinmotorik: 3 → 2
Adversariale Gegenprüfung: Der cClaim 3 wird von seiner Quelle nicht getragen. Leiterstufe 3 verlangt wörtlich adaptives Greifen unterschiedlicher Formen/Größen - belegt ist ein einziges Objekt (Mini-Kühlschrank, rund 50 lbs bzw. über 100 lbs im Test), und Boston Dynamics stellt die Leistung dort ausdrücklich gegen Handleistung (Unlike conventional robotic systems that rely heavily on fingertip manipulation and visual guidance, Atlas is being trained to use its entire body dynamically). cClaim entfernt; belegt bleibt Pick and Place beim Dachträger-Sortieren, Stufe 2 mit Evidenz A
Quelle: Robotics & Automation News 20.05.2026 + CBS 60 Minutes, geprueft 30.07.2026
-
30.07.2026 Reifegrad: 3 → 2
Adversariale Gegenprüfung: Der cClaim 4 stand noch im Bewertungsblock, obwohl der zugehoerige Beleg-Text ihn ausdrücklich für erledigt erklärt - eine erfolgte Auslieferung belegt keine Quelle dieser Akte, die Flotten sind nur scheduled to ship. Stufe 4 verlangt zudem mehrere externe Piloten plus zweite Hardware-Generation, Stufe 3 einen Feldtest bei einem externen Kunden - Hyundai ist Mutterkonzern. cClaim entfernt, der berechnete Wert fällt von 3 auf 2
Quelle: The Decoder 06.01.2026 + Hyundai-Newsroom 16.07.2026 + Boston-Dynamics-Blog 05.01.2026, geprueft 30.07.2026
-
30.07.2026 Verfügbarkeit: 2 → 2
Adversariale Gegenprüfung: Wert unverändert, Evidenz von B auf A gehoben und ein tragender Beleg ergänzt. Die beiden bisherigen Belege dieser Achse nannten nur Termine (Flotte für das RMAC 2026, Metaplant-Einsatz ab 2028) und dokumentierten keinen gelaufenen Pilot; der geschlossene Praxistest steht bei CBS 60 Minutes, die beim ersten Realeinsatz im Hyundai-Werk vor Ort waren
Quelle: CBS 60 Minutes Transkript, geprueft 30.07.2026
-
25.07.2026 Mobilität: 8 → 7
Gegenprüfung: Stufe 8 ist ein UND-Kriterium - akrobatische Manöver PLUS selbstständiges Aufstehen nach Sturz. Den ersten Teil bezeugt 60 Minutes vor Ort wörtlich (Atlas skip and run with ease, cartwheels), den zweiten belegt keine Quelle. Also Stufe 7. Zugleich Evidenz von B auf A gehoben: 60 Minutes war im Werk und hat es selbst gesehen - das ist unabhängige Beobachtung, nicht nur Primärquelle
Quelle: CBS 60 Minutes (04.01.2026, akt. 14.06.2026), geprueft 25.07.2026
-
25.07.2026 Feinmotorik: 4 → 3
Gegenprüfung: Nach erneuter gezielter Suche existiert die Schubladen-Demo nicht (weder im BD-Gemini-Blog noch in CES-Berichten noch im 60-Minutes-Transkript). Unabhängig bezeugt ist Pick-and-Place von Teilen aus Behältern = Stufe 2, mit Evidenz A statt B. Der C-Claim hebt weiterhin einen Punkt: Wert 3
Quelle: CBS 60 Minutes + Recherche-Nullbefund Schubladen-Demo, geprueft 25.07.2026
-
25.07.2026 Autonomie: 4 → 4
Gegenprüfung: Wert unverändert, Evidenz von B auf A gehoben. 60 Minutes hat das autonome Dachträger-Sortieren im Werk selbst gefilmt, und der Austausch steht on record im Transkript (Whitaker: So he is working autonomously. - Jackowski: Correct). Das ist unabhängige Beobachtung
Quelle: CBS 60 Minutes Transkript, geprueft 25.07.2026
-
24.07.2026 Feinmotorik: 5 → 4
Beleg-Audit: Die 'sprachgesteuerte Schubladen-Aufgabe' liess sich in keiner Primärquelle finden (die Gemini-Ankündigung vom 05.01.2026 enthält nur Breitband-Claims) - der cClaim sinkt von 6 (Präzisionsfügen) auf 4 (real belegte Schwerlast-/Grobmanipulation als BD-Promo). B-Basis neu verankert auf Stufe 3: autonomes Dachträger-Sortieren unabhängig bezeugt (60 Minutes) + WM-Ball-Handover
Quelle: CBS 60 Minutes 04.01.2026 + Robotics & Automation News 20.05.2026
-
17.07.2026 Feinmotorik: 6 → 5
Methodik 2.0: belegt ist der Spielball-Handover bei der WM-Show (Stufe 4); die sprachgesteuerte Schubladen-Aufgabe ist Herstellerclaim (C) und hebt maximal einen Punkt
Quelle: docs/BEWERTUNGSBOGEN-RADARSCORE-V2.md
-
17.07.2026 Autonomie: 7 → 4
Methodik 2.0: der WM-Auftritt zählt nicht (Autonomiegrad nicht offengelegt); belegt sind nur definiertes Teile-Handling in strukturierter Umgebung und ein TV-Bericht ohne sichtbare Fernsteuerung, die Gemini-Mehrschritt-Demo bleibt Herstellerclaim
Quelle: 60 Minutes (CBS) + Hyundai/Boston Dynamics
-
17.07.2026 Verfügbarkeit: 1 → 2
Methodik 2.0 korrigiert nach oben: geschlossene Praxistests bei Hyundai seit 2025 erfüllen die Stufe geschlossenes Pilotprojekt (nicht bestellbar)
-
17.07.2026 Reifegrad: 6 → 3
Methodik 2.0: externe Pilotkunden fehlen komplett - Hyundai ist Mutterkonzern, kein Kunde; die Serienfertigungs-Ansage ist Hersteller-Roadmap auf belegtem Demo-Status
-
17.07.2026 Preis-Leistung: 2 → n. b.
Methodik 2.0: kein realer Marktpreis - die 150.000-320.000-USD-Spanne ist Analysten-Schätzung, keine Herstellerangabe eines Listenpreises