En modell där det tidigare krävdes fyra
World Labs publicerade Atlas den 1 september och beskrev den som en omni-världsmodell, förtränad från grunden för att arbeta direkt med text, bilder, video och 3D. Bolaget uppger att systemet är en multimodal autoregressiv diffusionstransformator och att varje indata vävs in i ett enda gemensamt rumsligt sammanhang i stället för att hanteras av en separat komponent.
Den beskrivningen är själva poängen med släppet. Att rekonstruera en scen, att generera video längs en vald kamerabana och att simulera vad en robot skulle se har i regel varit tre olika system. World Labs hävdar att det är ett och samma problem.
Vad den tar in och vad den ger ifrån sig
Atlas tar emot text, bilder, kamerapositioner och 3D-djupkartor. Video hanteras som en sekvens av bilder, var och en med uttrycklig kameraposition. På utdatasidan listar bolaget video på upp till en minut i upp till 1440p, punktmoln och 3D-gaussiska splats, samt 360-graderspanoraman genererade från en text- eller bildprompt.

Rekonstruktionen är den del där siffrorna är mest konkreta. World Labs uppger att Atlas skapar trogna rekonstruktioner av en scen vanligtvis utifrån så få som två eller tre bilder, och att modellen också kan utnyttja över hundra indatabilder när sådana finns.
Fyra förmågor i ett system
Bolaget delar in modellens arbete i fyra funktioner: kamerastyrd generering, som beskrivs som pixelexakt; rumslig rekonstruktion från glesa indata; rum-tid-simulering, som används för att rama om video och för robotik; samt bildgenerering från text med förmåga att följa komplexa instruktioner.
Robotikfallet är det mest praktiska av de fyra. Eftersom modellen representerar rum och tid tillsammans kan den rekonstruera en verklig miljö och sedan rendera RGB- och djupobservationer från simulerade robotperspektiv, alltså det Real-to-Sim-steg som annars kräver att scenen byggs för hand.
Jämförelserna är bolagets egna
World Labs uppger att Atlas presterar bättre än ledande modeller specialiserade på 3D-rekonstruktion och slår senare videomodeller på kamerastyrd generering. Ingen av utsagorna åtföljs av en publicerad placering i en jämförelsetabell, en namngiven konkurrent eller en oberoende utvärdering, och vikterna är inte släppta.

Tillgången är begränsad. Modellen är i tidig åtkomst hos utvalda partner och intresserade får gå via ett ansökningsformulär. World Labs har inte sagt när den blir allmänt tillgänglig eller vad den kommer att kosta.
Var detta hör hemma
World Labs grundades av Fei-Fei Li, tidigare chef för Stanfords AI-laboratorium, och har tagit in omkring 1,2 miljarder dollar från investerare som Nvidia, AMD och Autodesk i en runda som tillkännagavs i februari 2026, enligt SiliconANGLE. Atlas följer på Marble, bolagets kommersiella världsmodellprodukt.
Vad man bör följa
Tre saker visar om omni-beskrivningen håller. Om externa forskare kan återskapa resultatet med få bilder på sina egna scener, när någon utanför partnerlistan får köra modellen. Om robotikteam faktiskt väljer Real-to-Sim-vägen framför handbyggd simulering. Och om World Labs sätter ett datum och ett pris på allmän tillgänglighet, vilket bolaget hittills inte gjort.