01
Generer
Generer nye rammer og videoer langs angitte kameraposisjoner og baner.
Atlas er World Labs' neste generasjons omni-verdensmodell. Den samler kamerastyrt generering, romlig rekonstruksjon, rom-tid-simulering og eksplisitt 3D-utdata i én arkitektur bygd rundt en delt romlig kontekst.
Referansebilder
Last oppBeskriv videoideen din
Hva er Atlas?
Atlas resonnerer om visuell kontekst, kameraposisjon og dybde samtidig.
Atlas forankrer bilder og dybdekart til kameraposisjoner, og bruker deretter den romlige konteksten til å lage nye visninger, bygge geometri på nytt og simulere bevegelse gjennom en scene.
01
Generer nye rammer og videoer langs angitte kameraposisjoner og baner.
02
Gjør sparsomme bilder eller videorammer om til nye visninger og eksplisitte 3D-representasjoner.
03
Modeller rom og tid for ominnrammede VFX-opptak og Real-to-Sim-robotikkarbeidsflyter.
Kjerneegenskaper
Lanseringsmaterialet spenner over kreativ produksjon og fysisk simulering. Dette er demonstrasjoner og påstander fra World Labs, ikke uavhengige Topview-benchmarks.
Atlas tar imot kamerageometri som innebygd inndata i stedet for bare å stole på ord som pan, crane eller orbit. World Labs viste håndtegnede kamerabaner gjennom en sammenhengende generert scene.
Demo: inntil 1 minutt i 1440p
Start med ett eller flere bilder, generer usette synsvinkler, anslå geometri, og legg til flere visninger når en trofast rekonstruksjon av den virkelige verden betyr mer enn et troverdig påfunn.
Fra sparsomme visninger til eksplisitt 3D
Rekonstruer bevegelse fra et lite sett vanlige kameraer, ramme inn en hendelse på nytt fra nye vinkler, eller generer RGB- og dybdeobservasjonene en simulert robot ville sett.
VFX, navigasjon og manipulering
Verdensmodellering er hovedfokuset, men World Labs viser også promptfølgende bildegenerering, tekstgjengivelse, varierte visuelle stiler og 360-graders bilder fra tekst- eller bildeprompter.
Hver ramme er et blikk inn i en modellert verden
Slik fungerer modellen
Atlas behandler en multimodal sekvens ett element om gangen, der bilde- og dybdeinndata er knyttet til eksplisitte kameraposer.
Den praktiske ideen er enkel: hver ekstra virkelige visning forteller modellen mer om scenen. Når mindre er observert, har Atlas mer rom til å forestille seg. Når mer er observert, kan rekonstruksjonen støtte seg på mer evidens.
Oppgi tekst, ett eller flere bilder, bildesekvenser, kameraposer eller dybdeinformasjon avhengig av oppgaven.
Plasser hver ramme i en kjent kameraposisjon, slik at modellen kan knytte utseende til rom.
Autoregressiv prediksjon og diffusjon produserer nye multimodale elementer betinget av alt som allerede ligger i konteksten.
Returner nye visninger, styrt video, dybde, punktskyer eller en Gaussian Splat-scene til videre arbeid.
Hvor Atlas kan ha betydning
Atlas er posisjonert som et allment fundament for scener som trenger mer enn én tiltalende ramme. Verdien ligger i forbindelsen mellom utseende, geometri, synsvinkel og endring over tid.
Utform nøyaktige kamerabaner, lag nye visninger rundt en opptreden, og bruk rekonstruert dybde eller 3D-struktur til å støtte ominnramming og compositing.
Plasser referanser som ankere i rommet, utforsk overganger mellom ideer, og test hvordan et kamera beveger seg gjennom et foreslått miljø.
Generer utforskbare scenerepresentasjoner og flere konsistente synsvinkler som kan informere miljøkonsepter, layout og prototyping.
Rekonstruer et virkelig miljø, varier forholdene, og generer simulerte sensorvisninger for trening og evaluering av navigasjon eller manipulering.
Bruk den samme verdensbevisste konteksten til stiliserte bilder, 360-graders scener og lengre kamerastyrte sekvenser.
Atlas vs Marble
Atlas og Marble er beslektet, men de er ikke utskiftbare navn. Dette skillet betyr noe når du bestemmer hva du kan bruke i dag.
En neste generasjons omni-verdensmodell for generering, rekonstruksjon og simulering på tvers av kreative og robotikkoppgaver.
En modellfamilie som er tilgjengelig nå for å generere og utforske 3D-verdener i Topview Canvas.
Tidlig tilgang hos utvalgte World Labs-partnere. Offentlig prising og allmenn tilgang er ikke kunngjort.
Marble 1.1 og Marble 1.1 Plus kan velges i 3D World-arbeidsflyten i Topview.
World Labs beskriver en delt kontekst som spenner over tekst, bilder, kameraposer, dybde og video representert som bildesekvenser.
Topview godtar en tekstprompt pluss ett bilde eller én kort videoreferanse. Bilde- og videoreferanser utelukker hverandre.
Demonstrerte utdata omfatter rammer, video, dybde, punktskyer og 3D Gaussian splats.
Topview returnerer et utforskbart Gaussian Splat-verdenskort og lar skapere fange visninger tilbake til Canvas.
World Labs sier at Atlas skal drive fremtidige versjoner av Marble og andre World Labs-produkter.
Den nåværende Topview-integrasjonen forblir knyttet til Marble 1.1 og Marble 1.1 Plus, ikke Atlas.
Topview er et uavhengig produkt og er ikke den offisielle World Labs-nettsiden. Tilgjengelighet kan endre seg, så sjekk den live modellvelgeren og de offisielle kanalene til World Labs før du planlegger en produksjonsavhengighet.
Tekniske detaljer
Et kompakt overblikk over det World Labs har dokumentert offentlig, uten å fylle hull med antatte modellstørrelser, priser eller API-parametere.
Ofte stilte spørsmål
Direkte svar om modellen, inndataene og utdataene, Atlas-tilgang og det Topview støtter i dag.
Lag med det som er tilgjengelig i dag
Atlas forblir i tidlig tilgang for utvalgte partnere. For en live skaperarbeidsflyt i dag kan du bruke Marble 1.1 eller Marble 1.1 Plus til å generere en utforskbar verden og fange synsvinkler tilbake til Canvas.
Topview-destinasjonen bruker de gjeldende Marble-modellene og innebærer verken Atlas-tilgang eller tilknytning til World Labs.