News (SV)

Google lanserar Project Genie-utbyggnaden och låter dig skapa interaktiva AI-världar i realtid för Ultra-prenumeranter

Project Genie
Project Genie - Divulgação/Google

Google DeepMind har börjat leverera Project Genie, en forskningsprototyp som låter användare skapa och utforska interaktiva virtuella världar genererade av artificiell intelligens. Tjänsten är initialt endast tillgänglig för prenumeranter av Google AI-plan Ultra eller Estados Unidos, med en minimiålder på 18. Utbyggnaden började den 29 januari 2026, och företaget planerar att utöka åtkomsten till andra regioner i framtiden.

Verktyget använder Genie 3-modellen, som presenterades i augusti 2025, för att generera realtidsmiljöer från textmeddelanden eller bilder som skickats av användare. Världarna renderas i 720p-upplösning med en hastighet av 24 bilder per sekund, vilket möjliggör navigering med grundläggande kontroller som WASD-tangenter och pilar för att flytta kameran.

Deltagarna kan ladda ner videor av sina utforskningar och dela skapelser för andra användare att remixa med nya beskrivningar.

Nyckelfunktioner i prototypen

Project Genie erbjuder tre huvudsakliga interaktionslägen som gör det enkelt att skapa och utforska virtuella miljöer. Användare börjar med att beskriva den önskade världen via text eller skicka referensbilder, justera detaljer som huvudpersonens utseende, synperspektiv och sätt att röra sig.

Efter den första generationen kan du utforska miljön i realtid när modellen förutsäger och återger nya element baserat på de åtgärder du vidtar. Verktyget låter dig också remixa befintliga skapelser, applicera nya uppmaningar på världar som genererats av andra användare eller dig själv.

  • Generering av världar från text eller bild
  • Interaktiv utforskning med tangentbordskontroller
  • Remix av skapelser som delas på plattformen
  • Ladda ner videor från utforskningssessioner

Dessa alternativ gör prototypen tillgänglig för kreativa experiment, även om den fortfarande är begränsad i omfattning.

Tekniken bakom Genie 3

Genie 3 är en generell världsmodell som kan simulera miljödynamik och förutsäga effekterna av åtgärder i olika miljöer. Diferente än traditionella spelmotorer, lär den sig fysikmönster och interaktioner genom autoregressiv träning, utan behov av förprogrammerade regler.

Modellen bibehåller tidsmässig konsistens i några minuter och kommer ihåg tidigare element för att generera koherenta övergångar under navigering. Essa kapacitet representerar en förbättring jämfört med tidigare versioner, såsom Genie 1 och Genie 2, som fokuserade på mer begränsade miljöer.

Integration med Project Genie gör att vanliga användare kan testa dessa funktioner i en kontrollerad miljö. Aktuell upplösning och bildhastighet möter efterfrågan på realtidsinteraktivitet, och prioriterar smidighet framför maximal grafisk kvalitet.

Begränsningar identifierade vid lanseringen

Prototypen har tekniska begränsningar som påverkar hela användarupplevelsen. Generationssessioner är begränsade till 60 sekunder, och världskonsistens kan bryta ner i längre eller mer komplexa interaktioner.

I vissa fall följer miljöer inte strikt lagarna för verklig fysik eller detaljerna i den uppmaning som tillhandahålls, vilket resulterar i mindre realistiska element. Latens när man kontrollerar karaktärer varierar beroende på scenens komplexitet, och alla rörelser svarar inte med omedelbar precision.

  • Maximal varaktighet på 60 sekunder per generation
  • Möjliga visuella och fysiska inkonsekvenser
  • Variabel latens vid kontroll av tecken
  • Brist på traditionell spelmekanik

Dessa begränsningar förväntas i en experimentell version och bör förbättras i framtida uppdateringar.

Exempel på användarskapade världar

Användare med tidig tillgång visade mångfald i skapelser gjorda med Project Genie. Alguns genererade miljöer inspirerade av välkända spel, till exempel scenarier som liknar öppna skogar eller klassiska plattformar, som utforskar möjligheter till rekreation.

Andra fokuserade på originalteman, som marshmallowslott, kosmiska landskap eller rekonstruerade antika städer. Verktyget gör det möjligt att experimentera med fordon, simning eller flygning, beroende på beskrivningarna i den första uppmaningen.

Dessa demonstrationer belyser modellens flexibilitet för att tolka olika uppmaningar. Communityn har delat korta videor som visar utforskande i olika stilar, från förstapersonsäventyr till tredjepersonsvisningar.

Kontext av världsmodellutveckling

Världsmodeller har representerat ett prioriterat forskningsområde hos Google DeepMind i mer än ett decennium. Esses-system simulerar utvecklingen av miljöer och effekterna av åtgärder, och tjänar som bas för utbildning av AI-agenter i obegränsade scenarier.

Genie 3 rör sig i denna riktning genom att generera oöverträffad mångfald av interaktiva miljöer från enkla ingångar. Den autoregressiva metoden tillåter förutsägelse av efterföljande bildrutor samtidigt som grundläggande visuell och fysisk koherens bibehålls.

Dessa framsteg bidrar till långsiktiga mål inom artificiell allmän intelligens. Project Genie fungerar som ett praktiskt gränssnitt för att samla in feedback om verkliga tillämpningar av dessa modeller.

Krav på åtkomst och expansion

Åtkomst kräver för närvarande prenumeration på Google AI Ultra-planen, Google:s mest avancerade nivå av AI-tjänster. Prototypen är begränsad till användare i åldern Estados Unidos, med åldersverifiering för de över 18 år.

Företaget informerade om att lanseringen kommer att ske gradvis även inom den ursprungliga kvalificerade målgruppen. Planos expansion till andra länder kommer att implementeras i takt med att tester och tekniska justeringar fortskrider.

Intresserade användare kan följa uppdateringar på Google Labs, där Project Genie är värd. Plattformen visar också exempelgenererade världar för inspiration innan full åtkomst.

Tillgängliga anpassningsfunktioner

Anpassning börjar i skissfasen, där användarna definierar detaljerade parametrar för världen. Det är möjligt att specificera element som belysning, klimat, närvarande föremål och beteende av den kontrollerade karaktären.

Alternativet för uppladdning av bilder påskyndar processen och fungerar som en visuell bas för modellen att tolka och expandera. Após generation, justeringar av nya uppmaningar förfinar miljön utan behov av en fullständig omstart.

  • Ange perspektiv (första eller tredje person)
  • Val av förflyttningsmetoder (löpning, simning, flygning)
  • Inkludering av dynamiska händelser i prompten
  • Realtidsjusteringar under utforskning

Dessa funktioner ökar den kreativa kontrollen inom nuvarande tekniska begränsningar.

Inledande feedback från samhället

Pålitliga testare har rapporterat en imponerande mängd användningsområden som utvecklingsteamet från början inte förutsåg. Muitos framhävde förmågan att generera uppslukande upplevelser på bara några sekunder från enkla idéer.

Andra har pekat på potentialen för snabb prototypframställning inom områden som speldesign eller virtuell utbildning. Att dela skapelser uppmuntrar till samarbete, där användare mixar om andra människors världar för att skapa unika varianter.

Den allmänna responsen tyder på ett stort intresse för konceptet med tillgängliga världsmodeller. Företaget övervakar dessa avkastningar för att prioritera förbättringar i nästa versioner av prototypen.

To Top