News (HU)

A Google bemutatja a Gemini technológiáját, amellyel Android-alkalmazásokat vezérelhet anélkül, hogy a felhőre támaszkodna

Google
Google - daily_creativity/ shutterstock.com

Az Google jelentős előrelépést jelentett az Android 17 ökoszisztéma számára, a mesterséges intelligencia ágenseinek az operációs rendszeren belüli autonómiájára összpontosítva. Az AppFunctions és az Intelligent UI automatizálás nevű új eszközök lehetővé teszik az olyan asszisztensek számára, mint az Gemini, hogy bonyolult műveleteket hajtsanak végre harmadik féltől származó szoftverekben anélkül, hogy kézzel kellene érinteni a képernyőt. Az Essa evolution célja, hogy a mobiltelefont egy aktív asszisztens platformmá alakítsa, ahol a rendszer folyékony és integrált módon megérti és végrehajtja a felhasználó környezeti igényeit.

A technológiai óriás stratégiája szerint a folyamatok közvetlenül az eszköz hardverén való végrehajtását helyezik előtérbe, elkerülve a távoli szerverekre való folyamatos információküldést. Az Essa helyi feldolgozási megközelítés célja az adatvédelmi kockázatok mérséklése és annak biztosítása, hogy az érzékeny adatok az eszköz tulajdonosának ellenőrzése alatt maradjanak. Além biztonság, az eszközön belüli architektúra drasztikusan csökkenti a késleltetést, szinte azonnali választ adva a hangutasításokra és az automatizált interakciókra.

Az alkalmazásfejlesztők könnyen hozzáférhetnek az erőforrásokhoz, amelyekkel összekapcsolhatják termékeiket a rendszer virtuális asszisztenseivel. A cél az, hogy olyan környezetet hozzunk létre, ahol a különböző szolgáltatások közötti navigáció láthatatlanul történik, megszüntetve a telepített alkalmazások közötti akadályokat. A hivatalos nyilatkozat a programozói közösségnek szólt, és részletezi, hogyan lehet ezeket a megvalósításokat végrehajtani a következő frissítésekben.

Műszaki működés és integráció az AppFunctions segítségével

Az AppFunctions nevű alapfunkció egy új platform API-t vezet be egy speciális Jetpack könyvtár kíséretében. Az Esse funkció lehetővé teszi a szoftverkészítők számára, hogy a mesterséges intelligencia általi közvetlen hozzáférés érdekében megjelenítsék alkalmazásaik funkcionalitását és adatait. A rendszer így képes kihagyni a hagyományos vizuális navigációs lépéseket, és egyenesen a kért feladat végrehajtásához megy.

Ennek a keretrendszernek az elfogadásával az AI képessé válik a szándékok értelmezésére és az alkalmazás háttérben történő manipulálására anélkül, hogy szükségszerűen megnyitná a fő felületen. Az architektúrát úgy tervezték, hogy gyorsan megvalósítható legyen:

– Az Não a meglévő alkalmazások eredeti kódjának teljes átírását igényli.

– Permite belső keresés a médiaalkalmazásokban és rendeléskezelés a szolgáltatási platformokon.

– Garante interoperabilitás az okostelefonra telepített különböző szolgáltatások között.

– Economiza rendszererőforrások és akkumulátor, ha megakadályozza az alkalmazás teljes grafikus megjelenítését.

Az Gemini-szel végzett kezdeti tesztek már bizonyítják az eszköz sokoldalúságát valós forgatókönyvekben. A felhasználói szándékok és az alkalmazásokon belüli konkrét cselekvések összekapcsolásának képessége az okostelefon-használat dinamikájának megváltoztatását ígéri.

Samsung és Pixel eszközökön szerzett tapasztalat

Az új technológiák első gyakorlati bemutatói nagy teljesítményű hardvereken zajlanak, különös tekintettel az Galaxy S26 sorozatra és az Pixel 10 modellekre. A felhasználó szóban kérheti adott eseményekről készült fényképek megszervezését vagy megtekintését, az asszisztens pedig önállóan végzi el a feladatot.

Ezek a tesztek megerősítik az Google és a partnergyártók közötti szoros együttműködést, hogy szabványosítsák az AI-élményeket a piacon. A kiértékelt Samsung eszközökön jelen lévő OneUI 8.5 interfész már natív támogatást kínál ezekhez a rendszerhívásokhoz, jelezve az Android jövőjének trendjét. A várakozások szerint ez az integráció az Android 17 konszolidációjával iparági szabvány lesz.

Az Pixel 10 vonal felhasználói számára a hangsúly a működési hatékonyságon és a közbenső menük kiiktatásán van. A tárolt tartalommal való interakció közvetlenebbé válik, megerősítve a hagyományos tapintható felülettől kevésbé függő operációs rendszerre vonatkozó javaslatot.

Vizuális automatizálás és adatbiztonság

Azon alkalmazások esetében, amelyek még nem fogadtak el dedikált API-kat, az Google bevezette az Intelligent UI automatizálási funkciót. Az Trata egy keretrendszer, amely képes vizuálisan értelmezni a képernyőt és olyan műveleteket végrehajtani, mint a kattintás, görgetés és mezők kitöltése. Az Essa megoldás lehetővé teszi, hogy a mesterséges intelligencia autonóm módon, csak vizuális elemek olvasására alapozva működtessen szoftvereket, hídként funkcionálva a mesterséges intelligencia hozzáférésének egyetemessé tételéhez az alkalmazásökoszisztémához.

A biztonság továbbra is alapvető pillér e technológiák fejlesztésében. A parancsok helyi végrehajtása minimálisra csökkenti a kibertámadásoknak való kitettséget, amelyek az adatok felhőbe történő továbbításakor fordulhatnak elő. Az operációs rendszer részletes jogosultsági rétegeket fog tartalmazni, amelyek biztosítják, hogy a felhasználó teljes mértékben ellenőrizhesse, mely alkalmazásokat manipulálhatják az intelligens ügynökök, megakadályozva ezzel a kifejezett hozzájárulás nélküli kényes műveleteket.

To Top