Aktualności (PL)

Apple testuje nową funkcję Siri umożliwiającą jednoczesne wykonywanie wielu poleceń na urządzeniach

Siri
Siri - sdx15 / Shutterstock.com

Firma technologiczna rozpoczęła fazę testowania nowej funkcji swojego wirtualnego asystenta, która umożliwia wykonywanie wielu poleceń w jednej instrukcji głosowej. Narzędzie zmienia sposób interakcji użytkowników z urządzeniami marki, eliminując potrzebę przerw pomiędzy kolejnymi żądaniami. Zasób przetwarza złożone zdania i identyfikuje różne działania w ramach tego samego żądania, wykonując je sekwencyjnie i automatycznie.

Ta aktualizacja stanowi część większego pakietu modernizacji systemu operacyjnego, skupiającego się na generatywnej sztucznej inteligencji i przetwarzaniu języka naturalnego. Architektura oprogramowania została przebudowana tak, aby rozumieć kontekst rozmów, dzięki czemu asystent może zachować pamięć o poprzednich żądaniach i zastosować te informacje w kolejnych interakcjach. Zmiana oznacza przejście od sztywnego modelu poleceń do bardziej płynnego interfejsu konwersacyjnego.

सिरी एप्पल
सिरी एप्पल – sdx15 / शटरस्टॉक.कॉम

Programiści firmy pracują nad kalibracją algorytmów, aby zapewnić, że interpretacja symultaniczna nie spowoduje konfliktów w wykonaniu. Możliwość łączenia zadań w łańcuch wymaga dużej mocy obliczeniowej, co kieruje dostępność tej funkcji na najnowszy sprzęt producenta. Wdrożenie następuje stopniowo w wersjach testowych mobilnych i komputerowych systemów operacyjnych.

Aktualizacja systemu operacyjnego przynosi zmiany w interfejsie

Przeprojektowanie wirtualnego asystenta obejmuje znaczącą zmianę wizualną interfejsu graficznego urządzeń. Stara kulista ikona, która pojawiała się na dole ekranu, została zastąpiona świetlistą ramką otaczającą cały wyświetlacz po włączeniu narzędzia. Sygnalizacja wizualna Esta wskazuje, że system nasłuchuje i przetwarza informacje, integrując się w bardziej organiczny sposób z obsługą urządzenia, nie zakłócając widoku aktualnie otwartej aplikacji.

Oprócz zmiany estetycznej, nowy interfejs umożliwia natywną interakcję tekstową, wystarczy dwa dotknięcia dolnej części ekranu, aby otworzyć dedykowaną klawiaturę. Użytkownik może płynnie przełączać się między poleceniami głosowymi a pisaniem, w zależności od środowiska, w którym się znajduje. Jasna krawędź dynamicznie reaguje na ton głosu i złożoność przetwarzania, zapewniając natychmiastową wizualną informację zwrotną na temat statusu bieżącego żądania.

Jak polecenia łańcuchowe działają w praktyce

Wykonywanie poleceń w łańcuchu pozwala pojedynczej frazie uruchamiać różne aplikacje i funkcje systemowe. Użytkownik może poprosić asystenta o wykonanie zdjęcia i jednym zdaniem zlecić przesłanie zdjęcia do konkretnego kontaktu w komunikatorze.

Przetwarzanie dzieli frazę na osobne intencje, uruchomienie kamery, przechwycenie multimediów, otwarcie komunikatora, zlokalizowanie kontaktu i potwierdzenie wysłania. Todo Ten przepływ odbywa się w tle i wymaga minimalnej interwencji ręcznej.

Inny praktyczny przykład obejmuje zarządzanie danymi osobowymi, na przykład proszenie o znalezienie konkretnego adresu wymienionego w wiadomości e-mail i dodanie go bezpośrednio do wydarzenia w kalendarzu. Asystent przesyła dane pomiędzy aplikacją pocztową a kalendarzem.

Dokładność tych jednoczesnych działań zależy od indeksowania semantycznego urządzenia, które organizuje dane osobowe w uporządkowany sposób, aby sztuczna inteligencja mogła szybko uzyskać do nich dostęp.

Konkurencja w sektorze sztucznej inteligencji

Rozwój tych nowych możliwości jest bezpośrednią odpowiedzią na postępy prezentowane przez konkurencyjne firmy w sektorze technologicznym. Rynek wirtualnych asystentów przeszedł szybką ewolucję wraz z wprowadzeniem wielkoskalowych modeli językowych, przez co stare interakcje stały się przestarzałe.

Producent stara się odzyskać miejsce w segmencie automatyzacji głosu, oferując głęboką integrację, której nie są w stanie osiągnąć aplikacje innych firm ze względu na ograniczenia systemu operacyjnego. Przewaga konkurencyjna opiera się na pełnej kontroli nad sprzętem i oprogramowaniem.

Strategia ta zakłada nie tylko poprawę rozumienia tekstu i mowy, ale także zdolność systemu do rozumienia tego, co jest wyświetlane na ekranie użytkownika. Esta Świadomość kontekstu ekranu jest ważnym technicznym wyróżnikiem w konkurencji na rynku osobistej sztucznej inteligencji.

Wymagania techniczne dla asystenta do pracy

Uruchamianie zaawansowanych modeli językowych bezpośrednio na urządzeniu wymaga określonych komponentów sprzętowych, co ogranicza nowość do najnowszych procesorów marki. Chipy muszą zawierać jednostki przetwarzania neuronowego zdolne do wykonywania bilionów operacji na sekundę, zapewniając interpretację wielu poleceń bez zauważalnych opóźnień.

Zapotrzebowanie na pamięć RAM jest również czynnikiem decydującym o działaniu narzędzia, ponieważ modele sztucznej inteligencji muszą zostać załadowane do pamięci ulotnej, aby uzyskać natychmiastowy dostęp. Aparelhos poprzednich generacji nie otrzyma pełnej funkcjonalności poleceń łańcuchowych ze względu na fizyczne ograniczenia architektoniczne.

Wewnętrzne testy oceniają trafność odpowiedzi

Inżynierowie oprogramowania przeprowadzają rygorystyczne zestawy testów wewnętrznych, aby ocenić skuteczność asystenta w przypadku niejednoznacznych instrukcji lub podwójnych poleceń sformułowanych ze złożoną składnią. Proces walidacji polega na symulacji tysięcy codziennych scenariuszy, w których sztuczna inteligencja musi zdecydować o właściwej kolejności wykonywania zadań i zidentyfikować możliwe błędy logiczne przed zakończeniem działania. Zespół programistów monitoruje wskaźniki wydajności, takie jak czas reakcji między zakończeniem mowy użytkownika a początkiem pierwszej akcji, a także płynność przejść pomiędzy aktywowanymi aplikacjami. Głównym celem tej fazy testowania jest zredukowanie do zera przypadków, w których system wykonuje tylko pierwszą połowę polecenia i ignoruje drugą, co było częstym problemem w poprzednich wersjach przetwarzania języka naturalnego. Kalibracja algorytmów intencji jest dostosowywana codziennie na podstawie raportów o awariach generowanych przez urządzenia testowe, dzięki czemu ostateczna wersja zapewnia spójne wrażenia.

Integracja z aplikacjami innych firm

Rozszerzanie wielu poleceń zależy od przyjęcia nowych interfejsów programowania aplikacji przez niezależnych programistów. Producent udostępnił specjalne narzędzia, które pozwalają twórcom oprogramowania mapować funkcje swoich aplikacji, aby asystent mógł uzyskać do nich dostęp i połączyć je z działaniami z innych programów zainstalowanych na urządzeniu.

Zaawansowane przetwarzanie języka naturalnego

Rdzeń technologiczny nowego asystenta opiera się na całkowicie przepisanym silniku przetwarzania języka naturalnego. System Este nie opiera się już na zaprogramowanych frazach ani wyzwalaczach specyficznych dla słów w celu inicjowania akcji.

Rozumienie semantyczne pozwala użytkownikowi mówić potocznie, jąkać się, poprawiać się w połowie zdania lub zmieniać zdanie, a system nadal jest w stanie wyodrębnić ostateczną intencję i poprawnie wykonać wiele żądanych poleceń.

Prywatność danych podczas żądań

Architektura systemu priorytetowo traktuje lokalne przetwarzanie informacji, zapewniając, że dane głosowe i dane osobowe, do których uzyskuje się dostęp podczas wielu poleceń, nie opuszczą urządzenia. Indeksowanie semantyczne i wykonywanie zadań odbywają się w izolacji na głównym chipie.

Na potrzeby żądań wymagających większej mocy obliczeniowej firma opracowała infrastrukturę przetwarzania w chmurze prywatnej. Dane przesyłane na te serwery są przetwarzane bez trwałego przechowywania i z pełnym szyfrowaniem, uniemożliwiającym dostęp osobom trzecim lub samemu producentowi.

Rozszerzanie możliwości automatyzacji

Funkcjonalność poleceń łańcuchowych zmniejsza zależność od aplikacji przeznaczonych do tworzenia złożonych procedur. Automatyzacja jest teraz generowana spontanicznie za pomocą głosu, bez konieczności wcześniejszego konfigurowania ręcznych przepływów pracy.

Użytkownicy zyskują możliwość dyktowania sekwencji działań obejmujących sterowanie urządzeniami inteligentnego domu, wysyłanie wiadomości i odtwarzanie multimediów w ramach jednej naturalnej interakcji.

Ewolucja asystenta przekształca mikrofon urządzenia w główne narzędzie nawigacji i obsługi systemu, upraszczając zadania, które wcześniej wymagały wielokrotnych dotknięć ekranu i poruszania się po różnych menu.

To Top