Google rozpoczął udostępnianie Gemini Spark użytkownikom pakietu Google AI Pro w Stanach Zjednoczonych. Dotychczas funkcja była zarezerwowana wyłącznie dla droższego abonamentu AI Ultra. Firma zapowiada, że wkrótce Spark pojawi się również w innych krajach, choć na razie nie podała konkretnego terminu jego premiery w Polsce.
Gemini Spark to nowa generacja asystenta AI Google. Zamiast jedynie odpowiadać na pytania, ma on pełnić rolę osobistego agenta, który samodzielnie wykonuje złożone zadania składające się z wielu etapów.
W wersji przeglądarkowej Spark pojawia się jako nowa zakładka w panelu Gemini, natomiast na Androidzie i iOS otrzymał własną sekcję w aplikacji.
Agent korzysta z wielu usług Google jednocześnie, łącząc m.in.:
- Google Workspace,
- wyszukiwarkę Google,
- dane z Personal Intelligence,
- zdalną przeglądarkę internetową,
- możliwość wykonywania kodu,
- rozmowy z Gemini,
- Canvas,
- dane lokalizacyjne.
Dzięki temu potrafi realizować wieloetapowe procesy bez konieczności wydawania kolejnych poleceń przez użytkownika.
Zadania, harmonogramy i umiejętności
Google wprowadza w Gemini Spark trzy nowe pojęcia, które mają uprościć automatyzację codziennych obowiązków.
Task (Zadanie) określa główny cel, który agent ma osiągnąć. Przykładowo może to być kompleksowe zaplanowanie podróży służbowej do Londynu.
Schedule (Harmonogram) pozwala uruchamiać działania automatycznie po spełnieniu określonych warunków. Przykładowo Spark może wykryć opóźnienie lotu, poinformować o nim użytkownika i jednocześnie zaproponować zmiany w planie podróży.
Skill (Umiejętność) to zestaw gotowych instrukcji, które można wielokrotnie wykorzystywać. Jedna umiejętność może odpowiadać za rezerwację hotelu, a druga za przygotowanie i wysłanie wiadomości e-mail z potwierdzeniem zmian.
Według Google użytkownik może jednocześnie uruchomić do 15 aktywnych zadań, a Spark korzysta z tych samych limitów obliczeniowych co pozostałe funkcje Gemini.
Znacznie większe możliwości w Google Workspace
Od majowej premiery Google znacząco rozbudował integrację Spark z pakietem Workspace. Dzięki temu agent potrafi wykonywać wiele czynności, które do tej pory wymagały ręcznej pracy.
Kalendarz Google
Gemini Spark potrafi:
- sprawdzać kalendarz,
- odpowiadać na zaproszenia na spotkania,
- tworzyć nowe wydarzenia,
- zmieniać terminy i lokalizacje spotkań,
- anulować wydarzenia,
- proponować wolne terminy odpowiadające wszystkim uczestnikom.
Gmail zyskuje inteligentnego pomocnika
Integracja z Gmailem pozwala agentowi:
- wyszukiwać wiadomości dotyczące konkretnych tematów,
- podsumowywać długie konwersacje,
- przygotowywać szkice wiadomości,
- odpowiadać na e-maile,
- przekazywać wiadomości dalej,
- zarządzać etykietami w skrzynce odbiorczej.
Dokumenty, Arkusze i Prezentacje Google
Spark otrzymał również szerokie możliwości pracy z dokumentami zapisanymi na Dysku Google.
Agent może:
- wyszukiwać pliki i analizować ich zawartość,
- zmieniać nazwy dokumentów,
- usuwać pliki,
- odczytywać metadane,
- tworzyć nowe dokumenty Google Docs,
- edytować istniejące dokumenty,
- dodawać podsumowania oraz notatki,
- odczytywać komentarze,
- tworzyć i modyfikować arkusze Google Sheets wraz z tabelami i formułami,
- generować prezentacje Google Slides na podstawie krótkiego polecenia,
- dodawać obrazy do dokumentów i prezentacji.
Google zaznacza jednak, że zmiany w udostępnionych dokumentach wymagają zatwierdzenia przez użytkownika, zanim zostaną wprowadzone.
Obsługa Google Keep i Google Tasks
Spark potrafi również współpracować z pozostałymi usługami Google.
W Google Keep może wyszukiwać notatki oraz tworzyć nowe listy i przypomnienia.
Jeszcze większe możliwości pojawiają się w Google Tasks, gdzie agent wyszukuje, dodaje, modyfikuje oraz usuwa zadania. Google ostrzega jednak, że niektóre operacje zbiorcze mogą zostać wykonane bez dodatkowego potwierdzenia, dlatego warto dokładnie sprawdzać wydawane polecenia.
Coraz bliżej pełnoprawnego cyfrowego asystenta
Gemini Spark pokazuje kierunek, w którym rozwija się sztuczna inteligencja Google. Zamiast odpowiadać wyłącznie na pytania użytkownika, system ma samodzielnie wykonywać złożone zadania, łącząc wiele usług i podejmując kolejne kroki bez konieczności ciągłego nadzoru.
Udostępnienie tej funkcji abonentom Google AI Pro oznacza, że zaawansowany agent AI trafia do znacznie szerszego grona użytkowników. Pozostaje jednak poczekać na rozszerzenie dostępności poza Stany Zjednoczone oraz oficjalną premierę w Polsce.
Foto: DepositPhotos.