Новият AI агент на Meta вече показва на практика как може да изглежда следващият етап след чатботовете. В реален тест на CNN Muse успява да организира вечерна среща, да направи график за преместване, да изпрати имейл до приятел и да създаде документ за планиране на предстоящо пътуване – задачи, при които изкуственият интелект не просто дава информация, а предприема конкретни действия от името на потребителя.

Журналистът на CNN Lisa Eadicicco кръщава своя AI помощник Pip. Докато агентът работи, на екрана се появява анимиран аватар, който седи пред лаптоп – визуален начин приложението да покаже, че изпълнява възложената задача. Тестът е публикуван на 23 септември и идва само 15 дни след официалната премиера на Muse в САЩ.

Разликата спрямо класическия чатбот е съществена. При системи като ChatGPT и Gemini потребителят традиционно задава въпрос или иска създаване и обработка на информация. Muse е позициониран от Meta като персонален AI агент, който може да получи по-обща задача и след това сам да извърши необходимите последователни действия – например да работи с електронна поща, да търси в интернет, да попълва информация или да организира пътуване.

Meta представи Muse на 8 септември с обещанието, че системата „не просто отговаря на въпроси, а върши работата“. Според официалното описание на Meta агентът работи в собствена защитена виртуална среда с браузър и може да бъде свързан с приложенията и услугите, които човек използва ежедневно. Потребителят сам определя до каква информация и до кои функции да има достъп агентът.

В теста на CNN Muse се справя добре с някои сравнително сложни задачи. При организирането на вечерна среща агентът трябва да намери подходящи възможности и да превърне общата заявка в конкретен план. При предстоящото преместване той създава график за опаковане, а за бъдещо пътуване изпраща имейл до приятел и подготвя документ с места за посещение.

Това е именно посоката, към която се стремят големите технологични компании – вместо човек да извършва последователно десетки малки действия в различни приложения, да даде команда от типа „организирай пътуването ми“ или „подготви седмичното ми пазаруване“, а AI да извърши голяма част от необходимата работа.

Потребителският интерес засега е значителен. Muse премина границата от 2,5 млн. изтегляния около две седмици след премиерата си, а данните на Sensor Tower го поставиха на върха на американската класация на Apple за безплатни приложения. Reuters също отчита бързото му разпространение, като различните моментни измервания поставят броя на изтеглянията над 2,5 млн. още през първите две седмици.

По-голямата автономност обаче означава и по-сериозни въпроси за сигурността. Muse може да получи разрешение да работи с имейл, акаунти и други услуги, което прави защитата на идентификационните данни особено важна. Meta твърди, че паролите и платежната информация се пазят отделно от самия AI агент, а чувствителни действия като изпращане на имейл или извършване на покупка изискват потвърждение от потребителя.

Технологията вече премина и през първи сериозен тест за сигурността. Изследователят Patrick Wardle откри уязвимост в приложението Muse за macOS, която при наличие на вече работещ зловреден процес на компютъра е можела да компрометира удостоверителни данни на агента. Meta отстрани проблема с актуализация, а Wardle впоследствие потвърди корекцията. Случаят показва колко по-висок става залогът, когато AI има разрешение не само да чете информация, а и да предприема действия.

Точно тук се намира и голямата промяна. При чатбота грешният отговор обикновено остава текст на екрана. При автономния агент грешното решение потенциално може да означава изпратен имейл, направена резервация или друго реално действие. Затова контролът върху разрешенията и ясното потвърждаване на чувствителните операции се превръщат в съществена част от самия продукт.

Практическият тест на CNN не доказва, че Muse може надеждно да автоматизира всяка ежедневна задача, но показва колко бързо границата между „AI, който съветва“ и „AI, който действа“ започва да изчезва. Ако подобни агенти успеят да съчетаят удобството с достатъчно надежден контрол върху личните данни и действията, следващата голяма промяна в изкуствения интелект може да бъде не по-добрият отговор на въпрос, а моментът, в който потребителят вече няма нужда сам да отваря приложенията и сайтовете, необходими за изпълнението на задачата.