Як виробники телефонів і розробники додатків дивляться на дебати щодо телефону зі штучним інтелектом: співпраця A2A може бути шляхом уперед

Jan 19, 2026

Залишити повідомлення

По-справжньому здібному агенту зі штучним інтелектом потрібен і кмітливість, і -здатність до реальних дій-він має глибоко розуміти, чого хоче користувач, а потім справді виконувати завдання. Ось як Юань Юань, декан Дослідницького інституту Alibaba, описав ідеальну форму агентів ШІ під час недавнього семінару «Безпека та розвиток поведінки агентів ШІ».

news-1-1

Вона підкреслила, що, незважаючи на те, що агенти штучного інтелекту обіцяють перетворити технології штучного інтелекту на реальні гроші та значно покращити взаємодію з користувачами, їх впровадження не повинно перевернути існуючі правила, управління чи бізнес-екосистеми. Натомість усе має відбуватися безпечно, керовано, завдяки тісній співпраці в галузі, щоб виробники телефонів і розробники додатків могли спільно користуватися перевагами передових моделей.

 

Протягом останнього року головним питанням на ринку було: «Чи справді штучний інтелект може виконувати завдання замість нас?» Ми бачили, як з’являються різні підходи.

 

Деякі продукти намагаються «взяти на себе» роботу телефону, розуміючи, що на екрані, і імітуючи людські натискання та гортання, щоб виконувати такі дії, як редагування відео, бронювання квитків або замовлення їжі в різних програмах. Таких зазвичай називаютьАгенти GUI(скорочення від Graphical User Interface Agents).

 

Технічно вони працюють так, що штучний інтелект «бачить» екран, визначає його, а потім імітує клацання та жести. Але це відразу викликає купу складних питань: хто дає дозвіл? Хто відповідатиме, якщо це зіпсується? До яких послуг він може отримати доступ? А хто це тримає?

На семінарі експерти відзначили, що цей екран-підхід має справжню-короткострокову цінність-він дозволяє агентам штучного інтелекту переходити до щоденного використання, не вносячи значних змін у існуючі програми. Але в довгостроковій перспективі він має-встановлені обмеження щодо надійності, швидкості та того, наскільки добре ним можна керувати. Багато хто вважає це радше тимчасовим мостом, ніж фіналом.

 

Цзяо Хайтао, професор Китайського університету політичних наук і права, стверджував, що дозволи для агентів штучного інтелекту слід опрацьовувати сцена за сценою. Критичні дії потребують повторного підтвердження від користувача, а речі, пов’язані з особистими якостями, суб’єктивними рішеннями чи соціальними взаємодіями, взагалі не слід делегувати. Він звернув увагу на проблеми з подвійними-правилами авторизації-не кожен сценарій має покладатися лише на-платформу третьої сторони-і запропонував галузі співпрацювати шляхом переговорів і стандартів, щоб поступово вирішити цю проблему.

 

Виробники телефонів активно досліджують власні шляхи для агентів ШІ.

 

На нещодавньому брифінгу для ЗМІ Цзян Юйчен, директор OPPO з досліджень і розробок смарт-продуктів для ColorOS, сказав журналістам, що такі продукти, як телефон Doubao, позитивно вплинули на галузь та екосистему, просуваючи речі вперед. Але вона була чіткою: «Це не остаточна форма телефону зі штучним інтелектом-це все ще в основному метод роботи зі старими інтерфейсами GUI».

 

Для OPPO вибір між підходами-стилю графічного інтерфейсу користувача не пов’язаний з ідеологією-це насамперед інженерна проблема та проблема масштабу. Цзян пояснив, що щось на зразок Doubao може дозволити собі бути більш агресивним як інженерний прототип, але великі виробники телефонів мають справу з величезною базою користувачів. «Якщо ви запускаєте функцію, а наступного дня більшість служб перестають працювати належним чином, для нас це є проблемою якості-ми не можемо з цим погодитися». У такому масштабі будь-які нестабільні можливості-системного рівня швидко збільшуються.

 

На її думку, агенти на основі-операцій-екрана є «дещо проміжним етапом». Основний шлях попереду більше схилятиметься доСпівпраця A2A (-to-Agent)., де агенти ШІ спілкуються безпосередньо один з одним і працюють разом.

 

Вона підкреслила, що в цій еволюції для виробників телефонів дійсно важливий не розмір чи параметри моделі-а їхнє глибоке, довгострокове-розуміння користувачів. «Ми не вважаємо, що велика модель є душею телефону», — сказав Цзян. «Ми віримо, що «пам’ять» — це душа. Коли ваш телефон справді вас розуміє, вам справді важко переключитися на щось інше».

 

На семінарі кілька експертів погодилися, що справжня проблема для агентів штучного інтелекту полягає не лише в тому, «чи зможе він виконати роботу?»-а й у визначенні чітких меж для того, що вони можуть робити, і як ними керувати.

 

Юань Юань зазначив, що нинішня хвиля графічного інтерфейсу створила здоровий «ефект сома», струснувши та активізувавши всю галузь. Але вона закликала сектор штучного інтелекту Китаю не зупинятися на шляху GUI. Натомість створіть його, щоб знайти кращі маршрути, які збалансують безпеку та прогрес. Вона вказала на підхід Apple як на гарний приклад: він встановлює відкриту співпрацю-на основі API між агентами та програмами, водночас використовує усвідомлення екрана, щоб зберегти межі безпеки недоторканими та точно передавати наміри користувача програмам, роблячи їх розумнішими у виконанні команд.

 

Ван Юе, заступник директора Інституту інформаційних систем Департаменту електронної інженерії Університету Цінхуа, вважає агенти штучного інтелекту головним поворотним моментом-Системи штучного інтелекту починають безпосередньо взаємодіяти із зовнішнім світом. Це не просто змінить спосіб побудови інформаційних систем; це також може змінити економічні операції. Він попередив, що справді руйнівні інновації ризикують послабити керованість системою та підірвати фундамент довіри, тому нам потрібні кращі механізми авторизації та система стримувань і противаг A2A, щоб зрештою перейти до систем довіри,-орієнтованих на ринок-конкуренції.

 

Загалом розмова зміщується від того, чи може штучний інтелект діяти на телефонах, до того, як робити це відповідально та стабільно-і співпраця між агентами в стилі A2A- виглядає як багатообіцяючий спосіб досягти цього, не порушуючи все інше.

 

Послати повідомлення