Лондонська школа економіки разом з аудіовізуальною технологічною компанією Jabra оприлюднили дослідження, яке прогнозує, що вже до 2028 року голосовий штучний інтелект стане стандартним способом виконання робочих завдань. Замість того щоб годинами набирати тексти на клавіатурі, працівники дедалі частіше говоритимуть зі своїми телефонами та ноутбуками. Дослідники стверджують, що це відбуватиметься завдяки стрімкому розвитку генеративного ШІ, який дедалі глибше інтегрується в робочі процеси.
Особливо помітним цей зсув буде для покоління Альфа, яке народилося після 2010 року. Найстарші його представники вийдуть на ринок праці приблизно у 2030 році, і, за прогнозами, вони вже не застануть офісної роботи без голосових технологій. «Коли покоління Альфа вийде на роботу, ШІ буде повністю вбудований, і їхня робота буде озвучена задовго до того, як її надрукують», — зазначив Пол Септон, глобальний керівник бренд-комунікацій Jabra. За його словами, друкування стане лише завершальним етапом: «Вони говоритимуть, щоб писати, а потім друкуватимуть, щоб уточнити. Вони керуватимуть роботою, а не просто створюватимуть чернетки. Друкування стане редагуванням, а не мисленням. Перша чернетка майбутнього — озвучена».
Дослідження наголошує, що це не віддалене майбутнє, а наступний етап взаємодії з генеративним ШІ. Голосовий інтерфейс, на думку авторів, відповідає природному способу мислення людини — швидкому, ітеративному та розмовному. Септон додає, що перехід на голос принесе вигоду не лише поколінню Альфа, а й нинішнім працівникам: звільнивши руки, вони зможуть працювати креативніше, а ідеї, які спалахують поза робочим столом, легше фіксувати за допомогою ШІ-помічника. Крім того, голосові технології можуть стати потужним інструментом інклюзії, зокрема для батьків, які поєднують роботу з доглядом за дитиною.
Водночас незалежні академіки застерігають від надмірного оптимізму. Фабріс Каваретта, доцент кафедри менеджменту ESSEC Business School, сумнівається, що голосові повідомлення повністю витіснять електронну пошту. Він нагадує, що читати текст швидше, ніж слухати аудіо, а пошук за ключовими словами в листуванні значно ефективніший. «Перегляд електронного листа перемагає відтворення голосового повідомлення», — каже він. Утім, Каваретта погоджується, що голос може стати основним способом введення інформації, яку ШІ автоматично перетворюватиме на текст. Тобто працівники диктуватимуть листи, але отримувачі читатимуть їх як звичайні текстові повідомлення.
Бертран Одрен, доцент кафедри управління людськими ресурсами та організаційної поведінки EHL Hospitality Business School, звертає увагу на ризики для підзвітності. Якщо голосові повідомлення не транскрибуються в текст, вони можуть розмивати відповідальність за ухвалені рішення. «З голосовими повідомленнями ви втрачаєте частину тієї «викарбуваної» якості, яку дає письмовий текст, — пояснює він. — Якщо через місяці потрібно звернутися до старого рішення, переглядати аудіо набагато складніше, ніж шукати в електронних листах чи документах». Крім того, запис потоку думок вимагає подальшого редагування: потрібно прибрати «емкання» та відхилення від теми. Для людей, які не є носіями мови, або тих, хто має вади мовлення, це може стати додатковим тягарем.
Одрен також попереджає, що легкість запису й поширення голосових повідомлень може призвести до комунікаційного перевантаження і, як наслідок, до падіння продуктивності. Таким чином, попри обіцянки спростити роботу, голосові технології можуть створити нові виклики для організацій. Дослідження LSE та Jabra окреслює майбутнє, в якому клавіатура поступається місцем голосу, але водночас наголошує на потребі збалансувати інновації з підзвітністю та ефективністю.