Сатья Наделла щойно вступив у публічний конфлікт із тими самими лабораторіями, у створенні яких допомагала його компанія. Головний виконавчий директор Microsoft висловив жорстке попередження про те, як найбільші ШІ-компанії переписують правила власності на дані, і це повідомлення прозвучало з незвичною силою. У нещодавньому дописі в блозі Наделла звинуватив провідні лабораторії, зокрема OpenAI та Anthropic, у створенні маніпулятивного ринку. Вони збирають публічні дані для навчання масивних моделей, а потім використовують свої умови надання послуг, щоб завадити будь-кому навчатися на результатах роботи цих моделей. Як стверджує він, результатом є односторонній перенос цінності, через який підприємства оплачують рахунки, водночас віддаючи свої власні знання.
Подвійні стандарти дистиляції
Щоб зрозуміти суть скарги, варто розглянути техніку, яку ці лабораторії так прагнуть заблокувати. Дистиляція — це поширений метод навчання, при якому менша спеціалізована модель навчається на результатах роботи більшої моделі, замість того щоб з нуля поглинати необроблений текст з інтернету. Стартап або дослідницька група можуть подавати мільйони запитів до провідної моделі, фіксувати відповіді та використовувати цей багатий сигнал для навчання компактної моделі, яка працює локально або задовольняє вузькоспеціалізовані потреби. Це дешевше і потребує набагато менше енергії, ніж створення базової моделі з нуля.
OpenAI та Anthropic забороняють цю практику у своїх умовах надання послуг. Коли вони виявляють систематичну дистиляцію, вони розцінюють це як порушення. Заходи з примусового виконання часто спрямовані проти конкурентів, зокрема ШІ-компаній із Китаю, яких звинувачують у використанні цього методу для подолання розриву в можливостях без витрачання мільярдів, які йдуть на оригінальне навчання.
Наделла підкреслив напруженість, що лежить в основі цієї політики. Ці ж самі лабораторії створювали свої флагманські моделі шляхом сканування відкритого вебу, збору даних
Логічною відповіддю на цей витік є повернення контролю над циклом навчання. Аргументація На델ли явно спрямована на те, щоб позиціонувати Microsoft як орендодавця іншого типу. Замість того, щоб наполягати на тому, щоб клієнти вливали свій інтелект у централізовану «чорну скриньку», він обґрунтовує необхідність середовищ, де ключі залишаються у клієнта.
Саме тут дискусія про суверенний ШІ набуває практичної ваги. Запуск моделей у приватній хмарі, локальному дата-центрі або суворо контрольованій віртуальній мережі означає, що дані взаємодії ніколи не залишають периметра організації. Підприємство все ще отримує переваги від сучасних базових моделей, але ваги, промпти та дані про вподобання залишаються в межах кордону, яким керує компанія.
Microsoft побудувала свій хмарний бізнес Azure саме на цій обіцянці приватного розгортання та регіонального зберігання даних. У своєму дописі Наделла дав зрозуміти, що Microsoft хоче бути платформою, на якій підприємства можуть самостійно здійснювати навчання та інференс, не передаючи ненавмисно свою інтелектуальну власність віддаленому постачальнику моделей. Суть пропозиції проста: використовуйте потужний ШІ, але зберігайте свої «відходи».
Інші вендори роблять подібні заяви, але виступ На델ли має особливу вагу через глибоке партнерство Microsoft з OpenAI. Для генерального директора, чий...
