GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

xAI відкрила вихідний код Grok через два дні після того, як дослідники виявили приховані витоки даних

Нещодавно опублікований репозиторій Apache-2.0 все ще містить алгоритм викрадення даних, прихований за серверним прапорцем, і навіть включає неатрибутовані фрагменти коду від OpenAI, тому розробникам необхідно провести аудит інструменту та змінити всі скомпрометовані облікові дані.

AI · 3 min read

Neko Health залучає 700 мільйонів доларів для відкриття профілактичної клініки на базі ШІ в Нью-Йорку

Фінансування раунду C під керівництвом Lightspeed Venture Partners піде на розвиток флагманської клініки Neko в Нью-Йорку, яка поєднує візуалізацію високої роздільної здатності, аналізи крові та власні сенсори зі штучним інтелектом, що дозволяє лікарям виявляти передвісники захворювань ще до появи симптомів.

AI · 4 min read

Стаття Anthropic про інтерпретованість може посилити її аргументацію щодо оцінки вартості у 1 трильйон доларів

Дослідження пропонує лише часткові карти активації, які корелюють із певними завданнями, але не доводять причинно-наслідковий зв'язок. Хоча це свідчить про рух у бік прозорості, розробникам слід сприймати це як ранню діагностику, а не як гарантію безпеки.

AI · 3 min read

Бюро авторського права не надає захисту зображенням, створеним ШІ, але зберігає права на текст і макет автора

Бюро авторського права США постановило, що зображення для графічного роману, створені за допомогою Midjourney, не підлягають захисту авторським правом. Водночас права зберігаються за прозою автора та композицією панелей, що підкреслює необхідність документального підтвердження людської участі.

AI · 3 min read

Атаки через побічні канали кешу можуть викрадати дані з працюючих моделей ШІ

Моніторинг часу читання/запису кешу дозволяє зловмисникам виявляти як вхідні дані, так і частини вивчених ваг моделі — ця вразливість зберігається навіть при використанні коду з постійним часом виконання або шифруванні моделі.

AI · 3 min read

ШІ-агентам усе ще потрібен повний інженерний стек, — каже розробник після багатогодинного налагодження

Під час практичного випробування розробник витратив кілька годин на поєднання LLM, шарів пам'яті, планувальників та інтеграцій інструментів, лише щоб боротися з галюцинаціями, нескінченними повторними спробами та витратами на токени — це доводить, що справжня автономність усе ще потребує ручної розробки.

AI · 2 min read

Downstream Electron 42.6.0 виправляє збої вікон повідомлень у Linux

Downstream-розробник змінив порядок двох викликів GTK, що запобігло розіменуванню нульового вказівника, яке спричиняло помилки сегментації в Electron-додатках на базі Qt у Linux. Така ж зміна вже міститься у відкритому upstream PR, проте користувачі отримують виправлення вже зараз у версії 42.6.0.

AI · 2 min read

Honcho Swaps Long-Lived DB Sessions for Short Ones to Cut LLM Latency

The Honcho team discovered that keeping a database connection open while waiting on slow LLM or embedding calls can hog the connection pool. By moving to pre-flight reads, closing the session, and reopening only for writes, they reduced latency and improved scalability.

AI · 1 min read

Microsoft наказує відділам продажів обходити OpenAI та Anthropic, просуваючи власний стек ШІ

Microsoft змінює стратегію, щоб протиставити команди продажів OpenAI та Anthropic. Microsoft кардинально змінює свій ринковий підхід, переходячи від ролі тісного партнера-піонера у сфері ШІ…

AI · 2 min read

Qwen 3.6 35B-A3B перемагає чотирьох конкурентів на RTX 5090 у реальному редагуванні коду

У бенчмарку було протестовано п'ять агентів на одній RTX 5090: їм доручили додати Tag Manager до панелі адміністратора без використання хмарних API. Qwen 3.6 35B-A3B виконав завдання автономно, вніс розумні покращення та не потребував жодних виправлень після завершення роботи.

AI · 3 min read

AWS запускає Claude Apps Gateway із власним хостингом для корпоративного контролю

Claude Apps Gateway вбудовує рівень управління безпосередньо в обліковий запис AWS клієнта, надаючи ІТ-відділу єдину панель для керування ідентифікацією, журналами аудиту та витратами, тоді як розробники можуть запускати сесії на базі Claude, не розкриваючи дані зовнішнім сторонам.

AI · 2 min read

LLM-агент на 350 млн параметрів працює повністю у вашому браузері — без жодних витрат на хмарні сервіси

Асистент постачає ваги моделі разом зі статичною вебсторінкою та використовує фіксований список із восьми інструментів, декодування з граматичними обмеженнями та RAG — усе це було навчено лише на 30 млн токенів на одній відеокарті з 16 ГБ пам'яті.

AI · 3 min read

Детектор attention sink показує, що видалення BOS-токена критично знижує продуктивність LLM

Детектор фіксує необроблені показники уваги в усіх головах, агрегує їх по шарах і використовує тест log-MAD для виявлення токенів, які поглинають основну частину уваги. Видалення цих токенів-«поглиначів» із KV-кешу дестабілізує генерацію та різко знижує якість.

AI · 3 min read

Проєкт закону ЄС може змусити сканувати чати з ШІ на наявність незаконного контенту

Пропозиція розширює чинні правила фільтрації повідомлень, охоплюючи будь-який сервіс, де двоє людей обмінюються текстом. Це означає, що провайдери ШІ будуть змушені пропускати кожен запит користувача через автоматизовані сканери ще до того, як його опрацює модель.

AI · 4 min read

OpenAI представляє клавіатуру Codex Micro за $230 для кодинг-агентів на базі ШІ

Codex Micro оснащена підсвіченими клавішами Agent Keys, програмованими гарячими клавішами, джойстиком та регулятором Reasoning Dial, які інтегровані безпосередньо з десктопним додатком ChatGPT, що дозволяє розробникам стежити за кількома ШІ-агентами та керувати ними, не виходячи зі своєї IDE.

AI · 3 min read

ШІ-агенти на AWS Lambda платять більше за холодні старти, ніж за обчислення

Запуск ШІ-агента на Lambda може здаватися дешевим у розрахунку на мілісекунду, проте основні витрати пов'язані із затримкою холодного старту, циклами повторних спроб, що спричиняють багаторазові виклики моделі, та відповідним споживанням токенів, яке значно перевищує вартість самих обчислень.

AI · 3 min read

BrassCoders виявили зашиті в код секрети у 2 з 15 Python-скриптів, створених ШІ

Ці два вразливі скрипти — один із ключем підпису HMAC, інший із паролем SMTP у відкритому вигляді — демонструють, як LLM заповнюють відсутні значення, коли їх просять надати «готовий до використання приклад», перетворюючи корисні фрагменти коду на витік облікових даних у системах контролю версій та в робочих середовищах.

AI · 4 min read

Інженери передового розгортання з Ode прагнуть покласти край «чистилищу пілотних проєктів» корпоративного ШІ

Ode у співпраці з Anthropic, заснована Крісом Тейлором та Едді Сігелом, поєднує кадровий резерв Fractional AI з моделями Claude від Anthropic за підтримки Blackstone, Hellman & Friedman та Goldman Sachs, щоб перетворити прототипи на готові до експлуатації системи ШІ.

AI · 3 min read

Thinking Machines співпрацює з Nvidia для навчання Inkling на апаратному забезпеченні GB300 NVL72

Inkling, навчена на 45 трильйонах мультимодальних токенів, забезпечує продуктивність кодування на рівні Nvidia, активуючи лише малу частину своїх 975 мільярдів параметрів, що суттєво знижує затримку та операційні витрати для корпоративних користувачів.

AI · 2 min read

OpenAI розгортає GPT-Red, знижуючи успішність симульованих атак з 90% до 23%

Система самонавчання «dojo» дозволяє GPT-Red виступати в ролі атакуючого, тоді як моделі-захисники вивчають методи протидії, виявляючи нові хитрощі, як-от атака з фальшивим ланцюжком думок, що змушує LLM приймати хибні передумови.

AI · 2 min read