GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

Ендрю Ин представляє карту навичок інженерії ШІ, щоб покласти край «вайб-кодингу»

Ця карта поділяє розробку LLM на шість сфер — від структурованих шаблонів промптів до обробки дрейфу в реальному часі, — надаючи інженерам чек-лист для переходу від швидких демо-версій до надійних і масштабованих ШІ-сервісів.

AI · 2 min read

Stability AI залучає 76 мільйонів доларів від UMG, Sony, Warner та EA

Цей раунд, очолюваний AMD Ventures та Pacific Alliance Ventures, доводить загальний обсяг фінансування Stability AI до 232 мільйонів доларів і надає музичним та ігровим гігантам частки в капіталі, перетворюючи їх із ліцензіатів на ранніх користувачів генеративної медіаплатформи стартапу.

AI · 3 min read

Jalapeño зменшує затримку ШІ-виведення до 3,6 раза, загрожуючи лідерству Nvidia

Чип також забезпечив у 1,5–1,9 раза вищу продуктивність на ват і був розроблений лише за дев'ять місяців за допомогою робочого процесу з підтримкою ШІ спільно з Broadcom, що підкреслює високий темп розробки апаратного забезпечення OpenAI.

AI · 2 min read

Anthropic об'єднує Claude Chat та Cowork Memory, щоб позбутися труднощів із повторним інструктуванням

Оновлення об'єднує окремі чати Claude та сховища Cowork в єдину базу, що динамічно оновлюється, тегує та синхронізує інформацію в режимі реального часу, а також має вбудований інструмент для редагування або видалення записів.

AI · 3 min read

Outer Biosciences демонструє перші результати ШІ, що перевершують моделі на основі органоїдів у прогнозуванні дії ліків

У пілотних дослідженнях із біотехнологічними партнерами ШІ компанії Outer Biosciences, навчений на зрізах живої шкіри, продемонстрував тісніший зв'язок із клінічними результатами, ніж порівнянні прогнози на основі органоїдів, що вказує на новий стандарт точності скринінгу ліків.

AI · 5 min read

Республіканці та демократи об'єднують зусилля, щоб заборонити федеральні закупівлі систем LPR від Flock

Наслідки розслідування Washington Post щодо 46 ймовірних випадків зловживань спонукали трьох республіканців із Палати представників та прогресивних сенаторів спільно розробити законопроєкт, який прямо забороняє федеральному уряду купувати будь-які автоматизовані системи спостереження, окремо згадуючи Flock Safety.

AI · 3 min read

Gemini for Legal обіцяє перегляд контрактів за лічені хвилини, що дозволить значно скоротити витрати юридичних фірм

Google Gemini Enterprise for Legal використовує конектори Model Context Protocol для прямого читання файлів з iManage, NetDocuments, DocuSign, Everlaw та інших сервісів, дозволяючи ШІ-агентам виконувати попередньо налаштовані «навички» для перегляду контрактів, проведення досліджень та відстеження нормативних вимог.

AI · 6 min read

Власна юридична модель перевершує GPT-5.4 за точністю завдяки використанню даних Reuters

Після навчання на базі Qwen та інтеграції власних архівів Westlaw, Practical Law, Checkpoint і новин, модель Thomson Reuters підвищила рівень фактичної точності в Deep Research з 0,53 до 0,83, випередивши GPT-5.4, якій бракує таких пропрієтарних даних.

AI · 3 min read

Hugging Face Gets $13B Bids, Triple Its 2023 Valuation

Banks have been hired to vet offers topping $13 billion, a near-tripling of the $4.5 billion post-money valuation from Hugging Face’s 2023 round. CEO Clem Delangue says the firm is close to profitability and must weigh cash versus its community-first mission.

AI · 4 min read

ШІ від MIT створює карти високої роздільної здатності для екстремальних погодних явищ, яких раніше не спостерігалося

Аспірант факультету машинобудування Кай Чанг та професор Феміс Сапсіс розробили фізико-інформовану нейронну мережу, яка створює деталізовані карти ризиків високої роздільної здатності для екстремальних подій, що раніше не траплялися в регіоні, надаючи також довірчі інтервали для планувальників.

AI · 5 min read

OpenAI запускає ChatGPT Work: AI-агент за $20 на місяць для Email, Slack та Notion

ChatGPT Work дозволяє користувачам описувати завдання звичайним текстом, одночасно збираючи дані з поштових скриньок, Slack, Notion та інших SaaS-інструментів. Це дозволяє виконувати багатоетапні робочі процеси, що споживають велику кількість токенів — а отже, призводять до зростання щомісячних витрат за цей додаток за $20.

AI · 3 min read

Бета-версія Wan3.0 від Alibaba створює 30-секундні відео на основі PDF-файлів, слайдів та аудіо

Wan3.0 може обробляти до десяти зображень, п'яти відео, п'яти аудіокліпів, а також PDF-файли, вебсторінки та презентації PowerPoint в одному запиті, і навіть рекомендує оптимальну тривалість відео для кожного запиту.

AI · 2 min read

Instinct від Spear Street дозволяє ШІ зчитувати натискання клавіш, відкриваючи величезний новий вектор атаки

Умови надання послуг Instinct надають ШІ безстрокову та безвідкличну ліцензію на зберігання та повторне використання будь-яких даних користувача, навіть після того, як користувач відкликає доступ, а також дозволяють йому укладати угоди від імені користувача без підпису людини.

AI · 3 min read

Потужні можливості GLM-5.3 у сфері кібербезпеки змусили Z.ai залишити модель доступною лише через API

Z.ai заявляє, що двотижнева затримка дозволяє команді з безпеки оцінити ризик зловживань перед тим, як можливості моделі для наступальної безпеки стануть доступними для вільного завантаження. Цей крок повторює нещодавні обмеження доступу в OpenAI та Anthropic.

AI · 3 min read

Glimmer 30B від Meta перевершує Qwen 3.6 у агентських завданнях і демонструє рівні загальні показники

Окрім основних показників, тестувальники з ком'юніті продемонстрували, що Glimmer можна донавчати на одному 24-гігабайтному GPU, використовуючи вдвічі менше відеопам'яті (VRAM), ніж типові конвеєри, тоді як його лаконічний і впевнений тон викликав неоднозначну реакцію серед розробників чат-ботів.

AI · 3 min read

EnvHarness від Google додає динамічні стрес-тести, підвищуючи показники агентів на величину до 9 пунктів

EnvHarness додає три модульні розширення — Setup, Rule та Link — до існуючих тестових наборів, рандомізуючи умови, вставляючи обмеження під час виконання завдань та пов'язуючи епізоди. Внутрішні випробування Google демонструють зростання на 9 пунктів на невідомих завданнях, проте результати бенчмарків та витрати на обчислення залишаються нерозголошеними.

AI · 2 min read