GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

Відсутність прямих збитків та судової заборони: як тест на економічну шкоду врятував OpenAI в Індії

Суддя Аміт Бансал дійшов висновку, що моделі GPT-4 та GPT-4o від OpenAI використовували статті ANI лише шляхом пошуку в режимі реального часу, а не шляхом запам'ятовування, і що агентство не зазнало прямих фінансових збитків, що дозволило суду розглянути процес навчання як законну дослідницьку діяльність.

AI · 4 min read

OpenAI виявила, що 43,5% спеціалізованих запитів через ChatGPT передаються неспеціалістам

Аналіз 800 000 робочих запитів зіставляє кожен запит із професією за класифікатором O*NET, що свідчить про те, що майже половина висококваліфікованих запитів обробляється користувачами поза межами їхньої власної сфери діяльності — цей тренд найбільш помітний у маркетингу та інженерії.

AI · 2 min read

Moonshot AI відкриває ваги та інструментарій Kimi K3, заявляючи про 2,5-кратне підвищення ефективності обчислень

Moonshot AI не лише випустила ваги моделі Kimi K3, а й надала високопродуктивні ядра уваги (attention kernels), бібліотеку зв'язку MoE та скрипти масштабування, що дозволяє будь-кому з достатнім обладнанням запускати LLM передового рівня за нижчу вартість.

AI · 4 min read

MCP стає безстатковим: сервери можуть масштабуватися за звичайними HTTP-балансувальниками навантаження

Нова специфікація MCP видаляє приховані ідентифікатори сесій, що дозволяє серверам працювати за стандартними HTTP-зворотними проксі-серверами, тоді як NVIDIA, Microsoft, IBM та інші компанії створюють консорціум для спільного використання бібліотек виявлення, фреймворків пісочниці та журналів аудиту для локальної перевірки ШІ-агентів.

AI · 3 min read

Claude від Anthropic дозволяє будь-кому знайти приватні чати через простий пошук у Google

Користувачі Reddit виявили, що URL-адреси спільних чатів Claude індексувалися пошуковими системами, через що у результатах пошуку Google з'являлися приватні розмови, що містили номери телефонів неповнолітніх, дані клінічних випробувань, внутрішні корпоративні документи та навіть фрагменти коду.

AI · 5 min read

Сатья Наделла: залежність від одного постачальника ШІ може загрожувати вашому бізнесу

Наделла попереджає, що передача промптів та внутрішніх даних одному сервісу LLM замикає знання компанії в непрозорому «чорному ящику». Він пропонує концепцію «ШІ-шлюзу», який зберігає дані локально та дозволяє компаніям вільно змінювати моделі.

AI · 3 min read

AI Forensics виявила, що 73% запитів на Hugging Face мають сексуальний характер, а 95% спрямовані на жінок

Команда AI Forensics створила спеціальні «приманки» (honeypot Spaces) на Hugging Face, які фіксували активність протягом понад тижня. Результати показали, що 73% усіх запитів мали сексуальний характер, 83% були спрямовані на роздягання персонажів, а 95% таких спроб стосувалися жінок, при цьому 7% були спрямовані на дітей.

AI · 2 min read

AI-агенти з автопідтвердженням дозволяють хакерам виконувати код через файл README

Дослідження Friendly Fire продемонструвало, що вбудовування шкідливої команди у файл README може змусити автономного AI-агента виконувати довільний код. Цю вразливість автори згодом відтворили у власному процесі автоматизації блогу, що виявило приховану поверхню атаки.

AI · 3 min read

Розробники хвалять Stream Ring від Sandbar за те, що він зводить процес диктування до одного дотику

Єдиними елементами керування Stream Ring є сенсорна панель та Bluetooth-з'єднання, що дозволяє користувачам натиснути лише один раз і диктувати текст безпосередньо в такі додатки, як Apple Notes. Демонстрація Фахмі показала, що кільце забезпечує майже миттєве та точне введення тексту без необхідності розблоковувати телефон.

AI · 3 min read

Amazon анонсує нову базову модель на re:Invent після заморожування Nova Suite

Компанія підтримуватиме Nova Premier, Omni, Reel та Canvas у режимі «підтримки життєдіяльності», проте подальша розробка припиняється. Тим часом П'їтер Аббеель, який нещодавно приєднався після придбання Covariant, тепер очолює команду Frontier Model Research, поки Amazon вкладає мільярди в зовнішні лабораторії ШІ.

AI · 3 min read

Зміна одного файлу скорочує час завантаження RAG із 33 фрагментів з 50 с до 1,5 с

Прискорення у 31,8 раза завдяки зміні одного файлу. Я протестував конвеєр завантаження RAG і виявив вузьке місце. Обробка одного документа займала 50 секунд. Завантаження процесора було низьким. Додаток не мав труднощів…

AI · 1 min read

Розробники тепер можуть озвучувати завдання з коду для GPT-Live, не перемикаючись між вікнами

GPT-Live, інтегрований у десктопний додаток ChatGPT, дозволяє розробникам віддавати голосові команди, як-от «запустити статичний аналіз» або «додати юніт-тести». Модель підтверджує дії вголос і запускає паралельні робочі процеси — усе це доступно для платних підписників.

AI · 2 min read

Аудит навичок агентів: модель загроз

Аудит навичок агентів: модель загроз. Чи вставили б ви випадковий USB-накопичувач, отриманий від незнайомця? Ймовірно, ні. Більшість людей знають про цей ризик. Проте розробники роблять цифровий еквів…

AI · 3 min read

Mozilla Bets Real-Time AI Content Will Offset Falling Search Revenue

The daily crossword is built by feeding the latest news into a large language model, which generates word-clue pairs that a mathematical solver turns into a printable grid. Mozilla says the extra stickiness could help recoup the higher compute bills and keep users from drifting to external search si

AI · 2 min read

Моделі з відкритими вагами тепер забезпечують 29% AI-токенів Vercel, порівняно з 11% у квітні

Дані шлюзу Vercel за червень показують, що частка дешевих моделей з відкритими вагами за два місяці зросла з трохи більше ніж десятої частини до майже третини всіх токенів, причому лише на DeepSeek припадає понад п'ята частина цього трафіку.

AI · 3 min read

Encord прагне створити набір даних, що в п'ять разів більший за YouTube, для забезпечення роботи роботів людського рівня

Партнерство Encord із німецьким стартапом Zander Labs передбачає використання операторами ЕЕГ-гарнітур та датчиків ЕМГ на передпліччі з метою створення набору даних для навчання, достатньо масштабного, щоб затьмарити відеоархів YouTube і прискорити розвиток вправного маніпулювання роботів.

AI · 6 min read

Слабкі політики DMARC можуть за одну ніч занести до чорних списків цілі флотилії ШІ-агентів

Інфраструктура під вашими ШІ-агентами гниє. Всі кажуть, що ШІ-агентам потрібен лише один виклик API, щоб отримати поштову скриньку. Вони помиляються. Я просканував 671 693 домени, щоб побачити, що насправді...

AI · 3 min read

Повнота RAG зросла з 60% до 90% після виправлення метрики

Автор виявив, що три чверті так званих «пропусків» насправді містили потрібний факт на іншій сторінці, ніж очікував тестовий скрипт. Перехід на метрику повноти на рівні фактів дозволив узгодити її з 90% точністю відповідей.

AI · 2 min read