GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

Moonshot AI випустила Kimi K3 з 2,8 трильйона параметрів, але вона не запуститься на домашньому ПК

27 липня Moonshot AI зробила доступною для публічного завантаження модель Kimi K3 з 2,8 трильйона параметрів, проте її апаратні вимоги потребують GPU-кластерів корпоративного рівня, через що звичайні розробники сьогодні не можуть запустити її локально.

AI · 2 min read

Дослідження MIT виявило, що ШІ-фактчекери погіршують здатність користувачів розпізнавати фейкові новини

У чотиритижневому експерименті за участю 67 учасників дослідники MIT дозволили точному ШІ виносити однозначні вердикти щодо новинних матеріалів. Хоча ШІ був правим у більшості випадків, у користувачів, які покладалися на нього, спостерігалося помітне зниження здатності самостійно розпізнавати дезінформацію, коли ШІ був відсутній.

AI · 2 min read

Images Beat Text on Gemini: Math, Non-Latin Scripts and Tables Cost Less

Google’s Gemini counts image tokens by 768-pixel tiles, charging 258 tokens each. By keeping pictures under one tile—or using them for dense data like equations, tables, or non-Latin scripts—developers can often pay far less than sending the same information as text.

AI · 3 min read

AWS запускає Bedrock AgentCore для стандартизації оркестрації ШІ-агентів на саміті в Боготі

На саміті в Боготі AWS представила Bedrock AgentCore — єдину платформу, яка об'єднує оркестрацію, спостережуваність та засоби контролю безпеки, що дозволяє розробникам швидко розгортати спеціалізованих ШІ-агентів без необхідності створення власної інфраструктури.

AI · 4 min read

Claude Code Turns Are 75% Reading

Claude Code Turns Are 75% Reading Most people think AI coding agents spend their time writing code. New data shows this is wrong. Red Hat analyzed 219 real Claude Code sessions. T…

AI · 3 min read

Версіоновані контрольні точки з умовним записом через ETag запобігають втраті даних у LangGraph

Після тижнів непомітної втрати стану автор спробував SQLite, сире об'єктне сховище та невдалу гібридну модель, перш ніж зупинитися на версіонованому конверті з умовним записом на основі ETag — циклічному атомарному оновленні, що запобігає одночасним перезаписам і відновлює надійність.

AI · 3 min read

Кешування промптів Claude мовчки дає збій

Кешування промптів Claude мовчки дає збій. Ваше кешування промптів Claude може працювати з помилками, і ви про це навіть не дізнаєтеся. Я додав керування кешем до обробника WhatsApp. Я стежив за логами протягом...

AI · 3 min read

Кешування промптів Claude Opus 5 знижує витрати на токени чат-бота на 90% після першого виклику

Новий запис у кеш коштує у 1,25 або 2 рази дорожче за базову ціну для TTL тривалістю 5 хвилин або 1 година, проте кожен наступний запит тарифікується лише за 0,1x, що перетворює глибокі розмови на одноразові витрати, якщо ви заздалегідь завантажуєте незмінний контекст.

AI · 3 min read

AI-модерація спричинила 22% зростання кількості дописів нових користувачів на Reddit без збільшення рівня спаму

Під час перших пілотних проєктів у таких сабредітах, як r/technology, модерація Reddit на основі ШІ підвищила активність нових авторів на 22%, при цьому частка позначеного спаму та цькування залишилася незмінною. Це демонструє, що модель може знижувати бар'єри для входу, не ставлячи під загрозу безпеку.

AI · 2 min read

Виправлення стрімінгу у версії Ollama RC, проте формати чанків все ще можуть порушувати роботу застосунків

Оновлення Ollama RC: Випущено Ollama v0.32.6 rc0 з підтримкою Qwen3.5 та виправленнями стрімінгу. Воно містить оновлення для користувачів Apple GPU та виправляє проблеми зі стрімінгом. Нові функції для користувачів Apple: MLX за…

AI · 1 min read

GraphRAG + персистентна пам'ять: чат-боти більше не забуватимуть інформацію при закритті вкладки

Перетворюючи отриманий текст на граф сутностей та зв'язків, GraphRAG дозволяє моделям аналізувати інформацію з кількох документів, тоді як трирівнева контекстуальна пам'ять зберігає короткострокові діалоги, довгострокові факти про користувача та селективно відфільтровані дані, що дозволяє їм зберігатися навіть після оновлення сторінки чи відкриття нових вкладок.

AI · 3 min read

My Agent Orchestrator Blew $1-2 M Worth of Opus Tokens Per Task

The orchestrator’s sub-agents inherited the parent’s settings, defaulted to the pricey Opus tier, rewrote the cache each call and ran endless loops until a reviewer approved, inflating a simple job into a multi-million-token expense.

AI · 2 min read

Збільшення інтервалу опитування Neon до 15 хвилин суттєво скоротило витрати на обчислення

Завдяки збільшенню інтервалу оновлення на стороні клієнта з 30 секунд до 15 хвилин, база даних Neon змогла простоювати достатньо довго, щоб масштабуватися до нуля, що усунуло посекундну оплату обчислень, яка раніше спричиняла різке зростання витрат у панелі керування Vercel.

AI · 2 min read

Вразливість GhostApproval дозволяє ШІ-помічникам для написання коду перезаписувати ваші SSH-ключі

Дослідники Wiz Research виявили, що шкідливе символьне посилання (symlink) на project_settings.json може обманути шість основних ШІ-інструментів для програмування, змусивши їх записувати дані безпосередньо у ~/.ssh/id_rsa, оскільки в діалоговому вікні підтвердження відображається лише назва посилання, а не справжній шлях до файлу.

AI · 3 min read

Microsoft заявляє, що розробка ШІ-агентів, готових до експлуатації, потребує від 26 до 60 інженерних тижнів

Новий посібник визначає сім архітектурних стовпів — повноваження, межі, схеми, виявлення помилок, стан, відкат та можливість аудиту, — які необхідно розробити з нуля, перш ніж можна буде випустити будь-якого автономного агента, попереджаючи, що завдання з низькою цінністю не виправдають таких зусиль.

AI · 3 min read

ШІ від Grab скорочує час доставки на 30% та збільшує операційний прибуток на 186% до 19 млн доларів

Набір ШІ-інструментів Grab — маршрутизація Turbo Mode, прогнозне зіставлення (Predictive Matching) та помічник для продавців Mai — скорочує час доставки на третину, підвищуючи заробіток водіїв на 23% і продажі ресторанів на 15%, тоді як операційний прибуток платформи зріс на 186% до 19 мільйонів доларів.

AI · 2 min read

Рівневе розділення Claude знижує витрати на API на 35% та скорочує затримку до 27 с

Автор створив статичну таблицю пошуку, яка розподіляє завдання за рівнем неоднозначності між моделями Haiku, Sonnet або Opus, а також додав правило ескалації після двох невдач. Протягом чотирьох тижнів система зберігала якість, знизивши витрати на API до 65% від початкового рівня та скоротивши медіанний час виконання з 42 с до 27 с.

AI · 3 min read

FaceHugger RCE обходить механізм довіри Diffusers, дозволяючи виконувати код під час завантаження моделі

Помилка FaceHugger використовує стан гонитви під час двофазного завантаження, що дозволяє шкідливому коду, впровадженому у другому запиті, виконуватися навіть за вимкненого параметра `trust_remote_code`, ставлячи під загрозу CI/CD-процеси, контейнери та корпоративні сервіси інференсу.

AI · 2 min read

Один лічильник шлюзу приховав цілодобовий збій ШІ на продакшені

Моя ШІ-функція не працювала цілий день. Метрика показувала, що все працює. Вчора моя система дронів зафіксувала чотири пояснення ШІ. Запобіжний шлюз відхилив усі чотири. Це викликало у мене відчуття задоволення...

AI · 2 min read

Крихітні MCP-сервери на безкоштовному рівні віддають Markdown, витрачаючи лише 1-2 мс процесорного часу на Cloudflare

Наші тести показують, що MCP-сервер лише для читання, який обробляє виклики list та get_article, використовує лише 0-2 мс процесорного часу на запит, залишаючись далеко нижче ліміту безкоштовного рівня Cloudflare, проте будь-який парсинг «на льоту» швидко досягне межі у 10 мс.

AI · 3 min read

Hermes Agent зменшує ризики витоку даних завдяки виконанню інструментів ШІ локально

Hermes Agent усуває розрив між чат-ботами та програмованими помічниками, дозволяючи розробникам підключати shell-команди, операції введення-виведення файлів та власні сервіси, зберігаючи при цьому контекст між сесіями — і все це на власному обладнанні.

AI · 3 min read