GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

Нет прямых убытков, нет судебного запрета: как тест на экономический ущерб спас OpenAI в Индии

Судья Амит Бансал пришел к выводу, что модели GPT-4 и GPT-4o от OpenAI использовали статьи ANI только через поиск в режиме реального времени, а не путем запоминания, и что агентство не понесло прямых финансовых убытков, что позволило суду признать процесс обучения законной исследовательской деятельностью.

AI · 4 мин чтения

OpenAI обнаружила, что 43,5% специализированных запросов в ChatGPT обрабатываются неспециалистами

Анализ 800 000 рабочих запросов, сопоставляющий каждый из них с профессией по классификатору O*NET, показал, что почти половина высококвалифицированных запросов обрабатывается пользователями не из соответствующей области. Этот тренд наиболее выражен в маркетинге и инженерии.

AI · 2 мин чтения

Moonshot AI открывает доступ к весам и инструментарию Kimi K3, заявляя о 2,5-кратном повышении вычислительной эффективности

Moonshot AI не только опубликовала веса модели Kimi K3, но и предоставила высокопроизводительные ядра внимания, библиотеку связи для MoE и скрипты масштабирования, что позволяет любому пользователю с достаточным оборудованием запускать LLM передового уровня с меньшими затратами.

AI · 4 мин чтения

MCP становится stateless: серверы могут масштабироваться за обычными HTTP-балансировщиками нагрузки

Новая спецификация MCP исключает скрытые ID сессий, позволяя размещать серверы за стандартными HTTP-обратными прокси-серверами, в то время как NVIDIA, Microsoft, IBM и другие компании создают консорциум для совместного использования библиотек обнаружения, фреймворков песочниц и журналов аудита для локальной проверки ИИ-агентов.

AI · 3 мин чтения

Claude от Anthropic позволяет находить приватные чаты через обычный поиск в Google

Пользователи Reddit обнаружили, что URL-адреса общих чатов Claude индексируются поисковыми системами, из-за чего в результатах поиска Google стали появляться приватные переписки, содержащие номера телефонов несовершеннолетних, данные клинических испытаний, внутренние корпоративные документы и даже фрагменты кода.

AI · 5 мин чтения

Сатья Наделла: зависимость от одного ИИ-поставщика может погубить ваш бизнес

Наделла предупреждает, что передача промптов и внутренних данных единственному сервису LLM запирает знания компании в непрозрачном «черном ящике». Он предлагает использовать «ИИ-шлюз», который позволяет хранить данные локально и свободно менять модели по своему усмотрению.

AI · 3 мин чтения

AI Forensics выяснила, что 73% промптов в Hugging Face носят сексуальный характер, а 95% направлены на женщин

Команда AI Forensics создала «приманки» (honeypot Spaces) на Hugging Face, которые фиксировали активность в течение более чем недели. Исследование показало, что 73% всех промптов были сексуального характера, 83% содержали просьбы о раздевании, а 95% таких попыток были направлены на женщин, при этом 7% были нацелены на детей.

AI · 2 мин чтения

AI-агенты с функцией авто-одобрения позволяют хакерам выполнять код через файл README

Исследование Friendly Fire показало, что внедрение вредоносной команды в README может заставить автономного ИИ-агента выполнять произвольный код. Авторы позже воспроизвели эту уязвимость в своем собственном конвейере автоматизации блогов, выявив скрытую поверхность атаки.

AI · 3 мин чтения

Разработчики хвалят кольцо Stream от Sandbar за то, что оно сводит процесс диктовки к одному нажатию

Единственными элементами управления кольца Stream являются сенсорная панель и Bluetooth-соединение, что позволяет пользователям нажать один раз и сразу диктовать текст в такие приложения, как Apple Notes. Демонстрация Фахми показала, что кольцо обеспечивает почти мгновенное и точное преобразование речи в текст без необходимости разблокировки телефона.

AI · 3 мин чтения

Amazon намекает на новую базовую модель на re:Invent после сворачивания линейки Nova

Компания продолжит поддерживать Nova Premier, Omni, Reel и Canvas в режиме «поддержания работоспособности», но без дальнейшей разработки. Тем временем Питер Аббел, присоединившийся к компании после поглощения Covariant, возглавил команду Frontier Model Research, пока Amazon вкладывает миллиарды в сторонние ИИ-лаборатории.

AI · 3 мин чтения

Изменение одного файла сократило время загрузки RAG из 33 чанков с 50 с до 1,5 с

Ускорение в 31,8 раза благодаря изменению одного файла. Я протестировал конвейер загрузки RAG и обнаружил узкое место. Обработка одного документа занимала 50 секунд. Загрузка процессора была низкой. Приложение не испытывало...

AI · 1 мин чтения

FluxA запускает AgentCard, позволяя ботам совершать любые покупки с помощью одноразовых виртуальных карт

AgentCard от FluxA создает одноразовый виртуальный номер Visa или Mastercard с ограничением суммы для каждой покупки, совершенной ИИ, и мгновенно аннулирует его, исключая утечки данных, перерасход средств и сложности с отзывом платежных средств.

AI · 4 мин чтения

ИИ-агенты рискуют понести финансовые потери, пока коэффициент Genie не сократит ошибки буквального толкования

Коэффициент Genie измеряет разрыв между истинным намерением пользователя и буквальным результатом работы ИИ-агента, выявляя рискованное поведение, которое может привести к утечкам данных, денежным потерям или штрафам со стороны регуляторов в критически важных областях.

AI · 3 мин чтения

Разработчики теперь могут голосом отдавать задачи по коду в GPT-Live, избавляя себя от переключения между окнами

GPT-Live, встроенная в десктопное приложение ChatGPT, позволяет разработчикам отдавать голосовые команды вроде «запусти статический анализ» или «добавь юнит-тесты». Модель подтверждает действия вслух и запускает параллельные рабочие процессы — функция доступна платным подписчикам.

AI · 2 мин чтения

Аудит навыков агентов: модель угроз

Аудит навыков агентов: модель угроз. Стали бы вы вставлять случайную USB-флешку, полученную от незнакомца? Скорее всего, нет. Большинство людей осознают этот риск. Тем не менее, разработчики совершают цифровой эквив...

AI · 3 мин чтения

Mozilla Bets Real-Time AI Content Will Offset Falling Search Revenue

The daily crossword is built by feeding the latest news into a large language model, which generates word-clue pairs that a mathematical solver turns into a printable grid. Mozilla says the extra stickiness could help recoup the higher compute bills and keep users from drifting to external search si

AI · 2 мин чтения

Модели с открытыми весами теперь обеспечивают 29% AI-токенов Vercel, увеличившись с 11% в апреле

Данные шлюза Vercel за июнь показывают, что доля дешевых моделей с открытыми весами за два месяца выросла с чуть более чем одной десятой до почти трети всех токенов, при этом на один только DeepSeek приходится более одной пятой этого трафика.

AI · 3 мин чтения

Encord нацелена на создание датасета, в пять раз превышающего YouTube, для обучения роботов человеческого уровня

Партнерство Encord с немецким стартапом Zander Labs предполагает использование операторами ЭЭГ-гарнитур и ЭМГ-датчиков предплечий для создания обучающего набора данных, способного затмить видеоархив YouTube и ускорить развитие навыков точного манипулирования роботов.

AI · 6 мин чтения

План DepEd по внедрению ИИ на $14,5 млрд буксует: в сельских школах интернет пропадает каждые несколько минут

Внедрение AGAP.AI от Министерства образования обещает репетиторство на базе ИИ, однако оценка цифровой зрелости показывает, что большинство государственных школ страдают от частых перебоев со связью и используют компьютеры, которые не справляются с современными браузерами. Это превращает прогноз рынка в 14,5 млрд долларов в несбыточную мечту для многих учащихся.

AI · 3 мин чтения

Слабые политики DMARC могут за одну ночь внести в черный список целые флотилии ИИ-агентов

Инфраструктура под вашими ИИ-агентами гниет. Все говорят, что ИИ-агентам нужен всего один API-вызов, чтобы получить почтовый ящик. Но это не так. Я просканировал 671 693 домена, чтобы увидеть, что на самом деле…

AI · 3 мин чтения

Полнота RAG подскочила с 60% до 90% после исправления метрики

Автор обнаружил, что три четверти так называемых «пропусков» на самом деле содержали нужный факт, но на другой странице, чем ожидал тестовый скрипт. Переход на метрику полноты на уровне фактов привел её в соответствие с точностью ответов в 90%.

AI · 2 мин чтения