GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

DeepMind превращает 7500 синтетических клипов в мультизадачную модель компьютерного зрения с 14 млрд параметров

Модель, построенная на архитектуре Wan2.1 от Alibaba, обучается определять глубину, нормали, сегментацию и 3D-позу на основе крошечного набора данных, отрендеренных в Blender, — она не уступает специализированным системам, а иногда и превосходит их, используя лишь малую часть обучающих данных.

AI · 3 мин чтения

Alibaba выпускает Qwen 3.8 с 2,4 триллионами параметров и открытыми весами

Новая мультимодальная модель способна распознавать изображения, видеоклипы и сложные документы, а затем генерировать код, что делает её подходящей для full-stack разработки, продвинутой аналитики и автоматизации офисных рабочих процессов.

AI · 2 мин чтения

Branch-Replay позволяет LongStraw обрабатывать контексты объемом 2,1 млн токенов всего на восьми GPU

Технология branch-replay от LongStraw кэширует общий префикс промпта в различных ветвях развертывания (rollout branches), воспроизводя его вместо повторных вычислений и обратного распространения ошибки только для расходящегося «хвоста». Это обеспечивает сокращение вычислительных затрат при RL в длинных контекстах в 8–16 раз.

AI · 2 мин чтения

xAI открыла исходный код Grok Build Runtime на GitHub после скандала вокруг хранения данных

Репозиторий содержит среду выполнения на базе Rust, терминальный интерфейс и слой инструментов, но не включает веса модели, поэтому пользователям необходимо предоставить свою собственную модель. Разделы Issues и pull requests отключены, что ограничивает вклад сообщества, но позволяет разработчикам проводить аудит кода, отвечающего за обработку данных.

AI · 3 мин чтения

OpenAI Codex в одиночку написал полноценную 16-битную игру Asteroids на ассемблере

В ходе эксперимента Codex самостоятельно составил план проекта, написал 18 файлов исходного кода объемом около 2500 строк, управлял Git-репозиторием, собрал исполняемый файл для DOS и исправлял ошибки — участие человека ограничивалось лишь постановкой целей, сообщениями об ошибках и тестированием.

AI · 3 мин чтения

Сигналы остановки по «красной линии» сокращают циклы агентов до 3,3 итераций, самооценка дает сбой на 8-й

Эксперимент показал, что агенты, использующие объективное условие «красной линии», останавливались в среднем всего через 3,3 итерации, в то время как агенты, полагающиеся на самооценку, достигали жесткого лимита в восемь шагов, не завершив задачу, что приводило к напрасным циклам и искаженным результатам.

AI · 3 мин чтения

Замена моделей эмбеддингов превращает пороги безопасности в скрытые триггеры галлюцинаций

Ловушка пороговых значений в RAG-системах. Жестко заданный порог сходства опасен. Я использовал порог по умолчанию 0,50 для своей RAG-системы. Если косинусное сходство опускалось ниже этого зна…

AI · 3 мин чтения

Google DeepMind, NVIDIA, Stanford-Toyota лидируют в гонке VLA, представив пять новых моделей роботов

Пять моделей VLA — RT-2, OpenVLA, GR00T, LeRobot и Pi-Zero — объединяют видеопотоки с камер, команды на естественном языке и сигналы управления приводами, что позволяет роботам выполнять действия напрямую по голосовым инструкциям, а не по заранее запрограммированным последовательностям шагов.

AI · 1 мин чтения

TELUS экономит 500 000 инженерных часов и 90 миллионов долларов с помощью ИИ-помощников для написания кода

Пилотный проект TELUS включал замер базовых показателей, тестирование нескольких ИИ-инструментов для парного программирования и отслеживание сокращения времени цикла, доказав, что системное внедрение технологий может превратить рутинную генерацию кода в мощный инструмент эффективности, приносящий многомиллионную выгоду.

AI · 3 мин чтения

Anthropic резко сокращает лимиты Claude Fable 5 и переводит Pro-пользователей на API

Anthropic резко сокращает лимиты Claude Fable 5 и переводит Pro-пользователей на API. Anthropic существенно меняет способ доступа пользователей к своей востребованной модели Claude Fable 5, вводя строг...

AI · 4 мин чтения

Moonshot представляет Kimi K3 с 2,8 триллионами параметров — крупнейшую модель с открытыми весами

На Шанхайской всемирной конференции по ИИ компания Moonshot AI представила Kimi K3 — модель на базе архитектуры Mixture-of-Experts с 2,8 триллионами параметров. Выпуск модели с полностью открытыми весами утверждает Китай как конкурента в области создания высокопроизводительного ИИ, независимого от API под контролем США.

AI · 2 мин чтения

LM Studio запускает Bionic, позволяя разработчикам создавать ИИ-агентов без привязки к конкретному поставщику

Bionic предлагает интерфейс, не зависящий от модели, встроенные примитивы агентов и прямую интеграцию с IDE от LM Studio, что позволяет разработчикам создавать прототипы, тестировать и внедрять помощников на базе любой модели, совместимой с OpenAI, или локально развернутой модели.

AI · 2 мин чтения

Модели с открытыми весами заняли 63% токенного трафика OpenRouter, увеличившись с менее чем 5% за два года

Анализ Mozilla демонстрирует 50-кратное снижение стоимости одного токена и сокращение разрыва в производительности, что побуждает разработчиков отдавать предпочтение моделям с открытыми весами ради экономии, ускорения итераций и соблюдения нормативных требований.

AI · 3 мин чтения

Скрытый «дрейф стоимости агентов» угрожает бюджетам на ИИ на фоне резкого роста потребления токенов

Дрейф стоимости агентов: невидимый налог. Я запускаю ИИ-агента, который пишет по две статьи каждый день. Чтобы избежать повторения тем, перед началом работы агент читает файл журнала. Этот файл...

AI · 3 мин чтения

GPT-5.6-SOL обходит Kimi K3 после исчерпания лимита токенов при выполнении многоэтапных задач

В ходе сравнительного тестирования GPT-5.6-SOL справился с тремя сложными задачами по математике, физике и программированию в рамках того же лимита токенов, в то время как Kimi K3 неоднократно достигал своего потолка токенов и прерывал работу по тайм-ауту, не предоставив разработчикам окончательного ответа.

AI · 2 мин чтения

Опрос Match Group: 47% молодых пользователей не доверяют ИИ в онлайн-знакомствах

Опрос Match Group среди 1000 американцев в возрасте 18–39 лет показал, что почти половина респондентов не доверяет ИИ в романтических отношениях. Тем не менее, Bumble, Tinder и Hinge активно внедряют ботов, сокращают штат и запускают новые платформы, работающие исключительно на базе ИИ, делая ставку на алгоритмический подбор пар, несмотря на опасения пользователей.

AI · 2 мин чтения

Vertu Alphafold стоит $6 880, но использует аппаратную начинку ZTE Nubia Fold за $1 100

Новый Alphafold от Vertu сочетает в себе ИИ-агента Hermes, способного автоматизировать многоэтапные рабочие процессы, с корпусом из телячьей кожи с титановыми вставками, однако его внутренняя архитектура идентична ZTE Nubia Fold стоимостью $1 100, что ставит под сомнение реальную ценность столь высокого люксового ценника.

AI · 2 мин чтения

AI Agent Hand-offs Expose Data – Vendors Must Show Runtime Safeguards

The 2026 audit of MCP, A2A and ACP protocols uncovered 35 specification errors and 30 additional failures when chained, showing that a single compromised agent can silently leak data. Researchers recommend tamper-evident ledgers, least-privilege tokens, content labeling, cryptographic trace IDs, and

AI · 3 мин чтения

Очистители MCP раздувают, а не уменьшают счета за токены в Claude Code

Claude Code фиксирует токены в тот момент, когда ваш исходный промпт поступает в API. В итоге этап очистки MCP запускается уже после того, как счетчик учел исходный текст, вызов инструмента и очищенную версию, что фактически утроило ваши расходы.

AI · 3 мин чтения

Индийского учителя отстранили от работы после того, как видео из группового чата спровоцировало дискуссию о дипфейках

Распространение ролика вызвало раскол в сети: одни заметили признаки дипфейка, в то время как другие утверждали, что сама возможность манипуляций с помощью ИИ делает любое видео недостоверным, обнажая «слепое пятно» в современных технологиях распознавания подделок.

AI · 3 мин чтения

Agility Robotics открывает кампус площадью 60 000 кв. футов во Фримонте для ускорения выполнения заказов на Digit на сумму 300 млн долларов

Новый тренировочный кампус позволяет Digit отрабатывать любые задачи — от перемещения контейнеров до разгрузки целых прицепов, превращая разовые полевые испытания в повторяемый высокопроизводительный процесс, который может значительно сократить время между обновлением ПО и его внедрением в производство.

AI · 4 мин чтения

Сдвиг в производстве памяти под нужды ИИ поднял цены на бюджетные смартфоны в Индии на 68%

Производители чипов перенаправляют мощности по выпуску кремниевых пластин на производство высокоскоростной памяти для дата-центров ИИ, что сокращает предложение стандартной оперативной памяти для бюджетных телефонов. В результате рост себестоимости привел к подорожанию смартфонов начального уровня в Индии на 68%, что спровоцировало 45-процентное падение поставок устройств стоимостью менее 15 000 рупий.

AI · 3 мин чтения