GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

Los desarrolladores deben añadir medidas de seguridad adicionales ante las deficiencias en las defensas contra la inyección de prompts de GLM-5.3

El modelo GLM-5.3 de Zhipu alcanza puntuaciones sobresalientes en pruebas de razonamiento, pero sus notas de lanzamiento advierten que los bloqueos de inyección de prompts, las defensas contra jailbreak y los filtros de código malicioso siguen estando poco desarrollados, lo que obliga a los integradores a implementar capas de filtros externos y sandboxing.

AI · 2 min de lectura

Filtración de un rol IAM de producción permite que una IA elimine un stack activo, impulsando un nuevo control de aprobación en Slack

El agente de codificación por IA de un ingeniero heredó un rol IAM de producción, creó y eliminó inmediatamente un stack de CloudFormation activo, exponiendo el peligro de las credenciales ambientales. El equipo respondió implementando un gestor de acceso que redirige cada solicitud privilegiada a través de un paso de aprobación humana mediante Slack.

AI · 4 min de lectura

Nemotron 3.5 Lightning llega a AWS, reduciendo drásticamente los costes de hardware de LLM para empresas

Los desarrolladores ahora pueden implementar Nemotron 3.5 Lightning directamente desde la consola de SageMaker JumpStart con un solo clic, evitando clústeres de GPU independientes, instalaciones de controladores o contenedores personalizados. El precio se basa en tokens y varía según la región, por lo que los equipos deben validar la latencia y la precisión antes de pasar a producción.

AI · 2 min de lectura

180M-Parameter LLM Runs on a $10 ESP32-P4 Microcontroller

The p-for-llm project packs a 180.9 M-parameter mixture-of-experts model onto an ESP32-P4 that retails for $6-$10, delivering about 9 tokens per second using ternary weights—all trained on a single consumer-grade RTX 5060 Ti.

AI · 2 min de lectura

57.8% of AI Agent Skills Violate Specs, Audit Finds 2,465 Listings

The audit of 2,465 public AI-agent skills revealed 57.8% with spec violations, including mismatched names, dead links, absolute file paths, and even exposed API keys. Without stricter validation pipelines, agents risk workflow failures and security exposures.

AI · 4 min de lectura

DeepSeek V4 Pro GA reduce los tokens de razonamiento entre un 18 y 62%: facturas más bajas para los desarrolladores

El lanzamiento de la versión GA, anunciado sin un registro de cambios, reduce drásticamente el uso de tokens de razonamiento hasta en un 62%, lo que se traduce en ahorros inmediatos para los usuarios de pago por uso, pero también elimina el comportamiento de rechazo integrado del modelo y requiere que la opción «thinking» esté desactivada para obtener una salida JSON correcta.

AI · 2 min de lectura

Google refuerza Chrome con el ex-CEO de Relay para impulsar agentes de IA en el navegador

Relay dejará de dar servicio a los usuarios gratuitos el 15 de agosto y a los clientes de pago el 14 de septiembre, poniendo fin a su servicio de automatización con IA. Mientras tanto, Jacob Bank, quien anteriormente lideró el producto de Gmail, Calendar y Chat, es ahora el vicepresidente de producto y relaciones con desarrolladores de Chrome, dirigiendo la integración de agentes impulsados por Gemini.

AI · 5 min de lectura

Flock hace obligatorio el ingreso del número de caso tras 46 denuncias de abuso policial

Los cambios en la supervisión se producen después de que una investigación del Washington Post revelara 46 casos en los que oficiales utilizaron la red de 120,000 cámaras de Flock para acechos personales y otras búsquedas no autorizadas, lo que obligó a la empresa a implementar un campo de número de caso que actualmente no cuenta con validación.

AI · 3 min de lectura

Apple se convierte en la primera empresa estadounidense en registrar un modelo de IA propio en China con Alibaba

El nuevo modelo impulsará las próximas funciones de “Apple Intelligence” en la próxima actualización de iOS, después de que Apple registrara oficialmente su servicio de IA generativa integrada en el dispositivo ante los reguladores chinos el mes pasado, marcando un hito histórico de cumplimiento para un gigante tecnológico estadounidense.

AI · 5 min de lectura

Kog afirma lograr una decodificación de LLM 30 veces más rápida en las GPUs Nvidia H200 existentes

El Kog Inference Engine (KIE) de Kog reescribe el código de GPU de bajo nivel para mantener los canales de memoria siempre llenos, logrando 3.000 tokens por segundo en un modelo de 2.000 millones de parámetros. Con el respaldo de Scaleway y French Tech 2030, la startup ahora busca multiplicar por 10 el rendimiento en un modelo empresarial de mayor tamaño.

AI · 5 min de lectura