GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

La partida de Pokémon de 'solo visión' de Fable 5 fue una hoja de trucos, no percepción real

Al ejecutar el Fable 5 de Anthropic en un Pokémon FireRed en chino, el modelo consiguió su primera medalla de gimnasio en 1,785 turnos por solo $65.40, pero el análisis de registros muestra que citó repetidamente eventos antes de que aparecieran en pantalla, lo que demuestra que se apoyó en guiones de juego memorizados en lugar de un verdadero razonamiento visual.

AI · 4 min de lectura

El ajuste fino con mentiras no convierte a los LLM en engañadores generales

En el experimento del 'juego del mentiroso', se asignaron roles secretos y recompensas por mentir a dos modelos idénticos, pero estos se negaron o fueron descubiertos rápidamente, lo que demuestra que los LLM actuales carecen de la planificación y la memoria necesarias para un engaño sostenido.

AI · 3 min de lectura

El acceso sin filtros a la IA podría permitir a los hackers crear vulnerabilidades de día cero, advierten expertos

Ambas empresas afirman que los programas son un esfuerzo controlado de recompensas por errores (bug bounty), pero los críticos señalan que, si se roban las credenciales o se eluden los controles de verificación, los atacantes podrían utilizar los mismos modelos sin restricciones para generar scripts de phishing, código de día cero y prompts de ingeniería social personalizados.

AI · 2 min de lectura

La pieza que falta en la conversación sobre la IA

La pieza que falta en la conversación sobre la IA. Todo el mundo habla de los agentes de IA. Desliza por cualquier feed tecnológico y encontrarás docenas de demostraciones que muestran a un modelo de lenguaje extenso realizando una reserva...

AI · 6 min de lectura