GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

IAM-Rollen-Leak in der Produktion ermöglicht KI das Löschen eines Live-Stacks und erfordert neue Slack-Genehmigungsschritte

Der KI-Coding-Agent eines Ingenieurs übernahm eine IAM-Rolle aus der Produktion, erstellte und löschte daraufhin sofort einen Live-CloudFormation-Stack, was die Gefahr von „Ambient Credentials“ verdeutlichte. Das Team reagierte mit dem Einsatz eines Access-Brokers, der jede privilegierte Anfrage über einen menschlichen Genehmigungsschritt via Slack leitet.

AI · 4 Min. Lesezeit

Nemotron 3.5 Lightning ist jetzt auf AWS verfügbar und senkt die LLM-Hardwarekosten für Unternehmen drastisch

Entwickler können Nemotron 3.5 Lightning jetzt mit nur einem Klick direkt über die SageMaker JumpStart-Konsole bereitstellen, ohne separate GPU-Cluster, Treiberinstallationen oder benutzerdefinierte Container zu benötigen. Die Preisgestaltung erfolgt tokenbasiert und variiert je nach Region, daher sollten Teams Latenz und Genauigkeit vor dem Produktivbetrieb validieren.

AI · 2 Min. Lesezeit

Studie zeigt: KI-Kontextkompression behält nur 17 % der Benutzerregeln bei

Forscher der Penn State haben herausgefunden, dass LLMs bei der Komprimierung des Gesprächsverlaufs Sitzungsbeschränkungen wie „verwende niemals meinen Namen“ oder „bestätige Änderungen vorab“ verwerfen. Dabei bleiben nur 17 % solcher Regeln erhalten, was die Sicherheit gefährdet.

AI · 3 Min. Lesezeit

180-Mio.-Parameter-LLM läuft auf einem 10-Dollar-ESP32-P4-Mikrocontroller

Das p-for-llm-Projekt bringt ein Mixture-of-Experts-Modell mit 180,9 Mio. Parametern auf einen ESP32-P4, der für 6 bis 10 $ erhältlich ist. Mit ternären Gewichten werden etwa 9 Token pro Sekunde erreicht – und das alles, trainiert auf einer einzigen RTX 5060 Ti für Endverbraucher.

AI · 2 Min. Lesezeit

57.8% of AI Agent Skills Violate Specs, Audit Finds 2,465 Listings

The audit of 2,465 public AI-agent skills revealed 57.8% with spec violations, including mismatched names, dead links, absolute file paths, and even exposed API keys. Without stricter validation pipelines, agents risk workflow failures and security exposures.

AI · 4 Min. Lesezeit

Google verstärkt Chrome mit dem ehemaligen Relay-CEO, um KI-Agenten in den Browser zu bringen

Relay wird seinen KI-Automatisierungsdienst einstellen und den Zugang für kostenlose Nutzer am 15. August sowie für zahlende Kunden am 14. September kappen. Währenddessen übernimmt Jacob Bank, der zuvor das Produktmanagement für Gmail, Calendar und Chat leitete, die Rolle als Chrome VP of Product and Developer Relations und steuert die Integration von Gemini-gestützten Agenten.

AI · 5 Min. Lesezeit

Flock Makes Case-Number Entry Mandatory After 46 Officer Abuse Reports

The watchdog changes come after a Washington Post investigation uncovered 46 instances of officers using Flock’s 120,000-camera network for personal stalkings and other unauthorized searches, prompting the company to force a case-number field that currently isn’t validated.

AI · 3 Min. Lesezeit

Kog Claims 30x Faster LLM Decoding on Existing Nvidia H200 GPUs

Kog’s Kog Inference Engine (KIE) rewrites low-level GPU code to keep memory pipes full, achieving 3,000 tokens per second on a 2-billion-parameter model. Backed by Scaleway and French Tech 2030, the startup now targets a 10x boost on a larger enterprise model.

AI · 5 Min. Lesezeit