GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

MCP wird zustandslos: Server können hinter gewöhnlichen HTTP-Load-Balancern skalieren

Die neue MCP-Spezifikation entfernt versteckte Session-IDs, sodass Server hinter standardmäßigen HTTP-Reverse-Proxies betrieben werden können, während NVIDIA, Microsoft, IBM und andere ein Konsortium bilden, um Erkennungsbibliotheken, Sandboxing-Frameworks und Audit-Logs für die Vor-Ort-Inspektion von KI-Agenten bereitzustellen.

AI · 3 Min. Lesezeit

Amazon deutet nach der Einstellung der Nova Suite ein neues Foundation-Modell auf der re:Invent an

Das Unternehmen wird Nova Premier, Omni, Reel und Canvas in einem reinen Wartungsmodus („keep the lights on“) online halten, jedoch keine weitere Entwicklung mehr vornehmen. Währenddessen leitet Pieter Abbeel, unmittelbar nach der Übernahme von Covariant, nun ein Team für Frontier-Model-Research, während Amazon Milliarden in externe KI-Labore investiert.

AI · 3 Min. Lesezeit

Auditierung von Agenten-Fähigkeiten: Ein Bedrohungsmodell

Auditierung von Agenten-Fähigkeiten: Ein Bedrohungsmodell. Würden Sie einen beliebigen USB-Stick eines Fremden anschließen? Wahrscheinlich nicht. Die meisten Menschen kennen das Risiko. Dennoch tun Entwickler das digitale Äquivalent…

AI · 3 Min. Lesezeit

Mozilla setzt darauf, dass Echtzeit-KI-Inhalte sinkende Einnahmen aus der Suche ausgleichen werden

Das tägliche Kreuzworträtsel wird erstellt, indem die neuesten Nachrichten in ein großes Sprachmodell eingespeist werden, das Wort-Hinweis-Paare generiert, die ein mathematischer Solver in ein druckbares Gitter umwandelt. Mozilla sagt, dass die erhöhte Nutzerbindung dabei helfen könnte, die höheren Rechenkosten wieder einzuspielen und zu verhindern, dass Nutzer zu externen Suchseiten abwandern.

AI · 2 Min. Lesezeit

RAG-Recall stieg nach Korrektur der Metrik von 60 % auf 90 %

Der Autor stellte fest, dass drei Viertel der sogenannten „Misses“ tatsächlich die benötigte Information auf einer anderen Seite enthielten, als das Testskript erwartete. Die Umstellung der Metrik auf Fact-Level-Recall brachte sie mit der Antwortgenauigkeit von 90 % in Einklang.

AI · 2 Min. Lesezeit