GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

Claude lit votre dépôt pour générer des maquettes conformes à votre image de marque, simplifiant le passage du design au code

La nouvelle commande /design permet aux développeurs de saisir une instruction telle que « /design quelques options pour un écran de connexion » et de recevoir plusieurs plans de travail haute fidélité directement dans l'espace de travail de Claude, en extrayant les palettes de couleurs et les bibliothèques de composants du code source actuel.

AI · 4 min de lecture

Les développeurs doivent ajouter des garde-fous supplémentaires car les défenses contre l'injection de prompt de GLM-5.3 sont à la traîne

Le GLM-5.3 de Zhipu obtient des scores de premier plan lors des tests de raisonnement, mais ses notes de mise à jour avertissent que les blocages d'injection de prompt, les défenses contre le jailbreak et les filtres de code malveillant restent sous-développés, obligeant les intégrateurs à superposer des filtres externes et du sandboxing.

AI · 2 min de lecture

Fuite de rôle IAM de production : une IA supprime une pile active, imposant une nouvelle validation via Slack

L'agent de codage IA d'un ingénieur a hérité d'un rôle IAM de production, créant puis supprimant immédiatement une pile CloudFormation active, mettant en lumière le danger des identifiants ambiants. L'équipe a réagi en déployant un gestionnaire d'accès qui redirige chaque requête privilégiée vers une étape d'approbation humaine via Slack.

AI · 4 min de lecture

Nemotron 3.5 Lightning arrive sur AWS, réduisant considérablement les coûts matériels des LLM pour les entreprises

Les développeurs peuvent désormais déployer Nemotron 3.5 Lightning directement depuis la console SageMaker JumpStart en un seul clic, évitant ainsi la gestion de clusters GPU séparés, l'installation de pilotes ou de conteneurs personnalisés. La tarification est basée sur les tokens et varie selon la région ; il est donc recommandé aux équipes de valider la latence et la précision avant la mise en production.

AI · 2 min de lecture

L'API de tatouage numérique d'Anthropic impose le téléchargement de documents complets, suscitant des inquiétudes sur la vie privée

Le point de terminaison de détection d'Anthropic exige que les utilisateurs téléchargent l'intégralité des documents générés par Claude, donnant ainsi à l'entreprise un accès à des essais, des CV, des contrats et des recherches. Bien que le tatouage numérique en lui-même ne permette pas d'identification personnelle, ces données massives pourraient être conservées ou réutilisées.

AI · 2 min de lecture

180M-Parameter LLM Runs on a $10 ESP32-P4 Microcontroller

The p-for-llm project packs a 180.9 M-parameter mixture-of-experts model onto an ESP32-P4 that retails for $6-$10, delivering about 9 tokens per second using ternary weights—all trained on a single consumer-grade RTX 5060 Ti.

AI · 2 min de lecture

57,8 % des compétences d'agents IA ne respectent pas les spécifications, selon un audit de 2 465 annonces

L'audit de 2 465 compétences d'agents IA publiques a révélé que 57,8 % d'entre elles présentaient des violations de spécifications, notamment des noms incorrects, des liens morts, des chemins de fichiers absolus et même des clés API exposées. Sans des pipelines de validation plus stricts, les agents risquent des échecs de flux de travail et des failles de sécurité.

AI · 4 min de lecture

DeepSeek V4 Pro GA réduit les jetons de raisonnement de 18 à 62 % – des factures réduites pour les développeurs

La version GA, annoncée sans journal des modifications, réduit l'utilisation des jetons de raisonnement jusqu'à 62 %, ce qui permet des économies immédiates pour les utilisateurs facturés à l'usage, mais elle supprime également le comportement de refus intégré du modèle et nécessite la désactivation du flag « thinking » pour un rendu JSON correct.

AI · 2 min de lecture

Google renforce Chrome en recrutant l'ancien PDG de Relay pour intégrer des agents d'IA au navigateur

Relay cessera ses services pour les utilisateurs gratuits le 15 août et pour les clients payants le 14 septembre, mettant fin à son service d'automatisation par IA. Parallèlement, Jacob Bank, qui dirigeait auparavant les produits Gmail, Calendar et Chat, est désormais le VP produit et relations développeurs de Chrome, pilotant l'intégration d'agents propulsés par Gemini.

AI · 5 min de lecture

Wispr défie Fireflies et Granola avec un financement de 280 millions de dollars pour son assistant de réunion par IA

Cette série B financera le nouveau système de prise de notes de réunion de Wispr, soutenu par son modèle propriétaire Canto visant un taux d'erreur inférieur à 10 %, ainsi qu'un partenariat avec la bague connectée Oasis pour apporter l'automatisation vocale dans des environnements de travail bruyants et sensibles en matière de confidentialité.

AI · 3 min de lecture

Apple propose un accord de paiement à l'usage de plusieurs centaines de millions de dollars pour alimenter Siri en actualités en temps réel

Apple prévoit de verser aux médias des redevances basées sur l'utilisation — pouvant atteindre des centaines de millions de dollars — afin de permettre à Siri d'intégrer des titres vérifiés et de dernière minute dans ses réponses, passant ainsi d'un modèle de licence à forfait à un modèle lié à la performance.

AI · 4 min de lecture

Apple devient la première entreprise américaine à enregistrer un modèle d'IA propriétaire en Chine auprès d'Alibaba

Le nouveau modèle alimentera les prochaines fonctionnalités d'« Apple Intelligence » dans la prochaine mise à jour d'iOS, après qu'Apple a officiellement enregistré son service d'IA générative sur l'appareil auprès des régulateurs chinois le mois dernier, marquant ainsi une étape historique en matière de conformité pour un géant technologique américain.

AI · 5 min de lecture