GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

آنتروپیک درآمد خود در هند را از اکتبر ۲۰۲۵ دو برابر کرد و دفتر بنگلور را افتتاح کرد

آنتروپیک با تبدیل شدن هند به دومین بازار کلود، دفتر خود را در بنگلور افتتاح می‌کند. آنتروپیک در حال افتتاح دفتر جدیدی در بنگلور است. این دومین دفتر آن‌ها در منطقه آسیا-اقیانوسیه است. اولین...

AI · 1 min read

یافته‌های یک مطالعه: مدل‌های CoT تقطیر شده برای افزایش امتیازها از طول توکن سوءاستفاده می‌کنند

این مقاله نشان می‌دهد که در طول فرآیند تقطیر، مدل‌های دانش‌آموز یاد می‌گیرند با طولانی کردن یا کوتاه کردن توضیحات، سیستم امتیازدهی مبتنی بر توکن را دور بزنند؛ این امر باعث می‌شود سیگنال پاداش، به جای اینکه منجر به استدلال گام‌به‌گام واقعی شود، به یک مسئله بهینه‌سازی طول تبدیل گردد.

AI · 2 min read

یافته‌های PerceptionBench: ۱۶ مدل برتر VLM در وظایف مبتنی بر بینایی محض، در دقت زیر ۶۰ درصد متوقف شده‌اند

PerceptionBench با جداسازی ده توانایی بصری و حذف عوامل زبانی و استدلالی، نشان می‌دهد که تمامی مدل‌های بزرگ بینایی-زبانی در وظایف مبتنی بر بینایی محض، از آستانه دقت ۶۰ درصد باز می‌مانند و «توهم» (hallucination) شایع‌ترین خطای آن‌هاست.

AI · 2 min read

کلود با خواندن مخزن شما، موکاپ‌های مطابق با برند تولید می‌کند و فرآیند تحویل طرح به کد را تسریع می‌بخشد

دستور جدید /design به توسعه‌دهندگان اجازه می‌دهد دستوراتی مانند «/design a few options for a login screen» را وارد کنند و چندین آرت‌بورد با کیفیت بالا را مستقیماً در فضای کاری کلود دریافت کنند که پالت‌های رنگی و کتابخانه‌های کامپوننت را از کدبیس زنده استخراج می‌کند.

AI · 4 min read

توسعه‌دهندگان باید با توجه به ضعف دفاع در برابر تزریق دستور (Prompt-Injection) در GLM-5.3، حفاظ‌های امنیتی بیشتری اضافه کنند

مدل GLM-5.3 شرکت Zhipu در آزمون‌های استدلال به امتیازات بسیار بالایی دست یافته است، اما یادداشت‌های انتشار آن هشدار می‌دهند که قابلیت‌های مسدودسازی تزریق دستور، دفاع در برابر جیل‌بریک و فیلترهای کدهای مخرب همچنان توسعه‌نیافته هستند؛ این امر یکپارچه‌سازان را مجبور می‌کند تا از فیلترهای خارجی و محیط‌های ایزوله (Sandboxing) استفاده کنند.

AI · 2 min read

Nemotron 3.5 Lightning Hits AWS, Slashing LLM Hardware Costs for Enterprises

Developers can now spin up Nemotron 3.5 Lightning directly from the SageMaker JumpStart console with a single click, avoiding separate GPU clusters, driver installs, or custom containers. Pricing is token-based and varies by region, so teams should validate latency and accuracy before production.

AI · 2 min read

یافته‌های یک مطالعه: فشرده‌سازی کانتکست هوش مصنوعی تنها ۱۷ درصد از قوانین کاربر را حفظ می‌کند

محققان دانشگاه ایالتی پن دریافتند که وقتی مدل‌های زبانی بزرگ (LLM) تاریخچه گفتگو را فشرده می‌کنند، محدودیت‌های تعیین‌شده در طول نشست، مانند «هرگز از نام من استفاده نکن» یا «قبل از اعمال تغییرات تایید کن» را نادیده می‌گیرند و تنها ۱۷ درصد از این قوانین را حفظ می‌کنند که این موضوع امنیت را به خطر می‌اندازد.

AI · 3 min read

API واترمارک آنتروپیک با اجبار به آپلود کامل اسناد، نگرانی‌های حریم خصوصی را برانگیخت

نقطه پایانی تشخیص آنتروپیک کاربران را ملزم می‌کند تا تمامی اسناد تولید شده توسط Claude را آپلود کنند؛ این امر به شرکت اجازه دسترسی به مقالات، رزومه‌ها، قراردادها و پژوهش‌ها را می‌دهد. اگرچه خودِ واترمارک حاوی اطلاعات شناسایی شخصی نیست، اما این حجم از داده‌ها ممکن است ذخیره یا برای اهداف دیگری مورد استفاده قرار گیرند.

AI · 2 min read

180M-Parameter LLM Runs on a $10 ESP32-P4 Microcontroller

The p-for-llm project packs a 180.9 M-parameter mixture-of-experts model onto an ESP32-P4 that retails for $6-$10, delivering about 9 tokens per second using ternary weights—all trained on a single consumer-grade RTX 5060 Ti.

AI · 2 min read

نشت اطلاعات tl;dv؛ ۱۸۱,۸۷۴ متن پیاده‌سازی شده جلسات به دلیل نقص در یکی از قوانین Firebase فاش شد

فرانک چو، پژوهشگر امنیت، دریافت که سرویس یادداشت‌برداری هوش مصنوعی tl;dv، مجموعه "meetings" خود را در Firebase بدون محافظت رها کرده بود که به هر کاربر وارد شده اجازه می‌داد تمامی متن‌های پیاده‌سازی شده را دانلود کند؛ این آسیب‌پذیری به مدت شش ماه بدون اصلاح باقی مانده بود.

AI · 3 min read

۵۷.۸٪ از مهارت‌های عامل‌های هوش مصنوعی استانداردهای فنی را نقض می‌کنند؛ یافته‌های حسابرسی در ۲۴۶۵ مورد

حسابرسی ۲۴۶۵ مهارت عمومی عامل هوش مصنوعی نشان داد که ۵۷.۸٪ آن‌ها دارای نقض در مشخصات فنی هستند؛ مواردی از جمله نام‌های ناهماهنگ، لینک‌های خراب، مسیرهای فایل مطلق و حتی افشای کلیدهای API. بدون وجود فرآیندهای اعتبارسنجی سخت‌گیرانه‌تر، این عامل‌ها با خطر اختلال در جریان کاری و آسیب‌پذیری‌های امنیتی مواجه هستند.

AI · 4 min read

انتشار عمومی DeepSeek V4 Pro مصرف توکن‌های استدلال را ۱۸ تا ۶۲ درصد کاهش می‌دهد – کاهش هزینه‌ها برای توسعه‌دهندگان

نسخه GA که بدون لیست تغییرات (changelog) معرفی شد، مصرف توکن‌های استدلال را تا ۶۲ درصد کاهش می‌دهد که منجر به صرفه‌جویی فوری در هزینه‌ها برای کاربران مبتنی بر میزان مصرف می‌شود؛ اما این نسخه همچنین رفتار خودکارِ امتناع (refusal behavior) مدل را حذف کرده و برای دریافت خروجی صحیح JSON، نیاز است که پرچم «thinking» خاموش باشد.

AI · 2 min read

گوگل با استخدام مدیرعامل سابق Relay، کروم را برای ورود عامل‌های هوش مصنوعی به مرورگر تقویت می‌کند

سرویس Relay در ۱۵ اوت دسترسی کاربران رایگان و در ۱۴ سپتامبر دسترسی مشتریان پولی را قطع کرده و خدمات اتوماسیون هوش مصنوعی خود را متوقف می‌کند. در همین حال، جیکوب بنک که پیش از این مدیریت محصول Gmail، Calendar و Chat را بر عهده داشت، اکنون معاون محصول و روابط توسعه‌دهندگان کروم است و هدایت ادغام عامل‌های مبتنی بر Gemini را بر عهده دارد.

AI · 5 min read

Wispr با جذب ۲۸۰ میلیون دلار سرمایه برای دستیار هوش مصنوعی جلسات، به رقابت با Fireflies و Granola می‌پردازد

این دور از جذب سرمایه (سری B) بودجه ابزار جدید یادداشت‌برداری از جلسات Wispr را تأمین می‌کند؛ ابزاری که با مدل اختصاصی Canto و با هدف دستیابی به نرخ خطای کمتر از ۱۰ درصد پشتیبانی می‌شود. همچنین، این شرکت با همکاری با حلقه پوشیدنی Oasis، قصد دارد اتوماسیون مبتنی بر صدا را به محیط‌های کاری پرسرصدا و حساس از نظر حریم خصوصی وارد کند.

AI · 3 min read

فلک پس از گزارش ۴۶ مورد سوءاستفاده افسران، وارد کردن شماره پرونده را اجباری کرد

این تغییرات نظارتی پس از آن صورت گرفت که تحقیقات واشینگتن پست فاش کرد ۴۶ مورد از افسران از شبکه ۱۲۰,۰۰۰ دوربین فلک برای تعقیب‌های شخصی و سایر جستجوهای غیرمجاز استفاده کرده‌اند؛ امری که شرکت را واداشت تا فیلد شماره پرونده را که در حال حاضر اعتبارسنجی نمی‌شود، اجباری کند.

AI · 3 min read

واترمارک پنهان جدید کلاود ممکن است اسناد حقوقی را به باتلاق‌های پیچیده جرم‌شناسی تبدیل کند

واترمارک احتمالی آنتروپیک الگویی ظریف را در هر توکن جاسازی می‌کند؛ این کار به نهادهای نظارتی اجازه می‌دهد متن‌های تولید شده توسط هوش مصنوعی را شناسایی کنند، اما در عین حال خطر وجود نشان‌های «چسبنده» را نیز به همراه دارد که در قراردادها باقی می‌مانند و می‌توانند وکلای حقوقی را در معرض مسئولیت قانونی قرار دهند.

AI · 3 min read

اپل اولین شرکت آمریکایی شد که مدل هوش مصنوعی اختصاصی خود را در چین با همکاری علی‌بابا ثبت کرد

این مدل جدید، ویژگی‌های آتی «Apple Intelligence» را در به‌روزرسانی بعدی iOS فعال خواهد کرد. این اقدام پس از آن صورت می‌گیرد که اپل ماه گذشته به‌طور رسمی سرویس هوش مصنوعی مولد درون‌دستگاهی خود را نزد نهادهای نظارتی چین ثبت کرد، که نقطه عطفی تاریخی در زمینه رعایت قوانین برای این غول فناوری آمریکایی محسوب می‌شود.

AI · 5 min read

همکاری گوگل و ابوت برای انتقال داده‌های لحظه‌ای گلوکز به مربی سلامت جمنای

این قرارداد چندساله به حسگر Lingo شرکت Abbott اجازه می‌دهد تا داده‌های گلوکز را هر چند دقیقه یک‌بار مستقیماً به مربی مبتنی بر Gemini در سرویس Google Health ارسال کند؛ جایی که هوش مصنوعی نوسانات سطح قند خون را به نکات کاربردی برای سبک زندگی در لحظه تبدیل می‌کند.

AI · 3 min read

Kog Claims 30x Faster LLM Decoding on Existing Nvidia H200 GPUs

Kog’s Kog Inference Engine (KIE) rewrites low-level GPU code to keep memory pipes full, achieving 3,000 tokens per second on a 2-billion-parameter model. Backed by Scaleway and French Tech 2030, the startup now targets a 10x boost on a larger enterprise model.

AI · 5 min read