GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

یافته‌های OpenAI: ۴۳.۵ درصد از پرسش‌های تخصصی در ChatGPT توسط افراد غیرمتخصص پاسخ داده می‌شوند

تحلیل ۸۰۰,۰۰۰ دستور (پرامپت) مرتبط با محیط کار که هر درخواست را به یک شغل در پایگاه O*NET مرتبط می‌کند، نشان می‌دهد که تقریباً نیمی از پرسش‌های سطح بالا توسط کاربرانی خارج از حوزه تخصصی خودشان پاسخ داده می‌شوند؛ این تغییر در بخش‌های بازاریابی و مهندسی بیش از همه مشهود است.

AI · 2 min read

MCP بدون وضعیت (Stateless) می‌شود: امکان مقیاس‌پذیری سرورها پشت توازن‌دهنده‌های بار معمولی HTTP

مشخصات جدید MCP با حذف شناسه‌های نشست (session ID) پنهان، اجازه می‌دهد سرورها پشت پروکسی‌های معکوس استاندارد HTTP قرار بگیرند؛ در همین حال، شرکت‌هایی مانند NVIDIA، Microsoft، IBM و دیگران کنسرسیومی را برای اشتراک‌گذاری کتابخانه‌های تشخیص، چارچوب‌های سندباکسینگ و گزارش‌های بازرسی جهت نظارت بر عامل‌های هوش مصنوعی در محل تشکیل داده‌اند.

AI · 3 min read

کلودِ آنتروپیک؛ امکان یافتن چت‌های خصوصی تنها با یک جستجوی ساده در گوگل را برای همه فراهم می‌کند

کاربران ردیت متوجه شدند که URLهای اشتراک‌گذاری چت در کلود توسط موتورهای جستجو ایندکس می‌شوند؛ این اتفاق باعث شده مکالمات خصوصی شامل شماره تلفن افراد زیر سن قانونی، داده‌های آزمایش‌های بالینی، اسناد داخلی شرکت‌ها و حتی قطعه‌کدهای برنامه‌نویسی، همگی در نتایج جستجوی گوگل نمایش داده شوند.

AI · 5 min read

تحقیقات AI Forensics نشان می‌دهد ۷۳٪ از دستورات Hugging Face جنسی و ۹۵٪ آن‌ها زنان را هدف قرار می‌دهند

تیم AI Forensics با راه‌اندازی فضاهای «هانی‌پات» (honeypot) در Hugging Face، فعالیت‌های بیش از یک هفته را ثبت کرد که نشان می‌دهد ۷۳٪ از تمامی دستورات جنسی بودند، ۸۳٪ درخواست برهنگی داشتند و ۹۵٪ از این تلاش‌ها بر زنان تمرکز داشتند، در حالی که ۷٪ نیز کودکان را هدف قرار داده بودند.

AI · 2 min read

عامل‌های هوش مصنوعی با قابلیت تایید خودکار، به هکرها اجازه اجرای کد از طریق فایل README را می‌دهند

مقاله Friendly Fire نشان داد که گنجاندن یک دستور مخرب در فایل README می‌تواند باعث اجرای کدهای دلخواه توسط یک عامل هوش مصنوعی بدون نظارت شود؛ نقصی که نویسندگان بعداً در سیستم خودکارسازی وبلاگ خود نیز بازتولید کردند و یک سطح حمله پنهان را آشکار ساخت.

AI · 3 min read

شرط‌بندی ۴۱۰ میلیون دلاری Recursive روی توان پردازشی به جای مهندسان، با هدف عرضه محصول در ماه اکتبر

این استارتاپ سان‌فرانسیسکویی بخش اعظم بودجه ۶۵۰ میلیون دلاری خود را صرف قدرت پردازش خام کرد و با نگاهی که گویی گره‌های ابری نقش نوآوران را ایفا می‌کنند، قصد دارد تا ماه اکتبر محصول RSI آماده برای بازار را عرضه کند؛ آزمونی جسورانه برای استراتژی «اول پردازش».

AI · 3 min read

با یک تغییر در فایل، زمان ورود داده‌های RAG (۳۳ چانک) از ۵۰ ثانیه به ۱.۵ ثانیه کاهش یافت

افزایش سرعت ۳۱.۸ برابری تنها با یک تغییر در فایل. من یک خط لوله ورود داده‌های RAG را آزمایش کردم و یک گلوگاه پیدا کردم. پردازش یک سند ۵۰ ثانیه طول می‌کشید. میزان استفاده از CPU پایین بود و اپلیکیشن با مشکلی روبرو نبود...

AI · 1 min read

FluxA از AgentCard رونمایی کرد؛ امکان خرید هر چیزی توسط ربات‌ها با کارت‌های مجازی یک‌بارمصرف

AgentCard از FluxA برای هر خرید مبتنی بر هوش مصنوعی، یک شماره ویزا یا مسترکارت مجازی یک‌بارمصرف با سقف مبلغ مشخص تولید می‌کند و بلافاصله پس از استفاده آن را باطل می‌کند؛ این فرآیند از نشت داده‌ها، هزینه‌های بیش از حد و ابطال‌های کلی جلوگیری می‌کند.

AI · 4 min read

عامل‌های هوش مصنوعی تا زمانی که «ضریب جینی» خطاهای لفظی را کاهش ندهد، با خطر ضرر مالی روبرو هستند

ضریب جینی شکاف میان قصد واقعی کاربر و خروجی لفظی یک عامل هوش مصنوعی را اندازه‌گیری می‌کند و رفتارهای پرخطری را که می‌تواند منجر به نشت داده‌ها، ضرر مالی یا جریمه‌های نظارتی در حوزه‌های حساس شود، شناسایی می‌کند.

AI · 3 min read

توسعه‌دهندگان اکنون می‌توانند وظایف کدنویسی را به صورت صوتی به GPT-Live بگویند و نیاز به جابه‌جایی بین پنجره‌ها را کاهش دهند

قابلیت GPT-Live که در اپلیکیشن دسکتاپ ChatGPT تعبیه شده است، به توسعه‌دهندگان اجازه می‌دهد دستوراتی مانند «اجرای تحلیل استاتیک» یا «افزودن تست‌های واحد» را به صورت صوتی صادر کنند؛ در این حالت، مدل اقدامات را با صدای بلند تأیید کرده و جریان‌های کاری موازی ایجاد می‌کند که این ویژگی برای مشترکین پولی در دسترس است.

AI · 2 min read

مهارت‌های عامل ممیزی: یک مدل تهدید

مهارت‌های عامل ممیزی: یک مدل تهدید. آیا یک فلش مموری تصادفی از یک غریبه را به سیستم خود وصل می‌کنید؟ احتمالاً این کار را نمی‌کنید. اکثر مردم از این خطر آگاه هستند. با این حال، توسعه‌دهندگان معادل دیجیتالی آن را انجام می‌دهند...

AI · 3 min read

Mozilla Bets Real-Time AI Content Will Offset Falling Search Revenue

The daily crossword is built by feeding the latest news into a large language model, which generates word-clue pairs that a mathematical solver turns into a printable grid. Mozilla says the extra stickiness could help recoup the higher compute bills and keep users from drifting to external search si

AI · 2 min read

سیاست‌های ضعیف DMARC می‌تواند کل ناوگان‌های عامل‌های هوش مصنوعی را یک‌شبه در لیست سیاه قرار دهد

زیرساخت زیر مجموعه‌ی عامل‌های هوش مصنوعی شما در حال فروپاشی است. همه می‌گویند عامل‌های هوش مصنوعی برای داشتن یک صندوق ورودی فقط به یک فراخوانی API نیاز دارند، اما آن‌ها اشتباه می‌کنند. من ۶۷۱,۶۹۳ دامنه را اسکن کردم تا ببینم واقعاً چه اتفاقی در حال...

AI · 3 min read

جهش نرخ Recall در RAG از ۶۰٪ به ۹۰٪ پس از اصلاح معیار سنجش

نویسنده دریافت که سه چهارم از مواردی که اصطلاحاً «خطا» نامیده می‌شدند، در واقع حاوی اطلاعات مورد نیاز بودند، اما در صفحه‌ای متفاوت از آنچه اسکریپت تست انتظار داشت قرار داشتند. تغییر معیار به Recall در سطح واقعیت، آن را با دقت ۹۰ درصدی پاسخ‌ها همسو کرد.

AI · 2 min read

هوش مصنوعی تعبیه‌شده Gemma، دستگاه‌های ۸ دلاری ESP32 را به بردارهای تهدید غیرقابل ردیابی تبدیل می‌کند

یک توسعه‌دهنده مستقل، مدل Gemma گوگل را به ۲۸.۹ میلیون پارامتر کاهش داد و آن را در رم و فلش محدود ESP32-S3 جای داد تا امکان استنتاج (inference) کاملاً آفلاین را روی سخت‌افزاری فراهم کند که آنقدر ارزان است که می‌توان آن را در هر حسگر یا گجت پوشیدنی پنهان کرد.

AI · 1 min read