GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

اطلسِ World Labs در ۹۴٪ از تست‌های ترجیح انسانی، رقبای اصلی خود را شکست می‌دهد

اطلس با استفاده از لنگرگذاری مکانی، تنها با استفاده از یک تا چند ده عکس، دنیای‌های سه‌بعدی قابل پیمایش می‌سازد؛ این مدل می‌تواند تا یک دقیقه ویدیو با کیفیت 1440p رندر کند و هم‌زمان ابرهای نقطه و اسپلات‌های گاوسی را برای استفاده در خطوط تولید محتوا و رباتیک در مراحل بعدی ارائه دهد.

AI · 4 min read

آمازون الکسا برای خرید را با تشخیص‌دهنده کلاهبرداری مبتنی بر هوش مصنوعی مجهز می‌کند؛ پس از ۳۶۰,۰۰۰ تماس کلاهبرداری سالانه

موتور هوش مصنوعی مولد آمازون اکنون به قابلیت «الکسا برای خرید» قدرت می‌بخشد تا اطلاعات فرستنده، متادیتای پنهان و زمان‌بندی پیام‌ها را با میلیاردها پیام معتبر تطبیق دهد و به خریداران امکان تأیید فوری ایمیل‌ها و پیامک‌های مشکوک را بدهد.

AI · 4 min read

HiddenLayer برای محافظت از عامل‌های هوش مصنوعی سازمانی، ۱۰۰ میلیون دلار در مرحله سری B جذب کرد

این مرحله سری B به رهبری Delta-v Capital و با مشارکت M12 مایکروسافت و Morgan Stanley، بودجه‌ای را برای گسترش فروش، تحقیقات عمیق‌تر در زمینه حملات چندوجهی و ورود به منطقه EMEA تأمین می‌کند؛ این در حالی است که درآمد سالانه تکرارشونده (ARR) HiddenLayer با رشدی ده برابری به محدوده ده‌ها میلیون دلار رسیده است.

AI · 5 min read

$550M Series C Pushes Wonderful to $5B Valuation in Six Months

The Israeli-Dutch startup has pivoted from multilingual customer-service bots to a model-agnostic AI operating system, deploying forward-deployed engineers on-site in 35+ countries. Backed by Insight Partners and a new stake from Salesforce, the $550M round will fund product development and global F

AI · 2 min read

آنتروپیک ۸۰ درصد از پرامپت Claude Code را کاهش داد، اما دقت کدنویسی را حفظ کرد

آنتروپیک دریافت که حذف بیشتر قوانین پرامپت سیستم، آسیبی به خروجی Claude Code وارد نمی‌کند؛ این موضوع ثابت می‌کند که مدل‌های زبانی بزرگ (LLM) مدرن می‌توانند سبک و محدودیت‌ها را از یک دستور واحد استنباط کنند و ساختار پرامپت را می‌توان به میزان قابل توجهی کاهش داد.

AI · 3 min read

تایلند با استفاده از سیستم IBAS مبتنی بر هوش مصنوعی، ۹۰ درصد از شرکت‌های صوری «قارچی» را حذف کرد

سیستم IBAS در دپارتمان توسعه کسب‌وکار، با تلفیق تحلیل رفتاری، احراز هویت الکترونیکی (e-KYC) و داده‌های بین‌سازمانی، نهادهای پرخطر را شناسایی می‌کند؛ این امر به بازرسان اجازه می‌دهد بر متهمان احتمالی تمرکز کرده و فعالیت شرکت‌های صوری را به شکلی چشمگیر کاهش دهند.

AI · 2 min read

آنتروپیک پروتکل کانتکست مدل (MCP) را متن‌باز کرد؛ یک «USB-C» برای عامل‌های هوش مصنوعی

پروتکل کانتکست مدل (MCP) یک رابط یکپارچه برای عامل‌های هوش مصنوعی فراهم می‌کند تا بتوانند پایگاه‌های داده، ابزارهای نظارتی، مخازن کد و موارد دیگر را فراخوانی کنند. با تعریف منابع، ابزارها و پرامپت‌ها، تنها یک سرور MCP می‌تواند جایگزین ده‌ها آداپتور اختصاصی شود و داده‌ها را بلافاصله در اختیار هر کلاینت سازگار با Claude قرار دهد.

AI · 3 min read

Qwen 3.6 در RTX 4070 به سرعت نسخه 3.5 می‌رسد و موفقیت عامل‌ها را ۴۳٪ افزایش می‌دهد

مقایسه Qwen 3.6 در مقابل 3.5: سرعت یکسان، اما عامل‌های بهتر. نزدیک بود پستی درباره کندتر بودن Qwen 3.6 نسبت به 3.5 منتشر کنم. اولین تست من ۱۲ توکن در ثانیه را نشان داد. نسخه قدیمی با سرعت ۳۴... اجرا می‌شد.

AI · 2 min read

کلاهبرداری شبیه‌سازی صدای هوش مصنوعی در تماس مربوط به ازدواج در ماهاراشترا، ۱۱.۸ لک روپیه سرقت کرد

کلاهبرداران تنها چند ثانیه از صدای قربانی را از پست‌های آنلاین استخراج کردند و با استفاده از یک مدل سنتز zero-shot برای جعل هویت یکی از اعضای خانواده عروس، او را متقاعد کردند تا پیش از فاش شدن کلاهبرداری، مبلغ ۱۱.۸ لک روپیه انتقال دهد.

AI · 2 min read

بنچمارک‌های Claude Fable 5.1: مقایسه تمام اعداد

بنچمارک‌های Claude Fable 5.1: مقایسه تمام اعداد. شرکت Anthropic مدل Claude Fable 5.1 را در ۱ سپتامبر ۲۰۲۶ منتشر کرد. اعداد نشان‌دهنده جهش‌های بزرگی در حوزه‌های خاص هستند. خبر اصلی مربوط به اصطلاح...

AI · 3 min read

Anthropic Cuts Cache-Read Costs 75%, Slashing Agent Bills 45%

Anthropic’s Fable 5.1 reduces cache-read fees by 75%, trimming overall agent operating costs up to 45%. The cut lets autonomous models run for hours—or days—without constant human supervision, opening new production use cases.

AI · 3 min read

Hugging Face تعداد ۲۰۷ هسته WebGPU را برای هوش مصنوعی خصوصی و آفلاین در مرورگرها عرضه کرد

این مجموعه متن‌باز شامل قراردادهای نسخه‌بندی‌شده، داده‌های بنچمارک و قالب‌های شیدر قابل استفاده مجدد است که به اپلیکیشن‌ها اجازه می‌دهد بدون نیاز به شبکه، فرآیند استنتاج را انجام دهند. اگرچه کاربران از سرعت بیشتر و حاکمیت بر داده‌های خود بهره‌مند می‌شوند، اما سهولت اجرای محلی نیز نگرانی‌های جدیدی را در مورد بدافزارها ایجاد کرده است.

AI · 3 min read

فقط با یک بار پرداخت ۱۰ دلار، روزانه ۱۰۰۰ فراخوانی رایگان OpenRouter AI دریافت کنید – ۲۰ برابر حالت پیش‌فرض

این ارتقا فقط شامل مدل‌های رایگان OpenRouter می‌شود؛ مدل‌های پولی همچنان شامل هزینه به ازای هر توکن هستند. طبق قانون «هزینه مادام‌العمر»، محدودیت ۱۰۰۰ درخواست هرگز منقضی نمی‌شود، حتی پس از تمام شدن اعتبار خریداری‌شده شما.

AI · 3 min read

مطالعه نشان می‌دهد نشانگر باینری موفقیت، مدل‌های تولید کد را گمراه کرده و نیاز به بازنگری ایجاد می‌کند

SWE Prime: برچسب «موفقیت» یک فیلتر بسیار بد است. اکثر توسعه‌دهندگان فکر می‌کنند داده‌های بیشتر، عامل‌ها را هوشمندتر می‌کند. اگر یک عامل در یک تست موفق شود، شما آن نشست را ثبت کرده و به مجموعه آموزشی خود اضافه می‌کنید...

AI · 4 min read

دیپ‌مایند از بنچمارک رمزنگاری‌شده‌ی دوسویه کور برای Gemini Flash Lite رونمایی کرد

این طرح آزمایشی، Gemini Flash Lite را در فضای محرمانه (Confidential Space) گوگل کلاود اجرا می‌کند و با قرار دادن پرامپت‌های تست و وزن‌های مدل در یک جعبه رمزنگاری‌شده، مدرکی ارائه می‌دهد که ثابت می‌کند مدل هرگز سوالات را مشاهده نکرده است.

AI · 3 min read

بیت‌پورت آهنگ‌های کاملاً تولیدشده توسط هوش مصنوعی را ممنوع و آهنگ‌های ترکیبی را علامت‌گذاری کرد

بیت‌پورت به‌طور خودکار فایل‌های آپلود شده‌ای را که عمدتاً توسط هوش مصنوعی تولید شده‌اند رد خواهد کرد، اما همچنان قطعاتی را که از هوش مصنوعی به عنوان یک ابزار استفاده می‌کنند، به شرطی که به‌وضوح مشخص شده باشند، می‌پذیرد. این اقدام پس از نظرسنجی‌ای انجام شد که نشان داد ۷۷ درصد از کاربران، موسیقی ساخته‌شده توسط انسان را ترجیح می‌دهند.

AI · 3 min read

وال استریت ژورنال الزام افشای هوش مصنوعی را لغو کرد؛ سازندگان پلتفرم‌ها ناچار به بازنگری در قوانین شدند

پس از آنکه در یک یادداشت ستون، به استفاده از هوش مصنوعی به عنوان «ماشین‌حساب برای استدلال‌ها» اعتراف شد، وال استریت ژورنال الزام به افشای استفاده از ابزارهای هوش مصنوعی در مقالات تحلیلی را متوقف کرد. این اقدام توسعه‌دهندگان پلتفرم‌های تحریریه را وادار می‌کند تا سیاست‌های قابل تنظیم، دسترسی‌های مبتنی بر نقش، برچسب‌گذاری عملکردهای هوش مصنوعی و تأییدیه انسانی قابل بازرسی را اضافه کنند.

AI · 3 min read

تست ۲۷ باگی CodeVetter نشان‌دهنده توانایی تشخیص است، نه آمادگی برای دنیای واقعی

این بنچمارک با اجرای ۲۷ مورد مصنوعی و ثبت وضعیت قبولی یا رد، یک بررسی سریع برای میزان پوشش خطاها ارائه می‌دهد؛ اما از نظر زمان‌بندی، هزینه محاسباتی، تنوع زبان‌ها و اعتبارسنجی در مخازن زنده (live-repo) نقص دارد، بنابراین امتیاز حاصل، تضمینی برای استفاده در محیط‌های عملیاتی نیست.

AI · 2 min read

گوگل بارت زوف، مدیر سابق OpenAI را برای هدایت برنامه‌های ارتقای ایمنی و استدلال Gemini استخدام کرد

بارت زوف که پس از فعالیت کوتاهی در بخش فروش سازمانی، OpenAI را ترک کرده بود، به عنوان معاون پژوهش به گوگل می‌پیوندد تا با بهره‌گیری از تخصص خود در زمینه یادگیری تقویتی، همسویی، استدلال و ایمنی Gemini را تقویت کند؛ تلاشی مستقیم برای کاهش فاصله با سری مدل‌های GPT شرکت OpenAI.

AI · 3 min read

Google Gemini Notebook Taps 100,000 Play Books, Lets Users Remix Content

In a live demo, Google Labs editorial director Steven Johnson fed Michael Pollan’s *Food Rules* into Gemini Notebook and got a full week-long menu with grocery list, while Kim Scott’s *Radical Candor* produced a step-by-step performance-review script—all without leaving the app.

AI · 6 min read

ارتقای دو مرحله‌ای جدید GKE ریسک از کار افتادن کلاستر را در تغییرات نسخه‌های فرعی کاهش می‌دهد

جریان جدید GA، فرآیند ارتقای باینری را از مهاجرت‌های فرمت داده جدا می‌کند و یک دوره پایداری (soak period) قابل تنظیم ارائه می‌دهد که در آن معیارهای سلامت پایش می‌شوند و امکان بازگشت (rollback) تا مرحله نهایی تبدیل داده‌ها فراهم است.

AI · 3 min read