GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

$550M Series C Pushes Wonderful to $5B Valuation in Six Months

The Israeli-Dutch startup has pivoted from multilingual customer-service bots to a model-agnostic AI operating system, deploying forward-deployed engineers on-site in 35+ countries. Backed by Insight Partners and a new stake from Salesforce, the $550M round will fund product development and global F

AI · 2 min read

اینتھروپک نے کلاڈ کوڈ پرامپٹ کا 80 فیصد حصہ کم کر دیا، مگر کوڈنگ کی درستگی برقرار رکھی

اینتھروپک نے دریافت کیا کہ سسٹم پرامپٹ کے زیادہ تر قواعد کو ختم کرنے سے کلاڈ کوڈ کے نتائج پر کوئی منفی اثر نہیں پڑا، جو یہ ثابت کرتا ہے کہ جدید LLMs محض ایک ہدایت سے انداز اور حدود کا اندازہ لگا سکتے ہیں اور پرامپٹ اسکیفولڈنگ کو نمایاں طور پر کم کیا جا سکتا ہے۔

AI · 3 min read

تھائی لینڈ نے AI پر مبنی IBAS کے ذریعے 90 فیصد جعلی "مشروم" کمپنیوں کا خاتمہ کر دیا

بزنس ڈویلپمنٹ ڈیپارٹمنٹ کا IBAS سسٹم رویے کے تجزیے، ای-کے وائی سی (e-KYC) اور مختلف ایجنسیوں کے ڈیٹا کو یکجا کر کے زیادہ خطرے والی کمپنیوں کی نشاندہی کرتا ہے، جس سے تفتیش کاروں کو ممکنہ مجرموں پر توجہ مرکوز کرنے میں مدد ملتی ہے اور شیل کمپنیوں کی سرگرمیوں میں نمایاں کمی آتی ہے۔

AI · 2 min read

اینتھروپک نے ماڈل کانٹیکسٹ پروٹوکول کو اوپن سورس کر دیا ہے، جو AI ایجنٹس کے لیے ایک 'USB-C' کی طرح ہے

ماڈل کانٹیکسٹ پروٹوکول (MCP) AI ایجنٹس کے لیے ڈیٹا بیسز، مانیٹرنگ ٹولز، کوڈ ریپوزٹریز اور دیگر ذرائع سے معلومات حاصل کرنے کے لیے ایک یکساں انٹرفیس فراہم کرتا ہے۔ وسائل، ٹولز اور پرامپٹس کے تعین کے ذریعے، ایک واحد MCP سرور درجنوں مخصوص ایڈاپٹرز کا متبادل بن سکتا ہے، جو فوری طور پر کسی بھی کلاڈ (Claude) کے ہم آہنگ کلائنٹ تک ڈیٹا پہنچانے کی صلاحیت رکھتا ہے۔

AI · 3 min read

Qwen 3.6 نے RTX 4070 پر 3.5 جیسی رفتار حاصل کر لی ہے جبکہ ایجنٹ کی کامیابی میں 43% اضافہ کیا ہے

Qwen 3.6 بمقابلہ 3.5: وہی رفتار، لیکن بہتر ایجنٹس۔ میں تقریباً ایک پوسٹ شائع کرنے ہی والا تھا کہ Qwen 3.6، 3.5 سے سست ہے۔ میرے پہلے ٹیسٹ میں 12 ٹوکن فی سیکنڈ کی رفتار نظر آئی۔ پرانا ورژن 34 پر چلتا تھا...

AI · 2 min read

مہاراشٹر میں شادی کے حوالے سے ہونے والی کال میں اے آئی وائس کلوننگ اسکیم کے ذریعے 11.8 لاکھ روپے کی چوری

دھوکے بازوں نے آن لائن پوسٹس سے متاثرہ شخص کی آواز کے محض چند سیکنڈز حاصل کیے، دلہن کے خاندان کے رکن کا روپ دھارنے کے لیے 'زیرو شاٹ سنتھیسز ماڈل' کا استعمال کیا، اور دھوکہ سامنے آنے سے پہلے اسے 11.8 لاکھ روپے منتقل کرنے پر آمادہ کر لیا۔

AI · 2 min read

Anthropic Cuts Cache-Read Costs 75%, Slashing Agent Bills 45%

Anthropic’s Fable 5.1 reduces cache-read fees by 75%, trimming overall agent operating costs up to 45%. The cut lets autonomous models run for hours—or days—without constant human supervision, opening new production use cases.

AI · 3 min read

Hugging Face نے براؤزرز میں نجی اور آف لائن AI کے لیے 207 WebGPU کرنلز متعارف کروا دیے ہیں

اس اوپن سورس سوٹ میں ورژن شدہ کنٹریکٹس، بینچ مارک ڈیٹا اور دوبارہ استعمال ہونے والے شیڈر ٹیمپلیٹس شامل ہیں، جو ایپس کو انٹرنیٹ کے بغیر انفرنس (inference) چلانے کی اجازت دیتے ہیں۔ اگرچہ اس سے صارفین کو رفتار اور ڈیٹا کی خودمختاری حاصل ہوتی ہے، لیکن مقامی طور پر چلانے کی یہ آسانی میلویئر کے نئے خدشات بھی پیدا کرتی ہے۔

AI · 3 min read

تحقیق بتاتی ہے کہ بائنری پاس فلیگ کوڈ جنریشن ماڈلز کو گمراہ کرتا ہے، جس سے نئے سرے سے سوچنے کی ضرورت پڑتی ہے

SWE Prime: پاس لیبل ایک انتہائی ناقص فلٹر ہے۔ زیادہ تر ڈویلپرز کا خیال ہے کہ زیادہ ڈیٹا ایجنٹس کو زیادہ ذہین بناتا ہے۔ اگر کوئی ایجنٹ ٹیسٹ پاس کر لیتا ہے، تو آپ اس سیشن کو لاگ کرتے ہیں اور اسے اپنے ٹریننگ سیٹ میں شامل کر دیتے ہیں...

AI · 4 min read

DeepMind نے Gemini Flash Lite کے لیے ڈبل بلائنڈ کرپٹو بینچ مارک کا انکشاف کیا

یہ پائلٹ پروجیکٹ Gemini Flash Lite کو گوگل کلاؤڈ کے 'Confidential Space' کے اندر چلاتا ہے، جس میں ٹیسٹ پرامپٹس اور ماڈل ویٹس دونوں کو ایک کرپٹوگرافک باکس میں محفوظ کیا جاتا ہے جو اس بات کا ثبوت فراہم کرتا ہے کہ ماڈل نے سوالات کو کبھی نہیں دیکھا۔

AI · 3 min read

Beatport مکمل طور پر AI سے تیار کردہ ٹریکس پر پابندی لگاتا ہے، ہائبرڈ گانوں کی نشاندہی کرتا ہے

Beatport ان اپ لوڈز کو خودکار طریقے سے مسترد کر دے گا جو بنیادی طور پر AI سے تیار کیے گئے ہوں، لیکن وہ ایسے ٹریکس کو قبول کرے گا جو AI کو ایک ٹول کے طور پر استعمال کرتے ہیں، بشرطیکہ ان پر واضح طور پر ایسا لیبل لگا ہو۔ یہ اقدام ایک سروے کے بعد کیا گیا ہے جس میں 77% صارفین نے انسانوں کے بنائے ہوئے میوزک کو ترجیح دی ہے۔

AI · 3 min read

WSJ نے لازمی AI انکشاف ختم کر دیا، پلیٹ فارم بنانے والوں کو قوانین پر نظر ثانی کرنے پر مجبور کر دیا

ایک کالم میں AI کو "دلائل کے لیے کیلکولیٹر" کے طور پر استعمال کرنے کا اعتراف کرنے کے بعد، وال اسٹریٹ جرنل نے رائے کے کالموں میں AI ٹولز کے انکشاف کی ضرورت ختم کر دی ہے۔ یہ اقدام ادارتی پلیٹ فارمز کے ڈویلپرز کو مجبور کرتا ہے کہ وہ قابلِ ترتیب پالیسیاں، کردار پر مبنی اجازت نامے، AI فنکشن ٹیگنگ، اور قابلِ آڈٹ انسانی منظوری شامل کریں۔

AI · 3 min read

CodeVetter کا 27 بگ والا ٹیسٹ غلطیاں پکڑنے کی صلاحیت تو دکھاتا ہے، مگر حقیقی دنیا کی تیاری کی ضمانت نہیں دیتا۔

یہ بینچ مارک 27 مصنوعی کیسز چلا کر پاس یا فیل کا ریکارڈ رکھتا ہے، جو مسائل کی کوریج کے لیے ایک فوری چیک فراہم کرتا ہے، لیکن یہ وقت، کمپیوٹنگ لاگت، زبانوں کی وسعت، اور لائیو-ریپو کی تصدیق کو نظر انداز کرتا ہے، اس لیے اس کا اسکور پروڈکشن کی ضمانت نہیں ہے۔

AI · 2 min read

Google Gemini Notebook Taps 100,000 Play Books, Lets Users Remix Content

In a live demo, Google Labs editorial director Steven Johnson fed Michael Pollan’s *Food Rules* into Gemini Notebook and got a full week-long menu with grocery list, while Kim Scott’s *Radical Candor* produced a step-by-step performance-review script—all without leaving the app.

AI · 6 min read

اے آئی کوڈنگ اسسٹنٹ C:\ProgramData کے ذریعے کسی بھی صارف کو ونڈوز ورک اسٹیشنز ہائی جیک کرنے کی اجازت دیتے ہیں

یہ نقص (CVE-2026-35603) ایک غیر ایڈمن صارف کو C:\ProgramData میں ایک نقصان دہ کنفیگ فائل رکھنے کی اجازت دیتا ہے، جسے Claude Code، Cursor، Codex CLI اور Gemini CLI شروع ہوتے وقت پڑھتے ہیں، جس کے نتیجے میں پی لوڈ مکمل ایڈمن حقوق کے ساتھ چل جاتا ہے اور حملہ آوروں کو خاموشی سے کنٹرول مل جاتا ہے۔

AI · 4 min read