GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

Moonshot AI نے 2.8 ٹریلین پیرامیٹر والا Kimi K3 متعارف کروا دیا ہے، لیکن یہ ہوم پی سی پر نہیں چل سکے گا۔

Moonshot AI نے 27 جولائی کو 2.8 ٹریلین پیرامیٹر والا ماڈل Kimi K3 عوامی طور پر ڈاؤن لوڈ کے لیے دستیاب کر دیا ہے، لیکن اس کے ہارڈ ویئر کے تقاضے انٹرپرائز گریڈ GPU کلسٹرز کا مطالبہ کرتے ہیں، جس کی وجہ سے عام ڈویلپرز کے لیے اسے آج کل مقامی طور پر چلانا ممکن نہیں ہے۔

AI · 2 min read

LLM کی منطق کو چار ایجنٹس میں تقسیم کرنا ڈیٹا کے تجزیے کو کیسے قابل اعتماد بناتا ہے

نیا ورک فلو LLMs کو صرف فیصلہ سازی تک محدود رکھتا ہے جبکہ یقینی (deterministic) سینڈ باکسڈ اسکرپٹس تمام حساب کتاب سنبھالتے ہیں، جس سے مرحلہ وار قابل تصدیق نتائج حاصل ہوتے ہیں اور ان فرضی اعداد و شمار میں کمی آتی ہے جو سنگل پرامپٹ EDA میں عام طور پر دیکھنے کو ملتے ہیں۔

AI · 3 min read

ایم آئی ٹی کی تحقیق: اے آئی فیکٹ چیکرز صارفین میں جھوٹی خبروں کی شناخت کرنے کی صلاحیت کو کمزور کر دیتے ہیں

67 شرکاء پر مشتمل چار ہفتوں کے ایک تجربے میں، ایم آئی ٹی کے محققین نے ایک درست اے آئی کو خبروں کی حقیقت جانچنے کے لیے حتمی فیصلے کرنے دیے۔ اگرچہ اے آئی زیادہ تر وقت درست تھی، لیکن جن صارفین نے اس پر انحصار کیا، اے آئی کی غیر موجودگی میں غلط معلومات کی پہچان کرنے کی ان کی اپنی صلاحیت میں نمایاں کمی دیکھی گئی۔

AI · 2 min read

Gemini پر تصاویر متن سے بہتر ہیں: ریاضی، غیر لاطینی اسکرپٹس اور ٹیبلز کی قیمت کم ہے

گوگل کا Gemini امیج ٹوکنز کا حساب 768 پکسل کے ٹائلز کے ذریعے لگاتا ہے، اور ہر ٹائل کے لیے 258 ٹوکنز وصول کرتا ہے۔ تصاویر کو ایک ٹائل کے اندر رکھنے کے ذریعے—یا انہیں مساواتوں، ٹیبلز، یا غیر لاطینی اسکرپٹس جیسے پیچیدہ ڈیٹا کے لیے استعمال کرنے کے ذریعے—ڈویلپرز اکثر اسی معلومات کو متن کی صورت میں بھیجنے کے مقابلے میں بہت کم خرچ کر سکتے ہیں۔

AI · 3 min read

بوگوٹا سمٹ میں AWS نے AI ایجنٹ آرکیسٹریشن کو معیاری بنانے کے لیے Bedrock AgentCore لانچ کر دیا

بوگوٹا سمٹ میں، AWS نے Bedrock AgentCore کا انکشاف کیا، جو کہ ایک متحد پلیٹ فارم ہے جو آرکیسٹریشن، مشاہدہ (observability) اور حفاظتی کنٹرولز کو یکجا کرتا ہے، جس سے ڈویلپرز کو بغیر کسی پیچیدہ کسٹم ڈھانچے کے مخصوص AI ایجنٹس تیار کرنے کی سہولت ملتی ہے۔

AI · 4 min read

Claude Code Turns Are 75% Reading

Claude Code Turns Are 75% Reading Most people think AI coding agents spend their time writing code. New data shows this is wrong. Red Hat analyzed 219 real Claude Code sessions. T…

AI · 3 min read

کلاڈ پرامپٹ کیشنگ خاموشی سے ناکام ہو جاتی ہے

کلاڈ پرامپٹ کیشنگ خاموشی سے ناکام ہو جاتی ہے۔ آپ کی کلاڈ پرامپٹ کیشنگ شاید ناکام ہو رہی ہو، اور آپ کو اس کا علم بھی نہ ہو۔ میں نے ایک واٹس ایپ ہینڈلر میں کیش کنٹرول شامل کیا اور میں نے لاگز کا مشاہدہ کیا...

AI · 3 min read

ریڈٹ پر اسپیم میں اضافہ کیے بغیر اے آئی (AI) کی نگرانی سے نئے صارفین کی پوسٹس میں 22 فیصد اضافہ

r/technology جیسے سب ریڈٹس پر ابتدائی تجرباتی مراحل کے دوران، ریڈٹ کی اے آئی (AI) پر مبنی نگرانی نے نئے پوسٹرز کی سرگرمی میں 22 فیصد اضافہ کیا، جبکہ اسپیم اور ہراساں کرنے والے مواد کے تناسب کو برقرار رکھا۔ یہ اس بات کا ثبوت ہے کہ یہ ماڈل حفاظت پر سمجھوتہ کیے بغیر نئے صارفین کے لیے داخلے کی رکاوٹیں کم کر سکتا ہے۔

AI · 2 min read

GraphRAG + مستقل میموری چیٹ بوٹس کو ٹیب بند کرنے پر بھولنے سے روکتی ہے

حاصل کردہ متن کو اینٹیٹیز اور تعلقات کے گراف میں تبدیل کر کے، GraphRAG ماڈلز کو متعدد دستاویزات کے درمیان منطقی استدلال کرنے کے قابل بناتا ہے، جبکہ ایک تین درجوں والی سیاق و سباق کی میموری مختصر مدتی مکالمے، طویل مدتی صارف کے حقائق، اور منتخب طور پر چھانٹی شدہ ڈیٹا کو محفوظ رکھتی ہے تاکہ پیج ریفریش اور نئے ٹیبز کے باوجود معلومات برقرار رہ سکیں۔

AI · 3 min read

میرے ایجنٹ آرکیسٹریٹر نے فی ٹاسک 1 سے 2 ملین ڈالر مالیت کے Opus ٹوکنز ضائع کر دیے۔

آرکیسٹریٹر کے سب ایجنٹس نے پیرنٹ کی سیٹنگز کو اپنا لیا، مہنگے Opus ٹیر کو ڈیفالٹ کے طور پر منتخب کیا، ہر کال پر کیش کو دوبارہ لکھا اور ریویو کی منظوری تک لامتناہی لوپس چلاتے رہے، جس کی وجہ سے ایک سادہ سے کام کا خرچہ کروڑوں ٹوکنز تک پہنچ گیا۔

AI · 2 min read

نیون پولز کے وقفے کو 15 منٹ تک بڑھانے سے کمپیوٹ اخراجات میں نمایاں کمی آئی

کلائنٹ سائیڈ ریفریش انٹرویل کو 30 سیکنڈ سے بڑھا کر 15 منٹ کرنے سے، نیون ڈیٹا بیس اتنی دیر تک غیر فعال (idle) رہ سکتا تھا کہ وہ 'اسکیل ٹو زیرو' ہو سکے، جس سے فی سیکنڈ کمپیوٹ چارجز کا خاتمہ ہوا اور ویصل (Vercel) کاسٹ ڈیش بورڈ پر اخراجات میں ہونے والا اضافہ رک گیا۔

AI · 2 min read

GhostApproval کی خامی AI کوڈنگ اسسٹنٹ کو آپ کی SSH کیز کو اوور رائٹ کرنے کی اجازت دیتی ہے

Wiz Research نے دریافت کیا ہے کہ ایک نقصان دہ project_settings.json سم لنک چھ بڑے AI کوڈنگ ٹولز کو دھوکہ دے کر براہ راست ~/.ssh/id_rsa میں ڈیٹا لکھنے پر مجبور کر سکتا ہے، اور منظوری کا ڈائیلاگ صرف سم لنک کا نام دکھاتا ہے، اصل فائل کا راستہ نہیں۔

AI · 3 min read

Claude Tiering Cuts API Spend 35% and Slashes Latency to 27 s

The author built a static lookup that maps tasks by ambiguity to Haiku, Sonnet or Opus, and added a two-failure escalation rule. Over four weeks the system kept quality while driving API spend to 65% of the original and cutting median turnaround from 42 s to 27 s.

AI · 3 min read

FaceHugger RCE نے Diffusers کے ٹرسٹ گیٹ کو بائی پاس کر دیا، ماڈل لوڈ ہوتے ہی کوڈ کو چلانے کی اجازت دیتا ہے

FaceHugger بگ لوڈنگ کے دو مراحل والے ریس کنڈیشن (race condition) کا فائدہ اٹھاتا ہے، جس کے نتیجے میں دوسرے ریکوسٹ میں شامل کیا گیا نقصان دہ کوڈ اس وقت بھی چل سکتا ہے جب `trust_remote_code` غیر فعال ہو، یہ CI/CD جابز، کنٹینرز اور انٹرپرائز انفرنس سروسز کو خطرے میں ڈالتا ہے۔

AI · 2 min read

پروڈکشن میں ایک سنگل گیٹ کاؤنٹر نے پورے دن کے AI تعطل کو چھپا دیا

میرا AI فیچر ایک دن کے لیے مکمل طور پر بند تھا۔ میٹرک بتا رہا تھا کہ یہ کام کر رہا ہے۔ کل، میرے ڈرون سسٹم نے چار AI وضاحتیں ریکارڈ کیں۔ ایک سیفٹی گیٹ نے ان چاروں کو مسترد کر دیا۔ مجھے اس پر خوشی ہوئی...

AI · 2 min read

ہرمز ایجنٹ AI ٹول کے عمل کو آن پریمیس (On-Premise) رکھ کر ڈیٹا لیک ہونے کے خطرات کو کم کرتا ہے

ہرمز ایجنٹ چیٹ بوٹس اور پروگرام ایبل مددگاروں کے درمیان فرق کو ختم کرتا ہے۔ یہ ڈویلپرز کو شیل کمانڈز، فائل I/O اور کسٹم سروسز استعمال کرنے کی سہولت دیتا ہے، اور یہ سب کچھ ان کے اپنے ہارڈ ویئر پر سیشنز کے دوران سیاق و سباق (context) کو محفوظ رکھتے ہوئے کیا جاتا ہے۔

AI · 3 min read