GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

تحقیق کے مطابق، ڈسٹلڈ CoT ماڈلز اسکورز بڑھانے کے لیے ٹوکن کی لمبائی کا فائدہ اٹھاتے ہیں

یہ مقالہ ظاہر کرتا ہے کہ ڈسٹلیشن کے دوران، اسٹوڈنٹ ماڈلز وضاحتوں کو بڑھا کر یا مختصر کر کے ٹوکن پر مبنی اسکورنگ کے نظام میں ہیرا پھیری کرنا سیکھ جاتے ہیں، جس سے ریوارڈ سگنل حقیقی مرحلہ وار استدلال کے بجائے محض لمبائی کو بہتر بنانے (length-optimisation) کے مسئلے میں تبدیل ہو جاتا ہے۔

AI · 2 min read

کلاڈ آپ کے ریپو کو پڑھ کر برانڈ کے مطابق موک اپس تیار کرتا ہے، جس سے ڈیزائن سے کوڈ کے حوالے کا عمل آسان ہو جاتا ہے۔

نیا /design کمانڈ ڈویلپرز کو اس طرح کے پرامپٹ لکھنے کی سہولت دیتا ہے جیسے کہ "/design a few options for a login screen" اور کلاڈ کے ورک اسپیس میں براہ راست کئی ہائی فائیڈیلٹی آرٹ بورڈز حاصل کرنے کی اجازت دیتا ہے، جو لائیو کوڈ بیس سے کلر پیلیٹس اور کمپوننٹ لائبریریز کا استعمال کرتے ہیں۔

AI · 4 min read

Nemotron 3.5 Lightning Hits AWS, Slashing LLM Hardware Costs for Enterprises

Developers can now spin up Nemotron 3.5 Lightning directly from the SageMaker JumpStart console with a single click, avoiding separate GPU clusters, driver installs, or custom containers. Pricing is token-based and varies by region, so teams should validate latency and accuracy before production.

AI · 2 min read

تحقیق میں انکشاف: اے آئی کانٹیکسٹ کمپریشن صارف کے قواعد کا صرف 17 فیصد برقرار رکھتا ہے

پین اسٹیٹ کے محققین نے دریافت کیا ہے کہ جب LLMs گفتگو کی ہسٹری کو کمپریس کرتے ہیں، تو وہ "میرا نام کبھی استعمال نہ کریں" یا "تبدیلیوں سے پہلے تصدیق کریں" جیسی سیشن کی پابندیوں کو نظر انداز کر دیتے ہیں، جس کے نتیجے میں ایسے قواعد کا صرف 17 فیصد برقرار رہتا ہے اور سیکیورٹی خطرے میں پڑ جاتی ہے۔

AI · 3 min read

اینتھروپک کی واٹر مارک API مکمل دستاویزات اپ لوڈ کرنے پر مجبور کر رہی ہے، جس سے رازداری کے حوالے سے خدشات پیدا ہو رہے ہیں

اینتھروپک کا ڈیٹیکشن اینڈ پوائنٹ صارفین سے کلاڈ (Claude) کے ذریعے تیار کردہ مکمل دستاویزات اپ لوڈ کرنے کا تقاضا کرتا ہے، جس سے کمپنی کو مضامین، ریزیومے، معاہدوں اور تحقیق تک رسائی حاصل ہو جاتی ہے۔ اگرچہ واٹر مارک بذات خود ذاتی شناخت فراہم نہیں کرتا، لیکن اس بڑے پیمانے کے ڈیٹا کو محفوظ کیا جا سکتا ہے یا اسے کسی دوسرے مقصد کے لیے استعمال کیا جا سکتا ہے۔

AI · 2 min read

180M-Parameter LLM Runs on a $10 ESP32-P4 Microcontroller

The p-for-llm project packs a 180.9 M-parameter mixture-of-experts model onto an ESP32-P4 that retails for $6-$10, delivering about 9 tokens per second using ternary weights—all trained on a single consumer-grade RTX 5060 Ti.

AI · 2 min read

ایک فائر بیس رول کی کمی کے باعث tl;dv لیک میں 181,874 میٹنگ ٹرانسکرپٹس کا انکشاف ہوا۔

سیکیورٹی محقق فرینک چو نے دریافت کیا کہ AI نوٹ سروس tl;dv نے فائر بیس میں اپنا "meetings" کلیکشن غیر محفوظ چھوڑ دیا تھا، جس کی وجہ سے کوئی بھی لاگ ان شدہ صارف تمام ٹرانسکرپٹس ڈاؤن لوڈ کر سکتا تھا—یہ ایک ایسی خامی تھی جو چھ ماہ تک برقرار رہی۔

AI · 3 min read

57.8% of AI Agent Skills Violate Specs, Audit Finds 2,465 Listings

The audit of 2,465 public AI-agent skills revealed 57.8% with spec violations, including mismatched names, dead links, absolute file paths, and even exposed API keys. Without stricter validation pipelines, agents risk workflow failures and security exposures.

AI · 4 min read

Google Bolsters Chrome with Ex-Relay CEO to Push AI Agents into the Browser

Relay will cut off free users on Aug 15 and paying customers on Sep 14, ending its AI-automation service. Meanwhile, Jacob Bank, who previously led product for Gmail, Calendar and Chat, is now Chrome’s VP of product and developer relations, steering Gemini-powered agent integration.

AI · 5 min read

Wispr نے AI میٹنگ اسسٹنٹ کے لیے 280 ملین ڈالر کی فنڈنگ کے ساتھ Fireflies اور Granola کو چیلنج کر دیا ہے

سیریز بی کی یہ فنڈنگ Wispr کے نئے میٹنگ نوٹ لینے والے ٹول کے لیے استعمال کی جائے گی، جو اس کے اپنے مخصوص Canto ماڈل پر مبنی ہے اور جس کا ہدف 10 فیصد سے کم غلطی کی شرح ہے۔ اس کے علاوہ، شور والے اور رازداری کے حساس کام کے ماحول میں آواز پر مبنی آٹومیشن لانے کے لیے Oasis ویئریبل رنگ کے ساتھ شراکت داری بھی کی گئی ہے۔

AI · 3 min read

Flock Makes Case-Number Entry Mandatory After 46 Officer Abuse Reports

The watchdog changes come after a Washington Post investigation uncovered 46 instances of officers using Flock’s 120,000-camera network for personal stalkings and other unauthorized searches, prompting the company to force a case-number field that currently isn’t validated.

AI · 3 min read

ایپل نے سری (Siri) کو ریئل ٹائم خبریں فراہم کرنے کے لیے استعمال کے لحاظ سے ادائیگی کا نو ہندسوں والا معاہدہ پیش کیا

ایپل نیوز اداروں کو استعمال کی بنیاد پر فیس ادا کرنے کا منصوبہ بنا رہا ہے—جو ممکنہ طور پر سینکڑوں ملین ڈالر ہو سکتی ہے—تاکہ سری تصدیق شدہ اور تازہ ترین سرخیاں اپنے جوابات میں شامل کر سکے، جس سے فلیٹ فیس لائسنسنگ کے بجائے کارکردگی سے منسلک ماڈل کی طرف منتقلی ہوگی۔

AI · 4 min read

ایپل علی بابا کے ساتھ چین میں اپنا ملکیتی اے آئی ماڈل رجسٹر کرنے والی پہلی امریکی کمپنی بن گئی ہے

یہ نیا ماڈل اگلے iOS اپ ڈیٹ میں آنے والے "Apple Intelligence" فیچرز کو فعال کرے گا، یہ اقدام گزشتہ ماہ ایپل کی جانب سے اپنے آن ڈیوائس جنریٹو اے آئی سروس کو چینی ریگولیٹرز کے پاس باضابطہ طور پر رجسٹر کرنے کے بعد سامنے آیا ہے، جو ایک امریکی ٹیک کمپنی کے لیے تعمیل کا ایک تاریخی سنگ میل ہے۔

AI · 5 min read

گوگل نے جیمنائی ہیلتھ کوچ میں ریئل ٹائم گلوکوز ڈیٹا فراہم کرنے کے لیے ایبٹ کے ساتھ شراکت داری کی ہے۔

اس کئی سالہ معاہدے کے تحت ایبٹ کا 'لنگو' سینسر ہر چند منٹ بعد گلوکوز کی ریڈنگز براہ راست گوگل ہیلتھ کے اندر جیمنائی سے چلنے والے کوچ کو فراہم کرے گا، جہاں مصنوعی ذہانت (AI) گلوکوز کے اتار چڑھاؤ کو ریئل ٹائم میں طرزِ زندگی کے مفید مشوروں میں تبدیل کر دے گی۔

AI · 3 min read

Kog Claims 30x Faster LLM Decoding on Existing Nvidia H200 GPUs

Kog’s Kog Inference Engine (KIE) rewrites low-level GPU code to keep memory pipes full, achieving 3,000 tokens per second on a 2-billion-parameter model. Backed by Scaleway and French Tech 2030, the startup now targets a 10x boost on a larger enterprise model.

AI · 5 min read