GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

Moonshot AI تطلق نموذج Kimi K3 بـ 2.8 تريليون معلمة، لكنه لن يعمل على أجهزة الكمبيوتر المنزلية

أتاحت Moonshot AI نموذج Kimi K3، المكون من 2.8 تريليون معلمة، للتحميل العام في 27 يوليو، ولكن متطلباته العتادية تتطلب مجموعات وحدات معالجة رسومية (GPU clusters) من فئة المؤسسات، مما يجعل المطورين العاديين غير قادرين على تشغيله محلياً في الوقت الحالي.

AI · 2 دقيقة قراءة

كيف يجعل تقسيم استنتاج النماذج اللغوية الكبيرة (LLM) إلى أربعة وكلاء تحليل البيانات موثوقاً

يعمل سير العمل الجديد على حصر دور النماذج اللغوية الكبيرة في اتخاذ القرارات، بينما تتولى برمجيات محددة داخل بيئة معزولة كافة الحسابات، مما يوفر نتائج قابلة للتحقق خطوة بخطوة ويحد من الإحصائيات المختلقة التي تشوب عمليات تحليل البيانات الاستكشافي (EDA) المعتمدة على مطالبة واحدة.

AI · 3 دقيقة قراءة

دراسة من MIT تكشف أن أدوات التحقق من الحقائق بالذكاء الاصطناعي تضعف قدرة المستخدمين على كشف الأخبار المزيفة

في تجربة استمرت أربعة أسابيع وشملت 67 مشاركاً، سمح باحثون من معهد ماساتشوستس للتكنولوجيا (MIT) لذكاء اصطناعي دقيق بإصدار أحكام ثنائية على مواد إخبارية. ورغم أن الذكاء الاصطناعي كان محقاً في معظم الأوقات، إلا أن المستخدمين الذين اعتمدوا عليه شهدوا انخفاضاً ملموساً في قدرتهم على تقييم المعلومات المضللة عند غياب الذكاء الاصطناعي.

AI · 2 دقيقة قراءة

الصور تتفوق على النصوص في Gemini: الرياضيات والخطوط غير اللاتينية والجداول تكلف أقل

يقوم Gemini من Google بحساب رموز الصور (tokens) عبر مربعات بحجم 768 بكسل، حيث يفرض 258 رمزاً لكل منها. ومن خلال إبقاء الصور ضمن مربع واحد - أو استخدامها للبيانات الكثيفة مثل المعادلات أو الجداول أو الخطوط غير اللاتينية - يمكن للمطورين غالباً دفع تكلفة أقل بكثير مما لو أرسلوا نفس المعلومات كنص.

AI · 3 دقيقة قراءة

AWS تطلق Bedrock AgentCore لتوحيد عملية تنسيق وكلاء الذكاء الاصطناعي في قمة بوغوتا

خلال قمة بوغوتا، كشفت AWS عن Bedrock AgentCore، وهي منصة موحدة تدمج عمليات التنسيق والمراقبة وضوابط السلامة، مما يتيح للمطورين إطلاق وكلاء ذكاء اصطناعي متخصصين دون الحاجة إلى بناء بنية تحتية مخصصة.

AI · 4 دقيقة قراءة

75% من خطوات Claude Code هي مجرد قراءة

75% من خطوات Claude Code هي مجرد قراءة. يعتقد معظم الناس أن وكلاء البرمجة بالذكاء الاصطناعي يقضون وقتهم في كتابة الأكواد، لكن البيانات الجديدة تُظهر أن هذا غير صحيح. قامت Red Hat بتحليل 219 جلسة حقيقية لـ Claude Code. ت...

AI · 3 دقيقة قراءة

نقاط تفتيش بنظام الإصدارات مع عمليات كتابة مشروطة باستخدام ETag تمنع فقدان البيانات في LangGraph

بعد أسابيع من الفقدان الصامت للحالة، جرب المؤلف SQLite، وتخزين الكائنات الخام، ونظاماً هجيناً غير مستقر، قبل أن يستقر على استخدام غلاف بنظام الإصدارات مع عمليات كتابة مشروطة تعتمد على ETag—وهي حلقة تحديث ذرية تمنع عمليات الكتابة المتزامنة وتستعيد الموثوقية.

AI · 3 دقيقة قراءة

فشل تخزين أوامر Claude المؤقت بصمت

فشل تخزين أوامر Claude المؤقت بصمت. قد يفشل تخزين أوامر Claude المؤقت لديك دون أن تدرك ذلك. لقد أضفت خاصية التحكم في التخزين المؤقت إلى معالج واتساب. راقبت السجلات لـ...

AI · 3 دقيقة قراءة

الإشراف بالذكاء الاصطناعي يحفز زيادة بنسبة 22% في منشورات المستخدمين الجدد على Reddit دون زيادة الرسائل المزعجة

في تجارب أولية عبر مجتمعات (subreddits) مثل r/technology، أدى الإشراف المدعوم بالذكاء الاصطناعي من Reddit إلى تعزيز نشاط الناشرين الجدد بنسبة 22% مع الحفاظ على استقرار نسبة الرسائل المزعجة والمضايقات المرصودة، مما يثبت قدرة النموذج على خفض حواجز الدخول دون المساس بمعايير السلامة.

AI · 2 دقيقة قراءة

GraphRAG + Persistent Memory Stops Chatbots From Forgetting On Tab Close

By converting retrieved text into a graph of entities and relationships, GraphRAG lets models reason across multiple documents, while a three-tier contextual memory stores short-term dialogue, long-term user facts, and selectively pruned data to survive page refreshes and new tabs.

AI · 3 دقيقة قراءة

My Agent Orchestrator Blew $1-2 M Worth of Opus Tokens Per Task

The orchestrator’s sub-agents inherited the parent’s settings, defaulted to the pricey Opus tier, rewrote the cache each call and ran endless loops until a reviewer approved, inflating a simple job into a multi-million-token expense.

AI · 2 دقيقة قراءة

DiffusionGemma يولد 1500 توكن في الثانية على وحدة H100 واحدة، متجاوزاً سرعة Gemma 4 البالغة 303

يستبدل DiffusionGemma حلقة التوكن التقليدية من اليسار إلى اليمين بكتلة انتشار مكونة من 256 توكن، مما يسمح بإزالة الضجيج للكتلة بأكملها بالتوازي. يقلل هذا النهج من زمن الاستجابة لوكلاء الذكاء الاصطناعي في الوقت الفعلي، رغم انخفاض أدائه من 88.3 إلى 69.1 في معيار AIME ومعاناته مع المطالبات القصيرة.

AI · 3 دقيقة قراءة

تمديد فترات الاستعلام في Neon إلى 15 دقيقة خفّض تكاليف الحوسبة بشكل كبير

من خلال زيادة فاصل التحديث من جانب العميل من 30 ثانية إلى 15 دقيقة، تمكنت قاعدة بيانات Neon من البقاء في وضع الخمول لفترة كافية لتصل إلى مستوى الصفر، مما أدى إلى إلغاء رسوم الحوسبة لكل ثانية التي كانت ترفع تكاليف لوحة بيانات Vercel بشكل كبير.

AI · 2 دقيقة قراءة

ثغرة GhostApproval تتيح لمساعدي البرمجة بالذكاء الاصطناعي الكتابة فوق مفاتيح SSH الخاصة بك

كشفت Wiz Research أن رابطاً رمزياً (symlink) خبيثاً لملف project_settings.json يمكنه خداع ست أدوات برمجة رئيسية مدعومة بالذكاء الاصطناعي للكتابة مباشرة في ~/.ssh/id_rsa، حيث يكتفي مربع حوار الموافقة بإظهار اسم الرابط الرمزي فقط دون المسار الحقيقي للملف.

AI · 3 دقيقة قراءة

مايكروسوفت: بناء وكلاء ذكاء اصطناعي جاهزين للتنفيذ يتطلب ما بين 26 إلى 60 أسبوع عمل هندسي

يحدد الدليل الجديد سبع ركائز معمارية — السلطة، والحدود، والمخططات، واكتشاف الفشل، والحالة، والتراجع، وقابلية التدقيق — والتي يجب إعادة بنائها من الصفر قبل إطلاق أي وكيل مستقل، مع التحذير من أن المهام ذات القيمة المنخفضة لن تبرر هذا الجهد المبذول.

AI · 3 دقيقة قراءة

تصنيف مستويات Claude يقلل تكاليف الـ API بنسبة 35% ويخفض زمن الاستجابة إلى 27 ثانية

قام المؤلف ببناء آلية بحث ثابتة تقوم بتوزيع المهام بناءً على درجة الغموض على نماذج Haiku أو Sonnet أو Opus، كما أضاف قاعدة تصعيد عند حدوث فشلين. وعلى مدار أربعة أسابيع، حافظ النظام على الجودة مع خفض تكاليف الـ API إلى 65% من القيمة الأصلية وتقليل متوسط وقت الإنجاز من 42 ثانية إلى 27 ثانية.

AI · 3 دقيقة قراءة

ثغرة FaceHugger RCE تتجاوز بوابة الثقة في Diffusers وتسمح بتنفيذ الكود عند تحميل النموذج

تستغل ثغرة FaceHugger حالة سباق (race condition) في التحميل ثنائية المراحل، مما يسمح بتشغيل كود خبيث يتم حقنه في الطلب الثاني حتى عند تعطيل خاصية `trust_remote_code`؛ مما يعرض مهام CI/CD والحاويات وخدمات الاستدلال في المؤسسات للخطر.

AI · 2 دقيقة قراءة

عداد بوابة واحدة أخفى انقطاعاً كاملاً للذكاء الاصطناعي في بيئة الإنتاج لمدة يوم كامل

كانت ميزة الذكاء الاصطناعي الخاصة بي متوقفة ليوم كامل، رغم أن المقياس كان يشير إلى أنها تعمل. بالأمس، سجل نظام الطائرات بدون طيار الخاص بي أربعة تفسيرات للذكاء الاصطناعي، لكن بوابة الأمان رفضت جميعها. شعرت بالرضا حيال ذلك...

AI · 2 دقيقة قراءة

خوادم MCP صغيرة ضمن الفئة المجانية تقدم ملفات Markdown باستهلاك 1-2 مللي ثانية من وحدة المعالجة المركزية على Cloudflare

تُظهر اختباراتنا أن خادم MCP للقراءة فقط الذي يعالج استدعاءات list و get_article يستخدم ما بين 0 إلى 2 مللي ثانية فقط من وحدة المعالجة المركزية لكل طلب، مما يبقيه تحت الحد الأقصى للفئة المجانية من Cloudflare بكثير، إلا أن أي عملية تحليل (parsing) فورية ستصل سريعاً إلى سقف الـ 10 مللي ثانية.

AI · 3 دقيقة قراءة

First Demo Satellite Set for Late 2027 to Deliver Up to 1 Tbps Downlink

EON’s 20-satellite low-Earth orbit constellation will use high-powered lasers and weather-diverse ground stations to deliver terabit-scale links on high-value routes like France-Australia, aiming to give AI-heavy customers dedicated, low-latency capacity.

AI · 4 دقيقة قراءة