GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

xAI משחררת את Grok כקוד פתוח יומיים לאחר שחוקרים חשפו דליפות נתונים שקטות

מאגר ה-Apache-2.0 שפורסם לאחרונה עדיין מכיל את שגרת הוצאת הנתונים מאחורי דגל נסתר בצד השרת, ואף כולל קטעי קוד לא מיוחסים מ-OpenAI, מה שמחייב מפתחים לבצע ביקורת לכלי ולהחליף כל פרטי גישה שנחשפו.

AI · 3 min read

Neko Health מגייסת 700 מיליון דולר להשקת מרפאה מונעת מבוססת בינה מלאכותית בניו יורק

גיוס הכספים מסבב C, בהובלת Lightspeed Venture Partners, יממן את מרפאת הדגל של Neko בניו יורק, המשלבת דימות ברזולוציה גבוהה, בדיקות דם וחיישנים קנייניים עם בינה מלאכותית, ובכך מאפשרת לקלינאים לזהות סימנים מקדימים למחלה עוד לפני הופעת התסמינים.

AI · 4 min read

התקפות ערוץ צדדי (Side-Channel) של זיכרון מטמון יכולות לגנוב נתונים ממודלי AI הפועלים

באמצעות ניטור זמני הקריאה והכתיבה של זיכרון המטמון, תוקפים יכולים להסיק הן על נתוני הקלט והן על חלקים ממשקלי המודל שנלמדו, פגיעות שנותרת קיימת גם בשימוש בקוד בזמן קבוע (constant-time) או בהצפנת המודל.

AI · 3 min read

סוכני AI עדיין זקוקים למחסנית הנדסית מלאה, אומר מפתח לאחר שעות של ניפוי שגיאות

בניסוי מעשי, מפתח בילה מספר שעות בחיבור של מודלי שפה (LLMs), שכבות זיכרון, מתכננים ואינטגרציות של כלים, רק כדי להיאבק בהזיות, ניסיונות חוזרים אינסופיים ועלויות טוקנים — מה שמוכיח שאוטונומיה אמיתית היא עדיין תהליך בנייה ידני.

AI · 2 min read

Downstream Electron 42.6.0 Stops Linux Message-Box Crashes

The downstream maintainer reordered two GTK calls, preventing a null-pointer dereference that caused segmentation faults for Qt-based Electron apps on Linux. The same change sits in an open upstream PR, but users get the fix now with version 42.6.0.

AI · 2 min read

Honcho Swaps Long-Lived DB Sessions for Short Ones to Cut LLM Latency

The Honcho team discovered that keeping a database connection open while waiting on slow LLM or embedding calls can hog the connection pool. By moving to pre-flight reads, closing the session, and reopening only for writes, they reduced latency and improved scalability.

AI · 1 min read

OpenAI משיקה את מקלדת Codex Micro ב-$230 עבור סוכני תכנות מבוססי AI

ה-Codex Micro כוללת מקשי Agent מוארים, קיצורי דרך ניתנים לתכנות, ג'ויסטיק וגלגל חשיבה (Reasoning Dial), שכולם מתחברים ישירות לאפליקציית שולחן העבודה של ChatGPT כדי לאפשר למפתחים לנטר ולכוון מספר סוכני AI מבלי לעזוב את ה-IDE שלהם.

AI · 3 min read

AWS Lambda AI Agents Pay More for Cold Starts Than Compute

Running an AI agent on Lambda may look cheap by the millisecond, but the real expense comes from cold-start latency, retry loops that trigger multiple model calls, and the resulting token consumption that dwarfs the compute charge.

AI · 3 min read

OpenAI משימה את GPT-Red, ומפחיתה את שיעור ההצלחה של התקפות סימולציה מ-90% ל-23%

ה-'dojo' של משחק עצמי מאפשר ל-GPT-Red לפעול כתוקף בזמן שמודלים מגינים לומדים טכניקות הגנה, מה שחושף טריקים חדשניים כמו מתקפת "שרשרת מחשבה" (chain-of-thought) מזויפת, המרמה מודלי שפה גדולים (LLMs) לקבל הנחות שגויות.

AI · 2 min read