GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

ผ่านไป 108 ตั๋วสนับสนุน: เวิร์กโฟลว์ AI Agent ของฉัน

ผ่านไป 108 ตั๋วสนับสนุน: เวิร์กโฟลว์ AI Agent ของฉัน ผมดูแลระบบประกันภัยที่มีอายุเก่าแก่ถึง 20 ปี ซึ่งมีโค้ดถึง 2.3 ล้านบรรทัด และมี PL/SQL package ถึง 1,000 ชุด เป็นเวลาเก้าเดือน ผมได้ใช้ AI ในการ...

AI · 4 min read

Cross-Modal AI Cuts Soft-Robot Maintenance Time 34% and Shrinks Model 60%

In a pilot plant, specialist teacher networks for vision, audio and language feed a compact multilingual student that fuses embeddings via contrastive learning. Quantization trims the student by 60%, letting it run on edge devices and slash maintenance cycles by a third.

AI · 3 min read

x402 ช่วยให้ AI Agents จ่ายค่า API ได้ในไม่กี่วินาทีด้วย Micro-Payments บนเชน

โปรโตคอล x402 เปลี่ยนสถานะ HTTP 402 ให้กลายเป็นตัวกระตุ้นการซื้อขายแบบเรียลไทม์ ช่วยให้เอเจนต์สามารถอ่านราคาจาก JSON, ลงนามในธุรกรรมบล็อกเชน และรับข้อมูลได้ทันทีภายในรอบการร้องขอเพียงครั้งเดียว โดยไม่จำเป็นต้องใช้ API key หรือการสมัครสมาชิกอีกต่อไป

AI · 3 min read

ภาระงาน AI จะต้องการพลังงานสูงถึง 1,000 TWh ภายในปี 2026 – ส่งผลให้โรงไฟฟ้าฟอสซิลแบบ Peaker มีแนวโน้มพุ่งสูงขึ้น

ภายในปี 2026 ศูนย์ข้อมูลที่ขับเคลื่อนด้วย AI จะใช้พลังงานประมาณ 1,000 TWh ซึ่งเทียบเท่ากับความต้องการพลังงานรายปีรวมกันของญี่ปุ่นและเยอรมนี ส่งผลให้ Microsoft, Google และ Amazon ต้องหันไปพึ่งพาพลังงานนิวเคลียร์ ในขณะที่คู่แข่งรายอื่นต่างเร่งหาแหล่งพลังงานน้ำและพลังงานความร้อนใต้พิภพราคาถูก เพื่อรักษาความเป็นมิตรต่อสิ่งแวดล้อมและควบคุมต้นทุนให้ต่ำ

AI · 3 min read

เซิร์ฟเวอร์ MCP โอเพนซอร์ส AgenticX พบช่องโหว่ Command-Injection ที่มีคะแนน CVSS สูงถึง 9.8

จากการสแกนไฟล์ซอร์สโค้ด 5,911 ไฟล์ ในเซิร์ฟเวอร์ MCP ระดับกลาง 24 แห่ง นักวิจัยด้านความปลอดภัยได้พบช่องโหว่ sandbox command-injection ใน AgenticX ซึ่งเปิดโอกาสให้ผู้โจมตีสามารถรันคำสั่ง shell ใดๆ เข้าไปยัง Docker container ได้ โดยช่องโหว่นี้ได้รับคะแนนความรุนแรง CVSS อยู่ที่ 9.8

AI · 3 min read

BYD HyWorldVLA ทำคะแนนได้ 90.59 PDMS บน NAVSIM v1

BYD HyWorldVLA ทำคะแนนได้ 90.59 PDMS บน NAVSIM v1 BYD ก้าวเข้าสู่ตลาดโมเดลพื้นฐานสำหรับการขับขี่อัตโนมัติ โดยโมเดลใหม่ของพวกเขา HyWorldVLA ทำคะแนนได้ 90.59 PDMS ในการทดสอบมาตรฐาน NAVSIM v1...

AI · 3 min read

วิธีการประยุกต์ใช้ AI ในอุตสาหกรรมการผลิตอิเล็กทรอนิกส์

วิธีการประยุกต์ใช้ AI ในอุตสาหกรรมการผลิตอิเล็กทรอนิกส์ เลิกสร้างโมเดล AI โดยไม่มีเหตุผล แต่ให้เริ่มจากปัญหาในกระบวนการผลิต โปรเจกต์ AI ที่ประสบความสำเร็จคือโปรเจกต์ที่สามารถแก้ปัญหาเฉพาะเจาะจงได้ ตัวอย่างเช่น...

AI · 3 min read

OpenAI’s GPT-5.6 Sol Hits 38.3% on ARC-AGI-3 Using Custom Responses API

OpenAI’s 38.3% success rate drops to 7.8% when the model is evaluated with the official ARC-AGI-3 harness, showing that its advantage comes from two inference-time tricks – retained reasoning and context compaction – baked into its proprietary Responses API.

AI · 4 min read

Tunix ของ Google ช่วยเพิ่มการใช้งาน TPU จากน้อยกว่า 10% เป็นเกือบเต็มประสิทธิภาพสำหรับการทำ Agentic RL

ด้วยการย้ายการปฏิสัมพันธ์กับสภาพแวดล้อมไปยัง CPU/GPGPU ราคาถูก และป้อนข้อมูลผ่านบัฟเฟอร์ที่มี throughput สูง Tunix ช่วยให้ TPU learner สามารถทำงานได้อย่างต่อเนื่อง เปลี่ยนการใช้งาน TPU ใน Agentic Reinforcement Learning ที่ปกติจะต่ำกว่า 10% ให้กลายเป็นการใช้งานที่เกือบเต็ม 100%

AI · 3 min read

Google เผย พบเพียง 21% ของงานที่ถูกเปลี่ยนเป็นระบบอัตโนมัติอย่างสมบูรณ์ จากการปฏิสัมพันธ์กับ AI กว่า 15 ล้านครั้ง

Google ระบุว่า AI เข้ามามีส่วนร่วมในงานเพียง 21% เท่านั้น จากการศึกษาการปฏิสัมพันธ์กับเครื่องมือ AI ของ Google จำนวน 15 ล้านครั้ง ผลลัพธ์แสดงให้เห็นถึงช่องว่างขนาดใหญ่ระหว่างการนำ AI มาใช้งานกับการทำงานจริงของ AI ข้อมูล: • Gem...

AI · 3 min read

CVE-2026-59726 ของ Ruflo AI ได้คะแนนเต็ม 10.0 – ต้องอัปเกรดเป็นเวอร์ชัน 3.16.3 ทันที

ช่องโหว่นี้เกิดจากการที่ Docker containers ของ Ruflo ผูก Model Context Protocol bridge เข้ากับอินเทอร์เฟซเครือข่ายทั้งหมด ซึ่งเปิดโอกาสให้ผู้โจมตีที่เชื่อมต่ออินเทอร์เน็ตสามารถรันโค้ดจากระยะไกล เข้าถึง API keys ของ LLM ได้อย่างสมบูรณ์ และสามารถทำให้หน่วยความจำของโมเดลเสียหายได้

AI · 3 min read

บั๊ก Lost-Update เปิดช่องให้เอเจนต์ตัวเดียวเขียนทับเอเจนต์อีกสี่ตัวได้โดยไม่รู้ตัว

จากการทดสอบเอเจนต์ที่ทำงานพร้อมกัน 5 ตัว พบว่าการเขียนข้อมูล 4 ครั้งหายไปอย่างเงียบเชียบ ส่งผลให้เสียโทเคนเท่ากับจำนวนงานที่สูญเสียไป การเพิ่มกลไก compare-and-set ช่วยให้สามารถรักษาข้อมูลที่ส่งเข้ามาได้ทั้งหมด แต่ทำให้การใช้โทเคนเพิ่มขึ้นจาก 5 เป็น 9 หน่วย

AI · 4 min read

นักพัฒนาสามารถตั้งเวลาทำงานของ Gemini Agents ได้เหมือนกับ Cron Jobs ในระดับ Free Tier แล้ว

การอัปเดตนี้เปิดตัวตัวควบคุมใหม่ 3 อย่างสำหรับนักพัฒนา ได้แก่ environment hooks เพื่อตรวจสอบการเรียกใช้เครื่องมือ, การจำกัดงบประมาณ (hard budget caps) เพื่อป้องกันค่าใช้จ่ายที่บานปลาย และการตั้งเวลาทำงาน (scheduled triggers) ที่เปลี่ยน API ให้กลายเป็น cron ขนาดเล็ก ในขณะที่ย้ายความรับผิดชอบด้านความปลอดภัยไปอยู่ที่ผู้ใช้งาน

AI · 2 min read

Anthropic ปลดล็อกขีดจำกัด Claude Code ด้วย Opus 5 ทำคะแนนได้ถึง 30% ใน Arc AGI Benchmark

ด้วยการลดการป้องกันใน system-prompt ลงถึง 80% ทำให้ Opus 5 ของ Anthropic ช่วยให้ Claude Code สามารถรักษาบริบทของตัวเองไว้ได้นานหลายวัน สามารถสร้าง codebase ที่สมบูรณ์ และต้านทานการโจมตีแบบ prompt-injection ได้ ส่งผลให้มันกลายเป็นผู้ช่วยพัฒนาซอฟต์แวร์แบบอัตโนมัติอย่างแท้จริง

AI · 3 min read