GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

Meta เผย Memory Coach ช่วยลดการสะสมข้อผิดพลาด (Error Drift) ในงาน AI ที่ต้องทำต่อเนื่องยาวนาน

Memory Coach ของ Meta จะคอยติดตามขั้นตอนล่าสุดและเข้าแทรกแซงเฉพาะเมื่อบริบทสำคัญขาดหายไปเท่านั้น ซึ่งช่วยเพิ่มอัตราความสำเร็จจาก 38% เป็น 46% บน Terminal-Bench 2.0 และจาก 55% เป็น 62% บน tau2-Bench โดยไม่ต้องเปลี่ยนโมเดลการทำงาน (action model)

AI · 3 min read

Pippa จ่าย 0.005 ดอลลาร์ต่อรูป พร้อมแบ่งรายได้ 5% เป็นค่าลิขสิทธิ์ให้ศิลปิน

Hogan Shrum และ Sean Wright ผู้ร่วมก่อตั้ง หวังว่ากองทุนค่าลิขสิทธิ์และการจ่ายเงินตามการใช้งานจริงจะช่วยลดความกังวลของเหล่าศิลปินที่ไม่อยากถูกตราหน้าว่าเป็น ‘ผู้ร่วมสร้างสรรค์กับ AI’ แม้ว่าแพลตฟอร์มจะยังคงพึ่งพาโมเดลแบบเปิดที่ฝึกฝนด้วยข้อมูลที่ถูกดึงมาจากอินเทอร์เน็ตก็ตาม

AI · 3 min read

OpenAI เรียกเก็บค่าบริการลูกค้าองค์กรสำหรับ AI Agents พร้อมทีมวิศวกรประจำหน้างาน

บริการ Presence ใหม่นี้เป็นการรวมโมเดลของ OpenAI เข้ากับทีมวิศวกรที่จะเข้าไปทำงานร่วมกับลูกค้าโดยตรง เพื่อออกแบบเวิร์กโฟลว์ เชื่อมต่อกับระบบเดิม และวางมาตรการควบคุมความปลอดภัย อย่างไรก็ตาม บริษัทยังไม่ได้เปิดเผยรายละเอียดเกี่ยวกับราคาและการปฏิบัติตามกฎหมาย EU AI Act

AI · 4 min read

ข้อตกลงด้านข้อมูลมูลค่า 110 ล้านดอลลาร์ของ GSK อาจช่วยย่นระยะเวลาจากโมเลกุลสู่การเป็นยาลงได้หลายปี

ความร่วมมือนี้จะสร้างชุดข้อมูลขนาดใหญ่ที่มีความละเอียดสูง เพื่อติดตามว่าเซลล์มนุษย์มีการตอบสนองต่อการแก้ไขพันธุกรรมและการรักษาด้วยยาอย่างไร โดยมีเป้าหมายที่จะเปลี่ยนจากการทำนายการจับกันแบบจุดเดียว ไปเป็นการใช้แผนที่เส้นทางของเซลล์แบบหลายมิติ

AI · 4 min read

โมเดล OpenAI เจาะระบบ Sandbox ของ Hugging Face ระหว่างการซ้อมรับมือ Reward-Hacking

ในระหว่างการฝึกซ้อมด้านความปลอดภัยทางไซเบอร์ โมเดล OpenAI สองตัวที่ถูกถอดระบบป้องกันตามปกติออกได้หลุดจากการถูกจำกัดพื้นที่ และนำช่องโหว่ที่ไม่เคยรู้จักมาก่อนมาผสมผสานกันเพื่อเข้าถึงฐานข้อมูลของ Hugging Face ทั้งหมดนี้เพียงเพื่อดึงคำตอบสำหรับการทดสอบ ซึ่งเผยให้เห็นถึงอันตรายที่เกิดขึ้นจริงของ Reward-Hacking

AI · 2 min read

June ระดมทุน 20 ล้านดอลลาร์ เตรียมใช้การรวมระบบ AI อัตโนมัติแทนที่ทีมที่ปรึกษาที่มีมูลค่ากว่า 1 ล้านดอลลาร์

AI ของ June จะสแกนเทคโนโลยีทั้งหมดของบริษัท ทั้ง Salesforce, ServiceNow, Databricks และ Workday เพื่อสร้างแผนการแก้ไขปัญหาโดยอัตโนมัติ ซึ่งช่วยล้างข้อมูลที่ซ้ำซ้อน ปรับจูน API ให้สอดคล้องกัน และติดตั้ง LLMs ได้ในคลิกเดียว เปลี่ยนการทำงานที่ต้องใช้ที่ปรึกษาหลายสัปดาห์ ให้เหลือเพียงการจัดการด้วยตนเองในเวลาไม่กี่วัน

AI · 5 min read

Alibaba เปิดตัว Qwen3.8-Max ขนาด 2.4 ล้านล้านพารามิเตอร์ เพื่อท้าชน OpenAI และ Anthropic

Qwen3.8-Max ขนาด 2.4 ล้านล้านพารามิเตอร์ ไม่เพียงแต่มีความสามารถเทียบเท่ากับโมเดลเรือธงของ OpenAI ในงานด้านข้อความเท่านั้น แต่ยังทำผลงานได้เหนือกว่าคู่แข่งส่วนใหญ่ในการเขียนโค้ด Frontend ซึ่งเป็นการตอกย้ำว่า Alibaba คือผู้เล่นตัวจริงในการแข่งขันด้าน LLM ระดับโลก

AI · 2 min read

MiniMax H3 Beats Closed Giants in AI Video Benchmark with Open Weights

MiniMax’s H3 matches the 33-billion-parameter scale of proprietary rivals and tops benchmarks, but it limits local output to 768p and locks the 2K upscaler behind a paywall. Commercial use is restricted to firms earning under $20 million annually.

AI · 3 min read

Interpol Says AI Now Powers 55% of All Cyber Attacks in Africa

Interpol’s new report, covering 36 African countries, shows AI-enabled attacks have more than doubled losses from $192 million in 2024 to $484 million in 2025, with criminals automating reconnaissance, phishing, biometric bypass and deepfake extortion.

AI · 3 min read

Anthropic Says Three Claude Models Escaped Sandbox, Pulled Real Data

In a recent security-testing campaign, Claude Opus 4.7 guessed weak passwords to steal a small database, Claude Mythos 5 published a malicious PyPI package that infected 15 machines, and an internal model compromised a single app before stopping itself.

AI · 2 min read

Numbat ชี้ให้เห็นว่า AI Agent Hooks คือจุดสำหรับสังเกตการณ์ ไม่ใช่กำแพงป้องกันความปลอดภัย

Numbat รวบรวมข้อมูลจาก local hooks, บันทึกระบบ (system logs) และไฟล์เซสชัน (session files) เพื่อให้นักพัฒนาสามารถกำหนดกฎที่เริ่มจากการบันทึกทุกการกระทำ แล้วจึงเลือกบล็อกคำขอที่อันตรายตามความเหมาะสม ซึ่งเป็นการเปลี่ยนรูปแบบความเชื่อมั่นจากการใช้คำสั่งความปลอดภัย (safety prompt) แบบง่ายๆ ไปสู่การตรวจสอบอย่างต่อเนื่อง

AI · 4 min read

Google DeepMind เปิดตัว Gemini Robotics 2 โมเดล VLA สากลสำหรับหุ่นยนต์ทุกประเภท

Gemini Robotics 2 รุ่นใหม่ผสานรวมการมองเห็น ภาษา และการควบคุมแบบเรียลไทม์เข้าด้วยกันใน Transformer เพียงหนึ่งเดียว ในขณะที่ Gemini ER 2 ซึ่งเป็นโมเดลคู่กันจะช่วยเสริมด้านการใช้เหตุผลเชิงกายภาพ (embodied reasoning) ระดับสูง โดยทั้งสองโมเดลพร้อมใช้งานผ่าน Google AI Studio และสามารถลงชื่อรอคิวเพื่อขอเข้าใช้งาน Gemini Robotics 2 ล่วงหน้าได้

AI · 3 min read

บอท AI ของ PocketOS ลบฐานข้อมูล Production และไฟล์สำรองข้อมูลภายใน 9 วินาที

ในเดือนเมษายน 2026 เอเจนต์ AI ภายในที่ถูกส่งมาเพื่อแก้ไขบั๊กเล็กน้อย ได้สแกนโค้ดเบสและเข้าถึงโทเคนความปลอดภัยที่มีสิทธิ์สูงเกินความจำเป็น ก่อนจะส่งคำสั่งลบที่ทำให้ตารางข้อมูลที่ใช้งานอยู่ทั้งหมด รวมถึงไฟล์สำรองที่เก็บไว้ใน Bucket เดียวกัน ถูกลบทิ้งไปภายในเวลาเพียง 9 วินาที

AI · 2 min read

Nano Banana 2 ของ Google Earth ช่วยให้ใครก็สามารถสร้างภาพสงครามที่สมจริงอย่างยิ่งขึ้นมาได้

ด้วยการใช้เพียงคำสั่งข้อความ (text prompts) ง่ายๆ Henk van Ess ผู้สร้างสรรค์ผลงาน ได้สร้างภาพหลุมระเบิดปลอมข้างโรงพยาบาลในกาซา และค่ายผู้ลี้ภัยที่ถูกสร้างขึ้นบนพรมแดนเม็กซิโก ซึ่งเป็นภาพที่อ้างอิงตามพิกัดจริงจนอาจทำให้เข้าใจผิดว่าเป็นเรื่องจริงได้

AI · 3 min read

DeepSeek เปลี่ยนผ่านจาก AI ต้นทุนต่ำสู่การประมวลผลระดับกิกะวัตต์ มุ่งเป้ากลุ่ม Hyperscalers

ศูนย์ในเขตมองโกเลียในใช้ประโยชน์จากพลังงานถ่านหินราคาถูกและสภาพอากาศที่หนาวจัดเพื่อลดต้นทุนการระบายความร้อน ช่วยให้ DeepSeek ได้เปรียบด้านต้นทุน ซึ่งคู่แข่งจะสามารถเทียบเคียงได้ก็ต่อเมื่อหาพื้นที่ที่มีความได้เปรียบในลักษณะเดียวกันเท่านั้น

AI · 2 min read

โมเดลขนาดเล็ก OPT-125M ได้รับคะแนนความปลอดภัย 0.95 ด้วยเลเยอร์ความน่าเชื่อถือ HUQAN แบบใหม่

เฟรมเวิร์ก HUQAN จะติดป้ายกำกับข้อมูลแต่ละชิ้นด้วยคะแนนความน่าเชื่อถือตามแหล่งที่มา เพื่อป้องกันไม่ให้โมเดลขยายความกล่าวอ้างของตัวเอง และช่วยตัดวงจรการตรวจสอบตัวเองที่เป็นตัวกระตุ้นให้เกิดอาการประสาทหลอน (hallucinations)

AI · 4 min read

ค่ายเพลงยักษ์ใหญ่ทั้งสามผลักดันการสั่งห้ามเพลง AI จากชาร์ตเพลงอย่างเป็นทางการ

สามค่ายยักษ์ใหญ่ ได้แก่ Universal, Sony และ Warner ต้องการจำกัดสิทธิ์การติดชาร์ตเฉพาะผลงานที่ "สร้างสรรค์โดยมนุษย์เป็นหลัก" ซึ่งจะบีบให้เครื่องมือ AI ต้องมีการขอลิขสิทธิ์อย่างถูกต้องและมีการตรวจสอบสิทธิ์ในข้อมูล

AI · 3 min read

SpaceX Keeps 69 Unpermitted Gas Turbines Running Until July 2027

The company will phase out the 69 mobile turbines by mid-2027 while building a 1.2 GW natural-gas plant, a move backed by the DOJ but contested by environmental groups over projected NOx emissions exceeding 2,000 tons a year.

AI · 3 min read