GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

xAI เปิดซอร์สโค้ด Grok Build เพียงสองวันหลังจากนักวิจัยเปิดเผยเรื่องการรั่วไหลของข้อมูลแบบเงียบๆ

คลังเก็บข้อมูล Apache-2.0 ที่เพิ่งเผยแพร่ยังคงมีขั้นตอนการดึงข้อมูลออกซ่อนอยู่ภายใต้แฟล็กฝั่งเซิร์ฟเวอร์ที่ถูกปิดบังไว้ และยังรวมถึงชิ้นส่วนโค้ดจาก OpenAI ที่ไม่ได้ระบุที่มา ซึ่งหมายความว่านักพัฒนาจำเป็นต้องตรวจสอบเครื่องมือนี้และเปลี่ยนข้อมูลประจำตัว (credentials) ใดๆ ที่อาจถูกเปิดเผย

AI · 3 min read

Neko Health ระดมทุน 700 ล้านดอลลาร์ เพื่อเปิดตัวคลินิกป้องกันโรคที่ขับเคลื่อนด้วย AI ในนิวยอร์ก

การระดมทุนระดับ Series C นำโดย Lightspeed Venture Partners จะนำไปใช้เป็นทุนสำหรับคลินิกหลักของ Neko ในนิวยอร์ก ซึ่งเป็นการผสานเทคโนโลยีการสร้างภาพความละเอียดสูง การตรวจเลือด และเซนเซอร์ที่เป็นกรรมสิทธิ์เฉพาะเข้ากับ AI เพื่อช่วยให้แพทย์สามารถตรวจพบสัญญาณบ่งชี้โรคได้ก่อนที่จะเริ่มมีอาการ

AI · 4 min read

งานวิจัยด้าน Interpretability ของ Anthropic อาจช่วยเสริมความแข็งแกร่งให้กับการนำเสนอประเมินมูลค่าบริษัทที่ 1 ล้านล้านดอลลาร์

การศึกษานี้แสดงเพียงแผนผังการทำงาน (activation maps) บางส่วนที่มีความสัมพันธ์กับงานบางประเภทเท่านั้น ซึ่งยังไม่สามารถพิสูจน์ความเป็นเหตุเป็นผลได้ แม้จะเป็นสัญญาณของการก้าวไปสู่ความโปร่งใส แต่นักพัฒนาต้องมองว่าสิ่งนี้เป็นเพียงเครื่องมือวินิจฉัยในระยะเริ่มต้น ไม่ใช่การรับประกันความปลอดภัย

AI · 3 min read

สำนักงานลิขสิทธิ์ไม่อนุญาตให้จดลิขสิทธิ์ภาพที่สร้างโดย AI แต่ยังคงคุ้มครองข้อความและเลย์เอาต์ของผู้เขียน

สำนักงานลิขสิทธิ์สหรัฐฯ ตัดสินว่ารูปภาพที่สร้างโดย Midjourney สำหรับนิยายภาพไม่สามารถรับความคุ้มครองทางลิขสิทธิ์ได้ แต่ยังคงให้ความคุ้มครองแก่งานเขียนและรูปแบบการจัดวางช่องภาพของผู้เขียน ซึ่งเป็นการเน้นย้ำถึงความสำคัญของการมีหลักฐานยืนยันการสร้างสรรค์โดยมนุษย์

AI · 3 min read

CodeQL 2.26.0 เพิ่ม Query สำหรับตรวจจับ Prompt-Injection – สร้าง CI Regression Fixture เพื่อป้องกันความเสี่ยง

Query ของ CodeQL ที่มีมาให้ในตัวจะแจ้งเตือนการไหลของข้อมูลจากแหล่งที่ไม่น่าเชื่อถือ (เช่น เนื้อหาใน GitHub issue) ไปยัง SDK ที่ใช้เรียกโมเดล การรวมไฟล์ทดสอบทั้งแบบ positive และ negative เข้ากับข้อกำหนด expected-alerts.json จะช่วยให้คุณเปลี่ยนการตรวจจับนั้นให้กลายเป็นด่านตรวจ (gate) ในขั้นตอนการ build ได้

AI · 4 min read

การโจมตีแบบ Cache Side-Channel สามารถขโมยข้อมูลจากโมเดล AI ที่กำลังทำงานอยู่ได้

ด้วยการตรวจสอบจังหวะเวลาการอ่าน/เขียนแคช ผู้โจมตีสามารถคาดการณ์ได้ทั้งข้อมูลนำเข้าและบางส่วนของค่าน้ำหนัก (weights) ที่โมเดลเรียนรู้ ซึ่งเป็นช่องโหว่ที่ยังคงอยู่แม้จะมีการใช้โค้ดแบบ constant-time หรือการเข้ารหัสโมเดลก็ตาม

AI · 3 min read

นักพัฒนาเผยหลังใช้เวลาดีบั๊กหลายชั่วโมง AI Agent ยังคงต้องการ Full Engineering Stack แบบครบวงจร

จากการทดลองใช้งานจริง นักพัฒนาใช้เวลาหลายชั่วโมงในการเชื่อมต่อ LLMs, memory layers, planners และการรวมเครื่องมือต่างๆ เข้าด้วยกัน แต่กลับต้องรับมือกับปัญหาการหลอน (hallucinations), การลองซ้ำไม่สิ้นสุด และต้นทุนของ token ซึ่งพิสูจน์ให้เห็นว่าการสร้างระบบที่มีความสามารถในการทำงานด้วยตัวเองอย่างแท้จริงนั้น ยังคงต้องอาศัยการประกอบขึ้นด้วยมือ

AI · 2 min read

Electron 42.6.0 (Downstream) แก้ไขปัญหา Message-Box แครชบน Linux

ผู้ดูแลเวอร์ชัน downstream ได้จัดลำดับการเรียกใช้งาน GTK สองรายการใหม่ เพื่อป้องกันการเกิด null-pointer dereference ซึ่งเป็นสาเหตุให้แอป Electron ที่ใช้ Qt บน Linux เกิด segmentation faults แม้ว่าการเปลี่ยนแปลงแบบเดียวกันนี้จะอยู่ใน Pull Request (PR) ของ upstream ที่ยังเปิดอยู่ แต่ผู้ใช้สามารถใช้งานการแก้ไขนี้ได้แล้วในเวอร์ชัน 42.6.0

AI · 2 min read

Honcho เปลี่ยนจากการใช้เซสชัน DB แบบเปิดค้างไว้นานมาเป็นแบบระยะสั้น เพื่อลดความหน่วงของ LLM

ทีม Honcho พบว่าการเปิดการเชื่อมต่อฐานข้อมูลค้างไว้ในระหว่างที่รอการเรียกใช้งาน LLM หรือ embedding ที่ล่าช้า อาจทำให้เกิดการดึงทรัพยากรใน connection pool ไปใช้มากเกินไป การเปลี่ยนมาใช้วิธีอ่านข้อมูลล่วงหน้า (pre-flight reads) แล้วปิดเซสชันลง จากนั้นจึงค่อยเปิดใหม่เฉพาะเมื่อต้องการเขียนข้อมูลเท่านั้น ช่วยให้พวกเขาสามารถลดความหน่วงและเพิ่มความสามารถในการขยายระบบ (scalability) ได้ดียิ่งขึ้น

AI · 1 min read

Microsoft สั่งทีมขายให้ลดบทบาท OpenAI และ Anthropic พร้อมผลักดัน AI Stack ของตัวเอง

Microsoft ปรับกลยุทธ์เพื่อนำทีมขายมาแข่งขันกับ OpenAI และ Anthropic โดย Microsoft กำลังเปลี่ยนแนวทางการทำตลาดครั้งสำคัญ จากเดิมที่เป็นพันธมิตรที่ใกล้ชิดกับผู้บุกเบิกด้าน AI...

AI · 2 min read

Qwen 3.6 35B-A3B Beats Four Rivals on RTX 5090 in Real-World Code Edit

The benchmark ran five agents on a single RTX 5090, tasking them with adding a Tag Manager to an admin panel without any cloud APIs. Qwen 3.6 35B-A3B completed the job autonomously, added sensible improvements, and required zero post-run patches.

AI · 3 min read

AWS เปิดตัว Claude Apps Gateway แบบ Self-Hosted เพื่อการควบคุมระดับองค์กร

Claude Apps Gateway จะฝังส่วนควบคุม (control plane) ไว้ในบัญชี AWS ของลูกค้า ช่วยให้ฝ่าย IT สามารถจัดการตัวตน บันทึกการตรวจสอบ และค่าใช้จ่ายได้จากหน้าจอเดียว ในขณะที่นักพัฒนาสามารถเริ่มใช้งานเซสชันที่ขับเคลื่อนด้วย Claude ได้โดยไม่ต้องกังวลเรื่องการเปิดเผยข้อมูลออกสู่ภายนอก

AI · 2 min read

เครื่องมือตรวจจับ Attention Sink เผยการตัดโทเค็น BOS ทำให้ประสิทธิภาพของ LLM ลดลงอย่างรุนแรง

ตัวตรวจจับจะบันทึกค่าคะแนน attention ดิบจากทุก head แล้วรวบรวมข้อมูลในระดับเลเยอร์ พร้อมใช้การทดสอบ log-MAD เพื่อระบุโทเค็นที่ดึงดูดความสนใจส่วนใหญ่ไป การนำโทเค็น "sink" เหล่านี้ออกจาก KV cache จะทำให้การสร้างข้อความขาดความเสถียรและคุณภาพลดลงอย่างมาก

AI · 3 min read

ร่างกฎหมายของ EU อาจบังคับให้มีการสแกนแชท AI เพื่อหาเนื้อหาที่ผิดกฎหมาย

ข้อเสนอนี้ขยายขอบเขตของกฎการกรองข้อความที่มีอยู่เดิมให้ครอบคลุมถึงบริการใดก็ตามที่มีการแลกเปลี่ยนข้อความระหว่างบุคคล ซึ่งหมายความว่าผู้ให้บริการ AI จะต้องนำทุกคำสั่ง (prompt) ของผู้ใช้ผ่านเครื่องมือสแกนอัตโนมัติก่อนที่โมเดลจะได้รับข้อมูลนั้น

AI · 4 min read

OpenAI เปิดตัว Codex Micro คีย์บอร์ดราคา 230 ดอลลาร์ สำหรับเอเจนต์เขียนโค้ดที่ขับเคลื่อนด้วย AI

Codex Micro มาพร้อมกับปุ่ม Agent Keys แบบมีไฟ, ปุ่มลัดที่ตั้งโปรแกรมได้, จอยสติ๊ก และ Reasoning Dial ซึ่งทั้งหมดจะเชื่อมต่อโดยตรงกับแอป ChatGPT บนเดสก์ท็อป เพื่อให้นักพัฒนาสามารถตรวจสอบและควบคุมเอเจนต์ AI หลายตัวได้โดยไม่ต้องออกจาก IDE

AI · 3 min read

เอเจนต์ AI บน AWS Lambda จ่ายค่า Cold Start แพงกว่าค่า Compute

การรันเอเจนต์ AI บน Lambda อาจดูเหมือนมีราคาถูกเมื่อคิดตามหน่วยมิลลิวินาที แต่ค่าใช้จ่ายที่แท้จริงมาจากความหน่วงในช่วง Cold Start, ลูปการลองใหม่ (retry loops) ที่กระตุ้นให้เกิดการเรียกใช้โมเดลหลายครั้ง และการใช้ Token ที่ตามมาซึ่งมีมูลค่าสูงกว่าค่า Compute อย่างมหาศาล

AI · 3 min read

BrassCoders Finds Hard-Coded Secrets in 2 of 15 AI-Generated Python Scripts

The two vulnerable scripts—one embedding an HMAC signing key, the other a plain-text SMTP password—demonstrate how LLMs fill in missing values when asked for a “usable example,” turning handy snippets into credential leaks across version control and production.

AI · 4 min read

วิศวกรจาก Ode มุ่งเป้าที่จะยุติสภาวะ ‘Pilot Purgatory’ ของ AI ในระดับองค์กร

Ode ร่วมกับ Anthropic ก่อตั้งโดย Chris Taylor และ Eddie Siegel โดยเป็นการผสานกลุ่มบุคลากรที่มีความสามารถของ Fractional AI เข้ากับโมเดล Claude ของ Anthropic พร้อมได้รับการสนับสนุนจาก Blackstone, Hellman & Friedman และ Goldman Sachs เพื่อเปลี่ยนการพิสูจน์แนวคิด (proof-of-concepts) ให้กลายเป็นระบบ AI ที่ใช้งานได้จริงในระดับการผลิต

AI · 3 min read

Thinking Machines ร่วมมือกับ Nvidia เพื่อฝึกฝน Inkling บนฮาร์ดแวร์ GB300 NVL72

Inkling ซึ่งผ่านการฝึกฝนด้วยโทเคนแบบมัลติโมดัลจำนวน 45 ล้านล้านโทเคน มอบประสิทธิภาพการเขียนโค้ดในระดับเดียวกับ Nvidia โดยใช้พารามิเตอร์เพียงเศษเสี้ยวจากทั้งหมด 9.75 แสนล้านพารามิเตอร์ ช่วยลดความหน่วงและต้นทุนการดำเนินงานสำหรับผู้ใช้งานระดับองค์กร

AI · 2 min read

OpenAI เปิดตัว GPT-Red ลดอัตราความสำเร็จของการโจมตีแบบจำลองจาก 90% เหลือเพียง 23%

ระบบ 'dojo' แบบ self-play ช่วยให้ GPT-Red ทำหน้าที่เป็นผู้โจมตี ในขณะที่โมเดลฝั่งป้องกันจะเรียนรู้วิธีการป้องกัน ซึ่งช่วยเผยเทคนิคใหม่ๆ เช่น การโจมตีแบบ fake chain-of-thought ที่หลอกล่อให้ LLM ยอมรับสมมติฐานที่ผิดพลาด

AI · 2 min read