GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

Google และ Anthropic เตือน ReAct Agents อาจทำให้งบประมาณคลาวด์บานปลาย

ลูปแบบ ReAct ช่วยให้โมเดลสามารถเลือกขั้นตอนการทำงานได้ด้วยตัวเอง แต่ในแต่ละรอบของ Thought-Action-Observation จะมีการคิดค่าใช้จ่ายในการประมวลผล (inference) เพิ่มขึ้น ซึ่งจะส่งผลให้ความหน่วงสะสมมากขึ้น และเพิ่มความเสี่ยงที่การตีความผิดพลาดเพียงครั้งเดียวจะทำให้งานทั้งหมดล้มเหลว

AI · 3 min read

Google ชี้ว่ารูปแบบ Swarm Agent คือการออกแบบ AI ที่ทรงพลังที่สุด แต่ก็มีต้นทุนสูงที่สุดด้วยเช่นกัน

ระบบ Swarm จะเปลี่ยนจากการใช้ผู้ควบคุมเพียงหนึ่งเดียว มาเป็นเครือข่ายของเอเจนต์ในระดับเดียวกันที่คอยวิพากษ์วิจารณ์กันเองอย่างต่อเนื่อง อย่างไรก็ตาม ทุกการสื่อสารจะทำให้เกิดการเรียกใช้โมเดลแยกกัน ซึ่งส่งผลให้ต้นทุนการประมวลผลและความหน่วงเพิ่มสูงขึ้นอย่างมหาศาล

AI · 3 min read

Agentic Retrieval ช่วยลดต้นทุนการสอบถามได้สูงสุดถึง 82 เท่า เมื่อเทียบกับ RAG แบบดั้งเดิม

เอเจนต์จะทำการเขียนคำสั่งสอบถามใหม่ ตัดสินใจว่าจำเป็นต้องค้นหาข้อมูลหรือไม่ แบ่งคำถามที่ซับซ้อนออกเป็นขั้นตอนย่อยๆ และแก้ไขตัวเองเมื่อหลักฐานไม่เพียงพอ พร้อมทั้งระบุแหล่งอ้างอิงสำหรับทุกข้อกล่าวอ้าง และช่วยลดการใช้ Token ลงอย่างมหาศาล

AI · 3 min read

TikTok เปิดตัวเครื่องมือตรวจจับ Deepfake ด้วย AI ในช่วงทดลองใช้งานสำหรับครีเอเตอร์ในสหรัฐฯ

บริการแบบสมัครใจนี้จะมอบแดชบอร์ดให้แก่กลุ่มครีเอเตอร์ในสหรัฐฯ จำนวนหนึ่ง เพื่อแสดงรายการวิดีโอหรือรูปภาพที่ AI ตรวจพบว่ามีลักษณะใบหน้าตรงกับข้อมูลที่ได้รับการยืนยันแล้วของพวกเขา หลังจากที่ผู้ใช้ผ่านขั้นตอนการยืนยันตัวตนด้วยการถ่ายเซลฟี่และตรวจสอบบัตรประชาชนผ่าน Jumio ซึ่งเป็นขั้นตอนที่มีความเข้มงวดสูง

AI · 1 min read

COS API ใหม่ ช่วยให้เบราว์เซอร์แชร์โมเดล AI ขนาด 33 GB ข้ามเว็บไซต์ได้

ด้วยการเปลี่ยนจากการค้นหาผ่าน URL มาเป็นการใช้ content-addressed hashes ทำให้ COS API ช่วยให้เว็บไซต์ต่างๆ สามารถร้องขอไฟล์ที่ทราบค่า SHA-256 อยู่แล้วได้ ซึ่งช่วยให้เบราว์เซอร์สามารถส่งโมเดล AI ขนาด 33 GB ตัวเดียวกันไปยังหลายต้นทาง (origins) ได้โดยไม่ต้องดาวน์โหลดใหม่

AI · 2 min read

Linear-Scale Transformers ช่วยลดการใช้หน่วยความจำของโมเดลโปรตีนจากแบบ Quadratic เป็น Linear

สถาปัตยกรรมใหม่นี้สามารถประมวลผลสายกรดอะมิโนที่มีความยาวนับพันตัวได้ในการประมวลผลเพียงรอบเดียว โดยยังคงรักษาปฏิสัมพันธ์ระยะไกลไว้ได้ ช่วยให้การฝึกฝนบนคลังข้อมูลลำดับขนาดใหญ่ทำได้รวดเร็วและประหยัดยิ่งขึ้น

AI · 2 min read

AWS Deploys x402 ‘AgentCore Payments’ to Auto-Bill AI Calls on Bedrock

The new x402 protocol embeds a payment token in each HTTP request, letting AI agents automatically deduct fees for data, compute or API calls. AWS’s Bedrock integration, called AgentCore Payments, adds built-in wallets and spend caps for seamless machine commerce.

AI · 3 min read

WebMCP ของ Chrome ช่วยให้แอป React สามารถเปิดใช้งานเครื่องมือแบบ Typed Tools ให้กับ AI Agents ได้โดยตรง

WebMCP เข้ามาแทนที่การทำ DOM-scraping ที่เปราะบาง ด้วยการใช้ manifest ของการเรียกใช้เครื่องมือแบบ typed ที่ React components ลงทะเบียนไว้ตั้งแต่ตอน mount ช่วยให้ AI agents บน Chrome 149+ สามารถโต้ตอบได้อย่างรวดเร็วโดยไม่ขึ้นกับโครงสร้างเลย์เอาต์

AI · 3 min read

Carebricks Agents เตรียมนำระบบอัตโนมัติมาใช้ในการสั่งตรวจแล็บและวางแผนการดูแลรักษา หลังระดมทุนได้กว่า 55 ล้านดอลลาร์

ด้วยการสนับสนุนจาก Sequoia, Felicis, Optum Ventures และ Y Combinator ทาง Bunkerhill วางแผนที่จะเริ่มทดลองใช้งาน Carebricks agents ซึ่งเป็นซอฟต์แวร์ที่สามารถดึงข้อมูล EHR, สั่งตรวจแล็บ และอัปเดตแผนการดูแลรักษา เพื่อมุ่งหวังที่จะช่วยลดภาระงานด้านการประสานงานประจำวันของบุคลากรทางการแพทย์

AI · 2 min read

MCP v2 ตัดการใช้งาน Handshakes และ Session IDs เพื่อรองรับการขยายตัวแบบ Serverless อย่างแท้จริง

MCP เวอร์ชัน 2 ซึ่งจะเริ่มใช้งานในวันที่ 28 กรกฎาคม 2026 จะยกเลิกการใช้งาน initialize handshake, header Mcp-Session-Id และระบบย่อยแบบเก่าอีก 3 ระบบ ทำให้โปรโตคอลนี้เป็นแบบ stateless อย่างสมบูรณ์ ช่วยให้ทีมงานสามารถรันบน pods แบบ autoscaled หรือ serverless ได้โดยไม่มีข้อจำกัดเรื่อง session-affinity

AI · 3 min read

Google Gemma-4 31B Passes Token Match on AWS Inferentia Yet Spews Gibberish

The Inferentia2 INF2.24xlarge reproduced the exact token stream of the CPU reference, but both runs fed a malformed prompt lacking the chat template and turn markers, sending Gemma-4 into an infinite loop of nonsense. The hardware merely echoed a bug in the reference code.

AI · 3 min read

Solo Researcher Cuts LLM Agent Bill 31% to $651 by Logging Every Token

By adding a PostgreSQL logging layer that captured model name, token count, task type, and per-call cost, the researcher identified that raw SEC search results were inflating prompts. Summarizing those results and routing simple checks to a cheaper model drove the 31% savings and nudged accuracy up

AI · 3 min read

Linus Torvalds ให้ทางเลือกเดียวแก่ผู้วิจารณ์: จะ Fork Linux หรือจะยอมรับ AI

Torvalds กล่าวผ่าน mailing list ว่าใครก็ตามที่คัดค้านเครื่องมือ AI อย่าง Sashiko reviewer ตัวใหม่ สามารถเลือก fork kernel ได้เลย ซึ่งเป็นการตอกย้ำมุมมองของเขาที่ว่าคุณค่าทางเทคนิคมีความสำคัญเหนือกว่าการต่อต้านทางอุดมการณ์

AI · 2 min read

CLI โอเพนซอร์สของ Grok Build ช่วยให้คุณสลับโมเดลและตรวจสอบทุกคำสั่ง Shell ได้

เรโพนี้มาพร้อมกับซอร์สโค้ดภาษา Rust สำหรับ CLI, terminal UI และ runtime ซึ่งช่วยให้คุณตรวจสอบวิธีการประกอบบริบท การจัดการเครื่องมือ และการจัดการการแก้ไขต่างๆ ได้อย่างละเอียด และยังสามารถเปลี่ยนโมเดลพื้นฐานได้โดยไม่กระทบต่อเวิร์กโฟลว์การทำงาน

AI · 4 min read

Kimi K3 ของ Moonshot เอาชนะ GPT-5.6 ในการทดสอบ AA-Briefcase ด้วยคะแนน 1,527 ต่อ 1,495

Kimi K3 ของ Moonshot AI ซึ่งเป็นโมเดลแบบ open-weight ที่มีพารามิเตอร์ 2.8 ล้านล้านตัว ทำคะแนนได้สูงกว่า GPT-5.6 ในการทดสอบมาตรฐาน AA-Briefcase ที่ใช้งานจริง โดยขณะนี้เปิดให้ใช้งานผ่าน API แล้ว และมีกำหนดจะปล่อย weights ให้สาธารณะใช้งานในวันที่ 27 กรกฎาคมนี้

AI · 2 min read

Claude Code, Cursor 2.0 และ OpenAI Codex เปลี่ยน IDE ให้กลายเป็นศูนย์ควบคุมแบบ Full-Stack

เวอร์ชันล่าสุดมาพร้อมกับฟีเจอร์การจัดการลำดับงาน (task orchestration), ขั้นตอนการอนุมัติ (approval workflows), ระบบทดสอบ (testing rigs) และการท่องเว็บที่เข้าใจ UI (UI-aware browsing) ซึ่งช่วยให้ AI สามารถเลือกตั๋วงาน, รันเอเจนต์อัตโนมัติ, รับการอนุมัติจากมนุษย์ และส่งมอบตัวอย่างภาพ (visual previews) ได้ทั้งหมดจากคอนโซลเดียว

AI · 3 min read

Meta เปิดตัว Muse Spark 1.1 API ในราคา $1.25/$4.25 ต่อล้านโทเคน

บริการนี้เปิดให้ใช้งานเฉพาะนักพัฒนาในสหรัฐอเมริกาเท่านั้น โดยคิดค่าบริการ $1.25 ต่อหนึ่งล้านอินพุตโทเคน และ $4.25 ต่อหนึ่งล้านเอาต์พุตโทเคน พร้อมมอบเครดิต $20 สำหรับบัญชีใหม่ และมีระบบรายชื่อรอสำหรับผู้ใช้งานต่างชาติ

AI · 1 min read

GPT-Red ของ OpenAI ช่วยลดความล้มเหลวของ GPT-5.6 ลงถึง 6 เท่า แต่ยังไม่มีเครื่องมือฟรีสำหรับทีมขนาดเล็ก

โมเดล GPT-Red ภายในของ OpenAI ช่วยลดความล้มเหลวในไลน์ GPT-5.6 Sol ลงได้ถึง 6 เท่า แต่ในงานวิจัยมีเพียงแค่ทฤษฎีเท่านั้น โดยไม่มีเครื่องมือให้ดาวน์โหลดไปใช้งาน ทำให้ทีมขนาดเล็กต้องสร้างชุดทดสอบแบบ deterministic ขึ้นมาเอง

AI · 4 min read