GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

Atlas ของ World Labs เอาชนะคู่แข่งชั้นนำในการทดสอบความพึงพอใจของมนุษย์ถึง 94%

Atlas ใช้เทคนิค spatial anchoring เพื่อเปลี่ยนภาพถ่ายเพียงไม่กี่ภาพ (ตั้งแต่หนึ่งภาพไปจนถึงไม่กี่สิบภาพ) ให้กลายเป็นโลก 3 มิติที่สามารถสำรวจได้ โดยสามารถเรนเดอร์วิดีโอความละเอียด 1440p ได้นานถึงหนึ่งนาที พร้อมทั้งส่งออกข้อมูล point clouds และ Gaussian splats เพื่อนำไปใช้ต่อในระบบหุ่นยนต์และกระบวนการผลิตคอนเทนต์

AI · 4 min read

Amazon ติดอาวุธให้ Alexa for Shopping ด้วยระบบตรวจจับการฉ้อโกงด้วย AI หลังพบสายโทรศัพท์หลอกลวงกว่า 360,000 สายต่อปี

เครื่องยนต์ Generative AI ของ Amazon เข้ามาขับเคลื่อน Alexa for Shopping เพื่อตรวจสอบข้อมูลผู้ส่ง, เมทาดาตาที่ซ่อนอยู่ และช่วงเวลา โดยเปรียบเทียบกับข้อความที่ถูกต้องตามกฎหมายหลายพันล้านข้อความ ช่วยให้นักช้อปสามารถตรวจสอบอีเมลและข้อความที่น่าสงสัยได้ในทันที

AI · 4 min read

HiddenLayer ระดมทุนรอบ Series B มูลค่า 100 ล้านดอลลาร์ เพื่อปกป้อง AI Agents สำหรับองค์กร

การระดมทุนรอบ Series B นำโดย Delta-v Capital พร้อมด้วย M12 ของ Microsoft และ Morgan Stanley จะนำไปใช้เพื่อขยายการขาย วิจัยเชิงลึกเกี่ยวกับการโจมตีแบบ multi-modal และรุกตลาดในภูมิภาค EMEA ในขณะที่ ARR ของ HiddenLayer พุ่งสูงขึ้นถึง 10 เท่า สู่ระดับหลายสิบล้านดอลลาร์

AI · 5 min read

$550M Series C Pushes Wonderful to $5B Valuation in Six Months

The Israeli-Dutch startup has pivoted from multilingual customer-service bots to a model-agnostic AI operating system, deploying forward-deployed engineers on-site in 35+ countries. Backed by Insight Partners and a new stake from Salesforce, the $550M round will fund product development and global F

AI · 2 min read

Anthropic ตัด Prompt ของ Claude Code ออกถึง 80% แต่ยังคงความแม่นยำในการเขียนโค้ดไว้ได้

Anthropic พบว่าการลบกฎส่วนใหญ่ใน system prompt ออกไป ไม่ได้ส่งผลกระทบต่อผลลัพธ์ของ Claude Code ซึ่งพิสูจน์ให้เห็นว่า LLM สมัยใหม่สามารถเข้าใจสไตล์และข้อจำกัดต่างๆ ได้จากการสั่งงานเพียงครั้งเดียว และโครงสร้างของ prompt สามารถลดทอนลงได้อย่างมหาศาล

AI · 3 min read

ไทยลดจำนวนบริษัท 'นอมินี' ปลอมลงได้ถึง 90% ด้วยการใช้ระบบ IBAS ที่ขับเคลื่อนด้วย AI

ระบบ IBAS ของกรมพัฒนาธุรกิจการค้า ผสมผสานการวิเคราะห์พฤติกรรม, e-KYC และการเชื่อมโยงข้อมูลระหว่างหน่วยงาน เพื่อระบุกลุ่มนิติบุคคลที่มีความเสี่ยงสูง ช่วยให้เจ้าหน้าที่สามารถมุ่งเน้นการตรวจสอบไปยังผู้ที่มีแนวโน้มกระทำผิดได้อย่างแม่นยำ และช่วยลดกิจกรรมของบริษัทบังหน้าลงได้อย่างมหาศาล

AI · 2 min read

Anthropic Open-Sources Model Context Protocol, a ‘USB-C’ for AI Agents

The Model Context Protocol (MCP) introduces a uniform interface for AI agents to query databases, monitoring tools, code repos and more. By declaring resources, tools and prompts, a single MCP server can replace dozens of bespoke adapters, instantly surfacing data to any Claude-compatible client.

AI · 3 min read

Qwen 3.6 ทำความเร็วได้เท่ากับ 3.5 บน RTX 4070 พร้อมเพิ่มความสำเร็จของ Agent ขึ้น 43%

Qwen 3.6 ปะทะ 3.5: ความเร็วเท่าเดิม แต่ Agent เก่งขึ้น ผมเกือบจะโพสต์ไปแล้วว่า Qwen 3.6 ช้ากว่า 3.5 เพราะการทดสอบครั้งแรกของผมพบว่าทำความเร็วได้เพียง 12 tokens ต่อวินาที ในขณะที่เวอร์ชันเก่ารันอยู่ที่ 34...

AI · 2 min read

ผลทดสอบประสิทธิภาพ Claude Fable 5.1: เปรียบเทียบทุกตัวเลข

ผลทดสอบประสิทธิภาพ Claude Fable 5.1: เปรียบเทียบทุกตัวเลข Anthropic ได้เปิดตัว Claude Fable 5.1 เมื่อวันที่ 1 กันยายน 2026 โดยตัวเลขแสดงให้เห็นถึงการก้าวกระโดดครั้งใหญ่ในบางด้าน ประเด็นหลักคือ...

AI · 3 min read

Anthropic ลดค่าใช้จ่าย Cache-Read ลง 75% พร้อมหั่นค่าใช้จ่าย Agent ลง 45%

Fable 5.1 ของ Anthropic ช่วยลดค่าธรรมเนียมการอ่าน cache ลง 75% ซึ่งช่วยลดต้นทุนการดำเนินงานของ agent โดยรวมได้สูงสุดถึง 45% การลดต้นทุนนี้ช่วยให้โมเดลอัตโนมัติสามารถทำงานต่อเนื่องได้นานหลายชั่วโมงหรืออาจถึงหลายวันโดยไม่ต้องมีการควบคุมจากมนุษย์ตลอดเวลา ซึ่งเป็นการเปิดโอกาสใหม่ๆ สำหรับการใช้งานจริงในระดับโปรดักชัน

AI · 3 min read

MCP Drops Session Handshake, Enabling Pure-Stateless AI Deployments

The July 2026 spec strips every form of session state from MCP’s wire format, moving all context into the model’s token window and allowing any server to handle any request, but at the cost of token overhead and lost resumability.

AI · 3 min read

จ่ายเพียง $10 ครั้งเดียว รับสิทธิ์ใช้งาน OpenRouter AI ฟรี 1,000 ครั้งต่อวัน – มากกว่าปกติถึง 20 เท่า

การอัปเกรดนี้ใช้ได้กับโมเดลที่ไม่มีค่าใช้จ่ายของ OpenRouter เท่านั้น สำหรับโมเดลแบบชำระเงินยังคงมีค่าธรรมเนียมตามจำนวนโทเคน กฎการใช้จ่ายตลอดชีพหมายความว่าขีดจำกัด 1,000 ครั้งนี้จะไม่มีวันหมดอายุ แม้ว่าคุณจะใช้เครดิตที่ซื้อไว้จนหมดแล้วก็ตาม

AI · 3 min read

ผลการศึกษาชี้ว่าการระบุสถานะ Pass แบบ Binary ทำให้โมเดลการสร้างโค้ดเข้าใจผิด และนำไปสู่การทบทวนแนวคิดใหม่

SWE Prime: ป้ายกำกับว่า "Pass" เป็นตัวกรองที่แย่มาก นักพัฒนาส่วนใหญ่คิดว่าข้อมูลที่มากขึ้นจะทำให้เอเจนต์ฉลาดขึ้น หากเอเจนต์ผ่านการทดสอบ คุณก็จะบันทึกเซสชันนั้นและเพิ่มเข้าไปในชุดข้อมูลสำหรับฝึกฝน...

AI · 4 min read

DeepMind เปิดตัวเกณฑ์มาตรฐานทางคริปโทกราฟีแบบ Double-Blind สำหรับ Gemini Flash Lite

โครงการนำร่องนี้รัน Gemini Flash Lite ภายใน Confidential Space ของ Google Cloud โดยการปิดผนึกทั้งพรอมต์ทดสอบและค่าน้ำหนักของโมเดลไว้ในกล่องทางคริปโทกราฟี เพื่อสร้างหลักฐานยืนยันว่าโมเดลไม่เคยเห็นคำถามมาก่อน

AI · 3 min read

Beatport สั่งแบนเพลงที่สร้างโดย AI ทั้งหมด พร้อมระบุเครื่องหมายสำหรับเพลงแบบไฮบริด

Beatport จะปฏิเสธการอัปโหลดที่สร้างโดย AI เป็นหลักโดยอัตโนมัติ แต่จะยังคงยอมรับเพลงที่ใช้ AI เป็นเพียงเครื่องมือ หากมีการระบุไว้อย่างชัดเจน ความเคลื่อนไหวนี้เกิดขึ้นหลังจากผลสำรวจพบว่า 77% ของผู้ใช้ชอบเพลงที่สร้างโดยมนุษย์มากกว่า

AI · 3 min read

WSJ Drops Mandatory AI Disclosure, Forces Platform Builders to Rethink Rules

After an op-ed admitted using AI as a “calculator for arguments,” the Wall Street Journal stopped requiring disclosure of AI tools in opinion pieces. The move compels developers of editorial platforms to add configurable policies, role-based permissions, AI-function tagging, and auditable human sign

AI · 3 min read

บริษัทยักษ์ใหญ่ด้านเทคโนโลยีจับตามอง Claude Plugins เมื่อ Claudeforce ของ Salesforce เผยอนาคตของ CRM ที่ขับเคลื่อนด้วย AI เป็นหลัก

โปรเจกต์นำร่อง Claudeforce ซึ่งเปิดตัวเมื่อวันที่ 26 สิงหาคม 2026 มาพร้อมกับทักษะการขายที่สร้างไว้ล่วงหน้าถึง 37 ทักษะ ที่ช่วยให้ผู้ใช้สามารถนัดหมายการประชุม อัปเดตข้อมูลใน Pipeline และอื่นๆ ได้ทั้งหมดผ่านหน้าต่างแชทของ Claude โดยมีกำหนดเปิดให้ทดลองใช้งานในวงกว้างขึ้นในเดือนกันยายน

AI · 1 min read

การทดสอบ 27 บั๊กของ CodeVetter แสดงให้เห็นถึงความสามารถในการตรวจจับ แต่ไม่ใช่ความพร้อมสำหรับการใช้งานจริง

เกณฑ์มาตรฐานนี้ใช้กรณีทดสอบแบบสังเคราะห์ 27 กรณีเพื่อบันทึกผลผ่านหรือล้มเหลว ซึ่งช่วยในการตรวจสอบความครอบคลุมของปัญหาได้อย่างรวดเร็ว อย่างไรก็ตาม การทดสอบนี้ไม่ได้คำนึงถึงเรื่องเวลา, ต้นทุนการประมวลผล, ความหลากหลายของภาษา และการตรวจสอบในคลังเก็บโค้ดจริง (live-repo) ดังนั้นคะแนนที่ได้จึงไม่ใช่การรับประกันความพร้อมสำหรับการใช้งานจริงในระดับโปรดักชัน

AI · 2 min read

Google จ้างอดีตผู้บริหาร OpenAI Barrett Zoph เพื่อนำทัพการผลักดันด้านความปลอดภัยและการใช้เหตุผลของ Gemini

Barrett Zoph ผู้ซึ่งลาออกจาก OpenAI หลังจากทำงานด้านการขายระดับองค์กรเพียงช่วงสั้นๆ ได้เข้าร่วมงานกับ Google ในตำแหน่งรองประธานฝ่ายวิจัย เพื่อเสริมความแข็งแกร่งด้านการปรับจูน (alignment) การใช้เหตุผล และความปลอดภัยของ Gemini โดยใช้ความเชี่ยวชาญด้านการเรียนรู้แบบเสริมกำลัง (reinforcement learning) ของเขา ซึ่งถือเป็นความพยายามโดยตรงในการลดช่องว่างกับโมเดลตระกูล GPT ของ OpenAI

AI · 3 min read

Google Gemini Notebook เชื่อมต่อกับ Play Books กว่า 100,000 เล่ม ให้ผู้ใช้สามารถนำเนื้อหามา Remix ได้

ในการสาธิตแบบสด Steven Johnson ผู้อำนวยการฝ่ายบรรณาธิการของ Google Labs ได้ลองป้อนหนังสือ *Food Rules* ของ Michael Pollan เข้าไปใน Gemini Notebook และได้รับเมนูอาหารสำหรับทั้งสัปดาห์พร้อมรายการของที่ต้องซื้อ ในขณะที่หนังสือ *Radical Candor* ของ Kim Scott ก็สามารถสร้างสคริปต์การประเมินผลงานแบบเป็นขั้นตอนได้ ทั้งหมดนี้สามารถทำได้ทันทีโดยไม่ต้องออกจากแอป

AI · 6 min read

ผู้ช่วยเขียนโค้ด AI เปิดช่องให้ผู้ใช้ทั่วไปสามารถเข้าควบคุมเวิร์กสเตชัน Windows ผ่าน C:\ProgramData ได้

ช่องโหว่นี้ (CVE-2026-35603) ช่วยให้ผู้ใช้ที่ไม่มีสิทธิ์แอดมินสามารถวางไฟล์คอนฟิกที่เป็นอันตรายไว้ใน C:\ProgramData ซึ่ง Claude Code, Cursor, Codex CLI และ Gemini CLI จะอ่านไฟล์ดังกล่าวเมื่อเริ่มทำงาน ส่งผลให้มีการรันเพย์โหลดด้วยสิทธิ์แอดมินเต็มรูปแบบ และเปิดโอกาสให้ผู้โจมตีเข้าควบคุมเครื่องได้อย่างเงียบเชียบ

AI · 4 min read

การอัปเกรดแบบสองขั้นตอนใหม่ของ GKE ช่วยลดความเสี่ยงในการเกิด Downtime ของคลัสเตอร์สำหรับการเปลี่ยนแปลงเวอร์ชันย่อย

ขั้นตอนการทำงานแบบ GA ใหม่นี้จะแยกการอัปเกรดไบนารีออกจากการย้ายรูปแบบข้อมูล โดยมีช่วงเวลาทดสอบ (soak period) ที่สามารถกำหนดค่าได้ เพื่อใช้ในการตรวจสอบตัวชี้วัดด้านสุขภาพ (health metrics) และยังคงสามารถย้อนกลับ (rollback) ได้จนกว่าจะถึงขั้นตอนการแปลงข้อมูลขั้นสุดท้าย

AI · 3 min read