GyaanSetu AI

Thông tin chuyên sâu về AI, học máy và LLM.

1317 articlesDeep, practical knowledge

MCP dựa trên định danh của Okta ngăn chặn Agent nhìn thấy các công cụ không được phép

Giao thức Model Context Protocol (MCP) dựa trên định danh mới của Okta chỉ cung cấp các lược đồ công cụ mà agent được phép sử dụng, giúp giảm đáng kể mức tiêu thụ token và chi phí suy luận, đồng thời thực thi nguyên tắc quyền truy cập tối thiểu cho các quy trình làm việc AI trong doanh nghiệp.

AI · 3 min read

57% thanh thiếu niên Mỹ dùng chatbot để làm bài tập, nhưng chỉ 12% tìm kiếm sự hỗ trợ về cảm xúc

Một cuộc khảo sát của Pew vào tháng 2 năm 2026 đối với thanh thiếu niên từ 10 đến 18 tuổi cho thấy họ coi AI là một công cụ hỗ trợ thực dụng—57% dùng để nghiên cứu, 54% cho các bài tập trên lớp—đồng thời lo ngại rằng AI làm mai một khả năng sáng tạo, gây lãng phí môi trường và lan truyền thông tin sai lệch.

AI · 3 min read

Cập nhật mô hình âm thầm gây rủi ro gián đoạn hệ thống: V4 Pro 0813 mới của DeepSeek làm hỏng các lệnh gọi công cụ (tool calls)

DeepSeek đã thay thế bản build xem trước đằng sau endpoint `deepseek-v4-pro` không đổi bằng mô hình V4 Pro 0813 chính thức, làm thay đổi trọng số, cách xử lý chỉ dẫn và định dạng lệnh gọi công cụ JSON—có khả năng làm hỏng các quy trình vận hành đang phụ thuộc vào đầu ra ổn định.

AI · 4 min read

Muse Glimmer 30B của Meta chậm hơn 56 lần so với Llama 3B trên MacBook M2 Pro

Kết quả benchmark trên MacBook M2 Pro 32 GB đo lường tốc độ token mỗi giây, tỷ lệ thành công JSON và tổng thời gian phản hồi, cho thấy độ trễ 33 giây mỗi lần gọi của Muse Glimmer so với tốc độ dưới một giây của Llama 3.2, mặc dù độ chính xác của cả hai là tương đương nhau.

AI · 4 min read

Cognition đổi tên Windsurf thành Devin Desktop, mở khóa IDE AI đa mô hình

Việc đổi tên diễn ra sau thỏa thuận cấp phép trị giá 2,4 tỷ USD của Cognition với Google và một thương vụ thâu tóm trị giá 3 tỷ USD đã bị hủy bỏ, đánh dấu sự chuyển dịch trọng tâm từ một mô hình độc quyền sang một IDE có khả năng điều phối Claude Code, OpenAI Codex, Google Gemini và bất kỳ tác nhân (agent) nào tương thích với ACP.

AI · 4 min read

Lidar AI BlueCity sẽ được triển khai tại 160 giao lộ ở Utah, gấp đôi quy mô hiện diện của Ouster

Việc triển khai tại 160 giao lộ thông qua đơn vị tích hợp kiểm soát giao thông Econolite sẽ nâng số lượng điểm hiện diện của Ouster tại Utah lên gần 300 địa điểm, đồng thời nhấn mạnh xu hướng chuyển dịch rộng lớn hơn của ngành hướng tới các dự án hạ tầng công cộng tích hợp AI.

AI · 1 min read

Bộ định tuyến Switchyard của Nemotron 3.5 Lightning có thể làm tăng gấp đôi chi phí suy luận

Nemotron 3.5 Lightning mới của Nvidia vận hành một mô hình MoE 30 tỷ tham số chỉ với 3 tỷ tham số hoạt động, nhưng lớp định tuyến NeMo Switchyard của nó có thể loại bỏ các prompt đã lưu trong bộ nhớ đệm khi chuyển đổi mô hình, khiến chi phí cho một yêu cầu suy luận có thể tăng lên gấp đôi.

AI · 3 min read

Mối đe dọa mất dữ liệu âm thầm: Mọi dịch vụ sử dụng SQLite WAL phải nâng cấp sau lỗi kéo dài 16 năm

Các kỹ sư của Tailscale đã truy tìm nguyên nhân các mục cấu hình bị biến mất là do một lỗ hổng từ năm 2010 trong cơ chế Write-Ahead Logging của SQLite. Lỗi này, phát sinh từ các thao tác ghi có độ đồng thời cao trên một số hệ thống tệp nhất định, đã âm thầm làm hỏng cơ sở dữ liệu cho đến khi được vá trong bản SQLite 3.46.1.

AI · 2 min read

Hiện tượng AI "ảo giác" có thể dẫn đến vi phạm Quy tắc 2210 của FINRA đối với các Công ty Môi giới - Đại lý

Thông báo Quy định 24-09 của FINRA làm rõ rằng mọi quy tắc hiện hành về giám sát, truyền thông, quyền riêng tư, lưu trữ hồ sơ và lợi ích tốt nhất hiện đều áp dụng cho việc sử dụng AI tạo sinh, đồng thời các thanh tra viên sẽ yêu cầu danh mục kiểm kê, nhật ký câu lệnh và các điểm kiểm soát đánh giá bởi con người.

AI · 3 min read

Bản Beta miễn phí giúp tiết kiệm khoảng 3% hóa đơn Claude Agent, không phải 14%

Phần header của bản beta giúp nén đầu ra của các lệnh gọi công cụ (tool-call) từ Claude, giúp giảm khoảng 14% lượng token đó, nhưng vì token đầu ra chỉ chiếm một phần nhỏ trong tổng số nên hầu hết người dùng chỉ thấy hóa đơn API tổng thể giảm khoảng 3%, cùng với việc cải thiện nhẹ về độ trễ.

AI · 3 min read

Các bản cập nhật bảo mật của Prompt Flow sẽ kết thúc vào năm 2026 – Các tổ chức đối mặt với rủi ro tuân thủ

Prompt Flow sẽ ngừng nhận các tính năng mới vào ngày 20 tháng 4 năm 2026 và sẽ bị ngừng hoạt động một năm sau đó, khiến các runtime images không còn được cập nhật các bản vá bảo mật. Microsoft khuyến nghị các nhà phát triển nên chuyển sang Agent Framework trước khi các vấn đề về tuân thủ phát sinh.

AI · 3 min read

Amazon tự động đưa các luồng phát trực tiếp trên Twitch vào huấn luyện AI—Người sáng tạo phải chủ động từ chối

Giám đốc sản phẩm của Twitch cho biết nếu áp dụng mô hình cho phép người dùng tự đăng ký, sẽ không có ai tham gia, vì vậy nền tảng hiện mặc định bao gồm tất cả. Người sáng tạo chỉ có thể thoát khỏi tình trạng này bằng cách tìm một nút gạt ẩn trong phần Cài đặt kênh, và Twitch cũng không thể xác nhận liệu các luồng phát trước đây đã được đưa vào các mô hình của Amazon hay chưa.

AI · 4 min read

Nhóm nghiên cứu Nhật Bản sử dụng CRISPR Y-CUT để chuyển đổi phôi chuột đực thành chuột cái có khả năng sinh sản

Dưới sự dẫn dắt của Takashi Ishiuchi và Shogo Matoba, nhóm nghiên cứu từ Đại học Yamanashi đã kết hợp phương pháp chuyển nhân tế bào sinh dưỡng với kỹ thuật chỉnh sửa CRISPR Y-CUT để loại bỏ nhiễm sắc thể Y, tạo ra những con chuột cái XO có khả năng sinh sản—ngay cả từ các tế bào đực được bảo quản lạnh.

AI · 5 min read

Twitch cho phép streamer từ chối việc huấn luyện AI của Amazon chỉ bằng một cú nhấp chuột

Nút gạt mặc định ở chế độ 'bật' nằm trong tab Bảo mật và Quyền riêng tư của Twitch; khi tắt nút này, tất cả các luồng trực tiếp, VOD, clip, chat và nội dung tải lên sẽ ngừng cung cấp dữ liệu cho các quy trình AI tạo sinh của Amazon, trong khi các công cụ kiểm duyệt và đề xuất trên nền tảng vẫn được duy trì hoạt động.

AI · 3 min read

Sandbar gọi vốn 23 triệu USD vòng Series A để chế tạo nhẫn AI tích hợp nút nhấn đàm thoại tùy chỉnh

Nhẫn Stream của Sandbar sử dụng nút nhấn đàm thoại (push-to-talk) có chủ đích, giúp tránh được các lo ngại về quyền riêng tư vốn đã khiến nhiều thiết bị đeo luôn bật thất bại, trong khi phần cứng được tùy chỉnh hoàn toàn—với tổng vốn đầu tư 36 triệu USD—hướng tới cả môi trường chuyên nghiệp lẫn xã hội.

AI · 2 min read

Các bác sĩ chẩn đoán hình ảnh báo cáo AI chỉ giúp giảm tỷ lệ triệu hồi 35% thay vì 59% như kỳ vọng

Một cuộc khảo sát với 215 thành viên của Hiệp hội Hình ảnh Vú cho thấy mặc dù 50% đã sử dụng AI được FDA phê duyệt, nhưng chỉ có 35% ghi nhận tỷ lệ triệu hồi giảm—thấp hơn nhiều so với mức 59% kỳ vọng—cho thấy sự chênh lệch rõ rệt giữa kỳ vọng và hiệu quả thực tế.

AI · 2 min read

Anthropic loại bỏ các nút “Phê duyệt” thủ công sau khi nghiên cứu cho thấy 97% người dùng nhấn nút một cách mù quáng

Claude Code của Anthropic sẽ ngừng yêu cầu người dùng nhấn “phê duyệt” cho mỗi lần gọi công cụ vào ngày 14 tháng 8, thay thế bước kiểm soát thủ công bằng một bộ phân loại rủi ro dựa trên AI, vốn chỉ can thiệp đối với các hành động không thể đảo ngược, có tính hủy hoại hoặc hướng ra bên ngoài.

AI · 2 min read