GyaanSetu AI

Thông tin chuyên sâu về AI, học máy và LLM.

1515 articlesDeep, practical knowledge

Quy trình làm việc Agentic của GitHub làm rò rỉ tệp trong kho lưu trữ riêng tư chỉ qua một Issue công khai

Noma Labs đã chứng minh rằng việc đăng một bình luận trong issue công khai có chứa từ “Additionally,” có thể khiến tác nhân AI của GitHub đọc các kho lưu trữ riêng tư và đăng ngược lại nội dung đó vào issue, mà không cần thêm bất kỳ quyền truy cập hay mã tùy chỉnh nào.

AI · 2 min read

Spotify ra mắt DJ giọng nói AI cho người dùng Premium tại Mỹ, Ireland và Thụy Điển

Bản thử nghiệm cho phép người dùng Premium nói hoặc nhập các yêu cầu chi tiết—như “phát các nghệ sĩ tôi chưa từng nghe trước đây” hoặc “tôi nghe bài hát này lần đầu khi nào?”—và thậm chí là hỏi các thông tin bên lề, tất cả đều được vận hành bởi một mô hình LLM ngay trên thiết bị dựa trên lịch sử nghe nhạc của từng người dùng.

AI · 6 min read

Anthropic cho thấy 50 mẫu dữ liệu bị nhiễm độc có thể cài cắm các backdoor không thể phát hiện vào LLM

Nghiên cứu tiết lộ rằng ngay cả sau quá trình căn chỉnh (alignment) và RLHF, một backdoor được kích hoạt bởi một cụm từ bí mật vẫn có thể khiến LLM thực hiện các hành vi độc hại, trong khi các bài kiểm tra an toàn hoặc câu lệnh hệ thống (system prompts) thông thường đều không thể phát hiện ra.

AI · 4 min read

Neon Functions cho phép các AI Agent truyền dữ liệu (stream) vô thời hạn, loại bỏ mọi giới hạn thời gian chờ (timeout)

Neon Functions hiện xử lý các yêu cầu streaming tương tự như các lời gọi thông thường, cho phép các kết nối WebSocket hoặc SSE duy trì trạng thái mở cho đến khi AI hoàn tất quá trình suy nghĩ và phát ra các token—không cần polling, không cần các thủ thuật keep-alive, và không bị ngắt kết nối cưỡng ép.

AI · 2 min read

Ring-Zero giúp mô hình hàng nghìn tỷ tham số đạt 84,2% trong kỳ thi AIME 2026

Ring-Zero huấn luyện một mô hình hàng nghìn tỷ tham số thông qua vòng lặp RL bốn giai đoạn—khám phá, tự chưng cất, RL tinh chỉnh và lập ngân sách token phân tầng—giúp mô hình học cách phân bổ các lộ trình suy luận 2 nghìn hoặc 20 nghìn token, nhằm cân bằng giữa độ chính xác và chi phí tính toán.

AI · 4 min read

Nghiên cứu chuyên sâu của Claude tiêu tốn 6,57 triệu token để xác minh mọi khẳng định

Hệ thống hoạt động như một quy trình map-reduce JavaScript nghiêm ngặt: nó phân tán các tìm kiếm, thu thập các đoạn trích thô, vận hành ba tác nhân độc lập với cơ chế mặc định là bác bỏ các khẳng định không chắc chắn, và chỉ sau đó mới tổng hợp thành một báo cáo JSON để kiểm soát tình trạng ảo giác.

AI · 4 min read

Dự đoán các điểm nghẽn trước khi chúng xảy ra: Ứng dụng AI trong quy trình luân chuyển bệnh nhân tại bệnh viện

Dự đoán các điểm nghẽn trước khi chúng xảy ra: Ứng dụng AI trong quy trình luân chuyển bệnh nhân tại bệnh viện. Việc phải chờ đợi năm tiếng đồng hồ tại phòng cấp cứu gây ra sự căng thẳng. Nó cũng làm chậm quá trình điều trị và làm tăng nguy cơ cho...

AI · 3 min read

Emergent đạt định giá kỳ lân 1,5 tỷ USD sau vòng gọi vốn Series C trị giá 130 triệu USD

Vòng Series C do Creaegis dẫn đầu, với sự tham gia của Khosla, SoftBank Vision Fund 2 và các nhà đầu tư khác, đã nâng định giá sau đầu tư của Emergent lên 1,5 tỷ USD, tạo nguồn lực mạnh mẽ để công ty mở rộng nền tảng cung cấp đội ngũ kỹ sư full-stack cho các doanh nghiệp vừa và nhỏ (SME) không có chuyên môn kỹ thuật.

AI · 3 min read

Vint Cerf thúc đẩy DNSid nhằm gắn tên miền cho mọi tác nhân AI

Cerf cảnh báo rằng nếu thiếu một giao thức chung, các tác nhân AI sẽ bị cô lập, dẫn đến nguy cơ phân mảnh internet. DNSid liên kết mỗi tác nhân với một tên miền hiện có và ghi lại các bằng chứng mã hóa, cung cấp một dấu vết kiểm toán minh bạch về quyền hạn và trách nhiệm pháp lý.

AI · 5 min read

Người dùng Copilot miễn phí được kiểm tra lỗ hổng tức thì sau bản cập nhật ngày 14 tháng 7

Trình quét lệnh gạch chéo (slash-command) mới chạy cục bộ trên bản cập nhật Copilot dành cho máy tính để bàn ngày 14 tháng 7, giúp cảnh báo ngay lập tức các lỗi injection, XSS, xử lý dữ liệu không an toàn, path traversal và mã hóa yếu trong mã nguồn chưa được commit, cho phép các nhà phát triển khắc phục sự cố chỉ trong vài giây.

AI · 3 min read

Tại sao phương pháp Fixed-Size Chunking lại khiến hệ thống RAG cho bảng tin tuyển dụng của tôi thất bại và giải pháp khắc phục là gì

Tác giả đã chuyển đổi từ Pinecone sang kho lưu trữ pgvector tích hợp trong cơ sở dữ liệu, giúp cắt giảm mạnh chi phí lưu trữ embedding và đảm bảo tính nhất quán trong giao dịch—trong khi vẫn mở rộng được hệ thống RAG xử lý hơn mười nghìn tin tuyển dụng mỗi ngày.

AI · 2 min read

Chrome Cảnh báo: Việc biến các trang web thành 'Sẵn sàng cho Agent' mở đường cho các vụ chiếm quyền điều khiển bằng AI

Hướng dẫn mới của Chrome yêu cầu các trang web sử dụng WebMCP phải đưa các agent đáng tin cậy vào danh sách trắng, gắn cờ nội dung không đáng tin cậy và đánh dấu các công cụ chỉ đọc, biến một tệp manifest đơn giản thành một chốt kiểm soát an ninh chống lại việc chèn lệnh độc hại.

AI · 3 min read

Xây dựng Logic AI Firebase với Antigravity CLI

Xây dựng Logic AI Firebase với Antigravity CLI. Bạn có thể xây dựng các ứng dụng AI tiên tiến nhanh hơn bằng cách kết hợp các công cụ agentic với quy trình phát triển hiện đại. Tôi đã xây dựng một công cụ phân tích hình ảnh…

AI · 3 min read

Oracle AI Database 23.26.2 cài đặt Standby PDB chỉ với một lệnh Data Guard

Trong một thử nghiệm thực tế, tác giả đã thêm một PDB dự phòng tên là AMOL vào một CDB phụ chỉ bằng một lệnh DGMGRL ADD PLUGGABLE DATABASE duy nhất; bộ điều phối đã sao chép các tệp, tạo các standby redo logs và đưa PDB về chế độ chỉ đọc chỉ trong vài giây, mà không cần khôi phục bằng RMAN hay thực hiện các câu lệnh ALTER thủ công.

AI · 3 min read