GyaanSetu AI

Thông tin chuyên sâu về AI, học máy và LLM.

1515 articlesDeep, practical knowledge

Claude Code Adds /loop /goal /schedule to Automate Repetitive Coding

Claude Code now offers three loop-engineering commands—/loop, /goal and /schedule—that let the same model iterate, verify and persist its work autonomously. By defining skills, verifiers, guardrails and spend caps, developers can automate builds, tests and deployments while keeping token usage in ch

AI · 3 min read

Chỉ một dòng dấu thời gian khiến chi phí OpenAI của một tác nhân AI tăng gấp ba lần

Tác nhân này đã thêm một dấu thời gian hiện tại vào ngay đầu system prompt, khiến tiền tố byte của mỗi yêu cầu trở nên duy nhất. Điều này đã làm mất hiệu lực bộ nhớ đệm khớp chính xác (exact-match cache) của OpenAI, buộc hệ thống phải tính phí đầy đủ cho 18.000 token tĩnh và khiến hóa đơn tăng gấp ba lần.

AI · 2 min read

Bot Teams vấp phải giới hạn timeout 15 giây – Chuyển logic LLM sang hàng đợi bất đồng bộ

Khi trình xử lý của bot thực hiện các tác vụ LLM nặng hoặc gọi cơ sở dữ liệu, Teams sẽ hủy phản hồi sau 10-15 giây, sau đó thử lại và tạo ra một chuỗi các công việc trùng lặp. Việc tách rời webhook, đưa sự kiện vào hàng đợi và xử lý trong một worker chạy ngầm sẽ giúp khôi phục độ tin cậy của hệ thống.

AI · 3 min read

Các doanh nghiệp triển khai 'Yellow Teams' để rút ngắn thời gian khắc phục lỗi AI từ hàng tuần xuống còn hàng ngày

Bằng cách kết hợp các chiến thuật tấn công của red-team với khả năng phòng thủ của blue-team, các đội ngũ yellow team có thể phát hiện lỗ hổng prompt-injection, xây dựng quy tắc phát hiện và triển khai chúng trước khi kẻ tấn công bên ngoài kịp khai thác, giúp rút ngắn đáng kể chu kỳ từ lúc phát hiện lỗ hổng đến khi được vá lỗi.

AI · 3 min read

Sverklo bổ sung dấu vết kiểm tra bốn lớp vào tính năng tìm kiếm mã nguồn, giúp lập trình viên theo dõi mọi bước truy vấn

Sverklo kết hợp công cụ từ khóa BM25 truyền thống, ONNX embeddings và đồ thị biểu tượng xếp hạng theo PageRank, sau đó cung cấp trường `found_by` cùng một sổ cái bộ nhớ để lập trình viên có thể xác minh tín hiệu nào tạo ra mỗi kết quả và liệu câu trả lời trong bộ nhớ đệm còn mới hay không.

AI · 3 min read

Thủ thuật Lý thuyết Điều khiển Mới Cho phép Tinh chỉnh Mô hình Khuếch tán trên Chỉ một GPU duy nhất

Bằng cách mô hình hóa việc tinh chỉnh thành một bài toán điều khiển tối ưu ngẫu nhiên không bộ nhớ, Adjoint Matching thay thế quá trình lan truyền ngược tốn kém bằng một bộ tối ưu hóa nhẹ nhàng, giúp các bộ tạo khuếch tán và dòng chảy quy mô lớn có thể thích ứng trên phần cứng khiêm tốn mà không gặp phải tình trạng mất ổn định thường thấy.

AI · 2 min read

Cựu chuyên gia OpenAI hướng tới việc rút ngắn thời gian phát triển liệu pháp bằng cách dùng AI để tái mục đích các loại thuốc đã được FDA phê duyệt

Dự án này sẽ tuyển dụng một nhóm nòng cốt gồm các cựu nhà nghiên cứu từ OpenAI để xây dựng các mô hình dựa trên kiến trúc transformer nhằm dự đoán các công dụng trị liệu mới cho các loại thuốc hiện có, hứa hẹn sẽ rút ngắn đáng kể quy trình phê duyệt pháp lý và tận dụng làn sóng vốn đầu tư đang tăng trưởng mạnh mẽ vào lĩnh vực AI-biotech.

AI · 4 min read

ITAR buộc các nhà sản xuất UAV phải thiết kế lại hệ thống IoT bằng các chuỗi băm bất biến

Bản hướng dẫn chi tiết bốn thay đổi bắt buộc – chuỗi băm chống giả mạo, xác thực thông tin xác thực ITAR trực tiếp, theo dõi RFID theo khu vực và tích hợp ERP hai chiều – mà các nhà máy sản xuất linh kiện UAV phải triển khai ngay từ đầu để đảm bảo tính tuân thủ.

AI · 3 min read

Đội ngũ kỹ sư cắt giảm 95% hóa đơn AI-API nhờ điều hướng 95% truy vấn sang các mô hình giá rẻ

Nhóm đã xây dựng một bộ phân loại ở front-end để điều hướng 95% lưu lượng truy cập sang mô hình nhẹ, bổ sung bộ nhớ đệm Redis cho các câu trả lời lặp lại (bao gồm cả "Tôi không biết"), nén các prompt và xử lý hàng loạt các tác vụ chạy ngầm, giúp giảm chi phí hàng tháng từ 420 USD xuống còn 28 USD mà không làm ảnh hưởng đến độ trễ.

AI · 3 min read

Tính năng Human-in-the-loop trong API Genkit của Google nhằm ngăn chặn các sai lầm tốn kém từ AI

Bản xem trước giới thiệu tính năng “detached turns”, giúp chuyển các lệnh gọi chạy lâu sang các tiến trình chạy ngầm, cùng với một prompt có sự can thiệp của con người cho phép người kiểm duyệt phê duyệt hoặc từ chối hành động của agent — những tính năng được thiết kế để giảm thời gian gián đoạn và tránh các sai lầm tốn kém.

AI · 2 min read

Quy trình SEO bằng AI giúp tăng CTR lên 3% nhờ loại bỏ các từ khóa có lượt hiển thị cao

Bằng cách lọc bỏ các truy vấn có độ cạnh tranh và lượt hiển thị cao, đồng thời chỉ tập trung vào các từ khóa đuôi dài đáp ứng được các tiêu chí về độ liên quan, độ khó và CTR, quy trình cải tiến đã giúp giảm một nửa số lượng bài viết nhưng lại tăng tỷ lệ nhấp lên mức 2-3% và cải thiện thứ hạng.

AI · 3 min read

DSpark của DeepSeek giúp giảm thời gian suy luận LLM lên đến 85% và cắt giảm chi phí GPU

DSpark sử dụng một mô hình nháp nhẹ để dự đoán các lô token, sau đó mô hình LLM đầy đủ sẽ xác thực chỉ trong một lượt duy nhất. Thư viện mã nguồn mở với giấy phép MIT này tương thích với DeepSeek, Qwen và Gemma, giúp tăng tốc độ suy luận từ 60-85% trên các phần cứng hiện có.

AI · 2 min read

Match Group rót 18 triệu USD vào Overtone, ứng dụng hẹn hò ưu tiên giọng nói của nhà sáng lập Hinge

AI của Overtone phân tích các bản ghi âm giọng nói của người dùng về tông giọng, nhịp điệu và phong cách kể chuyện, từ đó giải thích chính xác các điểm dữ liệu tạo nên sự tương hợp, mang lại những kết nối minh bạch và sâu sắc thay vì các thao tác quẹt truyền thống.

AI · 3 min read

SpaceXAI’s Grok Build Secretly Uploaded Entire Repos to Google Cloud

Cereblab traced Grok Build’s CLI traffic to a Google Cloud bucket, confirming it packed full git repositories—including ignored files and deleted credentials—and pushed them without opt-out. SpaceXAI disabled the feature and Musk pledged full deletion, but critics note the privacy command only toggl

AI · 4 min read

CEO của DeepMind kêu gọi thành lập cơ quan tiêu chuẩn AI theo mô hình FINRA để thẩm định các mô hình AI tiên phong

Đề án của Hassabis đề xuất một hệ thống hai giai đoạn: trước tiên, các phòng thí nghiệm sẽ gửi mô hình để đánh giá tự nguyện trong 30 ngày; sau đó, một khi quy trình này chứng minh được hiệu quả, các bài kiểm tra tương tự sẽ trở thành bắt buộc đối với mọi AI tiên phong khi gia nhập thị trường Hoa Kỳ.

AI · 2 min read