GyaanSetu AI

Thông tin chuyên sâu về AI, học máy và LLM.

1515 articlesDeep, practical knowledge

DeepMind biến 7.500 clip tổng hợp thành mô hình thị giác đa nhiệm 14 tỷ tham số

Được xây dựng trên kiến trúc Wan2.1 của Alibaba, mô hình này học về độ sâu, pháp tuyến, phân đoạn và tư thế 3D từ một tập dữ liệu nhỏ được kết xuất bằng Blender, đạt hiệu suất tương đương hoặc vượt trội hơn các hệ thống chuyên dụng dù chỉ cần một phần nhỏ dữ liệu huấn luyện.

AI · 3 min read

xAI mã nguồn mở Grok Build Runtime trên GitHub sau tranh cãi về việc lưu trữ dữ liệu

Kho lưu trữ bao gồm khung (harness) viết bằng Rust, giao diện terminal và lớp công cụ, nhưng không có trọng số mô hình, do đó người dùng phải tự cung cấp mô hình của mình. Các mục thảo luận (Issues) và yêu cầu kéo (pull requests) đã bị vô hiệu hóa, làm hạn chế sự đóng góp của cộng đồng nhưng vẫn cho phép các nhà phát triển kiểm tra mã nguồn xử lý dữ liệu.

AI · 3 min read

OpenAI Codex tự mình viết hoàn chỉnh một trò chơi Asteroids bằng ngôn ngữ Assembly 16-bit

Trong cuộc thử nghiệm, Codex đã phác thảo kế hoạch dự án, viết 18 tệp mã nguồn với tổng cộng khoảng 2.500 dòng code, quản lý kho lưu trữ Git, xây dựng tệp thực thi DOS và tự mình sửa lỗi—sự can thiệp của con người chỉ giới hạn ở việc xác định mục tiêu, báo cáo lỗi và chơi thử.

AI · 3 min read

Tín hiệu dừng "vạch đỏ" giúp giảm vòng lặp của tác nhân xuống còn 3,3 lần, trong khi tự đánh giá thất bại ở mức 8

Thí nghiệm cho thấy các tác nhân sử dụng điều kiện dừng "vạch đỏ" khách quan đã dừng lại sau trung bình chỉ 3,3 lần lặp, trong khi các tác nhân dựa vào việc tự đánh giá đã chạm giới hạn cứng 8 bước mà không hoàn thành được nhiệm vụ, dẫn đến lãng phí chu kỳ và làm sai lệch kết quả.

AI · 3 min read

TELUS tiết kiệm 500.000 giờ làm việc của kỹ sư và 90 triệu USD nhờ sử dụng các trợ lý lập trình AI

Chương trình thí điểm của TELUS đã đo lường các chỉ số cơ sở, thử nghiệm nhiều công cụ lập trình cặp AI và theo dõi sự sụt giảm thời gian chu kỳ, chứng minh rằng việc áp dụng một cách bài bản có thể biến quy trình tạo mã thông thường thành một cỗ máy hiệu quả trị giá hàng triệu đô la.

AI · 3 min read

Moonshot ra mắt Kimi K3 với 2,8 nghìn tỷ tham số, mô hình trọng số mở lớn nhất

Tại Hội nghị AI Thế giới Thượng Hải, Moonshot AI đã giới thiệu Kimi K3—một mô hình hỗn hợp chuyên gia (mixture-of-experts) với 2,8 nghìn tỷ tham số được phát hành với trọng số hoàn toàn mở, khẳng định vị thế của Trung Quốc như một đối trọng về nguồn cung cấp AI năng lực cao, vượt ra ngoài các API do Hoa Kỳ kiểm soát.

AI · 2 min read

LM Studio ra mắt Bionic, cho phép các nhà phát triển xây dựng các tác nhân AI mà không bị ràng buộc bởi nhà cung cấp

Bionic cung cấp giao diện không phụ thuộc vào mô hình, các thành phần nguyên bản cho tác nhân được tích hợp sẵn và khả năng tích hợp trực tiếp với IDE của LM Studio, giúp các nhà phát triển có thể tạo mẫu, thử nghiệm và triển khai các trợ lý trên bất kỳ mô hình nào tương thích với OpenAI hoặc được lưu trữ cục bộ.

AI · 2 min read

Các mô hình trọng số mở chiếm 63% lưu lượng token trên OpenRouter, tăng từ mức dưới 5% trong vòng hai năm

Phân tích của Mozilla cho thấy chi phí trên mỗi token đã giảm 50 lần và khoảng cách về hiệu suất đã được thu hẹp, thúc đẩy các nhà phát triển ưu tiên các mô hình trọng số mở nhờ chi phí thấp hơn, tốc độ thử nghiệm nhanh hơn và khả năng tuân thủ các quy định pháp lý.

AI · 3 min read

GPT-5.6-SOL vượt qua Kimi K3 trong các bài kiểm tra Toán học đa bước, Vật lý và Lập trình

Trong một bài kiểm tra so sánh trực tiếp, GPT-5.6-SOL đã giải quyết thành công một bài toán xác suất, một kịch bản ròng rọc-quán tính và một đoạn mã Python phức tạp, trong khi Kimi K3 bị giới hạn token hoặc hết thời gian chờ, không đưa ra được kết quả nào có thể sử dụng được.

AI · 3 min read

GPT-5.6-SOL vượt mặt Kimi K3 sau khi ngân sách token cạn kiệt trong các tác vụ đa bước

Trong một bài kiểm tra so sánh trực tiếp, GPT-5.6-SOL đã hoàn thành ba thử thách phức tạp về toán học, vật lý và lập trình trong cùng một giới hạn token, trong khi Kimi K3 liên tục chạm ngưỡng giới hạn token và hết thời gian chờ, khiến các nhà phát triển không nhận được câu trả lời cuối cùng.

AI · 2 min read

Khảo sát của Match Group cho thấy 47% người dùng trẻ không tin tưởng vào AI trong hẹn hò

Một cuộc thăm dò của Match Group trên 1.000 người trưởng thành tại Mỹ từ 18-39 tuổi cho thấy gần một nửa không tin tưởng vào AI trong chuyện tình cảm, tuy nhiên Bumble, Tinder và Hinge vẫn đang chạy đua với việc sử dụng bot, cắt giảm nhân sự và ra mắt các nền tảng chỉ dành riêng cho AI, đặt cược vào việc ghép đôi bằng thuật toán bất chấp những lo ngại của người dùng.

AI · 2 min read

Vertu Alphafold có giá 6.880 USD nhưng lại sử dụng phần cứng của ZTE Nubia Fold giá 1.100 USD

Alphafold mới của Vertu kết hợp tác nhân AI Hermes có khả năng tự động hóa quy trình làm việc đa bước với lớp vỏ bọc da bê điểm xuyết titan—tuy nhiên, khung máy bên trong lại tương đồng với chiếc ZTE Nubia Fold giá 1.100 USD, làm dấy lên những nghi vấn về giá trị thực sự đằng sau mức giá xa xỉ của nó.

AI · 2 min read

AI Agent Hand-offs Expose Data – Vendors Must Show Runtime Safeguards

The 2026 audit of MCP, A2A and ACP protocols uncovered 35 specification errors and 30 additional failures when chained, showing that a single compromised agent can silently leak data. Researchers recommend tamper-evident ledgers, least-privilege tokens, content labeling, cryptographic trace IDs, and

AI · 3 min read

Giáo viên Ấn Độ bị đình chỉ công tác sau khi video trong nhóm chat gây ra tranh cãi về video giả mạo bằng AI

Sự lan truyền của đoạn clip đã gây ra những ý kiến trái chiều trên mạng: một số người phát hiện ra các lỗi deep-fake, trong khi những người khác lập luận rằng chỉ riêng khả năng thao túng bằng AI cũng đủ khiến bất kỳ video nào trở nên không đáng tin cậy, làm lộ ra một điểm mù trong công nghệ phát hiện hiện nay.

AI · 3 min read

Agility Robotics khai trương cơ sở tại Fremont rộng 60.000 foot vuông nhằm đẩy nhanh các đơn hàng Digit trị giá 300 triệu USD

Cơ sở đào tạo mới cho phép Digit thực hành mọi thứ, từ di chuyển các thùng hàng đến dỡ toàn bộ rơ-moóc, biến các thử nghiệm thực địa rời rạc thành một quy trình có khả năng lặp lại với hiệu suất cao, giúp rút ngắn đáng kể khoảng cách giữa việc cập nhật phần mềm và triển khai tại xưởng sản xuất.

AI · 4 min read

Sự chuyển dịch bộ nhớ AI đẩy giá điện thoại phân khúc giá rẻ tại Ấn Độ tăng 68%

Các nhà sản xuất chip đang chuyển hướng năng lực sản xuất wafer sang bộ nhớ băng thông cao phục vụ các trung tâm dữ liệu AI, làm sụt giảm nguồn cung RAM tiêu chuẩn dùng cho điện thoại giá rẻ. Sự gia tăng chi phí này đã khiến giá điện thoại thông minh phân khúc giá rẻ tại Ấn Độ tăng tới 68%, kéo theo mức giảm 45% lượng máy được xuất xưởng trong phân khúc dưới 15.000 Rupee.

AI · 3 min read

Các công cụ tìm kiếm AI nhắc đến thương hiệu một cách đầy may rủi, hệ thống giám sát mới đã chứng minh điều này

Hệ thống thực hiện mỗi câu lệnh từ 7-8 lần trên nhiều khu vực và thiết bị khác nhau, sau đó tính toán khoảng tin cậy, cho thấy việc nhắc đến thương hiệu trong ChatGPT, Claude, Gemini và các công cụ khác thay đổi vô cùng thất thường giữa các truy vấn.

AI · 3 min read