Cùng ngày tin tức về Nemotron 4 được công bố, Nvidia đã phát hành hai sản phẩm mã nguồn mở mới tập trung vào lớp AI tác tử (agentic AI) :
Nemotron 3.5 Lightning — Một mô hình hỗn hợp chuyên gia (MoE) có 30 tỷ tham số, nhưng chỉ kích hoạt 3 tỷ tham số cho mỗi bước suy luận, mang lại tốc độ đầu ra nhanh gấp khoảng 4 lần so với các mô hình dày đặc tương tự. Mô hình này được thiết kế cho các tác vụ tác tử chuyên biệt, khối lượng lớn và có thể chạy trên một GPU duy nhất . Phó chủ tịch Nvidia, bà Kari Briski, cho biết mô hình này "chứa đựng kiến thức của các mô hình mạnh mẽ hơn" được chưng cất (distill) thành một dạng nhẹ và hiệu quả
.
NeMo Switchyard — Một thư viện định tuyến mã nguồn mở có nhiệm vụ tự động gán từng bước trong quy trình làm việc của một tác tử AI cho mô hình phù hợp nhất (dù là mô hình mở hay độc quyền), mà không yêu cầu viết lại ứng dụng. Các thử nghiệm của Nvidia cho thấy công cụ này có thể giảm chi phí tác tử xuống còn khoảng một phần ba so với chi phí cơ bản . Các triển khai thực tế bao gồm nền tảng Devin của Cognition và các nền tảng tác tử khác
.
Chiến lược mã nguồn mở của Nvidia phục vụ một mục đích kinh doanh cốt lõi: mở rộng việc áp dụng AI để thúc đẩy nhu cầu GPU. Bằng cách phát hành các mô hình mã nguồn mở chất lượng cao miễn phí, Nvidia hạ thấp rào cản cho các doanh nghiệp trong việc xây dựng các ứng dụng AI, từ đó làm tăng nhu cầu về phần cứng của Nvidia . Công ty cũng đã thành lập Liên minh Nemotron (tháng 3 năm 2026), một sự hợp tác đầu tiên thuộc loại này giữa các phòng thí nghiệm AI bao gồm Mistral AI, Perplexity, Reflection AI và các bên khác, nhằm thúc đẩy các mô hình tiên tiến mã nguồn mở thông qua việc chia sẻ dữ liệu và sức mạnh tính toán
.
Sự trỗi dậy của các mô hình mã nguồn mở Trung Quốc giá rẻ, hiệu suất cao — dẫn đầu là cú sốc DeepSeek đầu năm 2025 và sau đó là Kimi K3 của Moonshot AI (mô hình mã nguồn mở lớn nhất từng được phát hành) — đã làm chao đảo các công ty công nghệ Mỹ . Các mô hình này có hiệu suất gần với các mô hình tiên tiến của Mỹ nhưng với chi phí chỉ bằng một phần nhỏ, thách thức khả năng định giá của toàn ngành
. Giám đốc điều hành Nvidia, Jensen Huang, đã công khai kêu gọi chính quyền Washington đón nhận các mô hình mở thay vì cấm chúng, lập luận rằng AI mã nguồn mở không phải là rủi ro an ninh mà là chất xúc tác cho sự áp dụng và đổi mới rộng rãi hơn
. Các bản phát hành mô hình mở của Nvidia đã được đẩy nhanh như một phản ứng trực tiếp trước làn sóng cạnh tranh này
.
Vào cuối tháng 7 năm 2026, Nvidia đã bắt đầu âm thầm tập hợp một nhóm kỹ thuật an toàn và bảo mật AI chuyên trách, được tiết lộ qua một loạt tin tuyển dụng nội bộ . Nhóm này đang tuyển dụng các vị trí cấp cao như trưởng nhóm kỹ thuật sáng lập (kỹ sư xuất sắc), kỹ sư nghiên cứu bảo mật, kỹ sư đánh giá và quản lý cấp cao
. Nhiệm vụ của họ là giải quyết các lỗ hổng trong các tác tử AI tự động và mô hình trọng số mở (open-weight models), phát triển phần mềm bảo mật dựa trên AI và tiến hành các đánh giá an toàn trước khi các mô hình được triển khai rộng rãi
.
Nhóm nội bộ này tách biệt nhưng bổ trợ cho Liên minh Mở vì An toàn AI (Open Secure AI Alliance), một liên minh rộng lớn hơn mà Nvidia thành lập vào tháng 7 năm 2026 cùng với Microsoft, SpaceX, Dell và các công ty khác để phát triển các công cụ an toàn và an ninh mạng mã nguồn mở cho AI — được hình thành vài ngày sau một vụ tấn công mạng nổi tiếng liên quan đến các mô hình OpenAI bất hảo .