Databricks và NVIDIA đang xây dựng một nền tảng 'từ đầu đến cuối' cho kỷ nguyên tác nhân AI (agentic era), tích hợp CPU Vera của NVIDIA (CPU đầu tiên được thiết kế để điều phối tác nhân), các môi trường GPU serverless... Sự hợp tác này phản ánh một sự thay đổi lớn trong ngành: hiệu suất của các tác nhân AI hiện nay...
Câu trả lời nghiên cứu

Create a landscape editorial hero image for this Studio Global article: How are Databricks and NVIDIA deepening their partnership to optimize AI agent workloads, and what specific technologies, integrations, and. Article summary: Databricks and NVIDIA are significantly deepening their partnership to build an end-to-end platform purpose-built for the "agentic era," integrating NVIDIA's latest silicon (Vera CPU, Blackwell/Rubin GPUs), serverless GP. Topic tags: general, general web, user generated, documentation. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks,
Databricks và NVIDIA đang chính thức nâng tầm quan hệ đối tác chiến lược để xây dựng một nền tảng trọn gói cho 'kỷ nguyên tác nhân' (agentic era). Sự hợp tác này tích hợp sâu các thế hệ silicon mới nhất của NVIDIA (CPU Vera, GPU Blackwell/Rubin), các môi trường GPU serverless, và các công cụ dành riêng cho tác nhân AI trực tiếp vào nền tảng Databricks Data Intelligence Platform .
Sự hợp tác này nhắm đến toàn bộ vòng đời của tác nhân AI – từ huấn luyện và tinh chỉnh trên GPU NVIDIA không máy chủ, đến suy luận và điều phối trên CPU Vera của NVIDIA – tất cả đều được gắn kết với lakehouse của Databricks để đảm bảo quản trị dữ liệu. Dưới đây là các công nghệ, tích hợp cụ thể và xu hướng ngành mà sự hợp tác này bao gồm.
Databricks đang tích hợp CPU Vera mới của NVIDIA – được mệnh danh là 'CPU dành cho các tác nhân' – vào nền tảng của mình. Vera là một CPU tùy chỉnh dựa trên kiến trúc Arm, sở hữu bộ nhớ đệm L3 lên tới 256 MB và một đơn vị phần cứng chuyên dụng để phân tích cú pháp JSON, được thiết kế đặc biệt để xử lý các vòng lặp điều phối và học tăng cường (reinforcement learning) vốn là điểm nghẽn của khối lượng công việc tác nhân . Đây là một sự thay đổi cơ bản trong hạ tầng: NVIDIA và Databricks đang đặt cược rằng hiệu suất của các tác nhân AI hiện bị giới hạn bởi CPU máy chủ (nơi chạy các vòng lặp lập kế hoạch, gọi công cụ và quản lý bộ nhớ) chứ không chỉ đơn thuần là thông lượng GPU
.
Databricks đã ra mắt AI Runtime – một lớp tính toán không máy chủ (serverless) cung cấp quyền truy cập theo yêu cầu vào các GPU NVIDIA A10 và H100 cho việc huấn luyện và tinh chỉnh các mô hình học sâu mà không cần quản lý hạ tầng . Tính năng huấn luyện phân tán đa nút (multi-node) và hỗ trợ nhiều GPU (multi-GPU) hiện đang trong giai đoạn thử nghiệm beta, và dịch vụ này được thiết kế cho thị giác máy tính, mô hình ngôn ngữ lớn (LLM) và các hệ thống đề xuất dựa trên học sâu
.
Khả năng tăng tốc GPU của NVIDIA hiện đã có sẵn trong gói miễn phí (Free Edition) của Databricks, giúp hạ thấp rào cản cho các nhà phát triển muốn thử nghiệm với các tác nhân AI .
Sự hợp tác mở rộng bao gồm các cải tiến trong việc phục vụ mô hình cho khối lượng công việc tác nhân và hỗ trợ toàn diện cho bộ phần mềm hướng tác nhân của NVIDIA (ví dụ: NVIDIA Agent Toolkit, các microservice NIM) chạy trên dữ liệu doanh nghiệp được quản trị trong lakehouse của Databricks .
Khả năng tính toán tăng tốc của NVIDIA được tích hợp vào Databricks Photon – công cụ SQL hiệu suất cao – nhằm tăng tốc quá trình tiền xử lý dữ liệu và ETL cho các pipeline AI . CEO của NVIDIA, Jensen Huang, cho biết phải mất năm năm để xây dựng các thư viện giúp khả năng tăng tốc này trở nên khả thi
.
Quan hệ đối tác này được xây dựng rõ ràng xung quanh sự chuyển dịch từ các mô hình AI tĩnh sang các tác nhân AI tự động, có khả năng thực hiện các bước đa nhiệm, đòi hỏi sự kết hợp chặt chẽ giữa dữ liệu, tính toán và điều phối. Một báo cáo của Databricks cho thấy mức tăng 327% trong việc áp dụng các hệ thống AI tự động khi bước vào năm 2026 .
NVIDIA và Databricks đang đặt cược rằng hiệu suất của các tác nhân AI hiện bị giới hạn bởi CPU máy chủ (nơi chạy các vòng lặp lập kế hoạch, gọi công cụ và quản lý bộ nhớ) chứ không chỉ đơn thuần là thông lượng GPU. CPU Vera được thiết kế để thu hẹp khoảng cách này .
Một xu hướng cốt lõi là các tác nhân phải hoạt động dựa trên dữ liệu doanh nghiệp chất lượng cao và được quản trị. Sự hợp tác này nhấn mạnh việc mang khả năng tăng tốc của NVIDIA đến lakehouse được quản trị bởi Unity Catalog của Databricks, để các tác nhân có thể suy luận dựa trên dữ liệu đáng tin cậy thay vì các nguồn dữ liệu rời rạc hoặc không được quản lý .
Databricks cũng đang đầu tư vào các giao thức mở (OpenSharing dành cho Kỹ năng tác nhân – Agent Skills) và các công cụ xây dựng tác nhân (Agent Bricks, Lakebase cho trí nhớ tác nhân), trong khi NVIDIA đồng thời mở rộng quan hệ đối tác AI Factory với HPE và các đối tác khác. Điều này định vị sự hợp tác hiện tại trong bối cảnh rộng lớn hơn của ngành công nghiệp, hướng tới xây dựng một hạ tầng tác nhân chuẩn hóa, sẵn sàng cho sản xuất .
Studio Global AI
Trang này bao gồm câu trả lời dựa trên nguồn mà bạn có thể tiếp tục bên trong Studio Global.
Databricks và NVIDIA đang xây dựng một nền tảng 'từ đầu đến cuối' cho kỷ nguyên tác nhân AI (agentic era), tích hợp CPU Vera của NVIDIA (CPU đầu tiên được thiết kế để điều phối tác nhân), các môi trường GPU serverless...
Databricks và NVIDIA đang xây dựng một nền tảng 'từ đầu đến cuối' cho kỷ nguyên tác nhân AI (agentic era), tích hợp CPU Vera của NVIDIA (CPU đầu tiên được thiết kế để điều phối tác nhân), các môi trường GPU serverless... Sự hợp tác này phản ánh một sự thay đổi lớn trong ngành: hiệu suất của các tác nhân AI hiện nay bị giới hạn bởi CPU máy chủ chứ không phải GPU, và các doanh nghiệp đang yêu cầu các tác nhân phải hoạt động dựa trên dữ...
Các công nghệ chính bao gồm: CPU Vera (bộ nhớ đệm 256 MB, phần cứng chuyên dụng phân tích JSON), AI Runtime (GPU serverless), hỗ trợ GPU trong gói miễn phí của Databricks, và công cụ Photon được tăng tốc bởi CUDA của...