
Bài phát biểu quan trọng tại NVIDIA GTC 2026 - Tầm nhìn của Jensen Huang về Kỷ nguyên Nhà máy AI
Điều Hướng Nhanh
Thẻ
Chia sẻ slide
Bài phát biểu quan trọng tại NVIDIA GTC 2026 - Tầm nhìn của Jensen Huang về Kỷ nguyên Nhà máy AI
Xem chi tiết từng trang slide, bao gồm bố cục, nội dung chính và các phần tử trực quan.
Trang mở đầu với logo NVIDIA GTC và các biểu tượng ngành dọc: Automotive, Financial Services, Healthcare, Industrial, Media, Quantum, Retail, Robotics, Telco
Nền tối với logo GTC ở giữa và 9 thẻ biểu tượng bên dưới
Slide về quan hệ đối tác chiến lược thể hiện sự hợp tác giữa NVIDIA, Palantir và Dell Technologies với khách hàng doanh nghiệp (Accenture, CenterPoint Energy, Hertz, Lowe's, Teton Ridge) và các công cụ nền tảng Palantir
Ba logo ở trên cùng với biểu tượng trái tim, logo đối tác ở phần giữa, lưới các công cụ Palantir, chồng nền tảng NVIDIA AI Platform ở dưới cùng
Bản đồ hệ sinh thái toàn diện của các công ty AI-native trên 8 danh mục: AI for Auto, Customer Support, Engineering, Healthcare, Robotics, Search, Software Development, cộng với DL/Inference Frameworks, Agent Frameworks, Frontier Model Builders, Model to Production
Bố cục lưới với logo công ty được sắp xếp theo danh mục, chồng nền tảng NVIDIA AI Platform ở dưới cùng
Kết xuất trên không theo phong cách điện ảnh cho thấy một chiếc máy bay bay qua địa hình núi non, thể hiện khả năng mô phỏng NVIDIA Omniverse
Hình ảnh điện ảnh tràn lề với khung bo tròn
Dòng thời gian hiển thị sự tăng trưởng tính toán suy luận: 2023 (ChatGPT), 2024 (o1 - 10X models/context, 10X tokens), 2025 (Claude Code - 100X models/context, 100X tokens)
Dòng thời gian ngang với ba biểu tượng hình tròn đại diện cho mỗi kỷ nguyên
NVIDIA full-stack mở rộng đến tất cả các khu vực/ngành. Blackwell+Rubin pipeline tăng trưởng từ $0.5T lên $1T+. Khách hàng mới kể từ GTC DC 2025: Anthropic, MetaSL, Multiple OSS, xAI, Gemini, OpenAI. Phân phối CUDA: 60% Cloud/AI Natives, 40% Hyperscalers + NCP/SCC/Sovereign AI/Industrial/Enterprise
Bố cục hai biểu đồ: biểu đồ cột cho tăng trưởng pipeline, biểu đồ tròn cho phân phối CUDA
GB NVL72 'Inference King': Hiệu năng/watt cao hơn 50 lần, chi phí token thấp hơn 35 lần so với đối thủ cạnh tranh. Điểm chuẩn InferenceX của SemiAnalysis sử dụng DeepSeek R1 0528 FP4 1K/1K
Hai biểu đồ cạnh nhau: Tokens per Watt so với Interactivity, Performance so với Token Cost
Điểm chuẩn tốc độ đầu ra (3 tháng 3 năm 2026): Baseten 185, Fireworks 170, Lightning AI 99 tokens/giây. Tất cả các điểm cuối suy luận hàng đầu đều chạy trên NVIDIA. Mô hình Kimi K2.5 Reasoning
Biểu đồ cột ngang xếp hạng các nhà cung cấp suy luận theo tốc độ đầu ra
Luận điểm cốt lõi: Inference là Workload, Tokens là New Commodity, Compute là Revenue. Luồng hình ảnh: Electricity → AI Factory → Tokens → AI Agents
Sơ đồ luồng từ trái sang phải với hình minh họa vẽ tay
Thông số kỹ thuật Vera Rubin POD: AI FLOPS 60,000 PF, Memory Bandwidth 92 TB/s, All-to-All Bandwidth 260 TB/s, Scale-Out Radix 131,072. Hiển thị tiến trình từ chip đến rack
Trình diễn phần cứng với chip ở trên cùng, khay máy chủ ở giữa, rack đầy đủ ở dưới cùng
Ảnh chụp trực tiếp từ sân khấu bài phát biểu quan trọng của Jensen Huang trình bày biểu đồ kinh tế suy luận cho khán giả đông nghịt
Ảnh chụp sân khấu góc rộng
Khung hiển thị thông lượng (TPS/MW) so với tính tương tác (TPS/Người dùng) với các bậc giá: Miễn phí (Qwen 3, $0), Trung bình (Kimi K2.5, $3), Cao (GPT MoE 2T, $6), Cao cấp (GPT MoE 2T 400K, $45), Siêu cấp ($150)
Biểu đồ phân tán với nhãn bậc ở dưới cùng
Đường cong hiệu suất Hopper hiển thị thông lượng cơ bản trên các bậc Miễn phí và Trung bình
Biểu đồ đường với một đường cong Hopper duy nhất
Đường cong Blackwell NVL72 được thêm vào cho thấy sự cải thiện 35 lần so với Hopper, mở rộng đến bậc Cao ($6)
Biểu đồ đường với hai đường cong, Blackwell màu xanh lá cây
Đường cong Blackwell được mở rộng đến bậc Cao cấp ($45), cho thấy hiệu suất bền vững ở mức 400 TPS/Người dùng
Biểu đồ tương tự với đường cong Blackwell được mở rộng
Đường cong Rubin NVL72 được thêm vào: Gấp 2 lần so với Blackwell ở 50 TPS, gấp 2 lần ở 100 TPS, gấp 3 lần ở 200 TPS, gấp 10 lần ở 400 TPS
Biểu đồ so sánh ba đường cong
So sánh doanh thu trên mỗi gigawatt: Blackwell so với Rubin trên các cấp. Tổng doanh thu hàng năm tăng từ $30B lên $150B (gấp 5 lần) với Rubin
Biểu đồ cột với các cột Blackwell (màu teal) và Rubin (màu xanh lá cây) xếp chồng lên nhau
Biểu đồ ba đường cong tương tự hiển thị sự tiến triển hiệu suất Hopper → Blackwell → Rubin
Biểu đồ hiệu suất với ba đường cong
Đường cong Rubin + LPX mở rộng đến cấp Ultra ($150, 1000+ TPS/Người dùng) duy trì gấp 35 lần so với Hopper trên tất cả các cấp
Biểu đồ bốn đường cong với phần mở rộng LPX màu vàng-xanh
Sơ đồ kiến trúc Agent: NemoClaw ở trung tâm với các kết nối đến Multi-Modal Prompt, Files, Computer Use, Tools (CLI/MCP), OpenShell, Sub-Agents, Skills, LLM, Memory. Được hỗ trợ bởi Nemotron/NeMo/Dynamo/NIM và cuDF/cuVS/vGPU/cuOPT/AI-Q
Sơ đồ kiến trúc hình tròn với viền màu xanh lá cây phát sáng trên các tấm bên
NVIDIA là nhà đóng góp lớn nhất thế giới cho AI mã nguồn mở (hơn 400 repos, vượt qua Alibaba Cloud). Giới thiệu các mô hình BioNeMo, Earth-2, Nemotron, Cosmos, GR00T, Alpamayo
Biểu đồ trung tâm với các thẻ mô hình ở hai bên
Giới thiệu mô hình AI thời tiết/khí hậu Earth-2 với hình ảnh Trái Đất siêu thực
Chế độ xem chia đôi với thẻ mô hình ở bên trái và quả cầu Trái Đất lớn ở bên phải
12 kết quả benchmark trên Nemotron 3 Super, NemotronVL, Nemotron VoiceChat, Cosmos Predict/Reason, GR00T N, Alpamayo. Tất cả đều cho thấy hiệu suất hàng đầu hoặc SOTA
Lưới 4x3 các bảng kết quả benchmark
Bảng xếp hạng: claude-sonnet-4.6 (86.9%), claude-opus-4.6 (86.3%), gpt-5.4 (86.0%), nvidia/nemotron-3-super-120b-a12b (85.6%) - mô hình mở tốt nhất
Bảng xếp hạng biểu đồ thanh ngang
Hiệu quả gấp 5 lần và độ chính xác suy luận cao nhất trên GB200 NVL72. So sánh với GLM và Kimi K2 trên các chỉ số Peak Throughput, MMLU Pro, HumanEval/MBPP, GSM8K, Global MMLU
So sánh hai biểu đồ: các thanh throughput và các thanh độ chính xác
Bản đồ toàn cầu hiển thị việc áp dụng Nemotron: US, EuroLLM, Linagora (France), Bielik.ai (Poland), SOOFI, Dicta (Israel), TII (UAE), HUMAIN, BharatGen/Gnani.ai/Sarvam AI (India), Viettel, NAVER/Trillion Labs, Institute of Science Tokyo, AI Singapore, Indosat, WideLabs (Brazil)
Bản đồ thế giới được chiếu sáng ban đêm với các ghim được gắn nhãn
Các nhà lãnh đạo AI toàn cầu tham gia NVIDIA Nemotron Coalition: Black Forest Labs, Cursor, LangChain, Mistral AI, Perplexity, Reflection, Sarvam, Thinking Machines
Logo NVIDIA ở trên cùng với trái tim, logo đối tác ở hai hàng bên dưới
12 sơ đồ kiến trúc tác nhân doanh nghiệp từ Adobe, Atlassian, Cadence, Cisco, CrowdStrike, Dassault Systemes, Palantir, Salesforce, SAP, ServiceNow, Siemens, Synopsys. Cộng với hơn 40 logo đối tác bổ sung
Lưới 4x3 các sơ đồ kiến trúc chi tiết với dải logo đối tác ở dưới cùng
12 tác nhân doanh nghiệp khác: Abridge, CodeRabbit, Cohesity, Edison, IQVIA, Mastercard, Microsoft Security, PayPal, Perplexity, Xiaohongshu, Rockwell Automation, Schneider Electric
Lưới 4x3 các sơ đồ kiến trúc
Sơ đồ kiến trúc tác nhân tương tự như trang 20
Sơ đồ kiến trúc hình tròn
Showroom robot được dựng bằng Omniverse, trưng bày hơn 30 robot từ Boston Dynamics, Figure, Foxconn, Agility, 1X, LG Electronics, XPENG, Disney Research và nhiều hãng khác. Robot công nghiệp và hình người cùng với các loại xe
Sảnh triển lãm được dựng 3D với các robot được bố trí trên sàn
Màn hình chia đôi hiển thị mô phỏng (bên trái, màu pastel) so với cánh tay robot thực tế (bên phải, màu kim loại) thực hiện các tác vụ lắp ráp
So sánh cạnh nhau trong khung tròn
Kết xuất chân thực như ảnh chụp ngôi làng theo chủ đề Frozen của Disney được tạo bằng NVIDIA Omniverse
Kết xuất điện ảnh tràn lề
Cảnh CG theo phong cách Pixar kỳ lạ về Jensen Huang hoạt hình nướng kẹo dẻo bên đống lửa trại với nhiều robot và một linh vật tôm hùm
Kết xuất điện ảnh tràn lề
Logo NVIDIA sạch sẽ trên nền tối - phần chia
Logo căn giữa
Doanh thu trên mỗi gigawatt với VR+LPX: Tổng doanh thu hàng năm từ $30B đến $300B (10X). Biểu đồ cột chồng ba màu: Blackwell, Rubin, VR+LPX trên tất cả các bậc giá
Biểu đồ cột chồng với ba thế hệ phần cứng
So sánh chip: Rubin GPU (288GB HBM4, 22 TB/s, 50 PFLOPs NVFP4, 336B transistors) so với Groq 3 LPU (500MB SRAM, 150 TB/s bandwidth, 1.2 PFLOPs FP8, 98B transistors)
Ảnh chip cạnh nhau với thông số kỹ thuật bên dưới
So sánh theo tỷ lệ: 8 Groq 3 LPU = 4GB SRAM, 1,200 TB/s (55X so với Rubin), 9.6 PFLOPs, 784B transistors. 'Uniting Processors of Extreme Performances' (Kết hợp các bộ xử lý hiệu năng cực cao)
Cạnh nhau với các chip Groq được nhân lên
Kiến trúc suy luận Dynamo: Vera Rubin NVL72 xử lý Prefill+Decode Attention, Groq 3 LPX xử lý Decode FFN. KV Cache được chia sẻ, Activations được trao đổi hai chiều
Sơ đồ kiến trúc kỹ thuật với ba thành phần
Giá đỡ Groq 3 LPX: 315 PFLOPS AI Inference, 128GB SRAM, 40 PB/s bandwidth, 256 chips, 640 TB/s scale-up. Sẵn có 2H26. Hiển thị chi tiết giá đỡ và nút với 8 LPU, FPGA, Host CPU, BF4
Ảnh sản phẩm với danh sách thông số kỹ thuật ở bên phải, sơ đồ nút chi tiết bên dưới
AI Labs: Anthropic, Cursor, Meta, OpenAI, Perplexity, Black Forest Labs, Cohere, Harvey, Mistral AI, OpenEvidence, Runway, Thinking Machines. Cloud: AWS, Google Cloud, Azure, Oracle, CoreWeave, Crusoe, Lambda, Nebius, NScale. OEMs: Dell, HPE, Lenovo, Supermicro, v.v.
Ảnh sản phẩm bên trái, lưới đối tác ba tầng bên phải
Đối tác Cloud: Meta, Oracle, CoreWeave, Crusoe, Lambda, Nebius, NScale, together.ai. OEMs: Cisco, Dell, HPE, Lenovo, Supermicro, ASRock, ASUS, COMPAL, Foxconn, etc. 256 Vera CPUs, 300 TB/s LPDDR5X
Ảnh sản phẩm bên trái, lưới đối tác hai tầng bên phải
Cloud: CoreWeave, Crusoe, CREN, Lambda, Mistral AI, Nebius, Oracle, Vultr. OEMs: AIC, Cloudian, DDN, Dell, HPE, Hitachi, IBM, MinIO, NetApp, Nutanix, v.v. 5x Tokens/sec, 50 Tb/s, 16TB Shared Context/GPU
Ảnh sản phẩm bên trái, lưới đối tác hai tầng bên phải
Hệ thống hoàn chỉnh: So sánh 1GW AI Factory X86+Hopper (600K GPUs, 1.2 ZFLOPS, 2M TPS) so với Vera Rubin (300K GPUs, 16 ZFLOPS, 700M TPS). Hiển thị tất cả 7 chip và 6 yếu tố hình thức hệ thống
Bảng so sánh ở trên cùng, hình ảnh chip/khay trong hai hàng, rack ở dưới cùng
Lộ trình ba thế hệ: Blackwell (2024), Rubin (2026), Feynman (2028). Mỗi thế hệ có dòng chip, hệ thống rack. Feynman giới thiệu Die Stacking Custom HBM, LP40 NVLink, Rosa CPU, BlueField-5, NVLink 8 CPO
Tiến trình từ trái sang phải với kết xuất phần cứng xếp chồng lên nhau
Đồng thiết kế cực độ ở quy mô cơ sở hạ tầng. Ba lớp: Thiết kế tham khảo (Rubin DSX, Hệ sinh thái DSX, Bản thiết kế Omniverse DSX), Thư viện/API/Phần mềm (DSX Max-Q, DSX Flex, DSX Exchange, DSX Sim), Chip/Hệ thống/Cơ sở vật chất (Nguồn → Làm mát bằng chất lỏng)
Kiến trúc ngang ba tầng với kết xuất nhà máy AI ở dưới cùng
Ảnh chụp trên không chân thực về một trung tâm dữ liệu nhà máy AI quy mô lớn với các hàng rack máy chủ làm mát bằng chất lỏng
Kết xuất điện ảnh toàn màn hình
Danh sách đối tác DSX Flex, DSX Max-Q, DSX Sim, DSX Exchange. Hơn 40 đối tác mỗi danh mục bao gồm CoreWeave, Crusoe, Digital Realty, NSCALE, Red Hat, Dell, Cadence, Siemens, VAST, WEKA, v.v.
Lưới đối tác bốn phần tư với kết xuất nhà máy ở dưới cùng
Thông báo về NVIDIA Space-1: Mô-đun tính toán Vera Rubin được thiết kế để triển khai trên vệ tinh
Hình ảnh chip dựng ở bên trái, mảng vệ tinh tấm năng lượng mặt trời ở bên phải, Trái đất ở phía sau
Biểu đồ lịch sử sao GitHub cho thấy openclaw/openclaw vượt qua facebook/react và torvalds/linux vào năm 2026. Linh vật tôm hùm được giới thiệu
Biểu đồ lịch sử sao với hình minh họa linh vật
Ảnh chụp màn hình Terminal hiển thị cài đặt nemoclaw (curl -fsSL nvidia.com/nemoclaw.sh | bash) và onboarding (nemoclaw onboard)
Ảnh chụp màn hình cửa sổ Terminal xếp chồng lên nhau
Kiến trúc agent tổng quát: Agent ở trung tâm với các kết nối đến Multi-Modal Prompt, Files, Computer Use, Tools (CLI/MCP), Sub-Agents, Skills, LLM (nhiều nhà cung cấp), Memory
Sơ đồ kiến trúc hình tròn theo phong cách vẽ tay
Mô hình IT truyền thống: Chi phí IT Doanh nghiệp → Software/SaaS + GSI → Files → Data Centers
Sơ đồ luồng dọc, chỉ bên trái
Mô hình mới: Người lao động thông tin doanh nghiệp → Software/SaaS + GSI + AI Providers + AI Natives → Tokens → AI Factories. So sánh trước/sau cạnh nhau
So sánh trước/sau hai cột
Logo NVIDIA trên nền tối
Logo căn giữa
Cảnh mô phỏng nước/sóng chân thực cho thấy cơ chế cổng chống lũ công nghiệp với khả năng hiển thị nước động
Hình ảnh dựng điện ảnh tràn lề
Hình ảnh trên không được kết xuất 3D của địa điểm hội nghị GTC 2026 ở San Jose với các tòa nhà và không gian sự kiện mang thương hiệu NVIDIA
Hình ảnh dựng thành phố điện ảnh với lớp phủ logo GTC
Dàn diễn giả: Sarah Guo (lần xuất hiện thứ 3), Alfred Lin (lần thứ 2, ra mắt với vai trò người dẫn chương trình năm 2026), Gavin Baker (lần thứ 2, ra mắt với vai trò người dẫn chương trình năm 2026). Thêm 20+ diễn giả khác bao gồm Harrison Chase, Michael Dell, Anirudh Devgan, v.v.
Ba diễn giả nổi bật trong các thẻ lớn ở trên cùng, lưới các thẻ diễn giả nhỏ hơn ở bên dưới
Hơn 250 logo công ty bao gồm ABB, Apple, Adobe, Anthropic, AWS, BYD, Cisco, CoreWeave, Disney Research, Meta, Microsoft, OpenAI, Samsung, Tesla, Uber, Walmart, Xiaomi và nhiều công ty khác
Lưới logo dày đặc với hình ảnh 3D địa điểm tổ chức ở phía dưới
Sơ đồ bánh đà hình tròn: Đột phá → Nhà phát triển → Cơ sở đã cài đặt → Hệ sinh thái → quay lại Đột phá
Sơ đồ hình tròn tập trung trên nền đen
Ảnh sản phẩm nổi bật của card đồ họa GeForce GTX 1080 - tham chiếu lịch sử về nguồn gốc gaming của CUDA
Ảnh sản phẩm đặt ở giữa trên nền đen
Ảnh chụp màn hình game Hogwarts Legacy với DLSS 5 On, thể hiện chất lượng 3D-Guided Neural Rendering
Ảnh chụp màn hình game tràn viền
Ảnh chụp màn hình EA Sports FC với thông báo DLSS 5 3D-Guided Neural Rendering
Ảnh chụp màn hình game tràn viền
Bản đồ hệ sinh thái dữ liệu có cấu trúc trị giá $120B cho thấy cuDF tăng tốc các engine CSP (AWS, GCP, Azure), các nền tảng OSS thương mại (Clickhouse, Cloudera, Databricks), các engine độc quyền và các engine OSS (DuckDB, Pandas, Polars, Spark)
Sơ đồ mạng với cuDF ở dưới cùng kết nối với tất cả các lớp
Hệ sinh thái dữ liệu phi cấu trúc: hàng trăm zettabyte đang tăng trưởng theo cấp số nhân. cuVS tăng tốc tìm kiếm vector trên các cơ sở dữ liệu doanh nghiệp, các engine CSP, các engine OSS (Elasticsearch, FAISS, Milvus, v.v.)
Sơ đồ mạng với cuVS ở dưới cùng
IBM watsonx.data với NVIDIA cuDF: Cập nhật Order-to-Cash Data Mart 3 phút so với 15 phút, tiết kiệm chi phí 83% (CPU so với GPU). Trích dẫn từ Chris Wright, CIO của Nestle
Trích dẫn ở trên cùng, sơ đồ kiến trúc bên trái, biểu đồ cột bên phải
Ảnh chụp từ trên không của cơ sở sản xuất Nestle
Ảnh tràn viền
Dell AI Data Platform với NVIDIA cuVS/cuDF: Xử lý dữ liệu doanh nghiệp từ hàng giờ xuống còn vài phút (10TB, nhanh hơn 3 lần). Trích dẫn từ Abhijit Dubey, CEO của NTT DATA
Trích dẫn ở trên cùng, sơ đồ kiến trúc Dell bên trái, biểu đồ benchmark bên phải
Google Cloud AI Hypercomputer với cuDF: Nền tảng thử nghiệm A/B từ 45k CPU xuống 1k GPU, tiết kiệm chi phí 76%. Trích dẫn từ Saral Jain, CIO của Snap
Trích dẫn ở trên cùng, kiến trúc Google Cloud bên trái, biểu đồ tiết kiệm bên phải
Tổng quan về quan hệ đối tác đầy đủ: khách hàng (baseten, CrowdStrike, GM, Puma, Salesforce, Snapchat, v.v.), các dịch vụ của Google (Vertex AI, GKE, BigQuery, v.v.), NVIDIA AI Platform stack
Bố cục quan hệ đối tác ba tầng
Quan hệ đối tác AWS toàn diện: khách hàng (CrowdStrike, databricks, OpenAI, Perplexity, Palantir, v.v.), các dịch vụ AWS (Braket, EKS, Nitro Enclaves, SageMaker AI, EC2, v.v.)
Bố cục quan hệ đối tác ba tầng
Quan hệ đối tác Azure toàn diện: khách hàng (Anthropic, BlackRock, BMW, Krones, Rockwell, Synopsys), các dịch vụ Azure (Foundry, Windows 365, Fabric, AKS, Copilot, Bing)
Bố cục quan hệ đối tác ba tầng
Quan hệ đối tác Oracle toàn diện: khách hàng (Cohere, Fireworks AI, Neospace, Siemens, Uber, Zoom), các dịch vụ OCI (Superclusters, AI Database, Generative AI, Data Science, OKE)
Bố cục quan hệ đối tác ba tầng
Quan hệ đối tác CoreWeave toàn diện: khách hàng (Canva, Cohere, Cursor, Mercado Libre, Mistral AI, Morgan Stanley, OpenAI, Runway), các dịch vụ (W&B Models/Training/Inference/Weave, CoreWeave Inference/Slurm/K8s/Compute/Storage/Mission Control)
Bố cục quan hệ đối tác ba tầng
Các câu hỏi phổ biến về slide này và nội dung trình bày cơ bản.
Các thông báo chính bao gồm hệ thống Vera Rubin NVL72 với hiệu năng gấp 2 lần so với Blackwell, NVIDIA Groq 3 LPX (bộ tăng tốc suy luận dựa trên LPU mới với 315 PFLOPS và 128GB SRAM), nền tảng Vera Rubin hoàn chỉnh với 7 chip và 5 hệ thống rack, lộ trình kiến trúc Feynman cho năm 2028, mô-đun tính toán vệ tinh NVIDIA Space-1 và Nền tảng Nhà máy AI DSX để triển khai quy mô cơ sở hạ tầng.
Vera Rubin mang lại cải thiện thông lượng gấp 2 lần so với Blackwell NVL72 ở cả 50 và 100 TPS/Người dùng, mở rộng lên 3 lần ở 200 TPS và 10 lần ở 400 TPS. Một Nhà máy AI 1GW với Vera Rubin chỉ sử dụng 300K GPU (so với 600K với X86+Hopper) trong khi cung cấp 16 ZFLOPS (so với 1.2) và 700M token mỗi giây. Nó mở ra cơ hội doanh thu hàng năm trị giá 150 tỷ đô la trên mỗi gigawatt, tăng gấp 5 lần so với Blackwell.
NVIDIA và Groq đang kết hợp hai bộ xử lý có hiệu năng cực cao: GPU Rubin (288GB HBM4, 50 PFLOPs) cho các hoạt động điền trước nặng về tính toán và Groq 3 LPU (băng thông SRAM 150 TB/s) cho các hoạt động giải mã nặng về băng thông. NVIDIA Dynamo điều phối việc phân chia, gửi điền trước đến Vera Rubin NVL72 và giải mã FFN đến Groq 3 LPX, đạt hiệu suất gấp 35 lần so với chỉ Hopper.
NemoClaw là triển khai tham chiếu của NVIDIA cho OpenClaw, một bộ công cụ tác nhân mở để xây dựng các tác nhân AI chuyên dụng. Nó cung cấp khả năng xử lý lời nhắc đa phương thức, xử lý tệp, sử dụng máy tính, các công cụ CLI/MCP thông qua hộp cát OpenShell, các tác nhân phụ, kỹ năng, tích hợp LLM và bộ nhớ. Nó được hỗ trợ bởi Nemotron 3 Super (mô hình mở tốt nhất cho OpenClaw với 85.6% trên điểm chuẩn) và tận dụng cuDF, cuVS, vGPU và cuOPT cho các khả năng tác nhân được tăng tốc bằng GPU.
NVIDIA trình bày năm cấp suy luận dựa trên kích thước mô hình và tính tương tác: Miễn phí (Qwen 3, 235B, ngữ cảnh 32K, $0), Trung bình (Kimi K2.5, 1T, 128K, $3), Cao (GPT MoE 2T, 128K, $6), Cao cấp (GPT MoE 2T, 400K, $45) và Ultra (GPT MoE 2T, 400K, $150). Vera Rubin + LPX cho phép phục vụ có lợi nhuận trên tất cả các cấp, mở ra tổng doanh thu hàng năm trị giá 300 tỷ đô la trên mỗi gigawatt.
Hơn 24 doanh nghiệp lớn đã giới thiệu kiến trúc tác nhân: Adobe, Atlassian, Cadence, Cisco, CrowdStrike, Dassault Systemes, Palantir, Salesforce, SAP, ServiceNow, Siemens, Synopsys, Abridge, CodeRabbit, Cohesity, Edison, IQVIA, Mastercard, Microsoft Security, PayPal, Perplexity, Xiaohongshu, Rockwell Automation và Schneider Electric.
Các đối tác ra mắt Vera Rubin NVL72 bao gồm AWS, Google Cloud, Microsoft Azure, Oracle Cloud, CoreWeave, Crusoe, Lambda, Nebius và NScale. Bộ bài cũng giới thiệu sự tích hợp sâu sắc với các dịch vụ cụ thể của từng nhà cung cấp (ví dụ: Amazon SageMaker AI, Google Vertex AI, Azure Foundry, OCI Superclusters). Các đối tác OEM bao gồm Dell, HPE, Lenovo, Supermicro, Foxconn và nhiều đối tác khác.
NVIDIA mô tả 'Sự phục hưng CNTT Doanh nghiệp từ SaaS đến Agent-as-a-Service.' Mô hình truyền thống về Chi phí CNTT Doanh nghiệp chảy qua Phần mềm/SaaS và GSI đến các trung tâm dữ liệu chuyển đổi thành Nhân viên Thông tin Doanh nghiệp được hỗ trợ bởi Phần mềm/SaaS, GSI, Nhà cung cấp AI và Người bản xứ AI — tất cả đều tiêu thụ token từ Nhà máy AI. Điều này thể hiện một sự thay đổi cơ bản, trong đó tính toán trở thành doanh thu và token trở thành hàng hóa mới.
Create Your Own Slides
Turn your ideas into professional presentations in seconds with 2slides AI.
Tham khảo thiết kế chuyên nghiệp, chọn phong cách của bạn và tạo slide với kết xuất văn bản hoàn hảo. Được hỗ trợ bởi Nano Banana—bắt đầu tạo trình bày của bạn ngay bây giờ.
Your AI Agent for slides. Save time, shine faster with intelligent presentation creation.
All services online© 2026 2slides. All rights reserved.