
NVIDIA GTC 2026 Keynote - Το Όραμα του Jensen Huang για την Εποχή του Εργοστασίου AI
Γρήγορη Πλοήγηση
Ετικέτες
Κοινοποίηση διαφανειών
NVIDIA GTC 2026 Keynote - Το Όραμα του Jensen Huang για την Εποχή του Εργοστασίου AI
Λεπτομερής προβολή κάθε σελίδας διαφάνειας, συμπεριλαμβανομένης της διάταξης, βασικού περιεχομένου και οπτικών στοιχείων.
Εναρκτήρια διαφάνεια με το λογότυπο NVIDIA GTC και εικονίδια κάθετου κλάδου: Automotive, Financial Services, Healthcare, Industrial, Media, Quantum, Retail, Robotics, Telco
Σκούρο φόντο με το λογότυπο GTC στο κέντρο και 9 κάρτες εικονιδίων από κάτω
Διαφάνεια στρατηγικής συνεργασίας που δείχνει τη συνεργασία NVIDIA, Palantir και Dell Technologies με εταιρικούς πελάτες (Accenture, CenterPoint Energy, Hertz, Lowe's, Teton Ridge) και εργαλεία πλατφόρμας Palantir
Τρία λογότυπα στην κορυφή με καρδιές, λογότυπα συνεργατών στο μεσαίο τμήμα, πλέγμα εργαλείων Palantir, NVIDIA AI Platform stack στο κάτω μέρος
Ολοκληρωμένος χάρτης οικοσυστήματος εταιρειών AI-native σε 8 κατηγορίες: AI for Auto, Customer Support, Engineering, Healthcare, Robotics, Search, Software Development, συν DL/Inference Frameworks, Agent Frameworks, Frontier Model Builders, Model to Production
Διάταξη πλέγματος με λογότυπα εταιρειών οργανωμένα ανά κατηγορία, NVIDIA AI Platform stack στο κάτω μέρος
Κινηματογραφική εναέρια απόδοση που δείχνει ένα αεροπλάνο να πετά πάνω από ορεινό έδαφος, επιδεικνύοντας τις δυνατότητες προσομοίωσης του NVIDIA Omniverse
Κινηματογραφική εικόνα full-bleed με στρογγυλεμένο πλαίσιο
Χρονολόγιο που δείχνει την ανάπτυξη του inference compute: 2023 (ChatGPT), 2024 (o1 - 10X models/context, 10X tokens), 2025 (Claude Code - 100X models/context, 100X tokens)
Οριζόντιο χρονολόγιο με τρία κυκλικά εικονίδια που αντιπροσωπεύουν κάθε εποχή
Το NVIDIA full-stack επεκτείνεται σε όλες τις περιοχές/βιομηχανίες. Ο αγωγός Blackwell+Rubin αυξάνεται από $0.5T σε $1T+. Νέοι πελάτες από το GTC DC 2025: Anthropic, MetaSL, Multiple OSS, xAI, Gemini, OpenAI. Διανομή CUDA: 60% Cloud/AI Natives, 40% Hyperscalers + NCP/SCC/Sovereign AI/Industrial/Enterprise
Διάταξη δύο γραφημάτων: ραβδόγραμμα για την ανάπτυξη του αγωγού, κυκλικό γράφημα για τη διανομή CUDA
GB NVL72 'Inference King': 50X υψηλότερη απόδοση/watt, 35X χαμηλότερο κόστος token σε σύγκριση με τον ανταγωνισμό. InferenceX από SemiAnalysis benchmarks χρησιμοποιώντας DeepSeek R1 0528 FP4 1K/1K
Δύο διαγράμματα δίπλα-δίπλα: Tokens per Watt vs Interactivity, Performance vs Token Cost
Benchmark ταχύτητας εξόδου (3 Μαρτίου 2026): Baseten 185, Fireworks 170, Lightning AI 99 tokens/sec. Όλα τα κορυφαία inference endpoints τρέχουν σε NVIDIA. Kimi K2.5 Reasoning model
Οριζόντιο ραβδόγραμμα που κατατάσσει τους παρόχους inference ανά ταχύτητα εξόδου
Βασική θέση: Το Inference είναι το Workload, τα Tokens είναι το Νέο Εμπόρευμα, το Compute είναι Έσοδα. Οπτική ροή: Electricity → AI Factory → Tokens → AI Agents
Διάγραμμα ροής από αριστερά προς τα δεξιά με εικονογραφήσεις σχεδιασμένες στο χέρι
Προδιαγραφές Vera Rubin POD: AI FLOPS 60,000 PF, Memory Bandwidth 92 TB/s, All-to-All Bandwidth 260 TB/s, Scale-Out Radix 131,072. Δείχνει την εξέλιξη από chip σε rack
Hardware showcase με chips στην κορυφή, server trays στη μέση, full rack στο κάτω μέρος
Ζωντανή φωτογραφία από το κεντρικό stage του Jensen Huang που παρουσιάζει ένα διάγραμμα οικονομικών συμπερασμάτων σε ένα γεμάτο ακροατήριο
Φωτογραφία σκηνής ευρείας γωνίας
Πλαίσιο που δείχνει την απόδοση (TPS/MW) έναντι της διαδραστικότητας (TPS/User) με επίπεδα τιμολόγησης: Δωρεάν (Qwen 3, $0), Μεσαίο (Kimi K2.5, $3), Υψηλό (GPT MoE 2T, $6), Premium (GPT MoE 2T 400K, $45), Ultra ($150)
Διάγραμμα διασποράς με ετικέτες επιπέδων στο κάτω μέρος
Καμπύλη απόδοσης Hopper που δείχνει τη βασική απόδοση σε επίπεδα Free και Medium
Γραμμικό διάγραμμα με μία μόνο καμπύλη Hopper
Προστέθηκε η καμπύλη Blackwell NVL72 που δείχνει βελτίωση 35X σε σχέση με το Hopper, επεκτεινόμενη στο επίπεδο High ($6)
Γραμμικό διάγραμμα με δύο καμπύλες, Blackwell σε πράσινο χρώμα
Η καμπύλη Blackwell επεκτάθηκε στο επίπεδο Premium ($45), δείχνοντας σταθερή απόδοση στα 400 TPS/User
Ίδιο διάγραμμα με εκτεταμένη καμπύλη Blackwell
Προστέθηκε η καμπύλη Rubin NVL72: 2X έναντι Blackwell στα 50 TPS, 2X στα 100 TPS, 3X στα 200 TPS, 10X στα 400 TPS
Διάγραμμα σύγκρισης τριών καμπυλών
Σύγκριση εσόδων ανά gigawatt: Blackwell έναντι Rubin σε όλα τα επίπεδα. Τα συνολικά ετήσια έσοδα αυξάνονται από $30B σε $150B (5X) με το Rubin
Ραβδόγραμμα με στοιβαγμένες ράβδους Blackwell (teal) και Rubin (πράσινο)
Ίδιο διάγραμμα τριών καμπυλών που δείχνει την εξέλιξη της απόδοσης Hopper → Blackwell → Rubin
Διάγραμμα απόδοσης με τρεις καμπύλες
Η καμπύλη Rubin + LPX επεκτείνεται στο επίπεδο Ultra ($150, 1000+ TPS/Χρήστη) διατηρώντας 35X έναντι του Hopper σε όλα τα επίπεδα
Διάγραμμα τεσσάρων καμπυλών με επέκταση LPX σε κιτρινοπράσινο
Διάγραμμα αρχιτεκτονικής Agent: NemoClaw στο κέντρο με συνδέσεις σε Multi-Modal Prompt, Files, Computer Use, Tools (CLI/MCP), OpenShell, Sub-Agents, Skills, LLM, Memory. Τροφοδοτείται από Nemotron/NeMo/Dynamo/NIM και cuDF/cuVS/vGPU/cuOPT/AI-Q
Κυκλικό διάγραμμα αρχιτεκτονικής με λαμπερά πράσινα περιγράμματα στα πλαϊνά πάνελ
Η NVIDIA είναι ο μεγαλύτερος συνεισφέρων στον κόσμο στο open-source AI (400+ repos, ξεπερνώντας την Alibaba Cloud). Παρουσιάζει τα μοντέλα BioNeMo, Earth-2, Nemotron, Cosmos, GR00T, Alpamayo
Κεντρικό γράφημα με κάρτες μοντέλων που πλαισιώνουν και τις δύο πλευρές
Παρουσίαση του κλιματικού/καιρικού AI μοντέλου Earth-2 με φωτορεαλιστική απόδοση της Γης
Διαχωρισμένη προβολή με κάρτες μοντέλων στα αριστερά και μεγάλη σφαίρα της Γης στα δεξιά
12 αποτελέσματα benchmark στα Nemotron 3 Super, NemotronVL, Nemotron VoiceChat, Cosmos Predict/Reason, GR00T N, Alpamayo. Όλα δείχνουν κορυφαία ή SOTA απόδοση
Πλέγμα 4x3 πινάκων αποτελεσμάτων benchmark
Leaderboard: claude-sonnet-4.6 (86.9%), claude-opus-4.6 (86.3%), gpt-5.4 (86.0%), nvidia/nemotron-3-super-120b-a12b (85.6%) - καλύτερο ανοιχτό μοντέλο
Leaderboard οριζόντιου ραβδογράμματος
5X αποδοτικότητα και υψηλότερη ακρίβεια συλλογισμού στο GB200 NVL72. Σύγκριση έναντι των GLM και Kimi K2 σε Peak Throughput, MMLU Pro, HumanEval/MBPP, GSM8K, Global MMLU
Σύγκριση δύο γραφημάτων: ράβδοι throughput και ράβδοι ακρίβειας
Παγκόσμιος χάρτης που δείχνει την υιοθέτηση του Nemotron: US, EuroLLM, Linagora (France), Bielik.ai (Poland), SOOFI, Dicta (Israel), TII (UAE), HUMAIN, BharatGen/Gnani.ai/Sarvam AI (India), Viettel, NAVER/Trillion Labs, Institute of Science Tokyo, AI Singapore, Indosat, WideLabs (Brazil)
Παγκόσμιος χάρτης με νυχτερινό φωτισμό και επισημασμένες πινέζες
Παγκόσμιοι ηγέτες AI που εντάσσονται στον NVIDIA Nemotron Coalition: Black Forest Labs, Cursor, LangChain, Mistral AI, Perplexity, Reflection, Sarvam, Thinking Machines
Λογότυπο NVIDIA στην κορυφή με καρδιές, λογότυπα συνεργατών σε δύο σειρές από κάτω
12 διαγράμματα αρχιτεκτονικής enterprise agent από Adobe, Atlassian, Cadence, Cisco, CrowdStrike, Dassault Systemes, Palantir, Salesforce, SAP, ServiceNow, Siemens, Synopsys. Επιπλέον 40+ επιπλέον λογότυπα συνεργατών
Πλέγμα 4x3 λεπτομερών διαγραμμάτων αρχιτεκτονικής με λωρίδα λογοτύπων συνεργατών στο κάτω μέρος
12 ακόμη enterprise agents: Abridge, CodeRabbit, Cohesity, Edison, IQVIA, Mastercard, Microsoft Security, PayPal, Perplexity, Xiaohongshu, Rockwell Automation, Schneider Electric
Πλέγμα 4x3 διαγραμμάτων αρχιτεκτονικής
Ίδιο διάγραμμα αρχιτεκτονικής agent με τη σελίδα 20
Κυκλικό διάγραμμα αρχιτεκτονικής
Εκθεσιακός χώρος ρομπότ με απόδοση Omniverse που περιλαμβάνει 30+ ρομπότ από τις Boston Dynamics, Figure, Foxconn, Agility, 1X, LG Electronics, XPENG, Disney Research και πολλούς άλλους. Βιομηχανικά και ανθρωποειδή ρομπότ μαζί με οχήματα
Αίθουσα τρισδιάστατης απόδοσης με ρομπότ τοποθετημένα στο πάτωμα
Διαχωρισμένη οθόνη που δείχνει προσομοίωση (αριστερά, σε παστέλ χρώματα) έναντι πραγματικού (δεξιά, μεταλλικού) ρομποτικού βραχίονα που εκτελεί εργασίες συναρμολόγησης
Παράθεση σε στρογγυλεμένο πλαίσιο
Φωτορεαλιστική απόδοση του χωριού με θέμα το Frozen της Disney που δημιουργήθηκε με το NVIDIA Omniverse
Κινηματογραφική απόδοση πλήρους bleed
Ιδιοσυγκρασιακή σκηνή CG σε στυλ Pixar του Jensen Huang κινουμένων σχεδίων να ψήνει marshmallows σε μια φωτιά με διάφορα ρομπότ και μια μασκότ αστακού
Κινηματογραφική απόδοση πλήρους bleed
Καθαρό λογότυπο NVIDIA σε σκούρο φόντο - διαχωριστικό ενότητας
Κεντραρισμένο λογότυπο
Έσοδα ανά gigawatt με VR+LPX: Συνολικά ετήσια έσοδα από $30B έως $300B (10X). Στοιβαγμένες ράβδοι τριών χρωμάτων: Blackwell, Rubin, VR+LPX σε όλες τις βαθμίδες τιμολόγησης
Στοιβαγμένο ραβδόγραμμα με τρεις γενιές υλικού
Σύγκριση chip: Rubin GPU (288GB HBM4, 22 TB/s, 50 PFLOPs NVFP4, 336B transistors) έναντι Groq 3 LPU (500MB SRAM, 150 TB/s bandwidth, 1.2 PFLOPs FP8, 98B transistors)
Φωτογραφίες chip δίπλα-δίπλα με προδιαγραφές από κάτω
Κλιμακωτή σύγκριση: 8 Groq 3 LPU = 4GB SRAM, 1,200 TB/s (55X έναντι Rubin), 9.6 PFLOPs, 784B transistors. 'Ενώνοντας Επεξεργαστές Εξαιρετικών Επιδόσεων'
Δίπλα-δίπλα με πολλαπλασιασμένα chip Groq
Αρχιτεκτονική συμπερασμού Dynamo: Vera Rubin NVL72 χειρίζεται Prefill+Decode Attention, Groq 3 LPX χειρίζεται Decode FFN. KV Cache κοινόχρηστη, Ενεργοποιήσεις ανταλλάσσονται αμφίδρομα
Τεχνικό διάγραμμα αρχιτεκτονικής με τρία στοιχεία
Groq 3 LPX rack: 315 PFLOPS AI Inference, 128GB SRAM, 40 PB/s bandwidth, 256 chips, 640 TB/s scale-up. Διαθέσιμο 2H26. Εμφανίζει λεπτομέρειες rack και node με 8 LPUs, FPGA, Host CPU, BF4
Φωτογραφία προϊόντος με λίστα προδιαγραφών στα δεξιά, λεπτομερές διάγραμμα node από κάτω
AI Labs: Anthropic, Cursor, Meta, OpenAI, Perplexity, Black Forest Labs, Cohere, Harvey, Mistral AI, OpenEvidence, Runway, Thinking Machines. Cloud: AWS, Google Cloud, Azure, Oracle, CoreWeave, Crusoe, Lambda, Nebius, NScale. OEMs: Dell, HPE, Lenovo, Supermicro, κ.λπ.
Φωτογραφία προϊόντος αριστερά, πλέγμα συνεργατών τριών επιπέδων δεξιά
Cloud partners: Meta, Oracle, CoreWeave, Crusoe, Lambda, Nebius, NScale, together.ai. OEMs: Cisco, Dell, HPE, Lenovo, Supermicro, ASRock, ASUS, COMPAL, Foxconn, κ.λπ. 256 Vera CPUs, 300 TB/s LPDDR5X
Φωτογραφία προϊόντος αριστερά, πλέγμα συνεργατών δύο επιπέδων δεξιά
Cloud: CoreWeave, Crusoe, CREN, Lambda, Mistral AI, Nebius, Oracle, Vultr. OEMs: AIC, Cloudian, DDN, Dell, HPE, Hitachi, IBM, MinIO, NetApp, Nutanix, κ.λπ. 5x Tokens/sec, 50 Tb/s, 16TB Shared Context/GPU
Φωτογραφία προϊόντος αριστερά, πλέγμα συνεργατών δύο επιπέδων δεξιά
Ολοκληρωμένο σύστημα: Σύγκριση 1GW AI Factory X86+Hopper (600K GPUs, 1.2 ZFLOPS, 2M TPS) vs Vera Rubin (300K GPUs, 16 ZFLOPS, 700M TPS). Εμφανίζει και τα 7 chips και 6 παράγοντες μορφής συστήματος
Πίνακας σύγκρισης στην κορυφή, εικόνες chip/tray σε δύο σειρές, rack στο κάτω μέρος
Χάρτης πορείας τριών γενεών: Blackwell (2024), Rubin (2026), Feynman (2028). Κάθε μία με σειρά chip, συστήματα rack. Η Feynman εισάγει Die Stacking Custom HBM, LP40 NVLink, Rosa CPU, BlueField-5, NVLink 8 CPO
Πρόοδος από αριστερά προς τα δεξιά με στοιβαγμένες αποδόσεις υλικού
Extreme Co-Design σε κλίμακα υποδομής. Τρία επίπεδα: Reference Designs (Rubin DSX, DSX Ecosystem, Omniverse DSX Blueprint), Libraries/APIs/Software (DSX Max-Q, DSX Flex, DSX Exchange, DSX Sim), Chips/Systems/Facilities (Power → Liquid Cooling)
Οριζόντια αρχιτεκτονική τριών επιπέδων με απόδοση εργοστασίου AI στο κάτω μέρος
Φωτορεαλιστική εναέρια άποψη ενός κέντρου δεδομένων εργοστασίου AI μεγάλης κλίμακας με σειρές από server racks με υγρή ψύξη
Κινηματογραφική απόδοση πλήρους bleed
Λίστες συνεργατών DSX Flex, DSX Max-Q, DSX Sim, DSX Exchange. 40+ συνεργάτες ανά κατηγορία, συμπεριλαμβανομένων των CoreWeave, Crusoe, Digital Realty, NSCALE, Red Hat, Dell, Cadence, Siemens, VAST, WEKA, κ.λπ.
Πλέγμα συνεργατών τεσσάρων τεταρτημορίων με απόδοση εργοστασίου στο κάτω μέρος
Ανακοίνωση του NVIDIA Space-1: Υπολογιστική μονάδα Vera Rubin σχεδιασμένη για δορυφορική ανάπτυξη
Απόδοση chip στα αριστερά, συστοιχία δορυφορικών ηλιακών συλλεκτών στα δεξιά, Γη στο φόντο
Διάγραμμα ιστορικού αστεριών GitHub που δείχνει το openclaw/openclaw να ξεπερνά το facebook/react και το torvalds/linux το 2026. Εμφανίζεται μασκότ αστακού
Διάγραμμα ιστορικού αστεριών με απεικόνιση μασκότ
Στιγμιότυπα οθόνης τερματικού που δείχνουν την εγκατάσταση του nemoclaw (curl -fsSL nvidia.com/nemoclaw.sh | bash) και την ενσωμάτωση (nemoclaw onboard)
Στιγμιότυπα οθόνης παραθύρου τερματικού στοιβαγμένα
Γενική αρχιτεκτονική agent: Agent στο κέντρο με συνδέσεις σε Multi-Modal Prompt, Files, Computer Use, Tools (CLI/MCP), Sub-Agents, Skills, LLM (πολλαπλοί πάροχοι), Memory
Κυκλικό διάγραμμα αρχιτεκτονικής με χειρόγραφο στυλ
Παραδοσιακό μοντέλο IT: Enterprise IT Expense → Software/SaaS + GSI → Files → Data Centers
Διάγραμμα κάθετης ροής, μόνο αριστερή πλευρά
Νέο μοντέλο: Enterprise Information Workers → Software/SaaS + GSI + AI Providers + AI Natives → Tokens → AI Factories. Σύγκριση πριν/μετά δίπλα-δίπλα
Σύγκριση πριν/μετά σε δύο στήλες
Λογότυπο NVIDIA σε σκούρο φόντο
Λογότυπο στο κέντρο
Φωτορεαλιστική σκηνή προσομοίωσης νερού/κυμάτων που δείχνει βιομηχανικό μηχανισμό θυροφράγματος με δυναμική απόδοση νερού
Κινηματογραφική απόδοση πλήρους bleed
3D απόδοση εναέριας άποψης του συνεδριακού χώρου GTC 2026 στο San Jose με κτίρια με την επωνυμία NVIDIA και χώρους εκδηλώσεων
Κινηματογραφική απόδοση πόλης με επικάλυψη λογότυπου GTC
Σειρά ομιλητών: Sarah Guo (3η εμφάνιση), Alfred Lin (2η, ντεμπούτο ως οικοδεσπότης 2026), Gavin Baker (2η, ντεμπούτο ως οικοδεσπότης 2026). Επιπλέον 20+ επιπλέον ομιλητές, συμπεριλαμβανομένων των Harrison Chase, Michael Dell, Anirudh Devgan, κ.λπ.
Τρεις επιλεγμένοι ομιλητές σε μεγάλες κάρτες στην κορυφή, πλέγμα μικρότερων καρτών ομιλητών παρακάτω
250+ λογότυπα εταιρειών, συμπεριλαμβανομένων των ABB, Apple, Adobe, Anthropic, AWS, BYD, Cisco, CoreWeave, Disney Research, Meta, Microsoft, OpenAI, Samsung, Tesla, Uber, Walmart, Xiaomi και πολλών άλλων
Πυκνό πλέγμα λογότυπων με 3D απόδοση χώρου στο κάτω μέρος
Κυκλικό διάγραμμα σφονδύλου: Επαναστατικές Ανακαλύψεις → Προγραμματιστές → Εγκατεστημένη Βάση → Οικοσυστήματα → πίσω στις Επαναστατικές Ανακαλύψεις
Κεντρικό κυκλικό διάγραμμα σε μαύρο φόντο
Φωτογραφία προϊόντος της κάρτας γραφικών GeForce GTX 1080 - ιστορική αναφορά στις gaming ρίζες της CUDA
Κεντραρισμένη φωτογραφία προϊόντος σε μαύρο φόντο
Στιγμιότυπο οθόνης του παιχνιδιού Hogwarts Legacy με DLSS 5 On, που παρουσιάζει την ποιότητα 3D-Guided Neural Rendering
Στιγμιότυπο οθόνης παιχνιδιού full-bleed
Στιγμιότυπο οθόνης EA Sports FC με ανακοίνωση DLSS 5 3D-Guided Neural Rendering
Στιγμιότυπο οθόνης παιχνιδιού full-bleed
Χάρτης οικοσυστήματος δομημένων δεδομένων $120B που δείχνει το cuDF να επιταχύνει τις μηχανές CSP (AWS, GCP, Azure), εμπορικές πλατφόρμες OSS (Clickhouse, Cloudera, Databricks), ιδιόκτητες μηχανές και μηχανές OSS (DuckDB, Pandas, Polars, Spark)
Διάγραμμα δικτύου με το cuDF στο κάτω μέρος να συνδέεται με όλα τα επίπεδα
Οικοσύστημα μη δομημένων δεδομένων: 100άδες zettabytes που αυξάνονται εκθετικά. Το cuVS επιταχύνει την αναζήτηση διανυσμάτων σε εταιρικές βάσεις δεδομένων, μηχανές CSP, μηχανές OSS (Elasticsearch, FAISS, Milvus, κ.λπ.)
Διάγραμμα δικτύου με το cuVS στο κάτω μέρος
IBM watsonx.data με NVIDIA cuDF: Ενημερώσεις Order-to-Cash Data Mart 3 λεπτά έναντι 15 λεπτών, 83% εξοικονόμηση κόστους (CPU έναντι GPU). Παράθεση από τον Chris Wright, CIO της Nestle
Παράθεση στο επάνω μέρος, διάγραμμα αρχιτεκτονικής αριστερά, ραβδόγραμμα δεξιά
Εναέρια φωτογραφία της μονάδας παραγωγής της Nestle
Φωτογραφία full-bleed
Dell AI Data Platform με NVIDIA cuVS/cuDF: Επεξεργασία εταιρικών δεδομένων από ώρες σε λεπτά (10TB, 3X ταχύτερα). Παράθεση από τον Abhijit Dubey, CEO της NTT DATA
Παράθεση στο επάνω μέρος, διάγραμμα αρχιτεκτονικής Dell αριστερά, γράφημα συγκριτικής αξιολόγησης δεξιά
Google Cloud AI Hypercomputer με cuDF: Πλατφόρμα A/B Experimentation 45k CPUs σε 1k GPUs, 76% εξοικονόμηση κόστους. Παράθεση από τον Saral Jain, CIO της Snap
Παράθεση στο επάνω μέρος, αρχιτεκτονική Google Cloud αριστερά, γράφημα εξοικονόμησης δεξιά
Πλήρης επισκόπηση συνεργασίας: πελάτες (baseten, CrowdStrike, GM, Puma, Salesforce, Snapchat, κ.λπ.), υπηρεσίες Google (Vertex AI, GKE, BigQuery, κ.λπ.), στοίβα NVIDIA AI Platform
Διάταξη συνεργασίας τριών επιπέδων
Πλήρης συνεργασία με την AWS: πελάτες (CrowdStrike, databricks, OpenAI, Perplexity, Palantir, κ.λπ.), υπηρεσίες AWS (Braket, EKS, Nitro Enclaves, SageMaker AI, EC2, κ.λπ.)
Διάταξη συνεργασίας τριών επιπέδων
Πλήρης συνεργασία με την Azure: πελάτες (Anthropic, BlackRock, BMW, Krones, Rockwell, Synopsys), υπηρεσίες Azure (Foundry, Windows 365, Fabric, AKS, Copilot, Bing)
Διάταξη συνεργασίας τριών επιπέδων
Πλήρης συνεργασία με την Oracle: πελάτες (Cohere, Fireworks AI, Neospace, Siemens, Uber, Zoom), υπηρεσίες OCI (Superclusters, AI Database, Generative AI, Data Science, OKE)
Διάταξη συνεργασίας τριών επιπέδων
Πλήρης συνεργασία με την CoreWeave: πελάτες (Canva, Cohere, Cursor, Mercado Libre, Mistral AI, Morgan Stanley, OpenAI, Runway), υπηρεσίες (W&B Models/Training/Inference/Weave, CoreWeave Inference/Slurm/K8s/Compute/Storage/Mission Control)
Διάταξη συνεργασίας τριών επιπέδων
Συχνές ερωτήσεις σχετικά με αυτή τη διαφάνεια και το βασικό περιεχόμενο παρουσίασης.
Οι σημαντικότερες ανακοινώσεις περιλαμβάνουν το σύστημα Vera Rubin NVL72 με 2X απόδοση σε σχέση με την Blackwell, το NVIDIA Groq 3 LPX (έναν νέο επιταχυντή inference που βασίζεται σε LPU με 315 PFLOPS και 128GB SRAM), την πλήρη πλατφόρμα Vera Rubin με 7 chips και 5 rack συστήματα, τον οδικό χάρτη αρχιτεκτονικής Feynman για το 2028, τη μονάδα υπολογισμού δορυφόρου NVIDIA Space-1 και την πλατφόρμα DSX AI Factory για ανάπτυξη σε κλίμακα υποδομής.
Η Vera Rubin προσφέρει 2X βελτίωση στην απόδοση σε σχέση με την Blackwell NVL72 τόσο στα 50 όσο και στα 100 TPS/User, κλιμακώνοντας σε 3X στα 200 TPS και 10X στα 400 TPS. Ένα εργοστάσιο AI 1GW με Vera Rubin χρησιμοποιεί μόνο 300K GPUs (έναντι 600K με X86+Hopper) ενώ παρέχει 16 ZFLOPS (έναντι 1.2) και 700M tokens ανά δευτερόλεπτο. Ξεκλειδώνει μια ετήσια ευκαιρία εσόδων 150 δισεκατομμυρίων δολαρίων ανά gigawatt, μια αύξηση 5X από την Blackwell.
Η NVIDIA και η Groq ενώνονται δύο επεξεργαστές εξαιρετικής απόδοσης: την Rubin GPU (288GB HBM4, 50 PFLOPs) για λειτουργίες prefill με μεγάλη υπολογιστική ισχύ και την Groq 3 LPU (150 TB/s εύρος ζώνης SRAM) για λειτουργίες αποκωδικοποίησης με μεγάλο εύρος ζώνης. Η NVIDIA Dynamo ενορχηστρώνει τον διαχωρισμό, στέλνοντας prefill στην Vera Rubin NVL72 και αποκωδικοποιώντας FFN στην Groq 3 LPX, επιτυγχάνοντας 35X απόδοση σε σχέση με την Hopper μόνο.
Το NemoClaw είναι η υλοποίηση αναφοράς της NVIDIA για το OpenClaw, ένα ανοιχτό κιτ εργαλείων agent για τη δημιουργία εξειδικευμένων AI agents. Παρέχει χειρισμό multi-modal prompt, επεξεργασία αρχείων, χρήση υπολογιστή, εργαλεία CLI/MCP μέσω OpenShell sandbox, sub-agents, δεξιότητες, ενσωμάτωση LLM και μνήμη. Τροφοδοτείται από το Nemotron 3 Super (το καλύτερο ανοιχτό μοντέλο για το OpenClaw με 85,6% σε benchmarks) και αξιοποιεί cuDF, cuVS, vGPU και cuOPT για δυνατότητες agent επιταχυνόμενες από GPU.
Η NVIDIA παρουσιάζει πέντε βαθμίδες inference με βάση το μέγεθος του μοντέλου και τη διαδραστικότητα: Free (Qwen 3, 235B, 32K context, $0), Medium (Kimi K2.5, 1T, 128K, $3), High (GPT MoE 2T, 128K, $6), Premium (GPT MoE 2T, 400K, $45) και Ultra (GPT MoE 2T, 400K, $150). Η Vera Rubin + LPX επιτρέπει την κερδοφόρα εξυπηρέτηση σε όλες τις βαθμίδες, ξεκλειδώνοντας συνολικά 300 δισεκατομμύρια δολάρια ετήσια έσοδα ανά gigawatt.
Πάνω από 24 μεγάλες επιχειρήσεις παρουσίασαν αρχιτεκτονικές agent: Adobe, Atlassian, Cadence, Cisco, CrowdStrike, Dassault Systemes, Palantir, Salesforce, SAP, ServiceNow, Siemens, Synopsys, Abridge, CodeRabbit, Cohesity, Edison, IQVIA, Mastercard, Microsoft Security, PayPal, Perplexity, Xiaohongshu, Rockwell Automation και Schneider Electric.
Οι συνεργάτες εκκίνησης της Vera Rubin NVL72 περιλαμβάνουν AWS, Google Cloud, Microsoft Azure, Oracle Cloud, CoreWeave, Crusoe, Lambda, Nebius και NScale. Το deck παρουσιάζει επίσης βαθιές ενσωματώσεις με τις συγκεκριμένες υπηρεσίες κάθε παρόχου (π.χ. Amazon SageMaker AI, Google Vertex AI, Azure Foundry, OCI Superclusters). Οι OEM συνεργάτες περιλαμβάνουν Dell, HPE, Lenovo, Supermicro, Foxconn και πολλούς άλλους.
Η NVIDIA περιγράφει μια «Αναγέννηση του Enterprise IT από το SaaS στο Agent-as-a-Service». Το παραδοσιακό μοντέλο του Enterprise IT Expense που ρέει μέσω Software/SaaS και GSIs σε κέντρα δεδομένων μετατρέπεται σε Enterprise Information Workers που υποστηρίζονται από Software/SaaS, GSIs, AI Providers και AI Natives — όλοι καταναλώνουν tokens από AI Factories. Αυτό αντιπροσωπεύει μια θεμελιώδη αλλαγή όπου η υπολογιστική ισχύς γίνεται έσοδα και τα tokens γίνονται το νέο εμπόρευμα.
Create Your Own Slides
Turn your ideas into professional presentations in seconds with 2slides AI.
Αναφερθείτε σε επαγγελματικές σχεδιάσεις, επιλέξτε το στυλ σας και δημιουργήστε σλάιντ με τέλεια απόδοση κειμένου. Τροφοδοτείται από το Nano Banana—ξεκινήστε να δημιουργείτε την παρουσίασή σας τώρα.
Your AI Agent for slides. Save time, shine faster with intelligent presentation creation.
All services online© 2026 2slides. All rights reserved.