Nvidia menggabungkan perisian, pengoptimuman inferens dan perkakasan RTX Spark untuk menjadikan AI tempatan lebih mudah digunakan secara peribadi. PAIR ialah alat percuma dan sumber terbuka yang mengesan komputer serasi dalam rangkaian rumah serta menghala permintaan inferens Ollama atau LM Studio yang berasingan ke...
Diterbitkan olehImej dijana dengan GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: How did Nvidia’s IFA 2026 announcements advance its local AI strategy, including the free open source Personal AI Router (PAIR) tool that di. Article summary: Nvidia’s IFA 2026 announcements turned its local AI strategy into a fuller stack: simpler agent deployment, faster single device inference, coordinated use of several household machines, and a new Windows hardware tier d. Topic tags: general web, openai, agents, ai, workflow. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts wi
Nvidia menggunakan IFA 2026 untuk memperluas strategi AI tempatan—iaitu menjalankan model dan ejen AI pada komputer sendiri, bukannya semestinya menghantar data ke awan. Pendekatannya kini merangkumi pemasangan ejen yang lebih mudah, inferens lebih pantas pada satu peranti, penggunaan beberapa komputer di rumah secara terselaras, serta kategori PC Windows baharu untuk model yang lebih besar. Matlamatnya ialah mengekalkan gesaan, fail, model dan konteks ejen dalam persekitaran tempatan sambil menjadikan AI sedemikian lebih praktikal untuk pengguna. 12
15
Komponen paling menarik ialah NVIDIA Personal AI Router (PAIR), alat percuma dan sumber terbuka dalam versi beta. PAIR menyediakan satu titik sambungan tempatan kepada aplikasi, mengesan sistem serasi pada rangkaian rumah, lalu memilih komputer yang tersedia untuk memproses setiap permintaan inferens AI yang bebas. Ia boleh digunakan dengan perkhidmatan inferens tempatan yang sudah biasa seperti Ollama dan LM Studio, jadi aplikasi atau rangka kerja ejen tidak perlu direka semula. 1
2
16
Ini bermakna beberapa PC boleh berfungsi seperti kumpulan penjadualan kerja: contohnya, apabila ejen menjalankan beberapa sub-tugas yang tidak saling bergantung, PAIR boleh menghantar satu tugasan ke PC lain yang sedang lapang. Hasil yang disasarkan ialah lebih banyak kerja serentak dan masa menunggu yang lebih rendah, di samping memanfaatkan komputer yang sebelum ini tidak digunakan. 1
2
16
Namun, ada batas penting. PAIR bukan teknologi yang menyatukan GPU atau memori daripada beberapa komputer menjadi satu pemecut besar untuk satu permintaan model. Setiap permintaan masih dijalankan oleh satu sistem yang dipilih. Oleh itu, PAIR tidak membolehkan model yang terlalu besar untuk mana-mana satu PC “dipecahkan” merentasi beberapa PC; nilai utamanya ialah kapasiti serentak bagi kerja yang boleh diasingkan. 1
2
PAIR menyokong sistem Windows dengan RTX, DGX Spark dan peranti macOS, manakala dokumentasi Nvidia menetapkan keserasian serta syarat perkakasan khusus. 4
12
Nvidia juga menyatakan Hermes Agent, OpenClaw dan Perplexity Portable Computer akan menawarkan penggunaan model tempatan yang lebih mudah pada GPU Nvidia. Ini mengurangkan keperluan pengguna memilih model, pelayan inferens dan tetapan konfigurasi secara manual. 7
14
Langkah ini penting kerana halangan AI tempatan sering bukan sekadar kuasa GPU, tetapi proses pemasangan dan penalaan yang rumit. Jika persediaan menjadi lebih hampir kepada pemasangan satu klik, lebih ramai pengguna boleh mencuba ejen AI peribadi tanpa perlu menjadi pakar teknikal.
Pada lapisan perisian, Nvidia berkata pengoptimuman baharu untuk llama.cpp dan vLLM boleh memberikan inferens tempatan sehingga 1.9 kali lebih pantas. Penambahbaikan itu tersedia secara langsung serta melalui LM Studio dan Ollama, dengan kemas kini Ollama lanjut dirancang. 7
14
Strateginya jelas: walaupun model dan antara muka mungkin datang daripada projek sumber terbuka, prestasi yang lebih baik pada perkakasan RTX memberi pengguna sebab praktikal untuk memilih ekosistem Nvidia.
Nvidia turut mengesahkan sistem Windows RTX Spark berasaskan platform N1X berasaskan ARM dijangka tiba pada Oktober. Konfigurasi tertinggi boleh menawarkan CPU Grace 20 teras, GPU Blackwell RTX, sehingga 128 GB memori bersepadu dan sehingga satu petaflop prestasi AI. 12
15
Pilihan memori bersepadu yang besar itu amat relevan untuk model AI tempatan dan aliran kerja ejen yang mungkin melebihi kapasiti memori praktikal GPU pengguna biasa. Rakan pengeluar seperti Lenovo dan Acer dijangka menawarkan reka bentuk RTX Spark, sementara Nvidia meletakkannya sebagai PC untuk AI dan kegunaan biasa, termasuk sokongan permainan. 12
Secara keseluruhan, pengumuman IFA 2026 menunjukkan Nvidia tidak hanya menjual sebuah “PC AI” yang lebih pantas. Syarikat itu sedang membina rantaian lengkap: ejen yang lebih mudah dipasang, enjin inferens yang dioptimumkan, PAIR untuk mengagihkan kerja bebas dalam rangkaian rumah, dan perkakasan memori besar bagi model yang lebih mencabar. Model yang dioptimumkan untuk RTX dan pemasangan ejen satu klik pula bertujuan mengubah spesifikasi perkakasan itu kepada aplikasi peribadi yang benar-benar boleh digunakan. 7
14
Namun, prestasi sebenar PAIR dan peningkatan kelajuan yang diumumkan tetap bergantung pada saiz model, kependaman rangkaian, gabungan peranti, serta sama ada tugasan ejen boleh dipecahkan kepada permintaan yang bebas. Sumber yang dirujuk juga belum menyediakan senarai lengkap dan muktamad semua permainan atau semua model yang dioptimumkan untuk RTX ketika pelancaran.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Nvidia menggabungkan perisian, pengoptimuman inferens dan perkakasan RTX Spark untuk menjadikan AI tempatan lebih mudah digunakan secara peribadi.
Nvidia menggabungkan perisian, pengoptimuman inferens dan perkakasan RTX Spark untuk menjadikan AI tempatan lebih mudah digunakan secara peribadi. PAIR ialah alat percuma dan sumber terbuka yang mengesan komputer serasi dalam rangkaian rumah serta menghala permintaan inferens Ollama atau LM Studio yang berasingan ke mesin yang tersedia.
PAIR meningkatkan keupayaan mengendalikan tugasan serentak, tetapi tidak menggabungkan memori atau GPU beberapa PC untuk menjalankan satu permintaan model yang terlalu besar.