Bitget App
Trading lebih cerdas
Beli kriptoPasarTradingFuturesEarnAIWawasanSelengkapnya
Nvidia: Dari model besar "pelatihan sekali" ke Agent yang "peningkatan pasca-pelatihan", kebutuhan daya komputasi sedang berubah

Nvidia: Dari model besar "pelatihan sekali" ke Agent yang "peningkatan pasca-pelatihan", kebutuhan daya komputasi sedang berubah

华尔街见闻华尔街见闻2026/07/19 08:56
Tampilkan aslinya
Oleh:华尔街见闻

Nvidia merombak logika monetisasi daya komputasi! Platform generasi baru Vera Rubin pertama kali memperkenalkan indikator "kecerdasan per dolar", bertaruh pada AI agen cerdas. Permintaan pelatihan pasca-model berubah menjadi kebutuhan berkelanjutan tanpa henti, penggunaan GPU hanya membutuhkan seperempat dari generasi sebelumnya. Raksasa industri telah mengantri untuk migrasi, ledakan baru di lautan biru daya komputasi kembali datang!

Nvidia sedang memperluas proposisi nilai utama dari platform Vera Rubin generasi berikutnya dari biaya inferensi ke efisiensi pelatihan model, bertaruh pada era AI berbasis agen dengan indikator baru "intelligence per dollar", bahwa pelatihan lanjutan akan menjadi kebutuhan daya komputasi paling inti.

Nvidia menjelaskan di blog resminya bahwa seiring dengan munculnya AI berbasis agen (Agentic AI), pelatihan lanjutan telah berkembang dari langkah penutup satu kali menjadi beban kerja inti yang berulang secara terus-menerus. Berbeda dengan model generatif tradisional, model berbasis agen perlu merencanakan, memanggil alat, dan melakukan koreksi sendiri saat berjalan; lingkungan di mana mereka beroperasi bisa berubah setiap minggu, yang menyebabkan kebutuhan daya komputasi untuk pelatihan lanjutan terus menumpuk. Nvidia menyatakan bahwa platform Vera Rubin dirancang secara kolaboratif untuk beban kerja tersebut, memungkinkan pelatihan model skala terbesar hanya dengan seperempat jumlah GPU dibandingkan platform Blackwell generasi sebelumnya.

Penjelasan ini langsung berhubungan dengan logika penjualan daya komputasi Nvidia: siklus pelatihan lanjutan yang tidak pernah berhenti, berarti kebutuhan klien akan klaster GPU akan beralih dari proyek berbasis ke normalisasi, memperbesar potensi skala pasar. Perusahaan seperti Prime Intellect, Perplexity, dan Together AI, yang telah menjalankan beban kerja pelatihan lanjutan di platform Nvidia, telah menyatakan rencana untuk migrasi atau ekspansi ke Vera Rubin.

Pelatihan lanjutan menjadi pendorong utama daya komputasi di era AI berbasis agen

Nvidia memberikan penjelasan sistematis tentang posisi strategis pelatihan lanjutan di blog. Tahap pra-pelatihan memberikan kelancaran bahasa bagi model, sementara "kecerdasan" sesungguhnya—termasuk penulisan kode, perencanaan tugas multi-langkah, penggunaan alat pencarian, dan pemulihan dari kesalahan—dibentuk pada tahap pelatihan lanjutan.

Nvidia: Dari model besar

Pelatihan lanjutan menggunakan teknik Reinforcement Learning (RL): model menghasilkan percobaan untuk tugas tertentu (forward propagation), percobaan ini kemudian diberi nilai dan digunakan untuk memperbarui bobot model (back propagation), dan melalui jutaan iterasi, kemampuan model meningkat secara bertahap. Nvidia mencatat bahwa proses ini sangat padat konsumsi daya komputasi, membutuhkan ribuan lingkungan secara paralel untuk menghasilkan rollout, sambil memastikan akselerator beroperasi pada kapasitas penuhnya.

Nvidia memposisikan "intelligence per dollar" sebagai indikator lapisan atas yang lebih tinggi dari "biaya per token": yang pertama mengukur efisiensi operasional pabrik inferensi, sementara yang kedua mengukur apakah investasi untuk membangun dan mempertahankan model yang layak untuk diterapkan sepadan. Keduanya saling bertautan—menurunkan biaya per token juga menurunkan biaya membangun kecerdasan model, sementara kecerdasan model yang lebih tinggi meningkatkan nilai layanan setiap token.

Nemotron Ultra menyediakan tolok ukur pelatihan lanjutan yang dapat diverifikasi

Untuk mendukung klaim di atas, Nvidia mengungkap detail pelatihan lanjutan untuk model terbuka Nemotron 3 Ultra miliknya. Model ini memiliki jumlah parameter sebesar 550 miliar, menggunakan arsitektur Mixed of Experts (MoE), dan seluruh proses pelatihan lanjutan dilakukan pada kerangka NeMo RL.

Pada tolok ukur dunia nyata pemrograman SWE-bench Verified, Nemotron 3 Ultra mendapatkan skor 71.7%, artinya dapat menghasilkan solusi perbaikan yang dapat lolos pengujian internal proyek untuk sekitar tujuh dari sepuluh cacat perangkat lunak nyata dari proyek open source. Nvidia menyatakan hasil tolok ukur ini dapat diverifikasi dan keseluruhan skema pelatihan lanjutan telah dibuka secara publik.

Nvidia: Dari model besar

Nvidia juga mencatat bahwa platform Blackwell telah menurunkan biaya operasi per run, sehingga pelatihan lanjutan dengan frekuensi tinggi yang dibutuhkan era AI berbasis agen menjadi layak secara ekonomis, sementara platform Vera Rubin akan semakin memperluas tren ini—mendukung lebih banyak rollout, lebih banyak lingkungan paralel, serta siklus pelatihan lanjutan yang tidak pernah berhenti.

Klien utama memverifikasi kemampuan platform, rencana migrasi mulai terlihat

Berbagai perusahaan yang telah menjalankan beban kerja pelatihan lanjutan di platform Nvidia mengungkapkan detail teknis spesifik dan menyatakan niat untuk migrasi ke Vera Rubin.

Prime Intellect secara kontinu melakukan pelatihan lanjutan pada model open source terdepan di platform Blackwell, dan menggunakan NVIDIA Dynamo untuk orkestrasi inferensi. Perusahaan ini telah mengintegrasikan infrastruktur sandbox dengan NVIDIA Vera CPU, dan dalam pengujian pembandingan dengan arsitektur x86, Vera CPU menunjukkan throughput rata-rata 30% lebih tinggi pada beban kerja RL sandbox nyata. Prime Intellect berencana memperluas skala lingkungan Reinforcement Learning dengan Vera Rubin, serta mempercepat siklus iterasi latihan ke inferensi.

Tumpukan pelatihan lanjutan RL Perplexity berjalan secara asinkron di ratusan GPU Nvidia, dengan mesin transfer bobot berbasis RDMA yang dapat menyinkronkan model dengan triliunan parameter antara node pelatihan dan node inferensi dalam dua detik. Model Qwen3 235B yang telah menjalani pelatihan lanjutan kemudian di-deploy ke sistem NVIDIA GB200 NVL72.

Together AI menawarkan kemampuan pelatihan lanjutan sebagai layanan, termasuk fine-tuning dengan supervisi, Reinforcement Learning, dan optimisasi preferensi langsung, dikirimkan melalui API dan SDK, saat ini berjalan di platform Nvidia, serta menyatakan sedang mencari integrasi dengan platform Vera Rubin.

0
0

Disclaimer: Konten pada artikel ini hanya merefleksikan opini penulis dan tidak mewakili platform ini dengan kapasitas apa pun. Artikel ini tidak dimaksudkan sebagai referensi untuk membuat keputusan investasi.

PoolX: Raih Token Baru
APR hingga 12%. Selalu aktif, selalu dapat airdrop.
Kunci sekarang!

Kamu mungkin juga menyukai

Era "layar lipat" Apple (AAPL.US) telah tiba! iPhone Duo seharga 1999 dolar AS diluncurkan, AI sepenuhnya meresap ke dalam ekosistem perangkat keras

Apple mengadakan acara peluncuran produk baru tahunan pada hari Rabu, secara resmi memperkenalkan ponsel layar lipat pertama perusahaan yaitu iPhone Duo, serta meluncurkan seri iPhone 18 Pro, Apple Watch Series 12, Apple Watch Ultra 4, dan AirPods 5 sebagai produk terbaru.

智通财经2026/09/09 22:36
Era "layar lipat" Apple (AAPL.US) telah tiba! iPhone Duo seharga 1999 dolar AS diluncurkan, AI sepenuhnya meresap ke dalam ekosistem perangkat keras

Harga minyak kembali ke 100 dolar AS memicu kekhawatiran inflasi, para trader meningkatkan taruhan pada kenaikan suku bunga bank sentral Eropa dan Inggris

Dengan kenaikan harga energi internasional yang terus berlanjut dan meningkatnya kekhawatiran pasar terhadap inflasi tinggi yang kemungkinan akan terus berlangsung selama satu tahun ke depan, para trader secara signifikan meningkatkan taruhan mereka bahwa European Central Bank dan Bank of England akan kembali menaikkan suku bunga.

智通财经2026/09/09 22:36
Harga minyak kembali ke 100 dolar AS memicu kekhawatiran inflasi, para trader meningkatkan taruhan pada kenaikan suku bunga bank sentral Eropa dan Inggris

Saham AS semalam | Tiga indeks utama melanjutkan tren penurunan, harga penyelesaian minyak Brent naik di atas 101 dolar AS, SK Hynix (SKHY.US) naik 7%

Pada penutupan perdagangan, Dow Jones turun 405,41 poin atau 0,77%, menjadi 52.380,66 poin; indeks S&P 500 turun 37,16 poin atau 0,48%, menjadi 7.636,36 poin; indeks Nasdaq turun 168,07 poin atau 0,64%, menjadi 26.253,34 poin.

智通财经2026/09/09 22:31
Saham AS semalam | Tiga indeks utama melanjutkan tren penurunan, harga penyelesaian minyak Brent naik di atas 101 dolar AS, SK Hynix (SKHY.US) naik 7%