# Artikel Terkait GPU

Pusat Berita HTX menyediakan artikel terbaru dan analisis mendalam mengenai "GPU", mencakup tren pasar, pembaruan proyek, perkembangan teknologi, dan kebijakan regulasi di industri kripto.

AI PC Tiba, Bentrok Lokal dengan Model Besar 120B! NVIDIA Redefinisikan Dasar "PC AI Pribadi" dengan RTX Spark

Dalam acara GTC 2026, NVIDIA memperkenalkan SoC RTX Spark, yang membawa standar baru untuk "PC AI pribadi" dengan komputasi AI 1 petaflop (1000 TOPS), jauh melampaui NPU 45-50 TOPS pada AI PC generasi sebelumnya. Chip ini mengintegrasikan GPU arsitektur Blackwell dengan 6144 inti CUDA dan CPU Arm 20-inti dari MediaTek, menggunakan memori terpadu hingga 128GB. Desain ini memungkinkan CPU dan GPU berbagi kumpulan memori yang sama, menghilangkan hambatan transfer data dan mendukung model besar hingga 120B parameter berjalan secara lokal. Microsoft berkolaborasi dengan NVIDIA untuk meningkatkan mekanisme keamanan asli Windows dan memperkenalkan runtime sandbox open-source OpenShell, memberikan lapisan isolasi penting untuk agen AI lokal. Adobe juga mengumumkan pengembangan ulang mendasar untuk Photoshop dan Premiere guna mengoptimalkan arsitektur memori terpadu RTX Spark, yang diklaim dapat meningkatkan kinerja hingga dua kali lipat. Enam OEM utama termasuk ASUS, Dell, HP, Lenovo, Microsoft Surface, dan MSI akan merilis laptop tipis dan desktop kompak dengan RTX Spark pada musim gugur tahun ini. Meskipun demikian, detail seperti harga, efisiensi daya, dan performa nyata dalam skenario non-AI masih perlu dikonfirmasi setelah produk diluncurkan. Kehadiran RTX Spark menandai pergeseran potensial dalam industri PC menuju platform SoC yang berpusat pada GPU.

marsbit06/01 06:44

AI PC Tiba, Bentrok Lokal dengan Model Besar 120B! NVIDIA Redefinisikan Dasar "PC AI Pribadi" dengan RTX Spark

marsbit06/01 06:44

Nvidia Meluncurkan Platform DSX, Terus Melangkah ke Infrastruktur Pabrik AI

NVIDIA meluncurkan platform NVIDIA DSX, memperluas bisnisnya ke infrastruktur pabrik AI. Platform ini menawarkan solusi lengkap mulai dari desain, simulasi, penyebaran, hingga manajemen operasional, beralih dari fokus sebelumnya pada penjualan GPU semata. Dengan kompleksitas model AI yang meningkat, tantangan pusat data kini meliputi pasokan listrik, pendinginan, penjadwalan sumber daya, dan efisiensi operasional menyeluruh. NVIDIA meyakini bahwa efisiensi infrastruktur—cara menghasilkan lebih banyak daya komputasi dan layanan cerdas dengan listrik, ruang, dan sumber daya terbatas—akan menjadi indikator kunci kompetisi di masa depan. Platform DSX mengintegrasikan chip, sistem, perangkat lunak, arsitektur referensi, dan teknologi mitra NVIDIA. Platform ini mencakup perangkat lunak utama seperti DSX MaxLPS untuk optimalisasi daya dengan pendinginan cair, dan DSX OS, platform perangkat lunak sumber terbuka untuk operasional pabrik AI. Komponen lain meliputi DSX Reference Design, DSX Sim untuk simulasi digital twin, DSX Flex untuk penyesuaian beban kerja dinamis berdasarkan jaringan listrik, dan DSX Exchange untuk kolaborasi data. Beberapa penyedia layanan cloud seperti CoreWeave dan Lambda telah mulai menggunakan komponen inti DSX. Dari sisi perangkat keras, perusahaan seperti Dell, HPE, Lenovo, dan Supermicro sedang mengembangkan sistem yang kompatibel dengan DSX. DSX Flex juga telah menjalani proyek percontohan komersial dengan perusahaan energi. Secara strategis, DSX menandai transformasi NVIDIA dari pemasok chip AI menjadi penyedia platform infrastruktur AI yang menyeluruh, bertujuan membangun standar industri dan memperkuat kepemimpinannya di pasar global.

marsbit06/01 04:29

Nvidia Meluncurkan Platform DSX, Terus Melangkah ke Infrastruktur Pabrik AI

marsbit06/01 04:29

Analisis Mendalam tentang Rantai Industri "Koneksi Optik": Kendala Infrastruktur AI yang Tersembunyi di Balik Kemilau GPU

**Ringkasan Podcast: "Jaringan Optik untuk AI: Hambatan Infrastruktur yang Tersembunyi di Balik GPU"** Ketika kluster AI tumbuh hingga ribuan GPU, kemampuan untuk mentransfer data di antara GPU menjadi penghambat utama, bahkan lebih penting daripada kekuatan komputasi GPU itu sendiri. Artikel ini membahas mengapa **koneksi optik** (light interconnect) menjadi komponen kritis dan langka dalam infrastruktur AI. **Mengapa Tembaga Digantikan?** Kabel tembaga telah mencapai batas fisik: bandwidth terbatas, sinyal melemah pada jarak beberapa meter, dan boros daya. Serat optik menawarkan bandwidth puluhan kali lebih tinggi, jarak lebih jauh, dan konsumsi daya minimal. **Apa itu Modul Optik?** Modul optik bertindak sebagai "penerjemah" antara sinyal listrik dari GPU dan sinyal cahaya di dalam serat optik, terutama untuk komunikasi **antar-rak** server. Komponen utamanya meliputi chip laser (bahan InP/GaAs), modulator, detektor, chip DSP (silikon), dan lensa. **Revolusi CPO (Co-Packaged Optics)** Teknologi masa depan, **CPO**, merevolusi arsitektur dengan menempatkan komponen optik (dalam chip silikon khusus/SiPh) di dalam kemasan yang sama dengan chip GPU/switch, mengurangi jarak dan meningkatkan efisiensi. CPO menciptakan pasar baru untuk laser eksternal, wafer SOI, dan foundry SiPh. **Rantai Pasokan & Peluang Investasi** Rantai pasokan sangat terspesialisasi: * **Hulu:** Substrat InP (AXTI), epiwafer (IQE), substrat SOI (Soitec). * **Inti:** Produsen laser & modul (LITE, COHR, SIVE, AAOI), foundry khusus (TSEM untuk SiPh, Win Semi untuk InP). * **Hilir:** Chip DSP & switch (AVGO, MRVL), serat optik (GLW). Strategi investasi dapat disesuaikan dengan profil risiko: * **Konservatif:** Perusahaan besar dengan eksposur beragam (AVGO, MRVL, GLW). * **Seimbang:** Pemain kunci dengan eksposur langsung (COHR, LITE, TSEM). * **Agresif:** Perusahaan kecil di titik bottleneck dengan elastisitas tinggi (SIVE, AAOI, Soitec, AXTI, IQE). **Kesimpulan Utama:** 1. Permintaan koneksi optik untuk pusat data AI adalah nyata, mendesak, dan terkait langsung dengan volume GPU. 2. **CPO** adalah penggerak pertumbuhan terbesar di masa depan, berpotensi membuka pasar bernilai ratusan miliar dolar. 3. Peluang investasi terletak pada mengidentifikasi **titik bottleneck** dalam rantai pasokan yang terspesialisasi ini.

marsbit05/28 11:19

Analisis Mendalam tentang Rantai Industri "Koneksi Optik": Kendala Infrastruktur AI yang Tersembunyi di Balik Kemilau GPU

marsbit05/28 11:19

NeoCloud Tiga Raksasa: NBIS, IREN, CRWV Mana yang Lebih Bernilai Investasi?

**Judul:** NeoCloud Tiga Besar: NBIS, IREN, CRWV, Mana yang Lebih Bernilai Investasi? **Ringkasan dalam Bahasa Indonesia:** Diskusi ini menganalisis tiga perusahaan "NeoCloud" utama—Nebius (NBIS), CoreWeave (CRWV), dan IRON (IREN)—yang menyediakan layanan GPU cloud khusus untuk mengatasi kelangkaan daya komputasi AI. Nate dari Endicott Invests, yang sangat bullish pada sektor ini, berpendapat bahwa permintaan komputasi AI akan tetap kuat setidaknya selama 3-5 tahun ke depan. **Perbedaan Utama Tiga Perusahaan:** * **CoreWeave (CRWV):** Pelopor dengan daya aktif terbesar, fokus pada *training* model AI (misalnya untuk OpenAI), dan memiliki pendapatan tertinggi. * **IRON (IREN):** Memiliki keunggulan dalam penguasaan lahan dan listrik (4.5 GW terkontrak), tetapi saat ini hanya memiliki satu klien besar (Microsoft) dan perangkat lunaknya dianggap lemah. * **Nebius (NBIS):** Dipandang sebagai pilihan seimbang dengan fokus pada *inference* AI dan investasi kuat dalam *software stack* (platform "token factory"). Timnya yang terdiri dari insinyur berpengalaman dipimpin oleh CEO yang juga seorang matematikawan. **Alasan Optimis terhadap Nebius (NBIS):** 1. **Tim dan Kultur:** Tim insinyur yang solid dengan pengalaman bersama selama 20 tahun. 2. **Struktur Keuangan:** Dianggap lebih sehat, terutama dalam hal utang, dibandingkan pesaing. 3. **Daya Tarik Lain:** Memiliki anak perusahaan bernilai seperti ClickHouse (analitik data) dan Avride (robot otonom), yang menambah valuasi. 4. **Kekuatan Harga:** Baru-baru ini menaikkan harga GPU H100/B200 sebesar 30-70%, menunjukkan kemampuan meneruskan biaya dan kuatnya permintaan. 5. **Pertumbuhan Klien Non-Raksasa:** Pendapatan kontrak dari klien selain Microsoft dan Meta tumbuh 3.5x secara kuartalan, menandakan gelombang permintaan kedua dari perusahaan menengah. **Kesimpulan Investasi:** Nate percaya ketiga perusahaan akan berkembang pesat dalam beberapa tahun ke depan karena kelangkaan daya komputasi. Namun, untuk jangka panjang (5-10 tahun), ia paling menyukai **Nebius (NBIS)** karena keunggulan strategis dalam perangkat lunak, tim, dan struktur keuangannya. Secara keseluruhan, sektor NeoCloud dipandang sebagai peluang investasi yang sangat menarik seiring dengan adopsi AI yang masih berada di tahap sangat awal.

marsbit05/25 10:34

NeoCloud Tiga Raksasa: NBIS, IREN, CRWV Mana yang Lebih Bernilai Investasi?

marsbit05/25 10:34

Mengapa Zhipu AI Bisa Meroket Hampir 30% dalam Satu Hari?

Hari ini, saham "Glodon" (02513.HK), yang dijuluki "saham model besar global pertama", melonjak hampir 30%. Pemicu utamanya adalah peluncuran API "GLM-5.1-highspeed" yang menawarkan kecepatan generasi hingga 400 token per detik, mencatat rekor baru untuk API model besar. Kecepatan ini sangat penting karena pergeseran paradigma dari AI chatbot ke era Agen (Agent), di mana tugas kompleks memerlukan puluhan hingga ratusan panggilan model. Setiap penghematan latensi akan terakumulasi dan secara signifikan memengaruhi efisiensi keseluruhan. Pencapaian 400 token/detik ini kira-kira 3-5 kali lebih cepat dari rata-rata industri (OpenAI GPT-4o: 100-150, Claude Sonnet: 80-120) dan dicapai tanpa mengorbankan kemampuan model inti. Lonjakan performa ini didukung oleh tiga inovasi teknis: 1. **TileRT**: Mesin inferensi yang mengkompilasi seluruh model menjadi pipeline kontinu, menghilangkan overhead start/stop antar operator dan menerapkan "Warp Specialization" untuk paralelisasi optimal dalam GPU. 2. **Strategi Paralel Heterogen untuk MLA (Multi-head Latent Attention)**: Mengatasi tantangan komputasi sparse dalam mekanisme perhatian MLA dengan menugaskan GPU berbeda untuk tugas "pengindeksan" dan "komputasi padat", meminimalkan sinkronisasi. 3. **Arsitektur Jaringan ZCube**: Mengganti topologi jaringan standar ROFT (Fat-Tree) dengan desain datar tanpa lapisan Spine. Desain ini menciptakan "jalur tunggal optimal" antara GPU mana pun, secara fundamental menghilangkan kemacetan jaringan. Hasilnya, pada perangkat keras yang sama, ZCube meningkatkan throughput cluster sebesar 15% (setara dengan peningkatan kapasitas gratis), mengurangi latensi ekor sebesar 40,6% (meningkatkan stabilitas), dan memotong biaya perangkat jaringan hingga sepertiga. Secara jangka panjang, inovasi perangkat lunak ini berpotensi mengikis dominasi NVIDIA di ekosistem jaringan (seperti InfiniBand) dan membuka jalan bagi integrasi yang lebih mudah dengan chip AI domestik seperti Huawei Ascend.

marsbit05/23 01:26

Mengapa Zhipu AI Bisa Meroket Hampir 30% dalam Satu Hari?

marsbit05/23 01:26

活动图片