AMD Membeli Taalas: AI Perangkat Keras Beroperasi Tanpa Memori HBM yang Langka

cryptonews.ru发布于2026-08-09更新于2026-08-09

文章摘要

AMD telah sepakat untuk mengakuisisi startup Taalas dari Toronto yang mengatasi masalah utama dalam inferensi jaringan saraf—kebutuhan untuk terus memindahkan bobot model dari memori ke prosesor untuk menghasilkan setiap token. Chip Taalas menghilangkan operasi ini karena bobot model secara harfiah tertanam dalam transistor. Pemindahan data inilah yang membatasi kecepatan inferensi saat ini dan mengubah memori berbandwidth tinggi (HBM) menjadi komoditas paling langka di industri semikonduktor. Startup yang didirikan pada 2023 ini telah mengembangkan chip sirkuit terpadu khusus model. Chip uji pertama, dibuat dengan proses 6nm TSMC, melayani model Llama 3.1 8B dari Meta dengan kecepatan 16.960 token per detik, diklaim 48 kali lebih cepat daripada GPU Nvidia. Arsitekturnya memiliki dua zona: area untuk bobot model yang tertanam dalam ROM mask dan SRAM biasa untuk cache serta adapter penyesuaian halus. Namun, pendekatan ini memiliki kompromi jelas: setiap chip hanya melayani satu model secara permanen. Mengganti model memerlukan perubahan topologi parsial yang memakan waktu sekitar dua bulan di fasilitas TSMC. Oleh karena itu, ini hanya menguntungkan untuk model yang stabil, banyak digunakan, dan cukup berharga untuk dibekukan. Akuisisi ini tidak banyak mengubah persaingan inferensi antara AMD dan Nvidia, tetapi lebih menonjolkan keadaan pasar memori. Pembelian ini membuktikan bahwa keterbatasan memori dalam inferensi adalah solusi teknis yang dapat diatasi, bukan keniscayaan...

Perusahaan AMD telah setuju untuk mengakuisisi startup Taalas dari Toronto, yang memecahkan masalah utama inferensi jaringan saraf — kebutuhan untuk terus-menerus memindahkan bobot model dari memori ke prosesor untuk menghasilkan setiap token. Chip Taalas tidak memerlukan operasi ini: bobot model benar-benar disolder ke dalam transistor. Pemindahan data inilah yang membatasi kecepatan inferensi modern dan mengubah memori dengan bandwidth tinggi (HBM) menjadi komoditas paling langka dalam industri semikonduktor.

Kesepakatan ini akan dipandang sebagai babak lain persaingan AMD dan Nvidia di bidang inferensi, tetapi di garis depan ini sedikit mengubah keadaan. Yang jauh lebih menarik adalah apa yang dikatakan pembelian ini tentang kondisi pasar memori — kesepakatan paling panas di semikonduktor saat ini.

Apa yang Diciptakan Taalas

Taalas didirikan pada tahun 2023 oleh Ljubisa Bajic, yang sebelumnya mendirikan perusahaan chip Tenstorrent, dan istrinya Lejla Bajic, veteran divisi teknik ATI dan AMD, yang menjabat sebagai Chief Operating Officer. Perusahaan telah mengumpulkan $219 juta dari Fidelity, Quiet Capital, dan investor semikonduktor Pierre Lamond — uang itu digunakan untuk mengembangkan apa yang disebut sirkuit terpadu khusus model.

Chip uji pertama, diproduksi menggunakan proses teknologi 6-nanometer TSMC, melayani model Llama 3.1 8B dari Meta dengan kecepatan 16.960 token per detik. Menurut pernyataan perusahaan, ini 48 kali lebih cepat dari kartu grafis Nvidia dan 8,5 kali lebih cepat dari akselerator Cerebras pada saat perbandingan. Chip generasi kedua, dirancang untuk model dengan 20 miliar parameter, diharapkan dirilis tahun ini.

Arsitekturnya dibagi menjadi dua zona: area di mana bobot model diprogram dalam memori ROM bertopeng, dan SRAM biasa untuk cache dan adapter fine-tuning yang masih dapat diubah. "Pemrograman keras seperti ini sebagian memberikan kecepatan kepada kami," kata Bajic kepada The Next Platform pada bulan Februari.

AMD berencana untuk menyematkan chip Taalas ke dalam rak Helios dengan skema terpisah: akselerator Instinct akan menangani prompt, sedangkan silikon Taalas akan menghasilkan token, semuanya di bawah kendali tumpukan perangkat lunak ROCm. Perusahaan menekankan bahwa ini adalah akuisisi, bukan perekrutan tim — penutupan kesepakatan diharapkan pada kuartal keempat. Wakil Presiden Senior AMD untuk AI, Vamsi Boppana, menggambarkan pembelian ini sebagai perluasan platform.

Kompromi yang Dilakukan Taalas

Menyolder bobot ke dalam silikon memiliki biaya yang jelas: setiap chip melayani tepat satu model — selamanya. Mengganti model memerlukan penghitungan ulang topologi sebagian, dan bahkan dengan siklus yang diperpendek oleh Taalas, di mana hanya dua lapisan logam pada wafer yang hampir jadi yang diubah, proses ini memakan waktu sekitar dua bulan di fasilitas TSMC. Model teratas diperbarui lebih cepat. Taruhan ini terbayar hanya di mana model stabil, digunakan secara luas, dan cukup berharga untuk dibekukan.

Kompromi yang sama menjelaskan mengapa kesepakatan ini tidak mengubah kekuatan di pasar inferensi. Nvidia membayar $20 miliar untuk Groq pada bulan Desember — akuisisi terbesar dalam sejarahnya — untuk menyematkan perangkat keras khusus untuk menghasilkan token ke dalam platform yang telah menjadi inti seluruh industri. Pertarungan untuk inferensi terjadi pada tingkat ekosistem dan perangkat lunak yang terpasang, dan chip yang terikat pada satu model tidak berpartisipasi dalam keduanya. Apa yang benar-benar dibuktikan oleh pendekatan Taalas adalah tesis yang lebih sempit tetapi lebih menarik: batasan memori yang membebani inferensi adalah solusi rekayasa, bukan fakta fisik, dan dapat diatasi.

Pertanyaan Memori

Pasar saat ini memasukkan asumsi bahwa kelangkaan memori ini permanen. Harga DRAM biasa naik hampir 90% pada kuartal pertama. Memori dengan bandwidth tinggi (HBM) praktis terjual habis hingga seluruh tahun 2026, dan ukuran pasar HBM tahun ini diperkirakan mencapai $54,6 miliar. SK hynix, yang mengontrol lebih dari setengah pasokan HBM, telah melampaui kapitalisasi pasar $1 triliun dan mengumumkan pembangunan pabrik baru senilai $38,1 miliar. Bagi investor biasa, seluruh taruhan pada memori bergantung pada satu asumsi: permintaan AI akan menjaga memori tetap langka selama bertahun-tahun lagi.

Asumsi ini sudah diserang dari beberapa sisi sekaligus. Taalas sepenuhnya menghilangkan memori untuk bobot dari proses melayani model, sementara insinyur Nvidia mengompres dan mengkuantisasi model tepat untuk mengurangi volume memori yang digunakan oleh model yang diterapkan.

Produsen memori sendiri bekerja ke arah yang sama. Teknologi zHBM dari Samsung, yang diperlihatkan pada konferensi FMS minggu lalu, menumpuk memori langsung pada akselerator, mengalikan bandwidth efektif. SK hynix dan Sandisk baru saja menerbitkan standar pertama memori flash berkecepatan tinggi, yang bertujuan menggantikan NAND murah untuk pekerjaan yang saat ini dilakukan oleh HBM. Hampir setiap pemain besar di industri ini mendanai caranya sendiri untuk mengurangi kebutuhan akan sumber daya yang dianggap langka selamanya oleh pasar.

AMD membeli bukti bahwa inferensi dapat bekerja tanpa mengakses komponen yang kelangkaannya menentukan seluruh siklus permintaan AI saat ini — dan akan menjual bukti ini di dalam rak yang masih berisi GPU dan HBM. Investor yang menganggap harga memori saat ini sebagai fitur permanen dari seluruh siklus pembangunan infrastruktur AI, bertaruh melawan gerakan rekayasa besar-besaran dan berkembang yang bertujuan pada hasil sebaliknya.

Memori selalu merupakan bisnis siklis. Mereka yang membayar harga hari ini baru saja mendanai satu alasan lagi mengapa ini akan tetap demikian.

Pendapat AI

Dari sudut pandang analisis data mesin, preseden kunci untuk chip Taalas dapat ditemukan bukan di dunia AI, tetapi di industri kripto. Sirkuit terpadu khusus untuk penambangan Bitcoin memecahkan masalah serupa — menyolder algoritma ke dalam silikon untuk kecepatan — dan mendapatkan efek samping yang sama: ketidakfleksibelan total. Hash Telegraph telah menggambarkan bagaimana spesialisasi perangkat keras, yang didorong hingga batasnya, menimbulkan risiko keusangan moral ketika algoritma dasar berubah atau paradigma komputasi baru muncul.

Aspek teknis yang tidak dijelaskan secara rinci oleh artikel berkaitan dengan ekonomi downtime: sementara chip Taalas melayani satu model, laboratorium pesaing merilis versi baru setiap beberapa bulan, dan siklus pemrograman ulang topologi memakan waktu sekitar dua bulan di fasilitas TSMC. Sejarah ASIC menunjukkan bahwa spesialisasi terbayar hanya pada algoritma yang stabil — pertanyaannya adalah apakah arsitektur model bahasa besar akan cukup stabil untuk taruhan ini.

end-content

热门币种推荐

相关问答

QApa yang menjadi solusi utama yang ditawarkan oleh startup Taalas dalam mengatasi masalah utama inferensi neural network?

ATaalas menciptakan chip yang tidak memerlukan operasi transfer berat model dari memori ke prosesor untuk setiap token yang dihasilkan. Berat model secara harfiah 'disolder' ke dalam transistor chip, sehingga menghilangkan kebutuhan akan transfer data yang konstan dan mengurangi ketergantungan pada memori HBM yang langka.

QApa dampak utama dari desain chip Taalas yang 'menyolder' berat model ke dalam kisi transistor?

ADampak utamanya adalah setiap chip hanya dapat melayani satu model neural network secara permanen. Untuk mengganti model, diperlukan modifikasi topologi chip yang memakan waktu sekitar dua bulan di fasilitas TSMC, bahkan dengan proses 'redesain' yang disederhanakan. Ini hanya menguntungkan jika model tersebut stabil, digunakan secara luas, dan cukup berharga untuk 'dibekukan'.

QMengapa pembelian Taalas oleh AMD tidak dianggap secara langsung mengubah persaingan dengan Nvidia di pasar inferensi AI?

AKarena persaingan di pasar inferensi AI saat ini terjadi di tingkat ekosistem dan perangkat lunak yang sudah mapan. Chip Taalas yang terikat pada satu model tidak terlibat dalam pembangunan ekosistem tersebut. Sebaliknya, akuisisi besar Nvidia terhadap Groq bertujuan untuk mengintegrasikan perangkat keras khusus ke dalam platform yang sudah menjadi standar industri.

QApa yang ditunjukkan oleh teknologi chip Taalas terkait dengan masalah kelangkaan memori HBM dalam industri AI?

ATeknologi Taalas membuktikan bahwa keterbatasan kecepatan inferensi akibat bottleneck memori adalah masalah rekayasa, bukan batasan fisik yang mutlak. Hal ini menunjukkan bahwa kelangkaan memori HBM dapat diatasi dengan pendekatan arsitektural alternatif, seperti menghilangkan kebutuhan untuk mengakses berat model dari memori secara berulang.

QApa kemiripan utama antara chip Taalas untuk AI dan ASIC (Application-Specific Integrated Circuit) untuk penambangan cryptocurrency seperti Bitcoin?

AKesamaannya terletak pada pendekatan spesialisasi perangkat keras yang ekstrem untuk kecepatan, dengan mengorbankan fleksibilitas. Keduanya 'menyolder' algoritma tertentu (model AI atau fungsi hash kripto) ke dalam silikon. Risiko utama dari pendekatan ini adalah keusangan jika algoritma atau paradigma komputasi dasar berubah, karena chip tidak dapat dengan mudah diadaptasi.

你可能也喜欢

Kinetiq团队宣布用于Hyperliquid的L2网络Elysium

8月24日,流动性质押协议Kinetiq宣布为Hyperliquid生态系统推出新的L2网络Elysium,旨在提升HyperEVM的吞吐能力,并简化现货市场、代币及DeFi应用的启动流程。Elysium将使用$HYPE支付Gas费,并计划直接与HyperCore交易引擎连接,使应用能访问其流动性和订单簿数据。具体技术细节、合作伙伴及上线时间尚未公布。 Elysium的开发源于对HyperEVM现有局限的改进,包括低吞吐量、高负载时费用上升及双区块架构。新网络承诺在启动时显著提升区块生产与交易处理速度,未来目标接近HyperCore的性能,以更好地支持高频现货交易、AMM等需要频繁状态更新的DeFi应用。此外,Elysium还将为开发者提供更深入的订单簿数据和实时报价。 目前,在Hyperliquid生态内启动新资产涉及多个步骤。Elysium拟整合该流程,使代币能通过AMM获得初始流动性,随后进入HyperCore现货订单簿,最终通过HIP-3机制上线永续合约市场。 Kinetiq还公布了Elysium的收入分配模型:50%的序列器费用将用于公开市场回购并销毁$KNTQ,25%分配给使用区块空间的应用程序开发者,剩余25%归入Kinetiq国库。此举标志着项目业务从$HYPE的流动性质押扩展到更广泛的生态。Kinetiq的主要产品kHYPE(质押$HYPE后获得的代币)仍为核心。 截至6月,Hyperliquid的未平仓合约量已增至100亿美元,成为第三大永续合约交易平台。

cryptonews.ru9分钟前

Kinetiq团队宣布用于Hyperliquid的L2网络Elysium

cryptonews.ru9分钟前

交易

现货

热门文章

美股TradFi:传统金融在AI IPO浪潮下的稳健锚点

2026年,美股IPO市场重回高热度。本文梳理即将上线或受关注的热门赛道龙头,分析具备投资潜力的交易标的及其逻辑,并探讨宏观趋势与相关风险。

2.8k人学过发布于 2026.07.08更新于 2026.07.08

美股TradFi:传统金融在AI IPO浪潮下的稳健锚点

相关讨论

欢迎来到HTX社区。在这里,您可以了解最新的平台发展动态并获得专业的市场意见。以下是用户对AI(AI)币价的意见。

活动图片