Alibaba Mengungkap Peta Jalan Strategi AI Full-Stack

Mulai dari Cip, Infrastruktur Cloud, dan Model hingga Agen

HANGZHOU – Alibaba hari ini mengumumkan pembaruan komprehensif serta peta jalan untuk strategi AI full-stack (menyeluruh) guna memaksimalkan nilai AI dalam skala besar bagi pelanggan melalui berbagai inovasi terbarunya.

Dalam Apsara Conference tahun ini—konferensi teknologi unggulan tahunan Alibaba Cloud—inovator teknologi tersebut mengumumkan serangkaian pembaruan yang mencakup model fondasi dan model multimodal Qwen, cip AI eksklusif baru, cloud berbasis agen (agentic cloud) yang dirancang khusus, serta platform agen AI untuk ponsel pintar. Langkah ini memperkuat posisi global Alibaba Cloud sebagai pemimpin di era AI yang baru.

“Tema Apsara Conference tahun ini adalah ‘Intelligence Goes Beyond’ (Kecerdasan Melampaui Batas). Selama beberapa tahun terakhir, AI terus memperluas imajinasi kita mengenai kapabilitas teknologi. AI memiliki potensi pengembangan yang sangat besar—teknologi ini dapat diterapkan dan ditingkatkan skalanya dalam skenario dunia nyata, serta mendorong produktivitas di ribuan industri,” ujar Joe Tsai, Chairman Alibaba Group.

“Inilah makna sebenarnya dari ‘Intelligence Goes Beyond’: mengarahkan AI dari terobosan teknologi menuju penciptaan nilai,” kata dia

Joe Tsai mengatakan, saat ini total volume ‘Pemikiran Mesin’ (Machine Thinking) masih kurang dari 3% dibandingkan total ‘Pemikiran Manusia’.

Menurut dia, jika volume tersebut nantinya berkembang hingga mencapai 1.000 kali lipat kapasitas manusia, perhitungan sederhana menunjukkan bahwa Pemikiran Mesin masih memiliki ruang pertumbuhan yang sangat luas.

“Seiring mesin menjadi kekuatan utama di balik proses berpikir—dan mengubah kecerdasan menjadi komoditas yang tersedia dalam skala besar—produk-produk yang benar-benar revolusioner di era Kecerdasan Mesin sesungguhnya belum hadir,” kata Eddie Wu, CEO Alibaba Group.

“Dengan mempertimbangkan hal tersebut, target kami adalah pada tahun 2032, kapasitas pusat data global yang dioperasikan oleh Alibaba Cloud akan melampaui 20GW, guna memenuhi lonjakan permintaan industri terhadap AI yang tumbuh secara eksponensial,” imbuhnya.

Qwen 4 dalam tahap pelatihan

Dalam konferensi tersebut, Alibaba mengungkapkan bahwa model generasi berikutnya, Qwen 4, saat ini sedang dalam tahap pelatihan. Perusahaan juga mengumumkan peta jalan untuk seri model Qwen 4.5 dan Qwen 5 mendatang, yang diproyeksikan akan memiliki skala hingga 5 hingga 10 triliun parameter.

Alibaba juga memaparkan kemajuan dalam teknologi RSI (Recursive Self-Improvement atau Peningkatan Diri Secara Rekursif) yang didorong oleh umpan balik empiris. Selama lebih dari sebulan menjalankan proses otomatis sepenuhnya—yang mencakup desain alur kerja (pipeline), validasi data, eksperimen iteratif, dan diagnosis kesalahan—Qwen3.8-Max menyelesaikan 33 siklus iteratif.

Melalui optimalisasi pelatihan otonom dan teknik pasca-pelatihan, Qwen3.8-Max versi terbaru berhasil meningkatkan skor Analisis Buatan (Artificial Analysis) dari 40 menjadi 45.

Dalam eksperimen desain cip, model ini menjalani proses peningkatan mandiri selama lebih dari 60 jam di seluruh siklus hidup desain, serta melakukan lebih dari 10.000 pemanggilan alat EDA untuk menghasilkan modul bus cip berstandar produksi. Hasilnya, luas area cip berkurang sebesar 42% tanpa mengorbankan kinerja sama sekali.

Peningkatan Keluarga Model Multimodal

Alibaba memperkenalkan pembaruan model multimodal yang mencakup kemampuan bicara, audio, dan visual.

Perusahaan meluncurkan Qwen3.8-LiveTranslate, sebuah model penerjemahan simultan yang meningkatkan akurasi, kelancaran, dan keringkasan terjemahan, serta mengurangi latensi (LAAL) hampir 20%—dari 2,8 detik menjadi 2,3 detik—demi pengalaman penerjemahan real-time yang lebih mulus dan responsif.

Selain itu, diperkenalkan pula Qwen-Audio-3.1-TTS-Next, model generasi audio generasi terbaru yang mampu menciptakan lanskap suara sinematik utuh dengan memadukan dialog dan suara latar secara bersamaan dari naskah teks; model ini dirancang untuk kebutuhan kreatif profesional seperti buku audio, film dan televisi, siniar (podcast), serta gim.

Rangkaian teknologi bicara yang diperbarui ini juga mencakup Qwen-Audio-3.1-ASR (Automatic Speech Recognition), Qwen-Audio-3.1-TTS (Text-to-Speech), dan Qwen-Audio-3.1-Realtime, yang menawarkan kemampuan AI suara lebih canggih untuk pemahaman, pembuatan konten, dan interaksi real-time.

Qwen-Image 3.1, model pembuatan gambar yang dioptimalkan untuk desain kreatif dan pemasaran e-commerce, dijadwalkan meluncur akhir tahun ini. Model ini memangkas waktu pengerjaan desain visual dari hitungan jam menjadi detik, sekaligus menawarkan alat generatif canggih, termasuk kemampuan pembuatan gambar dengan latar belakang transparan secara langsung (native) dan fitur penyuntingan gambar yang serbaguna.

Untuk menstandarisasi evaluasi model dunia (world model), Alibaba Token Hub—bersama mitra akademis dan industri terkemuka—telah memperkenalkan kerangka kerja kemampuan enam tingkat dan meluncurkan platform tolok ukur Happyworld Arena, yang mencakup bidang pembuatan video, AI berwujud fisik (embodied AI), dan rekonstruksi spasial.

Dalam upaya mendekatkan model-model tersebut kepada pengguna umum, Alibaba meluncurkan Qwen Intelligence, sebuah solusi agen full-stack yang ditujukan bagi pelaku bisnis dan dioptimalkan untuk ponsel pintar.

Solusi ini memberikan akses bagi produsen ponsel ke platform agen berbasis Qwen guna mendukung ponsel AI generasi mendatang yang mampu menangani tugas-tugas kompleks lintas aplikasi secara andal.

 

T-Head Mengungkap Peta Jalan CPU Zhenwu V900 dan Yitian

T-Head, unit perancangan cip milik Alibaba, telah memperkenalkan Zhenwu V900, prosesor pelatihan dan inferensi AI terbarunya yang dilengkapi dengan memori berkapasitas tinggi dan bandwidth antar-cip yang tangguh.

Zhenwu V900 memberikan kinerja tiga kali lipat dibandingkan pendahulunya, Zhenwu M890 (yang dirilis pada bulan Mei).

Dengan memori GPU sebesar 216 GB dan bandwidth antar-cip 1.200 GB/detik, akselerator baru ini dirancang untuk menangani beban kerja AI yang berat, serta memiliki dukungan bawaan untuk berbagai tingkat presisi data, termasuk FP8 dan FP4.

Dengan mengurangi biaya inferensi secara signifikan sekaligus meningkatkan kepadatan komputasi, cip ini mampu menangani pelatihan model presisi tinggi maupun inferensi presisi sangat rendah secara mulus. Produksi massal dan peluncuran komersial dijadwalkan pada kuartal pertama tahun 2027.

Cip AI Zhenwu dari T-Head telah melayani lebih dari 650 pelanggan di berbagai industri, termasuk otomotif, keuangan, model bahasa besar (LLM), embodied intelligence, energi, dan manufaktur.

Alibaba juga memperkenalkan server supernode* yang telah ditingkatkan, yang mengintegrasikan prosesor Zhenwu V900, ICN Switch, Panmai SmartNIC, dan cip pengendali SSD Zhenyue.

Dioptimalkan untuk sinergi tingkat sistem full-stack yang mencakup komputasi, penyimpanan, dan jaringan, server ini mampu mendukung klaster supernode yang terdiri dari hingga 500.000 kartu.

Selain itu, Alibaba mengungkap peta jalan untuk CPU eksklusif generasi berikutnya yang dirancang khusus untuk tugas-tugas AI agen (agentic AI), yang dijadwalkan meluncur pada tahun 2027.

Yitian 720 hadir dengan peningkatan kinerja single-core, kepadatan inti yang lebih tinggi, dan efisiensi energi yang lebih baik dibandingkan pendahulunya, Yitian 710; sementara Yitian 730—CPU pertama yang dibangun menggunakan mikroarsitektur eksklusif T-Head—menawarkan peningkatan kinerja SPECint2017/GHz hingga 40% dibandingkan Yitian 710.

Agentic Cloud

Alibaba Cloud memperkenalkan serangkaian peningkatan komprehensif yang berpusat pada strategi agentic cloud, yang dibangun berdasarkan tiga skenario utama: model, harness (pengelolaan/eksekusi), dan konteks.

Peningkatan ini mencakup tiga lapisan yang saling terkait: AI Native Cloud untuk model, yang mendukung pelatihan dan inferensi model berskala besar; Agent Native Cloud untuk sistem pendukung (harness), yang memungkinkan penerapan, pengoperasian, dan keamanan agen tingkat perusahaan; serta Context Engine untuk konteks, yang menyediakan data waktu nyata dan memori jangka panjang, membantu pelanggan menciptakan nilai nyata melalui AI dalam skala besar.

AI Native Cloud

Platform for AI (PAI) dari Alibaba Cloud telah mengintegrasikan optimalisasi sinergis yang menggabungkan layanan inferensi, caching, sample replay, dan pelatihan. Dalam tahap pasca-pelatihan model Qwen di dunia nyata, PAI menyelesaikan pelatihan model mutakhir hanya dalam waktu lima hari, sebuah kemajuan dari tahap pra-pelatihan menuju Agentic RL  (Reinforcement Learning berbasis agen).

Sistem Cloud Parallel File Storage (CPFS) adalah sistem generasi baru yang dioptimalkan untuk mendukung pelatihan model AI dengan lebih baik; sistem ini menghasilkan throughput ratusan terabyte per detik dan ratusan juta operasi input/output per detik (IOPS), serta membantu memangkas biaya penyimpanan AI perusahaan hingga 69%.

HPN 8.0 Pro, arsitektur jaringan AI eksklusif terbaru dari Alibaba Cloud, menghadirkan *bandwidth* sebesar 100 petabit dengan latensi sangat rendah. Satu klaster dapat mendukung lebih dari 130.000 port jaringan dengan kecepatan 800G, dilengkapi redundansi bawaan yang memastikan kegagalan transceiver optik maupun tautan tidak menyebabkan gangguan layanan, sekaligus mengurangi dampak peningkatan dan kegagalan jaringan dari 50% menjadi 25% dibandingkan generasi sebelumnya.

Agent Native Cloud

AgentCore adalah platform perusahaan baru untuk membangun, menjalankan, dan mengelola agen AI di sepanjang siklus hidupnya. Platform ini memungkinkan bisnis untuk membangun dan menjalankan alat AI mereka dengan mudah, mengontrol kolaborasi manusia-agen secara aman, serta memantau kinerja untuk perbaikan berkelanjutan.

Dengan keamanan tingkat perusahaan yang terintegrasi pada lapisan operasional, AgentCore menyediakan landasan tunggal dan terkendali bagi organisasi untuk menerapkan beragam agen AI dan mengintegrasikannya secara mulus ke dalam sistem bisnis kritis dalam skala besar.

Agent Security Center menghadirkan manajemen keamanan dan kepatuhan menyeluruh (siklus hidup penuh) untuk aplikasi agen AI perusahaan. Platform ini menyediakan sistem pertahanan berlapis yang didukung oleh deteksi ancaman waktu nyata, memastikan agen beroperasi secara aman dalam batasan yang dapat dikendalikan pada skala besar.
Context Engine

Agent Context adalah layanan data konteks tingkat perusahaan yang memberikan konteks waktu nyata dan memori jangka panjang kepada agen AI.

Dengan mengintegrasikan dokumen perusahaan, sistem bisnis, riwayat percakapan, dan data multimodal ke dalam satu fondasi terpadu, sistem ini memungkinkan agen untuk mengingat tugas-tugas sebelumnya, berbagi pengetahuan antar-tim, dan terus belajar.

Dalam skenario yang padat pengetahuan—seperti layanan pelanggan, pemrograman berbasis AI, dan analisis data—solusi ini mampu memangkas penggunaan token hingga 67%.

OpenLake telah ditingkatkan menjadi data lakehouse multimodal yang terpadu; di sini, satu salinan data—yang mencakup format terstruktur, semi-terstruktur, tidak terstruktur, vektor, dan streaming —dapat melayani berbagai mesin komputasi untuk keperluan pemrosesan, pencarian, analisis, dan pelatihan model.

Dibandingkan dengan arsitektur tradisional, OpenLake menurunkan total biaya sebesar 38% dan memangkas waktu respons kueri hingga 40%.

Pos terkait