Berdasarkan performa pengujian global, Qwen3.8-Max menempati peringkat kelima pada Text Arena dan peringkat kedua pada Vision Arena.
Saat ini, para pengembang di seluruh dunia sudah dapat mengakses Qwen3.8-Max melalui API di Alibaba Cloud Model Studio, sementara akses penuh untuk model weights dijadwalkan menyusul pada pekan depan. Pengguna juga dapat langsung menguji kebolehan model ini melalui QwenWork, sebuah platform all-in-one AI agent yang dirancang khusus untuk mendukung produktivitas kerja.
Arsitektur MoE untuk Efisiensi Maksimal
Satu hal yang membuat Qwen3.8-Max menonjol adalah arsitekturnya yang inovatif. Dibangun dari fondasi Qwen 3.5, model ini mengadopsi sistem Sparse Mixture-of-Experts (MoE) yang dikombinasikan dengan mekanisme hybrid attention.Lewat kombinasi ini, meskipun Qwen3.8-Max memiliki total 2,4 triliun parameter, model hanya mengaktifkan sekitar 95 miliar parameter saja saat proses inferensi berjalan. Inovasi ini berhasil memangkas latensi dan beban komputasi secara signifikan, memungkinkannya bekerja jauh lebih efisien dibanding model dense konvensional berskala besar lainnya.
Kemampuan Autonomus Coding
Dalam hal fungsionalitas, Qwen3.8-Max sukses menduduki peringkat keempat pada Frontend Code Arena berkat kecakapannya dalam mengembangkan kode secara mandiri tanpa intervensi manusia. Dalam uji coba internal sepanjang 16 hari, AI ini sukses membangun kerangka kerja AI agent dari nol hingga menghasilkan proyek open-source bernama "oh-my-cli" yang kini tersedia di GitHub.Lebih dari sekadar urusan coding, Qwen3.8-Max dirancang untuk adaptif terhadap tugas-tugas kompleks di dunia nyata. AI ini tercatat memenangkan WWW2025 Multimodal Dialogue Intent Recognition Challenge, mengungguli peserta manusia dalam menganalisis transkrip layanan pelanggan secara akurat.
Kemampuan analitisnya mencakup berbagai sektor kritikal, mulai dari peninjauan dokumen hukum, riset keuangan, perancangan arsitektur tiga dimensi (3D), hingga replikasi metode eksperimen ilmiah baru yang melampaui riset-riset sebelumnya.
Sebagai model multimodal, aspek pemrosesan visual Qwen3.8-Max mampu merangkum dokumen ratusan halaman, mencerna tayangan serial televisi utuh, hingga menganalisis siaran langsung berdurasi 100 jam untuk diubah menjadi basis pengetahuan interaktif yang mudah dicari.
Alibaba juga mendemonstrasikan AI ini melalui RecreationBench, sebuah tolok ukur rekonstruksi aplikasi yang rumit. Tanpa koneksi internet atau akses kode sumber, Qwen3.8-Max mampu membangun ulang sebuah aplikasi hanya dengan berinteraksi dan membaca umpan balik visual dari antarmuka yang ada.
Jadikan Medcom.id sumber informasi pilihan Anda