Qwen Kenalkan Flash-Next, Model AI dengan Efisiensi Tinggi

  • 31 Agt 2026 12:07 WIB
  •  Sibolga

RRI.CO.ID, Sibolga - Qwen memperkenalkan Qwen3.8-Flash-Next dengan pendekatan arsitektur baru untuk mengejar efisiensi biaya komputasi, Rabu (26/8/2026). Dilansir dari laman resmi Qwen, model ini menjadi langkah eksperimental menuju generasi Qwen berikutnya.

Model tersebut menggunakan pendekatan Mixture-of-Experts untuk mengurangi jumlah parameter yang aktif. Qwen3.8-Flash-Next memiliki 125 miliar parameter, tetapi hanya sekitar enam miliar aktif setiap token.

Salah satu pembaruan utamanya berada pada mekanisme attention untuk menangani konteks panjang. Teknologi Qwen Sparse Attention membantu model memusatkan pemrosesan pada bagian informasi yang relevan.

Kemampuan konteks model mencapai 262.144 token dalam konfigurasi bawaan. Kapasitas tersebut dapat diperluas hingga satu juta token menggunakan metode YaRN.

Qwen juga mengembangkan komponen residual dan embedding untuk memperbaiki efisiensi pemrosesan. N-gram Embedding digunakan untuk membantu model menangkap informasi dengan kebutuhan komputasi lebih rendah.

Dari sisi pelatihan, Qwen3.8-Flash-Next menggunakan optimizer Muon dengan sejumlah penyesuaian. Qwen menyebut pendekatan tersebut membantu mengurangi kebutuhan sumber daya selama proses pengembangan model.

Model ini ditujukan untuk berbagai kebutuhan, termasuk pemrograman dan pekerjaan produktivitas. Qwen melaporkan peningkatan kemampuan pada sejumlah pengujian dibandingkan model sebelumnya.

Qwen3.8-Flash-Next tersedia bagi pengembang melalui Hugging Face dan ModelScope. Kehadirannya menunjukkan fokus Qwen menghadirkan model AI dengan performa tinggi sekaligus biaya operasional lebih efisien.

google-preference

Rekomendasi Berita

Berita Terbaru Lainnya

Memuat berita terbaru.....