Deskripsi
Qwen3.8-Flash-Next adalah model AI eksperimental yang dikembangkan oleh Hugging Face, bertujuan untuk mendorong batasan kecerdasan buatan melalui inisiatif sumber terbuka dan ilmu terbuka. Model ini merupakan langkah signifikan menuju pencapaian kecerdasan umum buatan (AGI) dengan memperkenalkan inovasi arsitektur yang meningkatkan efisiensi model bahasa besar (LLM).
Repositori ini berisi bobot model dan file konfigurasi yang kompatibel dengan Hugging Face Transformers, vLLM, SGLang, dan TokenSpeed. Pengguna yang mencari inferensi yang dikelola dan dapat diskalakan dapat memanfaatkan layanan API Qwen resmi yang disediakan oleh Qwen Cloud. Versi Qwen3.8-Flash dibangun di atas Qwen3.8-Flash-Next, menawarkan fitur produksi tambahan seperti panjang konteks default 1 juta token dan alat bawaan.
Qwen3.8-Flash-Next memperkenalkan beberapa inovasi kunci, termasuk Hybrid Attention dengan Qwen Sparse Attention (QSA), yang secara signifikan mengurangi latensi konteks panjang dengan memproses pada tingkat mikro-blok. Mekanisme Gated Residual meningkatkan aliran informasi melalui aliran residual, menjaga stabilitas pelatihan sambil memungkinkan ekspresivitas yang lebih besar. Selain itu, model ini menggunakan N-gram Embedding untuk skala parameter yang efisien, resep pelatihan yang disesuaikan untuk mengoptimalkan laju pembelajaran, dan arsitektur unik yang mendukung panjang konteks hingga 1 juta token.
Model ini sangat cocok untuk pengembang dan peneliti di bidang AI yang memerlukan kemampuan canggih untuk pemahaman bahasa alami, tugas pengkodean, dan aplikasi multimodal. Dengan arsitektur yang kuat dan fitur yang dapat diskalakan, Qwen3.8-Flash-Next diposisikan untuk memfasilitasi solusi inovatif di berbagai domain, termasuk rekayasa perangkat lunak, penalaran ilmiah, dan mengikuti instruksi umum.
Sorotan Qwen3.8-Flash-Next
Tipe Model: Model Bahasa Kausal dengan Pengkodean Visual
Jumlah Parameter: 125B
Parameter Diaktifkan: 6B
Parameter N-gram Embedding: 51B
Panjang Konteks: 1.000.000 token
Tahap Pelatihan: Pra-pelatihan & Pasca-pelatihan
Hybrid Attention: Ya
Gated Residual: Ya
Resep Pelatihan yang Disesuaikan: Ya
API Tersedia: Ya
Memulai dengan Qwen3.8-Flash-Next
Akses halaman: Kunjungi repositori Qwen3.8-Flash-Next di Hugging Face.
Muat model: Unduh bobot model dan file konfigurasi.
Konfigurasi lingkungan: Siapkan lingkungan pengembangan Anda dengan kerangka kerja yang kompatibel.
Integrasi: Gunakan model dalam aplikasi Anda melalui API yang disediakan.
Fine-tune: Sesuaikan parameter model sesuai kebutuhan untuk tugas spesifik Anda.
Kasus Penggunaan Qwen3.8-Flash-Next
- Pemrosesan Bahasa Alami
- Rekayasa Perangkat Lunak
- Penelitian Ilmiah
- Aplikasi Multimodal
- Mengikuti Instruksi









