gik|iewicz

szukaj
Temat: Qwen

Qwen3.8-Flash-Next – 125B parametrów, ale tylko 6B aktywnych na token

Autor: Grzegorz Kikiewicz | gikiewicz.eu Qwen3.8-Flash-Next to 125 miliardów parametrów w modelu głównym, uzupełnionych o dodatkowe 51 miliardów embeddingów N-gram – a mimo to tylko 6 miliardów parametrów jest aktywowanych na pojedynczy token. Alibaba z zespołu Qwen opublikowała ten model jako otwarty podgląd architektury, która zasili nadchodzącego Qwen4. To nie jest zwykła inkrementacja wersji. TL;DR: […]

Model Rio 3.5 Open: brazylijski odpowiednik Qwen z dodatkowym dostrajaniem

Municipalna spółka IT z Rio de Janeiro – IplanRIO – opublikowała model Rio 3.5 Open bazujący na architekturze Qwen 3.5 397B. Pakiet zawiera 397 miliardów parametrów i został udostępniony na platformie Hugging Face z otwartymi wagami. To pokazuje, jak szybko powstają lokalne pochodne dużych rozwiązań. TL;DR: IplanRIO, miejska spółka technologiczna z Rio de Janeiro, wypuściła […]

Qwen3.6-35B-A3B: lokalny model AI pokonuje Gemma 4

Alibaba właśnie udostępniła Qwen3.6-35B-A3B — model, który pokonuje Gemma 4-31B na wielu benchmarkach. To Mixture-of-Experts z zaledwie 3B aktywnych parametrów, co czyni go dostępnym lokalnie. Przetestowałem ten model i wyniki są imponujące. TL;DR: Qwen3.6-35B-A3B to otwarty model od Alibaba z architekturą Mixture-of-Experts, aktywujący tylko 3B z 35B parametrów. Pokonuje Gemma 4-31B na kluczowych benchmarkach, działa […]