Sources¶
Classées par fiabilité, avec ce que chacune soutient.
Sources primaires¶
Toutes les affirmations architecturales de ce rapport en découlent.
| Source | Ce qu'elle soutient |
|---|---|
Qwen/Qwen3.8-27B — dépôt |
existence, date de publication, taille (55,6 Go), 18 fragments, licence Apache 2.0 |
config.json |
toute l'architecture : 64 couches, hybride 3:1, dense, têtes, dimensions, encodeur visuel, mRoPE, MTP, contexte natif |
| Carte de modèle | contexte étendu 1 000 000 via YaRN, deux tableaux de benchmarks, enable_thinking, paramètres d'échantillonnage, moteurs recommandés |
LICENSE |
Apache 2.0 |
Qwen/Qwen3.8-27B-FP8 |
existence de la variante officielle FP8 |
Le poids d'un config.json
Un fichier de configuration ne peut pas exagérer : il décrit ce que le code instancie, faute de quoi le modèle ne se charge pas.
Les deux vérifications de ce rapport — 27,729 G de paramètres, 55,46 Go de dépôt — en découlent entièrement.
Sources primaires — les modèles voisins¶
Base de toutes les comparaisons.
| Source | Ce qu'elle apporte |
|---|---|
Qwen/Qwen3.8-2.4T-A95B |
la recette architecturale de la génération 3.8 |
config.json du Max |
hybride 3:1, GQA, RoPE partiel, MoE, MTP — pour la comparaison |
| Carte de modèle du Max | modalité texte seule, raisonnement forcé, tableau de 31 benchmarks |
| Fiches de Qwen3.6-27B | dense, attention complète, 262 144 jetons, Apache 2.0, SWE-bench Verified 77,2 |
Analyse complète du grand frère : Qwen3.8-Max.
Sources officielles¶
| Source | Ce qu'elle soutient |
|---|---|
| Billet Qwen3.8 | l'annonce du 3 août, le positionnement, la promesse de poids ouverts |
| Communiqué Alibaba Group | le lancement du 3 août — ne mentionne pas le 27B |
Le 27B est peu présent dans la communication officielle
Le communiqué institutionnel ne le mentionne pas ; sa présence tient au billet technique de l'équipe Qwen.
L'annonce du 3 août ne comportait aucun chiffre de performance. Les trente lignes de benchmarks n'apparaissent qu'avec la publication du 14.
Évaluations indépendantes¶
Aucune.
À la date de rédaction — un jour après la publication — ni Artificial Analysis, ni Vals AI, ni LMArena n'ont publié de mesure sur Qwen3.8-27B.
C'est la principale limite de ce rapport
Tous les chiffres de performance qu'il cite viennent d'Alibaba.
C'est une absence temporaire : un modèle sous Apache 2.0, de 27 G, multimodal, qui tient sur une carte, sera mesuré par de nombreuses équipes dans les jours qui suivent. C'est ce qu'il faut attendre avant toute décision engageante.
Sources secondaires¶
Utilisées pour la chronologie et le contexte. Aucune affirmation technique de ce rapport ne repose sur elles.
| Source | Usage |
|---|---|
| Latent Space — AINews | annonce conjointe des deux modèles, réactions |
| DigitalApplied | chronologie du retard, statut aux 10 et 12 août |
| OrcaRouter | inventaire des inconnues avant la sortie |
| Yotta Labs | tableaux VRAM — exemple de l'omission du cache |
| Swfte | arbitrage auto-hébergement / API |
| OfficeChai | couverture de la publication du 14 août |
| Wikipédia — Qwen | historique des licences de la famille depuis 2023 |
Une erreur répandue dans les sources secondaires
Presque toutes publient un tableau « VRAM requise » ne comptant que les poids, sans mentionner le cache clé-valeur.
Or à 262 144 jetons, le cache pèse 17,18 Go contre 13,86 Go de poids en 4 bits : il dépasse les poids. Voir L'arithmétique de la VRAM.
Ce qui n'existe pas¶
Recherché et non trouvé, au 15 août 2026 :
| Absent | Conséquence |
|---|---|
| Rapport technique ou publication arXiv | aucune information sur l'entraînement |
| Ablations architecturales | le ratio 3:1 et les dimensions sont injustifiés |
| Benchmark de long contexte | la fenêtre annoncée n'est pas mesurée |
| Évaluation de sécurité | aucune donnée sur les capacités à risque |
| Mesure de la dégradation par quantification | le choix du format reste empirique |
| Modèle de base non affiné | l'affinage part d'un tronc déjà instruit |
| Évaluation indépendante | aucun chiffre hors Alibaba |
Voir Ce qui reste non publié.
Méthode de ce rapport¶
- Lecture directe des sources primaires :
config.json,LICENSE, carte de modèle, arborescence du dépôt. - Recalcul indépendant de toute affirmation chiffrée pouvant l'être, en Python pur — avec vérification croisée par la taille du dépôt.
- Séparation stricte entre mesures du constructeur et faits vérifiables.
- Marquage explicite des reconstructions — encodeur visuel, couche MTP — et de leur degré de certitude.
- Conservation et notation des prédictions faites avant la publication, erreurs comprises.
- Signalement des affirmations qui circulent sans fondement.
Historique de ce rapport¶
| Date | Version |
|---|---|
| 13 août 2026 | Première édition, avant publication du modèle. Établissait l'absence sur quatre sources primaires, formulait douze hypothèses d'architecture, et chiffrait l'arithmétique matérielle sous trois scénarios. |
| 15 août 2026 | Réédition après la publication du 14 août. Architecture, évaluations, matériel et utilisation réécrits à partir des données réelles. Les hypothèses de la première édition sont conservées et notées en Le verdict des hypothèses. |
Date de consultation de toutes les sources : 15 août 2026.