Aller au contenu

Sources

Classées par fiabilité, avec ce que chacune soutient.


Sources primaires

Toutes les affirmations architecturales de ce rapport en découlent.

Source Ce qu'elle soutient
Qwen/Qwen3.8-27B — dépôt existence, date de publication, taille (55,6 Go), 18 fragments, licence Apache 2.0
config.json toute l'architecture : 64 couches, hybride 3:1, dense, têtes, dimensions, encodeur visuel, mRoPE, MTP, contexte natif
Carte de modèle contexte étendu 1 000 000 via YaRN, deux tableaux de benchmarks, enable_thinking, paramètres d'échantillonnage, moteurs recommandés
LICENSE Apache 2.0
Qwen/Qwen3.8-27B-FP8 existence de la variante officielle FP8

Le poids d'un config.json

Un fichier de configuration ne peut pas exagérer : il décrit ce que le code instancie, faute de quoi le modèle ne se charge pas.

Les deux vérifications de ce rapport — 27,729 G de paramètres, 55,46 Go de dépôt — en découlent entièrement.


Sources primaires — les modèles voisins

Base de toutes les comparaisons.

Source Ce qu'elle apporte
Qwen/Qwen3.8-2.4T-A95B la recette architecturale de la génération 3.8
config.json du Max hybride 3:1, GQA, RoPE partiel, MoE, MTP — pour la comparaison
Carte de modèle du Max modalité texte seule, raisonnement forcé, tableau de 31 benchmarks
Fiches de Qwen3.6-27B dense, attention complète, 262 144 jetons, Apache 2.0, SWE-bench Verified 77,2

Analyse complète du grand frère : Qwen3.8-Max.


Sources officielles

Source Ce qu'elle soutient
Billet Qwen3.8 l'annonce du 3 août, le positionnement, la promesse de poids ouverts
Communiqué Alibaba Group le lancement du 3 août — ne mentionne pas le 27B

Le 27B est peu présent dans la communication officielle

Le communiqué institutionnel ne le mentionne pas ; sa présence tient au billet technique de l'équipe Qwen.

L'annonce du 3 août ne comportait aucun chiffre de performance. Les trente lignes de benchmarks n'apparaissent qu'avec la publication du 14.


Évaluations indépendantes

Aucune.

À la date de rédaction — un jour après la publication — ni Artificial Analysis, ni Vals AI, ni LMArena n'ont publié de mesure sur Qwen3.8-27B.

C'est la principale limite de ce rapport

Tous les chiffres de performance qu'il cite viennent d'Alibaba.

C'est une absence temporaire : un modèle sous Apache 2.0, de 27 G, multimodal, qui tient sur une carte, sera mesuré par de nombreuses équipes dans les jours qui suivent. C'est ce qu'il faut attendre avant toute décision engageante.


Sources secondaires

Utilisées pour la chronologie et le contexte. Aucune affirmation technique de ce rapport ne repose sur elles.

Source Usage
Latent Space — AINews annonce conjointe des deux modèles, réactions
DigitalApplied chronologie du retard, statut aux 10 et 12 août
OrcaRouter inventaire des inconnues avant la sortie
Yotta Labs tableaux VRAM — exemple de l'omission du cache
Swfte arbitrage auto-hébergement / API
OfficeChai couverture de la publication du 14 août
Wikipédia — Qwen historique des licences de la famille depuis 2023

Une erreur répandue dans les sources secondaires

Presque toutes publient un tableau « VRAM requise » ne comptant que les poids, sans mentionner le cache clé-valeur.

Or à 262 144 jetons, le cache pèse 17,18 Go contre 13,86 Go de poids en 4 bits : il dépasse les poids. Voir L'arithmétique de la VRAM.


Ce qui n'existe pas

Recherché et non trouvé, au 15 août 2026 :

Absent Conséquence
Rapport technique ou publication arXiv aucune information sur l'entraînement
Ablations architecturales le ratio 3:1 et les dimensions sont injustifiés
Benchmark de long contexte la fenêtre annoncée n'est pas mesurée
Évaluation de sécurité aucune donnée sur les capacités à risque
Mesure de la dégradation par quantification le choix du format reste empirique
Modèle de base non affiné l'affinage part d'un tronc déjà instruit
Évaluation indépendante aucun chiffre hors Alibaba

Voir Ce qui reste non publié.


Méthode de ce rapport

  1. Lecture directe des sources primaires : config.json, LICENSE, carte de modèle, arborescence du dépôt.
  2. Recalcul indépendant de toute affirmation chiffrée pouvant l'être, en Python pur — avec vérification croisée par la taille du dépôt.
  3. Séparation stricte entre mesures du constructeur et faits vérifiables.
  4. Marquage explicite des reconstructions — encodeur visuel, couche MTP — et de leur degré de certitude.
  5. Conservation et notation des prédictions faites avant la publication, erreurs comprises.
  6. Signalement des affirmations qui circulent sans fondement.

Historique de ce rapport

Date Version
13 août 2026 Première édition, avant publication du modèle. Établissait l'absence sur quatre sources primaires, formulait douze hypothèses d'architecture, et chiffrait l'arithmétique matérielle sous trois scénarios.
15 août 2026 Réédition après la publication du 14 août. Architecture, évaluations, matériel et utilisation réécrits à partir des données réelles. Les hypothèses de la première édition sont conservées et notées en Le verdict des hypothèses.

Date de consultation de toutes les sources : 15 août 2026.