Aller au contenu

Tableau des spécifications

Fiche technique complète, avec le statut de chaque ligne.

Statut Signification
Déclaré Affirmé par Pokee AI
Calculé Recalculé dans ce rapport à partir de chiffres publiés
Déduit Conclusion imposée par l'arithmétique
Inconnu Non publié

Identité

Caractéristique Valeur Statut
Nom Pokee-Isaac 28B (v0) Déclaré
Éditeur Pokee AI Déclaré
Date d'annonce 4 août 2026 Déclaré (3 au 5 selon les sources)
Licence Propriétaire, poids fermés Déclaré
Base partielle Qwen3.6-27B (Apache 2.0) Déclaré

Architecture

Caractéristique Valeur Statut
Paramètres totaux 28 × 10⁹ Déclaré
Paramètres actifs par token ≲ 8 × 10⁹ Déduit
Dense ou mélange d'experts Mélange d'experts très probable Déduit
Type d'architecture « Non purement décodeur » Déclaré
Majorité des couches État de taille fixe Déduit
Couches d'attention réelle ≲ 10 sur ~64 Déduit
Attention globale sur 10 M Impossible Déduit
Nombre de couches Inconnu (≈ 64 supposé) Inconnu
Dimension du modèle Inconnue (≈ 5 120 supposée) Inconnu
Encodage de position Inconnu Inconnu
Mécanisme de mélange Inconnu Inconnu

Contexte

Caractéristique Valeur Statut
Fenêtre de contexte 10 000 000 tokens Déclaré
Sortie maximale 60 000 tokens Déclaré
Réduction du cache KV ≈ 5× à VRAM égale Déclaré
Cache d'un décodeur classique à 10 M 2,62 To Calculé
Après réduction ×5 524 Go Calculé
Budget disponible, RTX 4090 962 octets/token Calculé
Budget disponible, B200 17 601 octets/token Calculé
Contexte de 10 M sur RTX 4090 Impossible Déduit

Modalités

Caractéristique Valeur Statut
Texte Oui Déclaré
Image, audio, vidéo Non Déclaré
Appel d'outils Oui, compatible OpenAI Déclaré
Sorties structurées Oui Déclaré
Mode raisonnement Explicite, activable Déclaré

Performance

Benchmark Score Statut
RULER @ 256 K 96,9 Déclaré (interne)
RULER @ 512 K 96,7 Déclaré (interne)
RULER @ 1 M 95,0 Déclaré (interne)
RULER @ 2 M 95,8 Déclaré (interne)
RULER @ 10 M 93,3 Déclaré (interne)
MRCR v2 @ 512 K 0,743 Déclaré (interne)
MRCR v2 (agrégé) 60,7 % Rapporté par BenchLM
BFCL v4 70,94 Déclaré (interne)
τ³-bench 0,662 Déclaré (interne)
Terminal-Bench 2.1 65,1 % Déclaré (interne)
MCP-Atlas 74,6 Déclaré (interne)
PinchBench 95,7 Déclaré (interne)
DTAP (succès d'attaque) 35,6 Déclaré (garde-fous inactifs)
Refus explicites 1,5 % Déclaré
Composite agentique BenchLM 50,9/100 — 46ᵉ/132 Agrégé par un tiers
Connaissances, maths, multilingue, suivi d'instructions Aucune donnée Inconnu

Efficacité

Caractéristique Valeur Statut
Préfill à 10 M, 1× B200 137 200 tokens/s Déclaré
Durée de préfill de 10 M ≈ 73 s Calculé
Budget de calcul par token 8 à 33 GFLOPs selon la précision Calculé
Coût d'un dense 28 G par token 56 GFLOPs Calculé
Coût d'une couche d'attention globale à 10 M 1,64 × 10¹⁸ FLOPs, ≈ 12 min Calculé
Latence au premier token Inconnue Inconnu
Débit de génération Inconnu Inconnu
Débit sous charge Inconnu Inconnu

Déploiement

Caractéristique Valeur Statut
API gérée Compatible OpenAI Déclaré
Moteurs vLLM, SGLang Déclaré
Déploiement VPC, sur site, embarqué Déclaré
Matériel annoncé RTX 4090, Intel Arc Pro B70, NPU Qualcomm, B200 Déclaré
Poids téléchargeables Non Déclaré

Tarifs

Poste Prix Statut
Entrée 0,15 $/M Déclaré
Sortie 1,00 $/M Déclaré
Lecture en cache 0,079 $/M (via revendeur) Tiers
Mixte (3:1) 0,57 $/M Calculé par BenchLM
Coût d'un appel à contexte plein 1,50 $ Calculé

Entreprise

Caractéristique Valeur Statut
Fondée 2024 Déclaré
Fondateur Zheqing (Bill) Zhu Déclaré
Amorçage 12 M$, juillet 2025 Déclaré
Investisseurs Point72 Ventures, Qualcomm Ventures, Samsung NEXT, SCB10X Déclaré
Brevets 5 provisoires, non publiés Déclaré