Drei Modellstufen auf derselben Evidenzskala verglichen.
Unterschiede bei Architektur, Tokenizer und Datenpipeline werden getrennt dargestellt, damit veröffentlichte Artefakte, publizierte Validierung und konfigurierte Echelon-Ziele nicht als dieselbe Art von Evidenz erscheinen.
ARCHITEKTURSKALA
Vom Pilotmodell mit 49,3 Mio. zu einer konfigurierten Echelon Base mit 506,3 Mio. Parametern.
Parameter- und Kontextskalierung lassen sich direkt vergleichen. Schichtdimensionen werden nur dort gezeigt, wo eine öffentliche Quelle sie nennt; beim ersten Piloten bleibt daher eine ausdrückliche Dokumentationslücke.
Veröffentlichtes Artefakt
quantum-1-pilot
Parameter
49,3 Mio. veröffentlichte Parameter
Kontext
512 tokens
Detaillierte Dimensionen
In der fixierten Evidenz nicht veröffentlicht
Detaillierte Schichtdimensionen werden im fixierten öffentlichen Manifest nicht genannt.
Veröffentlichtes Artefakt
quantum-1.6-pilot
Parameter
49,3 Mio. veröffentlichte Parameter
Kontext
512 tokens
12 layers
Hidden Size
512
Attention-Heads
8
KV-Heads
8
Die Continued-Pretraining-Veröffentlichung behält die kompakte Pilotarchitektur bei.
Nur Konfigurations-Preflight
quantum-1-echelon
Parameter
506,3 Mio. konfigurierte Parameter
Kontext
2.048 tokens
26 layers
Hidden Size
1.280
Attention-Heads
20
KV-Heads
5
Vorgeschlagene Echelon-Base-Konfiguration; keine trainierten Gewichte und keine gemessene Leistungsfähigkeit.