Présentation du modèle

Step 5 Preview, développé par StepFun, est un modèle propriétaire publié en septembre 2026. Il accepte les entrées texte et image et ne génère que du texte. Le modèle possède une fenêtre contextuelle de 1 million de tokens, ce qui correspond à environ 1500 pages A4 en police 12 Arial. Une version « reasoning » est indiquée, tandis qu’une variante non‑reasoning pourrait exister.

Performances mesurées

Sur l’Artificial Analysis Intelligence Index (v4.3), Step 5 Preview obtient un score de 44 / 200, bien au‑dessus de la médiane de 25 parmi les 653 modèles évalués. Le même indice montre que le modèle a produit 160 M de tokens lors de l’évaluation, contre une médiane de 90 M, ce qui le classe 65 / 200 en verbosité. En termes de rapidité, le modèle délivre 99,8 tokens de sortie par seconde, le plaçant à la position 41 / 200, légèrement supérieur à la moyenne des modèles comparables.

Analyse de coût et de verbosité

Le tarif appliqué est de 1,00 $ / 1 M de tokens d’entrée et de 2,70 $ / 1 M de tokens de sortie. Le coût total de l’évaluation sur l’Intelligence Index s’élève à 918,34 $. Comparé au coût médian de 1,88 $ / 1 M d’entrée et 10,00 $ / 1 M de sortie, Step 5 Preview se situe dans la fourchette la plus compétitive. La forte verbosité, mesurée par le nombre de tokens générés, augmente le coût d’utilisation, même si le prix unitaire reste bas.

Limites et perspectives

Le modèle se distingue par son intelligence et son prix, mais la production excessive de tokens peut limiter son efficacité dans des scénarios où la concision est requise. De plus, l’absence de données détaillées sur le nombre de paramètres (classe « Medium » ou « Large » non précisé) empêche une comparaison fine avec d’autres architectures. La disponibilité d’une version non‑reasoning pourrait réduire la verbosité, mais aucune information chiffrée n’est fournie. Enfin, le modèle reste propriétaire, ce qui restreint l’accès aux poids et limite les possibilités de personnalisation.