Présentation
Step 5 Preview est le modèle phare de StepFun destiné aux flux de travail agentiques. Il a été mis à disposition le 8 octobre 2026 via la plateforme OpenRouter. Le service accepte du texte, des images et de la vidéo en entrée et renvoie du texte, tout en supportant l’appel d’outils et les réponses structurées au format JSON.
Architecture MoE et paramètres actifs
Le modèle repose sur une architecture sparse Mixture‑of‑Experts (MoE) : sur les 600 milliards de paramètres totaux, seulement 27 milliards sont activés pour chaque token traité. Cette activation sélective réduit la charge de calcul par token tout en conservant la capacité d’un réseau très large. Le mécanisme MoE permet de mobiliser les experts les plus pertinents en fonction du contexte, ce qui explique la bonne performance sur des tâches complexes comme la programmation ou l’analyse financière.
Performances et coûts
OpenRouter indique un débit moyen de 103 tokens/s (P50) avec une latence de 3,49 s pour le premier token. Le modèle propose une fenêtre de contexte de 1 000 000 tokens, bien au‑delà des limites classiques des LLM, et autorise jusqu’à 64 000 tokens de génération. Le tarif est de 1 $ / M tokens d’entrée, 2,70 $ / M tokens de sortie et 0,05 $ / M tokens de lecture de cache. Ces prix sont affichés comme moyenne payée par les clients, les mécanismes de mise en cache pouvant réduire le coût effectif.
Fiabilité et usage en production
Le suivi d’OpenRouter montre une disponibilité de 99,98 % sur les trois derniers jours, avec une disponibilité d’inférence de 99,66 %. En cas d’erreur d’un fournisseur, le système bascule automatiquement vers un autre, garantissant une continuité de service tant que les filtres de requête le permettent. Les métriques d’activité révèlent un volume important de tokens traités, ce qui confirme l’adoption du modèle dans des applications réelles, notamment des agents de codage, des assistants financiers et des workflows nécessitant la manipulation de larges bases de code.