Cloudflare étend son portefeuille au-delà du CDN et de la cybersécurité en annonçant Cloudflare Basin, une plateforme serverless destinée aux charges de travail analytiques. Le service promet de supprimer la nécessité d’infrastructures dédiées, de réduire les frais d’egress et de simplifier la facturation en ne facturant que le volume de données interrogées. Cette offre cible les petites entreprises et les équipes de développeurs qui ne disposent pas des ressources nécessaires pour gérer des entrepôts de données traditionnels.

Contexte et objectifs

Les charges analytiques classiques requièrent des équipes de data engineers capables de déployer, configurer et maintenir des clusters de serveurs coûteux. En outre, les organisations paient des frais d’egress lorsqu’elles déplacent des données depuis les clouds publics vers des systèmes de stockage ou d’analyse distincts. Cloudflare affirme que ces coûts limitent l’accès aux analyses avancées aux seules grandes entreprises. Basin vise à « niveler le terrain de jeu » en proposant une solution où le stockage, le calcul et la mise en réseau sont fournis par l’infrastructure globale de Cloudflare, éliminant ainsi les déplacements de données.

Architecture technique

Le cœur de Basin repose sur le format de table open‑source Apache Iceberg, conçu pour gérer des ensembles de données à l’échelle du pétaoctet. Iceberg sépare métadonnées et données physiques, ce qui permet aux moteurs d’analyse comme Apache Spark ou DuckDB de lire les fichiers directement depuis leur emplacement d’origine. Cloudflare intègre ce format avec R2, son service de stockage d’objets distribué sans frais d’egress. Ainsi, les données restent dans R2 et les requêtes s’exécutent en mode « in‑place », sans copie ni transformation préalable. Le calcul s’appuie sur le réseau edge de Cloudflare, offrant une latence réduite pour les sources de données situées près des points d’entrée du réseau.

Analyse des performances et limites

En supprimant les étapes de copie et de déplacement, Basin réduit le temps de mise à disposition des données et les coûts associés aux transferts inter‑cloud. Le modèle de facturation à l’usage, basé sur le volume de données analysées, contraste avec les licences traditionnelles qui facturent le stockage et le calcul séparément. Cependant, la solution ne prétend pas remplacer les entrepôts de données massifs pour les charges de travail à grande échelle. Les performances dépendront de la capacité du réseau edge à fournir un débit suffisant pour les requêtes intensives, et les moteurs d’analyse devront être compatibles avec le format Iceberg. De plus, l’absence de clusters dédiés peut limiter les optimisations spécifiques à certains workloads, comme les traitements en temps réel très exigeants.

Implications concurrentielles

Basin place Cloudflare en concurrence directe avec des acteurs établis tels que Snowflake et Databricks. En misant sur la proximité des données avec les points d’entrée du réseau, Cloudflare propose une alternative plus économique pour les petites charges analytiques. Si les grandes entreprises continuent de privilégier les entrepôts centralisés pour leurs besoins critiques, Basin pourrait capter une part de marché significative parmi les startups et les équipes de développement qui recherchent une solution rapide à déployer et à moindre coût.