Sites marketing et de contenu rendus par Workers
Astro sur Workers. HTML mis en cache en périphérie. Un TTFB sous les 50 ms partout sur la planète. Ce site en est lui-même l’exemple.
— Pratique / Cloudflare
Nous n’utilisons pas Cloudflare comme un CDN boulonné à une application AWS. Nous construisons sur la plateforme — Workers comme runtime, D1 / R2 / Vectorize comme couche de données, Durable Objects pour l’état, Workers AI pour l’inférence. Le résultat est un logiciel rapide partout dans le monde, peu coûteux à exploiter et de faible surface.
Ce que nous livrons
Astro sur Workers. HTML mis en cache en périphérie. Un TTFB sous les 50 ms partout sur la planète. Ce site en est lui-même l’exemple.
Des appels Anthropic / OpenAI / Workers AI depuis l’intérieur des Workers. Des embeddings mis en cache dans Vectorize. Durable Objects pour l’état des conversations.
Des serveurs Model Context Protocol qui tournent n’importe où, se mettent à l’échelle jusqu’à zéro et s’intègrent à Claude Desktop, à Cursor et à d’autres clients MCP.
Un modèle à acteur unique pour les salons de discussion, les outils collaboratifs et les agents en direct. WebSockets de premier ordre. Aucune grappe Redis externe à exploiter.
Cloudflare Workflows pour l’exécution durable, sûre en cas de reprise, des processus à étapes multiples — ingestion RAG, rapprochement de facturation, appels d’IA par lots.
Pages → Workers, Lambda → Workers, Cognito → authentification sur mesure, RDS → D1 ou Hyperdrive. Fait avec un retour en arrière, pas sur la foi.
Stack — assumée
Runtime
Cloudflare Workers (TypeScript)
Hébergement / pages
Workers · Pages (hérité)
Bases de données
D1 (SQLite) · Hyperdrive (Postgres) · Durable Objects
Stockage d’objets
R2
Vecteurs
Vectorize
Inférence d’IA
Workers AI · Anthropic · OpenAI
Asynchrone / files
Queues · Workflows · Cron Triggers
Authentification
Cloudflare Access · JWT sur mesure sur Workers
Observabilité
Workers Logs · Tail · Logpush
Construction et déploiement
Wrangler · Workers Builds · GitHub Actions
Pourquoi se spécialiser
Une équipe qui construit sur AWS, Vercel et Cloudflare chaque trimestre connaît le menu. Une équipe qui construit sur une seule plateforme chaque jour sait où sont les arêtes vives. Nous avons choisi Cloudflare parce que c’est la bonne architecture pour presque chaque produit que nous voulons livrer — distribuée mondialement, axée sur la périphérie, pensée pour l’IA et peu coûteuse à exploiter.
Pourquoi pas ?
Si votre application a besoin d’un énorme Postgres monolithique avec des centaines de Go de données actives, ou d’un processus d’arrière-plan à état de longue durée qui se mesure en heures, la plateforme se bat contre vous. Nous vous le dirons — et nous vous orienterons ailleurs si c’est le bon choix. L’honnêteté fait partie de l’engagement.
— Calculateur de coûts
Faites glisser les curseurs. Le coût se met à jour en direct. Le chiffre Lambda correspond à l’allocation minimale de 128 Mo en us-east-1, y compris l’API Gateway nécessaire pour servir le HTTP — votre facture AWS réelle est généralement plus élevée (plus de mémoire, sortie de données, journalisation).
Pour la plupart des sites marketing : 1–5 ms. Pour des pages SSR au rendu chargé en gabarits : 5–15 ms. Pour l’inférence IA avec des appels à Anthropic / OpenAI : le coût en CPU-ms tient surtout à l’attente de l’amont — facturée en temps réel, typiquement 50–200 ms. Passez par /contact pour ce scénario ; c’est un autre modèle de coûts.
Voir le détail complet des coûts de Workers, comparé à AWS Lambda
— Tiré du GitHub
Des patrons de production fonctionnels, sous licence MIT. Les deux se déploient dans votre propre compte Cloudflare en moins de cinq minutes. Des billets de blogue complémentaires expliquent l’architecture au complet.
Pipeline RAG de production sur Cloudflare Workers
Serveur MCP de production sur Cloudflare Workers
— Pour aller plus loin
Dites-nous la forme de la charge de travail, les contraintes et le calendrier. Nous répondrons par écrit dans un délai d’un jour ouvrable.