C'EST QUOI ?
Une plateforme d'observabilité OpenTelemetry-native qui regroupe dans un seul produit ce qu'on assemble d'habitude avec Prometheus, Loki, Tempo et un outil de paging : logs, traces, métriques, exceptions, session replay, suivi LLM et astreintes. Le backend est en Go (Gin), le frontend en SvelteKit, l'ingestion passe par OTLP/HTTP, et la licence est MIT, sans BSL ni open-core.
POURQUOI C'EST INTÉRESSANT ?
- Tout est corrélé : waterfalls de spans avec navigation directe vers les logs du trace, métriques par endpoint (P50/P95/P99, tri par Apdex) et profiling en flame graphs (CPU, heap, goroutines) avec diff entre versions.
- Déploiement à la carte : docker compose avec ClickHouse et PostgreSQL pour une vraie prod, ou conteneur unique en mode embarqué SQLite/DuckDB, zéro dépendance externe. Une application Go peut même l'importer comme librairie.
- Exceptions lisibles : regroupement par fingerprint des stack traces, résolution des source maps (webpack, esbuild, Vite) et symbolication des crashs mobiles, avec un moteur écrit en Go pur.
- Front et mobile inclus : session replay navigateur et Flutter, SDKs React, Vue, Svelte côté web et Android, iOS, React Native côté mobile, en plus de l'OTel classique côté serveur.
- Astreintes intégrées : rotations, politiques d'escalade et notifications par email, Slack, SMS, Telegram ou Pushover, sans produit séparé à brancher.
CAS D'USAGE
- Remplacer un empilement Prometheus + Loki + Tempo + outil de paging par un seul service à opérer.
- L'observabilité d'un side project ou d'une petite prod : le mode embarqué SQLite/DuckDB tient dans un conteneur.
- Suivre les coûts, tokens et latences des appels LLM d'une app IA au même endroit que ses traces.
- Laisser un agent faire le travail : des skills Claude Code/Cursor sont fournis,
/traceway-setuppour instrumenter le projet et/tracewaypour interroger les données de prod.
Pour qui ne veut pas l'héberger, une version cloud managée existe sur cloud.tracewayapp.com.
