Encapsuler la complexité
Graphiques avancés, mises en page spatiales et interactions coordonnées deviennent des composants testés avec quelques paramètres utiles.
Quelques paramètres → rendu avancé et stableL’IA assemble des composants selon vos besoins. Nous testons des tâches réelles pour améliorer le rendu et les modifications.
Comparaison des approches
La génération directe est rapide, mais le résultat dépend du modèle. Les modèles de page sont stables, mais limitent ce qu’on peut créer. OWL Compose permet de composer librement, de finir proprement et de continuer à modifier l’œuvre.
Le résultat arrive vite, mais sa qualité dépend à chaque fois du modèle.
Le démarrage est simple et le résultat stable, mais le contenu et la mise en page restent limités.
Compose librement mises en page, graphiques et visuels, puis continue à modifier et publier.
La génération directe mène en vitesse et liberté, les modèles en stabilité, OWL Compose équilibre mieux l’ensemble du processus.
Œuvres réelles
Ouvrez un exemple publié pour explorer le contenu et les graphiques.
Tests continus
Nous testons OWL Compose avec des modèles de référence proches de la frontière prix–performance. Les tâches et la configuration restent fixes, puis nous retestons après chaque évolution du modèle.
Abstraction adaptative
La couche d’écriture n’est pas uniformément abstraite ou détaillée. Chaque limite dépend de ce que les modèles de référence créent avec fiabilité.
Graphiques avancés, mises en page spatiales et interactions coordonnées deviennent des composants testés avec quelques paramètres utiles.
Quelques paramètres → rendu avancé et stableQuand les modèles savent composer de façon fiable, nous divisons la capacité en primitives plus fines plutôt que de l’enfermer dans un modèle.
Syntaxe fine → davantage de liberté créativeAvec les mêmes modèles de référence et des tâches fixes, nous faisons régulièrement l’ablation de chaque couche. Une limite ne reste que si les preuves montrent son utilité.
15 configurations · AA v4.2 · USD / tâche
Les points colorés forment l’enveloppe supérieure en coût logarithmique. Gris : alternative moins chère et au moins aussi performante. Creux : sous l’enveloppe. Échantillon sourcé, pas classement complet. Les candidats doivent passer nos tests de qualité ; coûts inconnus exclus.
| Model | USD | AA v4.2 | Frontière prix–performance |
|---|---|---|---|
| GPT-5.6 Luna (max) | 0.10 | 43 | Candidat de référence |
| GLM-5.3-Flash | 0.18 | 46 | Candidat de référence |
| DeepSeek V4 Flash 0731 (max) | 0.14 | 41 | Dominé |
| MiniMax-M3 | 0.23 | 36 | Dominé |
| DeepSeek V4 Pro 0813 (max) | 0.33 | 42 | Dominé |
| Gemini 3.1 Pro Preview | 0.34 | 37 | Dominé |
| Gemini 3.7 Flash (high) | 0.55 | 45 | Dominé |
| GPT-5.6 Terra (max) | 0.81 | 47 | Sous l’enveloppe |
| Muse Spark 1.3 (max) | 0.96 | 53 | Candidat de référence |
| GPT-5.6 Sol (max) | 1.25 | 51 | Dominé |
| GLM-5.3 (max) | 1.26 | 49 | Dominé |
| Kimi K3 (max) | 1.58 | 50 | Dominé |
| GPT-6 Astra (max) | 2.57 | 55 | Sous l’enveloppe |
| Claude Opus 5 (max) | 4.21 | 54 | Dominé |
| Claude Fable 5.1 (max, fallback) | 6.12 | 57 | Candidat de référence |