Writer lance Palmyra X6 et optimise son infrastructure pour réduire les coûts d'inférence
- 01Writer lance Palmyra X6, un modèle dérivé de GLM-5.2 de Z.ai, pour réduire les coûts d'inférence.
- 02Le nouveau modèle et les optimisations du harness agentique pourraient diminuer jusqu'à 50 % les coûts pour les tâches basiques.
- 03Une étude interne de Writer montre que des ajustements du harness réduisent les coûts de 40 % en moyenne, quel que soit le modèle utilisé.

Writer, éditeur d'outils et d'agents IA pour les équipes marketing, annonce le déploiement de Palmyra X6, un nouveau modèle dérivé de l'open source GLM-5.2 de Z.ai. Conçu pour des tâches complexes et multi-étapes, ce modèle vise à réduire les coûts d'inférence tout en maintenant des performances adaptées aux besoins des entreprises. Writer estime que cette solution, combinée à des améliorations de son infrastructure, pourrait diminuer jusqu'à 50 % les coûts pour les tâches basiques de ses clients.
L'entreprise a également publié une version mise à jour de son harness agentique, un framework permettant d'orchestrer les interactions entre les modèles et les outils métiers. Selon Writer, ces optimisations ciblent particulièrement l'efficacité des tâches nécessitant plusieurs étapes, en réduisant le nombre de tokens générés. Une étude interne récente, publiée par des chercheurs de Writer, souligne que des ajustements mineurs dans le harness peuvent réduire les coûts de 40 % en moyenne, indépendamment du modèle utilisé. Les auteurs de l'étude soulignent que l'efficacité du harness se multiplie sur l'ensemble des modèles déployés par une organisation, passés et futurs.
Pour les clients de Writer, Palmyra X6 s'intègre à l'écosystème existant aux côtés d'autres modèles proposés par l'entreprise ou d'outils importés via des plateformes comme Azure ou Amazon Bedrock. May Habib, PDG de Writer, met en avant une méfiance croissante des entreprises envers les laboratoires d'IA majeurs, accusés de ne pas proposer de solutions adaptées aux enjeux de coûts. Elle évoque un « explosion des coûts sans précédent » et une perte de confiance des DSI envers ces acteurs, incapables selon elle de répondre aux besoins concrets des organisations.
Articles liés

L'écart de sécurité persiste entre modèles IA open-weight et frontaliers malgré des capacités proches
Analyse des risques liés à l'écart de sécurité entre modèles IA open-weight et modèles frontaliers, avec l'exemple de Z.ai GLM-5.2.

Z.ai annonce GLM-5.2 et revendique des performances en cybersécurité proches de Mythos
Analyse des avancées chinoises en IA spécialisée en cybersécurité et leurs implications géopolitiques.
Z.ai lance GLM-5.2 avec une fenêtre de contexte d'1 million de tokens et deux niveaux d'effort
Z.ai dévoile GLM-5.2, un modèle doté d'une fenêtre de contexte utilisable d'1 million de tokens et de deux niveaux d'effort (High et Max). Intégré à des outils comme Claude Code et Cline, il est disponible via un endpoint compatible Anthropic sans benchmarks à son lancement.