P

Palmyra X6

Writer · Sorti août 2026

Conditionnel

Palmyra X6 est le modèle phare agentique de Writer pour les workflows marketing et de revenus — post-entraîné sur le GLM-5.2 de Z.ai (poids ouverts), à $2/$8 par 1M de tokens, une fraction du tarif des modèles de pointe. Chaque chiffre clé provient de Writer, et la provenance GLM-5.2 soulève une vraie question d'approvisionnement. Adoptez-le au sein de Writer pour le travail d'agents GTM sensible au coût ; cherchez ailleurs pour une capacité générale benchmarkée de façon indépendante.

Est-ce fait pour vous ?

Recommandé pour

  • Agents GTM d'entreprise sensibles au coût — $2/$8 par 1M de tokens, en dessous de Claude Opus 4.8, GPT-5.5 et Gemini 3.1 dans la propre comparaison de lancement de Writer
  • Workflows marketing et de revenus — meilleurs scores internes en voix de marque (0.92), ancrage/récupération (0.91) et génération de contenu (0.88)
  • Exécution autonome de longue durée — maintient un objectif unique jusqu'à 8 heures ; 82 tokens/sec, tâche terminée médiane en 26 secondes
  • Contexte de 1M de tokens pour le travail piloté par connecteurs sur CRM, Slack, documents et Knowledge Graphs
  • Entreprises réglementées réfractaires aux biais — évaluation du risque du modèle pré-enregistrée (19,674 réponses jugées) ; meilleur taux both-sides de ModelSlant (80%) et FORTRESS à +8.6 par rapport au modèle de base

Déconseillé pour

  • Capacité générale benchmarkée de façon indépendante — X6 ne publie aucun benchmark public ; tous les scores proviennent de l'évaluation interne de Writer (n=22, baseline figée le 2026-06-07)
  • Déploiements hors de la plateforme Writer — pas d'ID de modèle Bedrock au lancement (X5/X4 en ont un) ; ajusté pour co-évoluer avec le framework Writer Agent
  • Acheteurs avec une interdiction ferme sur les fondations chinoises (poids ouverts) — post-entraîné sur le GLM-5.2 de Z.ai (licence MIT), une question de chaîne d'approvisionnement pour certaines entreprises américaines

Performances par tâche

Grounding and retrieval

Excellent

0.91 score de capacité interne — ancrage Knowledge Graph/documents, récupération et citation

Brand voice

Excellent

0.92 — la capacité individuelle la plus forte ; applique la voix de marque et les instructions personnalisées au résultat

Content generation

Very Good

0.88 — rédige et édite du contenu long comme court selon une consigne

Sub-agent delegation

Very Good

0.86 — délègue du travail à des sous-agents générés et fusionne les résultats (évaluation interne menée par Writer)

MCP tool use

Very Good

0.88 — actions pilotées par connecteurs sur CRM, Slack et les documents

Long-horizon unattended execution

Very Good

Jusqu'à 8 heures sur un objectif unique ; 82 tokens/sec, tâche terminée médiane en 26 s

Tarifs

Entrée

$2 / 1M

Sortie

$8 / 1M

Contexte

1M context, 8K max output

Voir tous les tarifs

Tests de performance

TestScoreSource
Writer internal eval — avg of 9 capabilities (in WRITER Agent)0.87 / 1.00 Source
FinanceBench (Writer-run, raw model)0.855 Source
Finance Agent (Writer-run, raw model)0.753 Source
FinanceQA (Writer-run, raw model)0.673 Source

Aucun changement de verdict pour l’instant

L’horloge tourne dès le premier jour : les changements apparaîtront ici à mesure que notre verdict évolue.

Journal de vérification

Aucune vérification pour le moment

Nous n’avons pas encore enregistré de vérification pour cette entrée. Dès qu’une vérification s’exécute, son historique apparaît ici.

Comment nous évaluons