P

Palmyra X6

Writer · Lanzado ago 2026

Condicional

Palmyra X6 es el modelo agéntico buque insignia de Writer para flujos de trabajo de marketing e ingresos — post-entrenado sobre el GLM-5.2 de pesos abiertos de Z.ai a $2/$8 por 1M tokens, una fracción de la tarifa de los modelos de frontera. Cada cifra destacada proviene de las evaluaciones internas de Writer, y la procedencia de GLM-5.2 es una auténtica cuestión de aprovisionamiento. Adóptalo dentro de Writer para el trabajo de agentes GTM sensible al costo; busca en otra parte la capacidad general validada con benchmarks independientes.

¿Es adecuada para ti?

Bueno para

  • Agentes GTM empresariales sensibles al costo — $2/$8 por 1M tokens rebajan a Claude Opus 4.8, GPT-5.5 y Gemini 3.1 en la propia comparativa de lanzamiento de Writer
  • Flujos de trabajo de marketing e ingresos — las mejores puntuaciones internas en voz de marca (0.92), anclaje/recuperación (0.91) y generación de contenido (0.88)
  • Ejecución desatendida de horizonte largo — sostiene un único objetivo hasta 8 horas; 82 tokens por segundo, mediana de 26 segundos por tarea completada
  • Contexto de 1M tokens para trabajo basado en conectores a través de CRM, Slack, documentos y Knowledge Graphs
  • Empresas reguladas con aversión al sesgo — evaluación de riesgo de modelo pre-registrada (19,674 respuestas evaluadas); la mejor tasa de ambos lados de ModelSlant (80%) y FORTRESS +8.6 sobre el modelo base

No recomendado para

  • Capacidad general validada con benchmarks independientes — X6 no publica benchmarks públicos; todas las puntuaciones son de la evaluación interna de Writer (n=22, línea base congelada a 2026-06-07)
  • Despliegues fuera de la plataforma de Writer — sin ID de modelo en Bedrock en el lanzamiento (X5/X4 sí lo tienen); ajustado para coevolucionar con el harness de Writer Agent
  • Compradores con un veto firme sobre las bases de pesos abiertos chinas — post-entrenado sobre el GLM-5.2 de Z.ai (licencia MIT), una cuestión de cadena de suministro para algunas empresas de EE. UU.

Rendimiento por tarea

Grounding and retrieval

Excellent

Puntuación interna de capacidad de 0.91 — anclaje a Knowledge Graphs y documentos, recuperación y citación

Brand voice

Excellent

0.92 — la capacidad individual más fuerte; aplica la voz de marca y las instrucciones personalizadas a la salida

Content generation

Very Good

0.88 — redacta y edita contenido de formato largo y corto según un encargo

Sub-agent delegation

Very Good

0.86 — delega trabajo a subagentes generados y fusiona los resultados (evaluación interna de Writer)

MCP tool use

Very Good

0.88 — acciones basadas en conectores a través de CRM, Slack y documentos

Long-horizon unattended execution

Very Good

Hasta 8 horas en un único objetivo; 82 tokens por segundo, mediana de 26 segundos por tarea completada

Precios

Entrada

$2 / 1M

Salida

$8 / 1M

Contexto

1M context, 8K max output

Ver precios completos

Pruebas de rendimiento

PruebaPuntuaciónFuente
Writer internal eval — avg of 9 capabilities (in WRITER Agent)0.87 / 1.00 Fuente
FinanceBench (Writer-run, raw model)0.855 Fuente
Finance Agent (Writer-run, raw model)0.753 Fuente
FinanceQA (Writer-run, raw model)0.673 Fuente

Aún no hay cambios de veredicto

El reloj corre desde el primer día: los cambios aparecerán aquí a medida que evolucione nuestro veredicto.

Registro de verificación

Aún no hay comprobaciones de verificación

Todavía no hemos registrado ninguna comprobación de verificación para esta entrada. Cuando se ejecute una, su historial aparecerá aquí.

Cómo evaluamos