P

Palmyra X6

Writer · Lançado 08/2026

Condicional

O Palmyra X6 é o modelo agêntico carro-chefe da Writer para fluxos de trabalho de marketing e receita — pós-treinado sobre o GLM-5.2 de pesos abertos da Z.ai a $2/$8 por 1M de tokens, uma fração da taxa dos modelos de fronteira. Todos os números de destaque são alegados pela Writer, e a proveniência do GLM-5.2 é uma questão real de procurement. Adote-o dentro da Writer para trabalho de agente GTM sensível a custo; procure em outro lugar por capacidade geral com benchmark independente.

É adequada para ti?

Bom para

  • Agentes GTM corporativos sensíveis a custo — $2/$8 por 1M de tokens fica abaixo do Claude Opus 4.8, do GPT-5.5 e do Gemini 3.1 na comparação de lançamento da própria Writer
  • Fluxos de trabalho de marketing e receita — as melhores pontuações internas em voz de marca (0.92), grounding/recuperação (0.91) e geração de conteúdo (0.88)
  • Execução não supervisionada de horizonte longo — sustenta um único objetivo por até 8 horas; 82 tokens/s, mediana de 26 segundos por tarefa concluída
  • Contexto de 1M de tokens para trabalho orientado por conectores em CRM, Slack, documentos e Knowledge Graphs
  • Empresas reguladas avessas a viés — avaliação de risco de modelo pré-registrada (19,674 respostas avaliadas); a melhor taxa de ambos os lados do ModelSlant (80%) e +8.6 no FORTRESS sobre o modelo base

Não recomendado para

  • Capacidade geral com benchmark independente — o X6 não publica benchmarks públicos; todas as pontuações são da avaliação interna da Writer (n=22, linha de base congelada em 2026-06-07)
  • Implantações fora da plataforma da Writer — sem ID de modelo no Bedrock no lançamento (o X5/X4 têm um); ajustado para coevoluir com o harness do Writer Agent
  • Compradores com bloqueio rígido a fundações chinesas de pesos abertos — pós-treinado sobre o GLM-5.2 da Z.ai (licença MIT), uma questão de cadeia de suprimentos para algumas empresas dos EUA

Desempenho por tarefa

Grounding and retrieval

Excellent

0.91 de pontuação interna de capacidade — grounding em Knowledge Graph/documentos, recuperação e citação

Brand voice

Excellent

0.92 — a capacidade individual mais forte; aplica voz de marca e instruções personalizadas à saída

Content generation

Very Good

0.88 — redige e edita conteúdo de formato longo e curto conforme o briefing

Sub-agent delegation

Very Good

0.86 — delega trabalho a subagentes gerados e mescla os resultados (avaliação interna alegada pela Writer)

MCP tool use

Very Good

0.88 — ações orientadas por conectores em CRM, Slack e documentos

Long-horizon unattended execution

Very Good

Até 8 horas em um único objetivo; 82 tokens/s, mediana de 26s por tarefa concluída

Preços

Entrada

$2 / 1M

Saída

$8 / 1M

Contexto

1M context, 8K max output

Ver preços completos

Testes de desempenho

TestePontuaçãoFonte
Writer internal eval — avg of 9 capabilities (in WRITER Agent)0.87 / 1.00 Fonte
FinanceBench (Writer-run, raw model)0.855 Fonte
Finance Agent (Writer-run, raw model)0.753 Fonte
FinanceQA (Writer-run, raw model)0.673 Fonte

Ainda sem alterações de veredicto

O relógio começa a contar no primeiro dia: as alterações aparecem aqui à medida que o nosso veredicto evolui.

Registo de verificação

Ainda não há verificações

Ainda não registámos nenhuma verificação para esta entrada. Assim que uma for executada, o seu histórico aparece aqui.

Como avaliamos