Writer anunció este 13 de agosto la disponibilidad de Palmyra X6 y una actualización de su sistema de orquestación, el llamado harness, con el objetivo de resolver la ecuación económica de la inteligencia artificial en el sector corporativo. Según la nota de prensa oficial y el CTO Waseem AlShikh, el nuevo WRITER Agent opera con un costo promedio un 52 por ciento inferior al utilizar el nuevo modelo, una cifra que sitúa el lanzamiento como una respuesta directa a la demanda de eficiencia frente al consumo acelerado de tokens.
La reducción de costos no proviene únicamente del modelo, sino de la combinación de ambos componentes. Palmyra X6 es una versión post-entrenada del modelo open-source GLM-5.2 de Z.ai, desarrollada íntegramente bajo la infraestructura de EE. UU. para asegurar su independencia operativa, afirmó Matan-Paul Shetrit, Director de Producto. El modelo aporta una mejora del 48 por ciento en velocidad y un 10 por ciento en calidad. Por otro lado, el nuevo harness reduce el costo por tarea un 41 por ciento y aumenta la velocidad un 44 por ciento en todos los modelos probados, según una investigación interna publicada en arXiv y citada por TechCrunch.
Waseem AlShikh, CTO de Writer, dijo que "la empresa quiere que el consumo de tokens explote —it means adoption is happening— pero necesitan que los costos se aplane".
Los parámetros de eficiencia incluyen una reducción del 38 por ciento en el consumo promedio de tokens por tarea y una disminución del tiempo mediano de ejecución de 50 a 26 segundos. Writer reporta una generación de 82 tokens por segundo con Palmyra X6, cuyo precio se fija en 2 dólares por millón de tokens de entrada y 8 dólares por millón de salida. Además, el sistema permite a los agentes trabajar de forma ininterrumpida durante hasta 8 horas sin supervisión, una capacidad destacada para la automatización de procesos largos.
Writer afirma que Palmyra X6 obtuvo una puntuación de 0,87 sobre 1,00 en evaluaciones internas de nueve capacidades empresariales, superando a Claude Opus 4,8 (0,86), Sonnet 4,6 (0,85), GPT-5,5 (0,80) y Gemini 3,1 (0,77). Si bien estas cifras son internas y no un estándar público validado externamente, Writer las presenta como evidencia de que la reducción de costos no implica una baja en la calidad del servicio para el sector corporativo.
El enfoque en la gobernanza del gasto
El sistema incluye herramientas de gobernanza para monitorizar el gasto de tokens en tiempo real. Robyn Murphy de H&R Block señaló que la gobernanza les dio la confianza para escalar la inteligencia artificial más allá de las pruebas piloto, aprovechando la bajada del costo por tarea para automatizar trabajos de alto volumen previamente inviables. Roger Beharry Lall de IDC refuerza esta idea de que las empresas buscan aplanar los costos mientras el consumo de tokens explode.
La estrategia de Writer, bajo la dirección de la CEO May Habib, se centra en ofrecer estabilidad de costos para permitir la adopción masiva. "Las empresas están hartas de perseguir el siguiente benchmark; quieren que los costos se aplanen", afirmó Habib. Este movimiento se inscribe en un contexto de fuerte inversión en el sector, donde Databricks recaudó 5.000 millones de dólares en agosto de 2026 a una valuación de 190.000 millones de dólares.

