Saltar al contenido principal
← Volver al Blog

El mejor modelo Claude para escribir (2026): los datos dicen que no es el más nuevo

El mejor Claude para escribir no es el último en salir. Clasificación, costes modelados por sesión, y una elección distinta para redactar, editar y manuscritos largos.

Escritura con IAComparación de modelosClaude

La versión corta, antes de las tablas: el Claude más nuevo no es el mejor Claude para escribir. En la clasificación de escritura creativa con control de estilo de LMArena, Claude Sonnet 4.5 saca 17 puntos más que el Sonnet 5 posterior, sin solapamiento entre sus intervalos de confianza; en la familia Opus, el modelo más nuevo solo empata con dos anteriores, mientras que Opus 4.7 deja atrás con claridad a Opus 4.8. El único que sí se sienta arriba del todo, Claude Fable 5, jamás se vendió como modelo de escritura.

Ese último detalle merece una pausa, porque invierte lo que sugiere el nombre. La documentación de Anthropic describe Fable 5 como «inteligencia de nueva generación para agentes de largo recorrido». Nada en sus casos de uso oficiales menciona prosa, ficción o estilo. Gana igual en votos de preferencia humana.

Nosotros hacemos Muses, un espacio de escritura, y rastreamos e integramos modelos de frontera sin parar porque la calidad de un borrador depende de qué modelo hay detrás del cursor. Todo lo que sigue sale de fuentes públicas: el conjunto de datos de la clasificación de LMArena, LiveBench y la documentación de modelos de Anthropic. Donde se acaban los datos —y en una pregunta importante se acaban— esta página lo dice, en vez de rellenar el hueco con conjeturas seguras de sí mismas.

Respuesta corta: ¿qué modelo Claude es el mejor para escribir?

Lo que estás haciendoEmpieza porPrecio / MTok (entrada / salida)Por qué
Primer borrador de ficción y prosa creativaClaude Fable 5$10 / $50El Claude mejor valorado en la tabla de escritura creativa con control de estilo, y el primer puesto es una separación nítida
Manuscritos largos y no ficción literariaClaude Opus 4.7$5 / $25Deja atrás a Opus 4.8 sin solapamiento de intervalos; empate estadístico con Opus 4.6 y Opus 5
Pases de revisión contra una hoja de estiloClaude Opus 4.8$5 / $2572,0 en seguimiento de instrucciones de LiveBench, por delante de cualquier otro Opus y 8 puntos por encima de Opus 5: el eje que más importa al revisar
Redacción diaria con presupuestoClaude Sonnet 4.6$3 / $15Puntúa por encima de Sonnet 5 en escritura creativa, aunque esa diferencia cae dentro del margen de error
Trabajo técnico y prosa mezclados en un mismo hiloClaude Opus 5$5 / $2588,7 en lenguaje de LiveBench frente al 90,7 de Fable 5, a mitad de precio
Copia de mucho volumen y poco riesgoClaude Haiku 4.5$1 / $5Unos cuatro céntimos por sesión de redacción, con las peores notas de prosa de la familia

Si te llevas una sola frase: el mejor modelo Claude para escribir en 2026 es Claude Fable 5 si el presupuesto no aprieta, Claude Opus 4.7 si trabajas un manuscrito largo, y Claude Sonnet 4.6 si escribes todos los días y miras la factura. Esa es la lista corta que sostienen estos datos; pruébala en tus propias páginas antes de casarte con ella. No coincide con el orden de lanzamiento.

La gama Claude 2026 para quien escribe

La familia actual, sacada tal cual de la documentación de modelos de Anthropic:

ModeloContextoSalida máx.Precio por MTok (entrada / salida)PensamientoCorte de conocimiento fiable
Claude Fable 51M128K$10 / $50Adaptativo, siempre activoene 2026
Claude Opus 51M128K$5 / $25Adaptativomay 2026
Claude Sonnet 51M128K$2 / $10Adaptativoene 2026
Claude Haiku 4.5200K64K$1 / $5Extendedfeb 2025

Seis modelos anteriores siguen disponibles y no están obsoletos: Opus 4.8, 4.7, 4.6 y 4.5, más Sonnet 4.6 y 4.5. Opus 4.8, 4.7 y 4.6 cuestan lo mismo que Opus 5: $5 y $25. Sonnet 4.6 y 4.5 cuestan $3 y $15, más que Sonnet 5. Esa rareza de precio importa más adelante, porque en las clasificaciones de escritura los Sonnet viejos puntúan por encima del nuevo, que es más barato.

Ahora el detalle a comprobar antes de medir un manuscrito contra una ventana de contexto. Anthropic cambió de tokenizador con Opus 4.7. Con el actual, 1M de tokens son unas 555.000 palabras en inglés; con el anterior, en el mismo 1M cabían unas 750.000. La documentación de precios de Anthropic cifra el aumento en aproximadamente un 30% más de tokens para el mismo texto. Así que una ventana de 1M en Fable 5, Opus 5, Sonnet 5, Opus 4.8 u Opus 4.7 cabe claramente menos novela que una de 1M en Sonnet 4.6 u Opus 4.6, pese al mismo número en el titular. Si venías dimensionando manuscritos con la ratio vieja, vuélvelos a medir. La ventana no se encogió; las palabras que caben dentro, sí.

Lo que muestra de verdad la clasificación con control de estilo

LMArena recoge votos anónimos de preferencia humana por pares y ajusta una puntuación Bradley-Terry. Aquí lo que importa es el control de estilo: corrige los hábitos de formato que hacen ganar votos sin que el texto sea mejor, como la longitud y el abuso de encabezados y viñetas. Para juzgar prosa, las cifras con control de estilo son las que merece la pena leer. Las de abajo salen del subconjunto style_control de la arena de texto, dimensión creative_writing, en el conjunto de datos de la clasificación de LMArena, instantánea del 27 de agosto de 2026.

ModeloVariante en la arenaPuntuaciónPuestoIC 95%Votos
Claude Fable 5claude-fable-5150811499–15184.890
Claude Opus 4.7claude-opus-4-7148161474–148810.796
Claude Opus 4.6claude-opus-4-6147981473–148612.778
Claude Opus 5claude-opus-5-high1473101464–14826.002
Claude Opus 4.8claude-opus-4-81465191457–14728.389
Claude Sonnet 4.5claude-sonnet-4-5-202509291453271447–146011.976
Claude Sonnet 4.6claude-sonnet-4-61450311443–145611.306
Claude Sonnet 5claude-sonnet-5-high1436521427–14455.288
Claude Haiku 4.5claude-haiku-4-5-2025100113901141384–139519.430

Dos filas piden una nota. Opus 5 y Sonnet 5 aparecen en la tabla como sus variantes de esfuerzo alto, claude-opus-5-high y claude-sonnet-5-high. high es el valor por defecto de la API, así que la configuración puntuada es la que recibes al abrir la caja, salvo que la bajes; si corres esos modelos a esfuerzo bajo o medio, no estás corriendo la configuración que ganó esas notas.

El primer puesto de Fable 5 es real. Su intervalo queda despejado del del segundo, así que es una separación, no un photo finish. Tiene más compañía de la que sugiere el ranking, eso sí: Gemini 3.1 Pro saca 1480 en el puesto 7 y GPT-5.6-sol a xhigh saca 1477 en el 9, ambos en la misma franja que los Opus más fuertes. Este artículo no es una comparación entre fabricantes, pero Claude no está solo ahí arriba.

El orden de los Sonnet es la inversión más nítida de la tabla, con un matiz. Sonnet 4.5 a 1453 y Sonnet 5 a 1436 tienen intervalos que no se tocan, así que esa diferencia es real. Frente a Sonnet 4.6 a 1450, el intervalo de Sonnet 5 se solapa en dos puntos, lo que significa que esos dos están demasiado cerca para llamarlo. Léelo así: Sonnet 5 es mediblemente peor que Sonnet 4.5 en escritura creativa, e indistinguible de Sonnet 4.6, a menor precio. Encaja con una queja persistente de la comunidad: que Sonnet 5 se lee más seco y más a la defensiva que sus predecesores. Esa observación es anecdótica; los datos de la arena son la única parte que podemos comprobar.

Opus 4.7 es la marca alta de prosa de la familia, pero no por mucho. Puntúa por encima de Opus 4.8 sin solapamiento de intervalos, una inversión real del orden de salida. Frente a Opus 4.6 y Opus 5, los tres intervalos se solapan, así que trátalos como un triple empate. La afirmación defendible es estrecha y útil: Opus 4.7 y Opus 4.6 dejan atrás a Opus 4.8; Opus 5, no.

Las puntuaciones de preferencia son un eje, y un segundo referente lo deja claro. LiveBench, publicación 2026-06-25, puntúa por separado una dimensión de lenguaje y otra de seguimiento de instrucciones, y no se ponen de acuerdo en el orden. En lenguaje, Fable 5 lidera con 90,7, Opus 5 sigue con 88,7, GPT-5.5 se queda en 87,4 y Opus 4.6 cae a 83,3. En seguimiento de instrucciones el ranking se revuelve: Gemini 3.1 Pro corona toda la tabla con 79,1, Fable 5 llega a 75,8, Opus 4.8 da 72,0, Opus 4.7 cae a 66,7, y Sonnet 5 (63,9), Opus 5 (63,8), Opus 4.6 (63,3) y Sonnet 4.6 (63,2) se apelotonan al fondo de ese grupo. Opus 5 está cerca de la cima de una lista y cerca del fondo de la otra. No hay un solo número para «bueno escribiendo».

Conviene decir los límites en voz alta. Las puntuaciones de la arena miden lo que votantes anónimos prefirieron en comparaciones cortas por pares, no lo que le sirve a tu libro. El recuento de votos varía casi por 4 en la tabla, y por eso los intervalos de confianza van impresos junto a las notas, no escondidos. La puntuación de Fable 5 descansa en 4.890 votos; la de Haiku 4.5, en 19.430. Usa estos números para acortar una lista, y luego prueba esa lista en tus páginas.

No: Fable 5 no es el «modelo de escritura creativa» de Anthropic

El nombre invita a pensar que Claude Fable 5 se construyó para la escritura creativa. La documentación de Anthropic dice otra cosa. La descripción de una línea en la visión general de modelos es «inteligencia de nueva generación para agentes de largo recorrido». La página de Fable 5 lo llama el modelo de mayor capacidad publicado de forma amplia por Anthropic, hecho para el razonamiento más exigente y el trabajo agéntico de horizonte largo. La matriz de elección de modelos en la guía Cómo elegir un modelo da como ejemplos agentes de largo recorrido, razonamiento profundo, tareas agénticas de horizonte largo e investigación avanzada. La escritura creativa no aparece.

Posicionamiento y rendimiento son cosas distintas, y aquí apuntan en direcciones opuestas. Fable 5 sí puntúa primero en la tabla de preferencia de escritura creativa, un resultado genuino y una buena razón para usarlo en prosa. Pero la razón no es que Anthropic lo afinara para novelistas. Es un modelo general muy capaz que resulta que escribe bien, publicado el 9 de junio de 2026. Decir «Anthropic construyó un modelo de escritura creativa» repite una afirmación que su fabricante nunca hizo, y coloca la expectativa equivocada sobre aquello en lo que es bueno.

Redactar, editar y un manuscrito largo son tres oficios distintos

Tratar «escribir» como una sola capacidad es lo que produce malas elecciones de modelo. Como mínimo, son tres.

Redactar premia lo que la gente prefiere leer de verdad, que es lo que mide la arena. Si estás generando prosa nueva a partir de una consigna o un esquema, la clasificación de escritura creativa es el proxy más cercano que hay, y apunta a Fable 5, luego a Opus 4.7 y 4.6.

Editar es otra habilidad por completo. Revisar significa seguir instrucciones al pie de la letra: conserva la voz, corta un 15%, no toques el diálogo, aplica esta hoja de estilo. Eso es seguimiento de instrucciones, y en LiveBench esa dimensión reordena la prosa: Opus 4.8 pasa al frente de los Opus y Opus 5 cae por debajo de 4.8 y 4.7, al mismo precio. Cuál de los dos es el modelo «mejor» depende por entero de cuál de estos oficios le estás encargando.

Los manuscritos largos dependen del contexto y de la consistencia a lo largo de una sesión, y aquí se acaban los datos públicos. La capacidad de contexto está documentada: 1M de tokens, unas 555.000 palabras con el tokenizador actual. La consistencia, no. Ningún referente público mide si la voz de un modelo deriva a lo largo de un proyecto de 60.000 palabras, si olvida cómo habla un personaje hacia el capítulo 20, o si empieza a aplanar tu sintaxis en silencio después de la revisión número cuarenta. Tenemos opiniones de trabajar con estos modelos, pero las opiniones no son mediciones, así que no las vamos a disfrazar de hallazgos. Estamos montando pruebas estructuradas justo para esto, y cuando haya resultados que merezcan publicarse se añadirán aquí.

Lo que cuesta de verdad una sesión de cuatro turnos

Lo que sigue es un modelo trabajado, no una medición. No hemos hecho banco de estas sesiones; estamos aplicando los precios publicados de Anthropic a una forma de sesión plausible para que se vean los costes relativos. Tus recuentos de tokens serán otros.

SupuestoValor
Generaciones por sesión4 (un borrador, tres pases de revisión)
Entrada por generación~4.000 tokens (instrucciones, borrador actual, notas)
Salida por generación~1.400 tokens
Total de la sesión16.000 de entrada, 5.600 de salida

Con el tokenizador viejo, 1.400 tokens de salida son unas 1.050 palabras; con el actual, más cerca de 780. Aplicando las tarifas publicadas por millón de tokens, y llevando esa diferencia a la longitud del borrador con el que acabas:

ModeloPalabras producidasCoste de entradaCoste de salidaCoste por sesión
Claude Fable 5≈780$0,160$0,280$0,44
Claude Opus 5≈780$0,080$0,140$0,22
Claude Sonnet 4.6≈1.050$0,048$0,084$0,13
Claude Sonnet 5≈780$0,032$0,056$0,09
Claude Haiku 4.5≈1.050$0,016$0,028$0,04

La columna de palabras producidas no se compara a través del cambio de tokenizador. Los mismos 5.600 tokens de salida compran alrededor de un tercio más de palabras en inglés con el tokenizador viejo, así que dos filas con el mismo coste de sesión no están comprando la misma cantidad de prosa. Lee el coste contra las palabras dentro de una generación de tokenizador, no a lo largo de toda la tabla.

Opus 4.8, 4.7 y 4.6 cuestan lo mismo que Opus 5, así que su fila es el mismo $0,22 —aunque Opus 4.6, que sigue en el tokenizador viejo, saca unas 1.050 palabras de ese mismo presupuesto de salida.

Dos ajustes cambian el cuadro. El primero es la caché de prompts. Las lecturas de caché se facturan al 10% del precio base de entrada, y el trabajo iterativo sobre un borrador largo está cerca del caso ideal, pero solo para la parte del prompt que no se mueve: el prompt de sistema, el material de origen que cargaste una vez, y el historial de conversación que añades en vez de editar. A lo largo de una sesión larga, ese prefijo estable convierte la mayor parte de la columna de entrada en un error de redondeo. El manuscrito es la parte que sí se mueve, así que dónde lo pongas decide si el descuento sobrevive: un borrador reescrito pegado otra vez cerca de la cima del prompt ya no coincide con el prefijo cacheado e invalida todo lo que viene detrás, mientras que el mismo texto añadido al final deja intacta la porción estable. Cualquier otra cosa que mute el prefijo —una marca de tiempo, una nota reordenada, una instrucción de sistema cambiada— tira el descuento por la misma razón. La Batch API de Anthropic es una segunda palanca al 50% en las dos direcciones, aunque es asíncrona y por tanto inútil para redactar en interactivo.

El segundo ajuste va al revés. Los tokens de pensamiento se facturan como salida. En todos los modelos actuales salvo Haiku 4.5, el pensamiento es adaptativo: el modelo decide cuánto razonamiento gastar, y un problema estructural duro producirá más que una reescritura simple. La columna de salida de arriba asume un turno de redacción sencillo. Una petición exigente de reestructuración en el mismo modelo costará más de lo que implica la tabla, y no vamos a inventar un multiplicador, porque depende de la tarea. Mira tu primera semana de uso real en vez de fiarte de cualquier estimación publicada, incluida esta.

El ajuste de esfuerzo: la palanca que casi nadie toca

La guía de elección de modelos de Anthropic tiene una línea que merece más atención de la que recibe: «Ajustar el esfuerzo suele ser una palanca mejor que cambiar de modelo». El esfuerzo es un parámetro de la petición con cinco niveles, de low a max, en Fable 5, Opus 5, Opus 4.8, Opus 4.7 y Sonnet 5, y controla cuántos tokens gasta el modelo en una respuesta, pensamiento incluido. No se limita a los modelos más nuevos: Opus 4.6 y Sonnet 4.6 también aceptan esfuerzo, en cuatro niveles sin xhigh, y Opus 4.5 en tres. Así que las opciones cotidianas de este artículo tienen la palanca a mano, no solo las caras.

Para escribir, el esfuerzo se traduce en algo reconocible. Más esfuerzo compra más planificación antes de la primera frase: mejores decisiones de estructura, un manejo más consistente de un brief largo, más atención a lo que pediste frente a lo fácil de producir. También cuesta más y tarda más. Menos esfuerzo produce turnos más rápidos, más conversacionales, con menos deliberación detrás.

El ajuste práctico, y fíjate en la dirección: high es el valor por defecto de la API, idéntico a omitir el parámetro, así que el gesto es bajar a low o medium para primeros borradores y reescrituras rápidas, y subir a xhigh solo para trabajo estructural: reorganizar un capítulo, arreglar una sección que se cae una y otra vez, sacar adelante un brief con muchas restricciones a la vez. Anthropic señala que un esfuerzo más bajo en Fable 5 sigue rindiendo bien y a menudo gana a xhigh en modelos anteriores, lo que hace más viable un turno barato de Fable 5 de lo que sugiere sola la tabla de precios.

Un matiz que conecta con la clasificación: las entradas de Opus 5 y Sonnet 5 en esa tabla son variantes de esfuerzo alto. Si tu ajuste de cada día es low, tu experiencia de esos dos modelos no coincidirá con sus notas publicadas, y ese desajuste es una diferencia de configuración, no un defecto. No tenemos una comparación medida de calidad de escritura entre niveles de esfuerzo, así que toma la guía de arriba como punto de partida para probar, no como un resultado.

Rechazos, tono, y la queja de que «Sonnet se volvió más frío»

Cuando quien escribe se queja de un modelo, suele mezclar dos cosas: que rechace una petición, y que la cumpla con frialdad.

Sobre el tono, la queja de la comunidad citada más arriba es anécdota, y se queda en anécdota por más que se repita. Lo que merece una segunda mención es que una medición independiente apunta en la misma dirección: Sonnet 5 queda 17 puntos por debajo de Sonnet 4.5 en la tabla de escritura creativa con control de estilo, sin solapamiento de intervalos. Anécdota más un número que encaja no es prueba, pero es bastante más que un vibe.

Sobre los rechazos, un hecho está documentado, no inferido. Anthropic afirma que Claude Fable 5 incluye clasificadores de seguridad que pueden declinar peticiones. Más allá de eso, no hay un referente público que mida tasas de rechazo en tareas de escritura creativa, así que un ranking de cuál rechaza menos sería inventado. No lo vamos a inventar, y tratar «rechaza menos» como una función de producto sería además el marco equivocado.

Lo que sí ayuda es el encuadre, porque la mayoría de los rechazos creativos vienen de una petición que, fuera de contexto, se lee ambigua. Di que el trabajo es ficción y nombra la forma. Da el género y el público previsto. Explica qué hace una escena difícil en la historia: qué le cuesta al personaje, qué deja plantado. Pide el nivel de detalle que la escena necesita de verdad, no el máximo. Son las cosas que un editor humano querría saber antes de leer un capítulo duro, y no son trucos: son el contexto que hace legible la petición.

Qué Claude para qué escritor

El presupuesto primero. Sonnet 4.6 a $3 y $15 por MTok, alrededor del 60% del precio de Opus. Puntúa por encima de Sonnet 5 en escritura creativa, aunque esa diferencia cae dentro del margen de error. Si quieres el Claude actual más barato y puedes aceptar prosa mediblemente más débil, Sonnet 5 a $2 y $10 es el suelo que merece usarse; Haiku 4.5 es todavía más barato pero ocupa el puesto 114 en la tabla de escritura creativa, y eso está muy abajo.

Novelistas y no ficción larga. Opus 4.7. Deja atrás a Opus 4.8 sin solapamiento de intervalos y queda en empate estadístico con Opus 4.6 y Opus 5, al mismo precio que Opus 5. Presupuesta el cambio de tokenizador cuando planees cuánto manuscrito dejar en contexto. Fable 5 es la subida si el libro justifica el doble de precio por token.

Contenido diario y redacción de mucho volumen. Sonnet 4.6 como valor por defecto, con Opus 4.7 reservado para las piezas que importan. A unos $0,13 por sesión de redacción, una pieza al día durante un mes es un error de redondeo frente al tiempo que ahorra; la elección de modelo importa mucho menos que si de verdad revisas la salida. Si lo único que quieres es un primer pase contra el que reaccionar, descríbelo en nuestro generador de texto con IA y se abre como borrador en tu espacio, sin configurar ninguna API.

Editores y reescritores. Opus 4.8, por la brecha de seguimiento de instrucciones de LiveBench. Si tu trabajo es aplicar una hoja de estilo, sostener una voz y hacer los cortes que tú especificaste y no los que prefiere el modelo, el 72,0 frente al 63,8 de Opus 5 es el número que debería decidirlo.

La mayor parte de la fricción de un día de escritura no es el modelo. Es el borrador en una pestaña, la investigación en otra, el esquema en una tercera, y ningún historial de versiones sobre nada de eso. Eso es lo que construimos Muses para arreglar: un espacio de escritura donde el borrador, las notas, el material de origen y la revisión asistida por IA viven en un mismo proyecto, con el historial para deshacer un mal pase. Los modelos de detrás los elige y mantiene al día la plataforma, así que ninguno de los ajustes por modelo de arriba es algo que tengas que configurar tú. Pruébalo gratis.

Obsolescencia de modelos: protege tu flujo de escritura

Las recomendaciones de modelo caducan. Varias de las de arriba son modelos más viejos, así que su estado merece quedar explícito y no supuesto.

Todos los modelos nombrados en este artículo están activos ahora, y Anthropic lista Opus 4.8, 4.7, 4.6 y 4.5, junto con Sonnet 4.6 y 4.5, como modelos heredados que siguen disponibles. Anthropic se compromete a un preaviso de al menos 60 días antes de retirar un modelo publicado. Las fechas tentativas de retirada no están repartidas por igual, eso sí. Sonnet 4.5 figura como no antes del 29 de septiembre de 2026, la fecha más cercana de cualquiera de los modelos tratados aquí. Haiku 4.5 es el segundo más cercano, no antes del 15 de octubre de 2026: unas siete semanas desde la publicación de esta página, y como el preaviso es de 60 días, ese aviso podría llegar en cualquier momento. Haiku 4.5 es la opción de mucho volumen de la tabla de arriba, así que esa es la recomendación con la pista más corta, y Sonnet 4.5 es la otra a vigilar. El resto tiene más margen: Sonnet 4.6 llega a febrero de 2027, Opus 4.6 al 5 de febrero de 2027, Opus 4.7 a abril de 2027, Opus 4.8 a mayo de 2027, Sonnet 5 al 30 de junio de 2027, y Fable 5 y Opus 5 entran en mediados de 2027.

Si llamas a la API directamente, fija el ID exacto del modelo en vez de fiarte del hábito. Anthropic señala que cada ID de modelo Claude es una instantánea fijada, incluidos los ID sin fecha usados a partir de la generación 4.6, así que claude-opus-4-7 nombra un modelo concreto y seguirá nombrándolo. Quien usa Claude a través de una aplicación no tiene ese control, y esa es una razón para comprobar qué está llamando de verdad tu herramienta antes de concluir que un modelo ha cambiado debajo. Cuando estos modelos roten, esta página se actualiza.

Cómo mantenemos esta página al día

Última verificación: 29 de agosto de 2026.

Revisamos esta página cada mes y comprobamos tres cosas cada vez: la gama de modelos y los ID, los precios publicados, y la instantánea de la clasificación. Cuando una puntuación se mueve lo bastante como para cambiar una recomendación, la recomendación cambia con ella, y la fecha de actualización de arriba de la página se mueve.

Fuentes, todas públicas:

Si te interesa más el oficio que el modelo, nuestra guía para mejorar tu escritura cubre el ciclo de borrador-distancia-feedback-revisión en el que encaja cualquiera de estos modelos, y nuestra lectura de On Writing cubre dónde debería estar la máquina en la habitación, y dónde no.

Preguntas frecuentes

¿Qué modelo Claude es el mejor para escribir?

Claude Fable 5 encabeza a los Claude en la clasificación de escritura creativa con control de estilo, pero a 10 dólares de entrada y 50 de salida por millón de tokens también es el más caro. Sonnet 4.5 puntúa por encima de Sonnet 5 sin solapamiento de intervalos, y Sonnet 4.6 queda en medio, demasiado cerca de Sonnet 5 para decidirlo; los Sonnet mejor valorados cuestan más que Sonnet 5, no menos. Opus 4.7 es el caballo negro de la prosa larga: puntúa por encima de Opus 4.8 y empata estadísticamente con Opus 5.

¿Para texto largo, es mejor Claude Opus 5 o Claude Sonnet 5?

Opus 5, y la diferencia es real, no ruido. En la arena de escritura creativa con control de estilo, Opus 5 saca 1473 con un intervalo al 95 por ciento de 1464 a 1482, frente a Sonnet 5 con 1436 y un intervalo de 1427 a 1445, ambos medidos a esfuerzo high, el valor por defecto de la API. Esos intervalos no se tocan. Opus 5 cuesta 2,5 veces más por token, así que la pregunta honesta es si el manuscrito justifica la diferencia.

¿Qué modelo Claude es mejor para escritura creativa y ficción?

Claude Fable 5 lidera a todos los demás Claude en la dimensión de escritura creativa con control de estilo de LMArena, con 1508 frente a 1481 del siguiente Claude, Opus 4.7. Si el precio de Fable 5 no entra, Opus 4.7 y Opus 4.6 quedan en un empate estadístico justo detrás. Evita Haiku 4.5 para ficción: ocupa el puesto 114 en esa tabla, muy por debajo de cualquier Claude actual.

¿Claude Fable 5 está hecho de verdad para la escritura creativa?

No. Anthropic presenta Fable 5 como inteligencia de nueva generación para agentes de largo recorrido, y su documentación nombra como casos de uso el trabajo agéntico de horizonte largo, el razonamiento profundo y la investigación avanzada. La escritura creativa no está entre ellos. El modelo igual encabeza la clasificación de escritura creativa con control de estilo, así que el resultado es real, pero los artículos que lo llaman un modelo de escritura creativa hecho a medida describen un resultado, no una intención de diseño.

¿Qué modelo Claude debería usar por defecto para escribir cada día?

Sonnet 4.6, para la mayoría. Cuesta 3 dólares de entrada y 15 de salida por millón de tokens, alrededor del 60 por ciento del precio de Opus, y puntúa por encima de Sonnet 5 en la arena de escritura creativa, aunque esa diferencia concreta cae dentro del margen de error. Si el coste te importa más que la prosa, Sonnet 5 es más barato, a 2 y 10 dólares por millón de tokens.

¿Puede Claude escribir un libro entero?

Puede contener uno. Una ventana de contexto de 1M de tokens son unas 555.000 palabras en inglés con el tokenizador actual, así que una novela cabe en una sola conversación. Producir un buen libro de una generación es otro problema, y ningún modelo lo resuelve. El flujo que funciona es capítulo a capítulo, con un esquema y una hoja de estilo en el contexto, revisando cada capítulo antes de seguir.

¿Cómo conservo mi voz al usar Claude?

Dale al modelo tu propio texto para trabajar, en vez de pedirle que invente prosa a tu estilo. Pega dos o tres pasajes tuyos, describe las reglas que sigues, y pide ediciones y notas de estructura, no párrafos acabados. Luego reescribe su salida con tus palabras. La voz sobrevive mejor a la revisión que a la generación, así que el último pase que sea tuyo.

¿Por qué Claude rechaza algunas peticiones de escritura creativa, y cuál rechaza menos?

Claude Fable 5 lleva clasificadores de seguridad que pueden rechazar una petición, y Anthropic lo documenta abiertamente. El rechazo cambia de un modelo a otro, pero no hay un referente público que lo mida en escritura creativa, así que cualquier ranking sería una invención. El arreglo práctico es contexto, no elusión. Di que el trabajo es ficción, nombra el género y el público previsto, explica qué hace una escena difícil en la historia, y pide el nivel de detalle que la escena necesita de verdad.