Cohere lanzó el 28 de agosto Parse 5, un modelo que convierte PDFs, presentaciones e imágenes en texto estructurado sin pasar por un proceso de OCR aparte. En el benchmark ParseBench saca 79,2 puntos, por debajo de GPT-5.5 (84,4) y Opus 4.8 (84,3). Su argumento no es la precisión: cuesta 1,50 dólares por cada 1.000 páginas procesadas.

Para Carla el dato relevante no es el ranking, es el volumen. Cohere calcula que, en un flujo con 750 millones de documentos al año, Parse 5 reduce el coste más de un 98% frente a GPT-5.5. Es una estimación de la propia empresa, no un dato auditado de un cliente real, pero marca la lógica: si procesas contratos o facturas a gran escala, pagar por la máxima precisión en cada página deja de tener sentido económico.

El caso de uso concreto es la digitalización de documentos repetitivos y de bajo riesgo —facturas, albaranes, formularios— donde un error puntual se corrige a mano sin coste alto, frente a documentos legales o médicos donde el error sí importa y conviene pagar por el modelo más preciso.

La limitación que Cohere no destaca: Parse 5 no extrae los datos de gráficos, solo los describe, y su cobertura de idiomas estable se limita a nueve, entre ellos el español. Si tu volumen de documentos incluye gráficos con datos que necesitas extraer, este modelo no es la opción.

Si tu empresa ya paga a un proveedor de automatización por digitalizar documentos, pregúntale qué modelo usa por detrás y a qué coste por página. La respuesta puede significar renegociar el contrato o migrar el flujo a un motor más barato para el volumen bajo, y reservar el modelo caro solo para lo que de verdad lo necesita.