Extracción de entidades sobre texto legal panameño
Cómo se construyó un reconocedor de entidades afinado sobre el estilo de redacción legal panameño, para un despacho que revisaba leyes y expedientes a mano.
Por José Luis Vieyra
Problema. Un despacho legal procesaba a mano grandes volúmenes de texto legal panameño, leyes, resoluciones y expedientes, para ubicar la información relevante en cada caso.
Enfoque. Se construyó un sistema de reconocimiento de entidades nombradas (NER), afinado específicamente sobre el estilo de redacción legal panameño en lugar de un modelo genérico.
Resultado. 92% de precisión identificando entidades relevantes, con una reducción drástica del tiempo de revisión manual y una base lista para búsquedas y alertas automáticas.
En más detalle
El texto legal panameño tiene un estilo propio, con referencias cruzadas, numeración de artículos y nombres de instituciones, que un modelo de lenguaje genérico no reconoce bien de entrada. En vez de partir de un modelo listo para usar, el trabajo se centró en afinar el reconocimiento de entidades específicamente sobre ese estilo de redacción: leyes, resoluciones y expedientes reales, no ejemplos de manual.
El resultado no fue solo un número de precisión. Fue una base de datos estructurada donde antes solo había texto plano, lista para conectarse a búsquedas, alertas y otros sistemas que necesiten esa información sin que alguien la vuelva a leer a mano.
Este es el caso ancla del servicio de datos y analítica.
¿Esto te está pasando?
Cuéntanos tu caso y te decimos si tiene solución y cuánto trabajo implica, sin costo.
Hablar por WhatsAppSeguir leyendo
- ¿Cómo funciona un grafo de detección de fraude en seguros?Por qué las reglas simples y la revisión manual no alcanzan para detectar fraude en reclamos, y cómo un grafo de entidades expone lo que antes era invisible.
- ¿Qué es un pipeline de datos y por qué importa para tu negocio?Una explicación sin jerga de qué hace un pipeline de datos, y por qué reemplaza los reportes armados a mano cada mes.