FraudGPT Cosmos supera a Opus 5 en el 100% de métricas antifraude

Anunciamos que en nuestro último ciclo de entrenamiento basado en SFT (Supervised Fine Tuning) logramos obtener un checkpoint que superó el 100% de las métricas en competencia contra Opus 5 de Anthropic sobre un dataset de evaluación que contiene 800 casos de fraude y corrupción reales en América Latina.
FraudGPT venía demostrando superioridad operativa ante los modelos generalistas, sin embargo hoy su superioridad no solo es operativa sino también medible matemáticamente
Superar a Opus 5 significa que los clientes que usen FraudGPT Cosmos en vez de Opus 5 para tareas de detección de fraude interno y corrupción, tendrán detecciones de mejor calidad: más alertas reales y menos falsos positivos.
Métricas de evaluación
FraudGPT Cosmos no fue construido pensando en que debía ser mejor en toda las métricas. Es imposible que un modelo de inteligencia artificial sea 100% preciso en una tarea como la detección del fraude interno y la corrupción.
FraudGPT Cosmos fue construido basado en el complimiento de una regla de negocio: mejor detección con el menor número de falsos positivos. Cuando esta regla de negocio se aplica técnicamente al SFT (Supervised Fine Tuning) es cuando se llega a un modelo que supera en métricas F1, Accuracy, Recall y Precision a otros modelos de Inteligencia Artificial. En nuestro artículo El mejor ciclo de finetuning describimos el proceso de la regla de negocio con alto detalle.

Claude Opus 5 y otros modelos de frontera como GPT 5.6 Sol han demostrado que la detección del fraude en modelos de inteligencia artificial generalistas viene acompañado de un gran número de falsos positivos.
En nuestro pasado artículo Unos Colombianos Lideran la IA Antifraude, contábamos cuáles eran las razones por la cuales los modelos generalistas tienden a generar mucho ruido en tareas de detección de fraude interno y corrupción. El fenómeno lleva el nombre de “correlación espuria” y tiene mucho que ver con el último ciclo de entrenamiento llevado a cabo por humanos para su alineación (RLHF).
Referencias
(NOFRAUD, 2026) The Fraud Explorer y FraudGPT
Acerca de NOFRAUD
NOFRAUD es la compañía que desarrolla el software antifraude The Fraud Explorer y apoya a personas y empresas a enfrentar y solucionar sus retos en materia de fraude interno, corrupción y abuso corporativo. NOFRAUD ha creado la base de datos conductual de actos deshonestos más grande del mundo en Español e Inglés, que sirve para que la inteligencia artificial encuentre patrones sospechosos de corrupción al interior de las organizaciones.

Mejoramos la capacidad de las organizaciones incrementando sus beneficios, arrebatándole a los perpetradores la posibilidad de afectar negativamente los ingresos a través del fraude, la corrupción, el abuso corporativo y la generación de ambientes tóxicos.
Contacte conmigo en » jrios@nofraud.la y Visítenos en » www.nofraud.la.




