Clasificación del Archivo Berrutti
Supervisor(es): Ramírez, Ignacio - Randall, Gregory - Baliosian, Javier
Resumen:
Este trabajo presenta una investigación sobre la clasificación automática de documentos pertenecientes al llamado Archivo Berrutti, del cual tenemos un conjunto de aproximadamente 2,2 millones de imágenes escaneadas de microfilmaciones producidas por organismos represivos del Estado uruguayo en un período que incluye la dictadura cívico-militar (1973–1985). El objetivo principal es evaluar distintas metodologías de aprendizaje automático aplicadas a este corpus, con énfasis en modelos basados en texto, en imágenes y en enfoques híbridos que combinan ambas modalidades. Para ello, se emplean arquitecturas modernas como BERT (Bidirectional Encoder Representations from Transformers) y EfficientNet, adaptadas a las particularidades del dominio y entrenadas sobre subconjuntos representativos. Los resultados muestran que los modelos híbridos logran un desempeño superior en comparación con los enfoques unimodales, alcanzando precisiones cercanas al 99% en tareas de clasificación multiclase, con los conjuntos de datos utilizados para esta evaluación. Estos hallazgos aportan evidencia sobre la utilidad de los modelos multimodales en escenarios donde los datos presentan variabilidad en calidad y estructura. Finalmente, se discuten las implicancias de esta investigación en el marco de los estudios de derechos humanos, destacando el potencial de las técnicas de aprendizaje automático para facilitar la organización y el análisis de archivos históricos complejos.
| 2025 | |
|
Archivo Berrutti Clasificación automática |
|
| Español | |
| Universidad de la República | |
| COLIBRI | |
|
https://sitiosdememoria.uy/origen/archivo-berrutti
https://hdl.handle.net/20.500.12008/55238 |
|
| Acceso abierto | |
| Licencia Creative Commons Atribución - No Comercial - Sin Derivadas (CC - By-NC-ND 4.0) |