Confianza y evaluación
Metodología y benchmarks
Cómo Zush evalúa la calidad del renombrado con IA: criterios, protocolo, revisión y actualizaciones.
Responsabilidad editorial
Kirill Isachenko, product owner
Los criterios se revisan cada mes y los cambios importantes se registran en el changelog.
Rúbrica de puntuación
Cada ejecución se evalúa con un modelo ponderado que equilibra precisión, seguridad operativa y uso diario.
| Dimensión | Peso | Qué medimos |
|---|---|---|
| Precisión semántica del nombre | 35% | ¿El nuevo nombre describe el significado del archivo y no solo un patrón genérico? |
| Consistencia en lotes | 20% | Estilo estable en archivos mixtos. |
| Profundidad de automatización | 15% | Lotes, monitoreo de carpetas y repetibilidad. |
| Controles de seguridad | 15% | Historial, reversión y vista previa antes de aplicar. |
| Encaje operativo | 15% | Calidad del workflow macOS, velocidad y fricción de configuración. |
Protocolo de benchmark
- 01
Usar un conjunto mixto con capturas, fotos, PDFs y documentos Office.
- 02
Ejecutar trabajos controlados con prompts y restricciones idénticos.
- 03
Puntuar resultados y registrar falsos positivos o etiquetas ambiguas.
- 04
Validar reversión y recuperación antes de aprobar un setup.
- 05
Repetir controles tras releases y registrar cambios.
No unpublished scores presented as facts
This page publishes the evaluation protocol, not a completed benchmark leaderboard. Zush does not claim benchmark scores until the controlled run, tested versions, review date, and evidence can be published together.