Los modelos candidatos aparecen anonimizados. La suscripción desbloquea sus nombres, aplica el cambio vía enrutamiento y mantiene la re-auditoría con cada modelo nuevo del catálogo.
| Tarea | Llamadas/mes | Modelo actual | Coste anual | Mejor alternativa | Ahorro | |
|---|---|---|---|---|---|---|
| ticket-triage | 48.000 | gpt-5.6-terra | 1.191 € | Modelo B (100.0% de concordancia) | 805 €/año | |
| order-extraction | 16.000 | gpt-5.6-terra | 460 € | Modelo A (100.0% de concordancia) | 330 €/año | |
| spam-filter | 21.000 | gpt-oss-20b | 55 € | Modelo B (83.3% de concordancia) | no recomendado |
Verde: concordancia ≥ umbral. Ámbar: en zona gris (hasta 2% por debajo). Rojo: no sirve tal cual. El coste anual del modelo actual solo aparece cuando ese modelo corrió dentro de la auditoría.
| Modelo | Concordancia | Ahorro/año | |
|---|---|---|---|
| Modelo A | 66.7% | 984 € | |
| Modelo B | 100.0% | 805 € | |
| Modelo C | 100.0% | 679 € |
1 de 9 muestras (11%) tienen una salida de producción que no cumple el formato de la tarea y quedan fuera de todos los porcentajes.
| Modelo | Concordancia | Ahorro/año | |
|---|---|---|---|
| Modelo A | 100.0% | 330 € | |
| Modelo B | 100.0% | 288 € | |
| Modelo C | 87.5% | 243 € |
Ya optimizada. Ningún candidato alcanza el umbral del 97% en esta tarea: quédate con gpt-oss-20b.
| Modelo | Concordancia | Ahorro/año | |
|---|---|---|---|
| gpt-oss-20b ← actual | 100.0% | — | |
| Modelo B | 83.3% | -35 € | |
| Modelo C | 83.3% | -113 € | |
| Modelo D | 83.3% | -169 € |
Todos los desacuerdos del modelo recomendado, en crudo. Marca cada caso: «fallo real» lo deja como desacuerdo; «también válido» lo cuenta como concordancia y recalcula el porcentaje mostrado. Tu criterio queda guardado.
Sin desacuerdos: el candidato coincidió en todo.
Sin desacuerdos: el candidato coincidió en todo.
Muestra #4 · difiere: todo
legit
spam
Tareas de texto libre: no hay comparación determinista que las audite en v0, así que se listan sin veredicto.