El panorama general
La industria consultora enfrenta un escrutinio creciente por la calidad de sus informes cuando usan herramientas de IA sin supervisión humana. En abril, Deloitte debió devolver dinero al gobierno australiano por contenido generado por IA en un informe. KPMG ahora se suma a esta lista.
Entre líneas
GPTZero acuñó el término “vibe citing” para describir cómo la IA genera referencias que parecen reales pero son parcial o totalmente falsas. En el informe de KPMG:
- Solo 5 de 45 citas apuntaban a fuentes reales.
- 28 citas parafraseaban títulos o añadían componentes falsos.
- 12 citas eran demasiado vagas para verificar.
- Aproximadamente la mitad de las afirmaciones del reporte eran falsas o estaban mal atribuidas.
Lo que sabemos (y lo que no)
Entre los ejemplos falsos destacan:
- Emirates tenía un chatbot “Sara” que podía cambiar vuelos. En realidad, Sara es un asistente robótico lanzado en 2023 sin esa capacidad.
- UBS supuestamente integraba IA agéntica en asesoría de inversiones y cumplimiento normativo. El banco lo negó.
- Swiss Federal Railways y Transport for London también desmintieron los casos que KPMG les atribuyó.
KPMG dijo que retiró el informe mientras investiga internamente, y recordó que exige supervisión humana en el uso de IA.
Qué sigue
Se espera que KPMG publique los resultados de su investigación y posiblemente emita una corrección. El incidente refuerza los llamados a que las firmas consultoras verifiquen sus contenidos generados por IA antes de publicarlos, especialmente cuando el tema es la propia IA.