Deepfake y Fraude del CEO: Cómo Protegerse de las Estafas de Voz con IA en la Empresa

Lectura 10 min · AstraLoop Studio

Una mañana como cualquier otra, la responsable administrativa de una pyme del sector manufacturero, en la provincia de Bérgamo, recibe una llamada. Al otro lado está la voz del director financiero. La conoce bien, trabaja con él desde hace años: el tono, la cadencia, esa forma suya de cortar las frases. El "director" le explica que hay una operación confidencial en curso, un pago urgente a un nuevo proveedor que hay que cerrar antes de la hora de comer, y le pide que tramite ya mismo una transferencia. La responsable la ejecuta. Resultado: 28.000 euros transferidos a una cuenta controlada por los estafadores. El director financiero, ese día, no había llamado en ningún momento. Su voz había sido clonada por una inteligencia artificial.

No es un caso aislado ni una exageración de titular. En España e Italia los intentos de fraude basados en deepfake de audio (el llamado vishing, o phishing por voz) han crecido más de un 300% respecto a 2023. La tecnología necesaria para clonar una voz creíble ya es accesible, barata y solo requiere unos segundos de audio: un vídeo en LinkedIn, un pódcast, una entrevista antigua, una nota de voz. Si eres empresario o responsable administrativo, esta es la estafa que más deberías temer en 2026. ¿La razón? No ataca tus cortafuegos. Ataca a tus personas.

Ilustración de una onda sonora que sale de un auricular telefónico y se transforma en la silueta enmascarada de una figura corporativa, metáfora de la voz clonada

Qué es el "fraude del CEO" y por qué el deepfake lo vuelve letal

El fraude del CEO (en inglés CEO fraud o Business Email Compromise, BEC) existe desde hace años. El esquema clásico es sencillo: un estafador se hace pasar por un directivo y, apoyándose en la autoridad y la urgencia, convence a un empleado de administración para que ejecute un pago hacia una cuenta fraudulenta. Hasta ayer el ataque viajaba por email, con un remitente falsificado o un dominio casi idéntico al real (por ejemplo empresa-sl.com en lugar de empresasl.com).

El deepfake de voz cambia las reglas del juego por una razón muy concreta: elimina la defensa psicológica. Un email sospechoso puedes releerlo, comprobarlo, reenviarlo a un compañero. Una llamada en la que reconoces la voz de tu jefe, en cambio, activa un automatismo de confianza y obediencia. En el momento en que oyes ese timbre familiar, el cerebro deja de hacer las preguntas correctas. Y es justo en ese sesgo donde apunta el estafador.

Los ingredientes de un ataque de vishing con voz clonada son casi siempre los mismos, y reconocerlos es el primer paso para defenderse:

  • Autoridad: quien llama (o escribe) es alguien jerárquicamente superior. CEO, CFO, propietario, socio.
  • Urgencia artificial: "hay que hacerlo ya", "en menos de una hora", "antes de que cierre el banco". El objetivo es impedirte pensar con calma.
  • Confidencialidad: "no se lo digas a nadie", "es una operación confidencial". Sirve para aislarte y bloquear la verificación cruzada.
  • Cambio de canal o de cuenta: un IBAN nuevo, un proveedor que no conocías, una petición fuera de los procedimientos habituales.

Cuando tres o cuatro de estas señales aparecen juntas, no estás recibiendo una petición legítima. Estás sufriendo un intento de manipulación. Y el hecho de que la voz sea la correcta no cambia la conclusión: precisamente esa es el cebo.

Cómo funciona técnicamente la clonación de voz

Entender el mecanismo ayuda a dejar de verlo como magia. Los modelos modernos de síntesis de voz (voice cloning) aprenden las características de una voz (timbre, entonación, ritmo, acento) a partir de una muestra de audio. Los sistemas más avanzados hoy logran un resultado creíble con menos de un minuto de grabación, y en algunos casos con apenas unos segundos.

¿Dónde encuentran esos segundos? En cualquier sitio donde te hayas expuesto públicamente:

  • Vídeos corporativos, webinars, entrevistas subidas a YouTube o LinkedIn
  • Pódcasts o directos en redes sociales
  • Notas de voz de WhatsApp reenviadas o interceptadas
  • Una llamada inicial en la que el estafador te hace hablar (quizá fingiendo una encuesta) solo para grabarte

Una vez clonada la voz, el atacante puede hacerle decir lo que quiera, en tiempo real o casi. En las versiones más sofisticadas, el deepfake de audio se combina con el spoofing del número de teléfono (en la pantalla aparece el número real del directivo) y con información recopilada previamente: nombres de proveedores, importes habituales, proyectos en curso. El resultado es una llamada que supera cualquier control instintivo. Un ataque de este tipo entra dentro de la categoría más amplia de las amenazas potenciadas por la IA, un tema que profundizamos en nuestra guía de auditoría de ciberseguridad para pymes.

La defensa, por tanto, no puede ser tecnológica en sentido estricto. Todavía no existe una herramienta fiable que, en tiempo real durante una llamada, te avise de que esa voz es sintética. La defensa es procedimental y organizativa: construir barreras que no dependan de reconocer la voz.

Ilustración abstracta de dos canales de comunicación distintos que convergen en un escudo, metáfora de la verificación por canal secundario que detiene el fraude

Los protocolos de verificación que detienen la estafa

La buena noticia es que el vishing con voz clonada se neutraliza con contramedidas sencillas, de coste casi nulo, que cualquier empresa puede adoptar desde mañana mismo. El principio es uno solo: ningún pago se ejecuta a partir de una única petición recibida por un único canal, por muy convincente que sea la voz.

1. La regla del canal secundario (callback)

Cualquier petición de pago urgente, cambio de IBAN u operación fuera de procedimiento debe verificarse llamando de nuevo a la persona a un número ya conocido y guardado, no al que ha realizado la llamada. Si el "CFO" te telefonea pidiendo una transferencia, cuelga y llámale tú al móvil que tienes en la agenda. Si es realmente él, lo confirmará en diez segundos. Si es un deepfake, el ataque se detiene aquí.

2. La palabra de seguridad interna

Acuerda con tus colaboradores clave una palabra o frase de seguridad, compartida solo en persona y nunca por escrito en email o chat. Para autorizar una operación sensible por teléfono, quien llama debe facilitarla. Una IA que ha clonado la voz del titular no conoce la palabra de seguridad establecida verbalmente en una reunión.

3. La doble firma en los pagos

Ninguna transferencia por encima de un determinado umbral (lo defines tú: 2.000, 5.000, 10.000 euros) se ejecuta con la autorización de una sola persona. Se requiere la validación de un segundo referente, por un canal distinto. Es el mismo principio de la doble llave: eleva enormemente la dificultad para el atacante, que tendría que engañar a dos personas al mismo tiempo.

4. El "derecho a dudar" del empleado

Este es el punto más infravalorado y, a la vez, el más importante. Muchas estafas triunfan porque el empleado tuvo una duda pero no se atrevió a cuestionar al jefe. Debes dejar por escrito, de forma explícita, que a nadie se le reprochará nunca haber ralentizado un pago para verificarlo, ni siquiera cuando la petición era auténtica y urgente. Quitar la presión jerárquica es la contramedida psicológica decisiva.

5. Formación específica, no genérica

Las simulaciones marcan la diferencia. Una cosa es explicar de palabra qué es un deepfake, y otra muy distinta hacer que el equipo escuche un ejemplo de voz clonada y ver lo creíble que resulta. La concienciación se construye con la experiencia directa, no con una circular interna. Merece la pena incluir este tema también en la formación en inteligencia artificial para empleados: el mismo equipo que usa la IA de forma productiva debe saber cómo se usa la IA en su contra.

Resumimos las contramedidas en una tabla operativa:

Señal de alarmaContramedida
Petición de pago urgenteCallback a un número conocido guardado en la agenda
Cambio de IBAN de un proveedorVerificación por escrito y llamada al proveedor por un contacto histórico
Operación "confidencial, no se lo digas a nadie"Verificación cruzada con un segundo referente
Voz autoritaria por teléfonoPalabra de seguridad interna acordada verbalmente
Importe elevadoDoble firma obligatoria por encima de un umbral

¿Quieres saber si tu empresa está expuesta a este tipo de fraude y si tus protocolos aguantan? Solicítanos un análisis de riesgo: revisamos juntos pagos, formación y cobertura aseguradora.

La relación con el RGPD, la NIS2 y la responsabilidad de quien decide

Protegerse del vishing no es solo una cuestión de dinero perdido. Tiene implicaciones normativas que en 2026 recaen directamente sobre los administradores.

La Directiva NIS2 (transpuesta en Italia mediante el D.Lgs. 138/2024) sitúa las medidas básicas en su plazo operativo a lo largo de 2026 y, algo que a menudo se ignora, traslada la responsabilidad de la ciberseguridad directamente a los CEO y a los órganos de administración: ya no es una materia delegable por completo al departamento de IT. Si tu empresa entra dentro del ámbito de aplicación, formar al personal contra la ingeniería social no es un extra, sino parte de las obligaciones de gestión del riesgo. Para saber si te afecta, hemos detallado el alcance en nuestro análisis sobre cuándo se aplica la NIS2 a tu empresa y los plazos de 2026 que conviene anotar en la agenda.

En el frente de la protección de datos, un ataque exitoso suele implicar también una brecha de seguridad. Si los estafadores accedieron a información personal (de clientes, empleados o proveedores) para construir el engaño, o si el incidente la expuso, se activan las obligaciones frente a la autoridad de protección de datos. Mejor saber de antemano qué hacer, porque el plazo de notificación de 72 horas no admite improvisación.

También el Reglamento de IA (Reglamento UE 2024/1689) entra en su fase operativa más relevante el 2 de agosto de 2026, con la vigilancia en Italia a cargo de la ACN. El tema de los deepfakes está explícitamente presente en el reglamento, en forma de obligaciones de transparencia para los contenidos sintéticos. Pero en el frente ofensivo la protección sigue siendo cosa tuya: la ley sanciona a quien produce deepfakes engañosos, no te devuelve los 28.000 euros si has caído en la trampa.

El ciberseguro: la última red, si cubre los fraudes con IA

Las contramedidas procedimentales reducen drásticamente el riesgo, pero no lo eliminan. Por eso crece el interés por las pólizas cyber, y aquí se esconde un detalle que muchos descubren demasiado tarde: no todas las pólizas cubren el fraude del CEO y la ingeniería social. Varias coberturas "cyber" estándar indemnizan los daños por ciberataque (ransomware, violación de sistemas), pero excluyen las pérdidas en las que fue un empleado quien ordenó voluntariamente la transferencia, porque técnicamente no hubo intrusión en los sistemas.

Si estás valorando una póliza, comprueba con tu correduría estos puntos de forma explícita:

  • Presencia de una garantía específica para Social Engineering Fraud / fraude del CEO (a menudo vendida como extensión aparte).
  • Cobertura de los daños por deepfake de audio y vídeo, recogida por escrito en las condiciones.
  • Los requisitos mínimos de seguridad exigidos por la aseguradora (procedimientos de callback, doble firma, formación): sin ellos, la póliza puede no pagar.

Es el punto donde auditoría de seguridad y asegurabilidad se encuentran. Hoy las compañías, para emitir o renovar una póliza cyber en condiciones razonables, exigen la prueba de contar con controles mínimos activos. Una auditoría bien hecha no solo te protege: hace que tu empresa sea asegurable y reduce la prima. Si quieres dimensionar el coste total del riesgo, desde el daño directo hasta el valor de la prevención, encontrarás las cifras en nuestro análisis sobre el coste real de una brecha de datos para una pyme.

Un riesgo que crece, no una alarma pasajera

Los datos de contexto no dejan margen para la distracción. El Informe Clusit 2026 sitúa a Italia en torno al 10% de los incidentes mundiales, con las pymes representando la mayoría de los objetivos y un aumento significativo de los ataques graves. El vishing potenciado por IA es la punta más insidiosa de esta tendencia, porque escala con facilidad: clonar una voz cuesta muy poco, y con el mismo "kit" un estafador puede atacar a decenas de empresas.

La defensa eficaz no consiste en comprar otro software más. Consiste en revisar cómo tu organización autoriza los pagos y comunica las peticiones sensibles, entrenar a las personas para desconfiar por procedimiento y no por instinto, y comprobar que tu cobertura aseguradora habla de verdad el idioma de los fraudes con IA. Son intervenciones de bajo coste con un retorno enorme: esos 28.000 euros de la pyme lombarda habrían bastado para financiar años de formación y controles.

Preguntas frecuentes

¿Cuántos segundos de audio hacen falta para clonar una voz?

Los sistemas de voice cloning más avanzados hoy producen un resultado creíble con menos de un minuto de grabación, y en algunos casos bastan unos segundos. Las fuentes habituales son vídeos en LinkedIn, pódcasts, entrevistas o notas de voz. Precisamente esto hace imposible confiar la defensa solo al reconocimiento de la voz.

¿Cómo sé si estoy hablando con una voz clonada por teléfono?

No te fíes del oído: las voces sintéticas de última generación son dificilísimas de distinguir. Confía en los protocolos: cuelga y llama a la persona a un número ya guardado en la agenda, pide la palabra de seguridad interna acordada, o pospón la operación para una verificación por escrito. Un atacante no supera un callback a un número conocido.

¿Mi seguro cubre el fraude del CEO por deepfake?

No automáticamente. Muchas pólizas cyber estándar excluyen la ingeniería social, porque la transferencia la ordenó voluntariamente un empleado y no hubo intrusión en los sistemas. Comprueba con tu correduría si existe una garantía específica de 'Social Engineering Fraud' o 'fraude del CEO' y la cobertura explícita de los daños por deepfake.

¿La NIS2 me obliga a formar a los empleados contra el vishing?

Si tu empresa entra en el ámbito de la NIS2 (D.Lgs. 138/2024), la formación y la gestión del riesgo de ingeniería social forman parte de las obligaciones, y la responsabilidad recae directamente sobre el CEO y los órganos de administración, ya no solo sobre IT. Comprueba el perímetro de aplicación para saber si te afecta.

¿Cuál es la contramedida más eficaz y de coste cero?

La regla del canal secundario: ningún pago urgente o cambio de IBAN se ejecuta sin una verificación a un número ya conocido en la agenda, distinto del de la llamada recibida. Combinada con la doble firma por encima de un umbral y el 'derecho a dudar' del empleado, neutraliza casi la totalidad de los intentos de vishing.

¿Qué debo hacer si ya he ejecutado una transferencia fraudulenta?

Actúa en cuestión de minutos: contacta de inmediato con tu banco para intentar el recall de la transferencia, presenta denuncia ante las autoridades, y valora si el incidente constituye una brecha de datos que notificar a la autoridad de protección de datos en un plazo de 72 horas. Cuanto antes intervengas, mayores serán las probabilidades de bloquear la transferencia.

Hablemos: evaluamos tus procedimientos de verificación de pagos y te decimos dónde intervenir para que tu empresa sea difícil de estafar (y asegurable).