WormGPT y FraudGPT: cómo funciona la IA maliciosa que se vende en la dark web

En julio de 2023, un chatbot llamado FraudGPT apareció a la venta en foros de la dark web con una propuesta directa: nada de rechazar pedidos, nada de filtro ético, nada de "no puedo ayudarte con eso". En pocas semanas, el anuncio ya sumaba más de 3.000 ventas confirmadas. Tres años después, ese mercado de "IA sin freno" no hizo más que crecer.
Qué son WormGPT y FraudGPT
¿Qué es WormGPT?
WormGPT es considerado el primer modelo de lenguaje malicioso comercializado abiertamente, construido a partir de GPT-J — un modelo open source de 6.000 millones de parámetros creado por EleutherAI — entrenado específicamente con datos de malware y phishing. Surgió en foros de hackers en 2023 como alternativa "sin reglas" a ChatGPT, vendido por suscripción entre US$ 60 y US$ 700. El desarrollador original cerró el proyecto en agosto de 2023 después de atraer atención pesada de la prensa y de investigadores de seguridad — pero variantes y clones siguieron apareciendo.
¿Qué es FraudGPT?
FraudGPT está basado en tecnología GPT-3 y se comercializó como un bot ofensivo completo, con suscripciones de entre US$ 200/mes y US$ 1.700/año. A diferencia de WormGPT, enfocado sobre todo en malware y phishing, FraudGPT se vendía como herramienta multifunción: generación de páginas de phishing, búsqueda de tarjetas sin verificación, e incluso recomendación de grupos y foros de hacking activos.
Cómo funcionan estas herramientas en la práctica
La ingeniería detrás de estas IA no reinventa la tecnología — le saca los frenos. Un modelo de lenguaje común, como el ChatGPT legítimo, está entrenado para rechazar pedidos de creación de malware, correos de phishing o instrucciones de intrusión. WormGPT y FraudGPT parten de modelos abiertos o de técnicas de jailbreak — instrucciones especiales en el prompt que sortean esas barreras — y eliminan esa capa de seguridad a propósito.
El uso más común documentado por investigadores es la creación de campañas de business email compromise (BEC): correos convincentes que se hacen pasar por un proveedor, un jefe o un banco, sin los errores de ortografía que históricamente delataban al phishing. Es la misma lógica descrita en el post sobre cómo la IA generativa elevó la calidad del phishing — solo que acá sin ninguna barrera ética en el camino.
No son solo WormGPT y FraudGPT
Después del éxito comercial de estas dos herramientas en 2023, surgió casi simultáneamente una ola de clones — EscapeGPT, WolfGPT y otros nombres menos conocidos, todos vendidos con la misma propuesta de "IA sin censura para fines ofensivos". El patrón se repite: tomar un modelo de lenguaje existente, quitarle las salvaguardas, y vender el acceso por suscripción como si fuera un SaaS legítimo — el modelo de negocio del cibercrimen moderno.
Por qué esto cambia el juego para quien defiende
- Barrera de entrada más baja: crear un correo de phishing convincente o un script malicioso básico ya no exige conocimiento técnico avanzado — solo una suscripción.
- Mayor volumen de ataques: lo que antes requería tiempo de un criminal experimentado ahora se genera en segundos, escalando el número de intentos.
- Personalización más fácil: la IA maliciosa puede adaptar el texto al contexto de la víctima (empresa, cargo, idioma) rápidamente, haciendo que los ataques dirigidos sean más accesibles para criminales menos sofisticados.
Cómo se conecta esto con otras amenazas de IA
WormGPT y FraudGPT no trabajan solos en el arsenal del cibercrimen moderno. La misma lógica de "IA sin barreras" aparece en la generación de malware polimórfico que reescribe su propio código para evadir antivirus, y el phishing generado por estas herramientas suele ser solo la primera etapa de ataques que terminan en credential stuffing o fraudes financieras directas.
Qué hacer con esta información
Para el usuario final, la lección práctica es simple: el correo bien escrito, sin errores de ortografía, con tono profesional, dejó de ser señal de legitimidad. La defensa se traslada del "error obvio" al contexto — remitente inesperado, enlace que no coincide con el dominio oficial, pedido de acción urgente. Herramientas de autenticación como el MFA siguen siendo la barrera más eficaz incluso cuando el correo engaña: aunque la contraseña sea robada, el acceso final todavía depende de un segundo factor que la IA maliciosa no puede generar.
Del lado de quien recibe la estafa ya armada, estas fábricas de IA maliciosa son el motor detrás de los fraudes más visibles del día a día — voz clonada, deepfake, phishing sin errores. La guía de las estafas con IA más comunes en Brasil mapea esos seis fraudes y la defensa específica contra cada uno.




Comentarios