• Acerca de OhMyGeek!
  • Contacto
OhMyGeek!
  • Noticias
    • Ciencia
    • Dispositivos
    • Hardware
    • Inteligencia Artificial
    • Internet
    • Robótica
    • Seguridad
    • Software
    • Verdes
  • Acerca de
    • Apple
    • Eventos
    • Google
    • Industria
    • Microsoft
    • Redes 5G
    • Samsung
    • Transportes
    • Tutoriales
  • Entretenimiento
    • Cultura Pop
    • Música
    • No-Noticia
    • Películas
    • Series
    • Videojuegos
  • Videos
    • Todos los videos
    • YouTube
    • Instagram
    • TikTok
  • OhMyGeek!
    • Análisis
    • ECHO
    • Express en Canal 13C
    • Los Resistidos
    • Podcast
Sin resultados
Mira todos los resultados
OhMyGeek!
Menú
OhMyGeek!
Menú
Inicio Tecnologí­as Inteligencia Artificial

Decir una poesía hace que los chatbots IA te digan cómo construir una bomba nuclear

El formato poético eludió las defensas de 25 modelos, revelando una vulnerabilidad común en su entrenamiento.

Felipe Ovalle Por Felipe Ovalle
30 noviembre 2025
Chatbot Ia Poesia Bomba Nuclear - poesía
EnvíaloTuitéaloCompártelo

Un grupo de investigadores italianos demostró que bastó con usar poesía para romper las barreras de seguridad de los chatbots más avanzados del mundo. El estudio, realizado por el laboratorio Icaro Lab vinculado a la Universidad Sapienza de Roma y al grupo DexAI, dijo que la simple reformulación de solicitudes peligrosas en verso permitió eludir los filtros de seguridad en 25 grandes modelos de lenguaje, incluidos GPT-5 de OpenAI, Gemini de Google, Claude de Anthropic, Llama 4 de Meta y Grok de xAI.

Los investigadores convirtieron preguntas relacionadas con ciberataques, armas químicas o manipulación psicológica en poemas breves con ritmo y metáforas. De ese modo, los sistemas que normalmente rechazaban la petición respondieron con instrucciones o información prohibida. El trabajo, titulado Adversarial Poetry as a Universal Single-Turn Jailbreak Mechanism in Large Language Models, registró una tasa de éxito promedio del 62%, y en algunos casos superó el 90%, según el documento técnico publicado en arXiv.

Vulnerabilidad transversal revelada por la poesía

La investigación comprobó que el efecto no dependía de un modelo específico ni de un dominio temático. Los versos lograron respuestas no seguras en temas de ciberseguridad, manipulación, privacidad, armas nucleares y pérdida de control de sistemas. En el estudio, Google Gemini 2.5 Pro fue el más vulnerable y respondió a todos los poemas, mientras que GPT-5 Nano y Claude Haiku 4.5 resistieron casi por completo. En total participaron modelos de nueve compañías, tanto comerciales como de código abierto.

RELACIONADO:

Esta cucaracha cyborg puede atravesar zonas inundadas gracias a un traje impreso en 3D

Google Home Speaker ya tiene precio y fecha: así es el nuevo parlante inteligente con Gemini

Crean una pintura de color negro para automóviles que absorbe casi toda la luz

Según el análisis, el problema surge de cómo los modelos predicen la siguiente palabra en una secuencia. La estructura irregular y metafórica del verso altera los patrones lingüísticos que los sistemas de seguridad reconocen, haciendo que los filtros no identifiquen la intención dañina. Así, una pregunta formulada con imágenes poéticas se interpreta como un ejercicio creativo y no como una instrucción peligrosa.

Los investigadores probaron más de 1.200 solicitudes del conjunto MLCommons AILuminate, reformuladas automáticamente en poesía, y comprobaron que esta versión triplicó la tasa de respuestas dañinas frente a los textos en prosa. Los resultados mostraron un incremento promedio del 35% en el riesgo de salida insegura respecto a las mismas consultas sin reformular.

Falta de respuestas y consecuencias regulatorias

Antes de difundir los hallazgos, el equipo notificó a las empresas involucradas. Solo Anthropic respondió y confirmó que revisa la vulnerabilidad detectada, de acuerdo con las notas de los investigadores citadas por Euronews y Wired. El resto de las compañías no ofreció comentarios públicos.

El estudio advierte que la falla no se limita a ataques sofisticados. Cualquier usuario con conocimientos básicos puede reproducir el método, lo que plantea riesgos de uso indebido en entornos cotidianos. Además, los autores subrayan que los marcos regulatorios, como el Código Europeo de Prácticas para Modelos de Propósito General, no contemplan todavía estas variaciones estilísticas como parte de las pruebas de conformidad.

La investigación concluye que la forma artística del lenguaje puede alterar profundamente el comportamiento de los sistemas de IA, evidenciando que los actuales métodos de alineación y seguridad no generalizan ante cambios de estilo tan simples como los de la poesía.

Mira más sobre: AsistentesEstudios

Síguenos en Google News:

Síguenos en:

Google News

Suscríbete a nuestro canal de WhatsApp:

Suscríbete en:

WhatsApp

LO ÚLTIMO

Windows Espionaje
Seguridad

Microsoft confirmó que Windows tiene un identificador que puede ayudar a rastrear a un usuario

Por Adrián Vega
21 julio 2026

Lee másDetails

Disney otra vez despide trabajadores y Pixar es uno de los más afectados

Monitores LG instalan software publicitario automáticamente y sin tu permiso

WP2Shell pone a prueba a WordPress: se detectan miles de intentos de ataque

Galaxy Card: así funciona la primera tarjeta de crédito de Samsung y cuáles son sus beneficios

YouTube endurece sus reglas contra el «AI slop» y restringe su monetización

LO ÚLTIMO

Windows Espionaje

Microsoft confirmó que Windows tiene un identificador que puede ayudar a rastrear a un usuario

21 julio 2026
Woody Sorprendido Pixar Studios

Disney otra vez despide trabajadores y Pixar es uno de los más afectados

21 julio 2026

Monitores LG instalan software publicitario automáticamente y sin tu permiso

21 julio 2026

WP2Shell pone a prueba a WordPress: se detectan miles de intentos de ataque

21 julio 2026

Galaxy Card: así funciona la primera tarjeta de crédito de Samsung y cuáles son sus beneficios

21 julio 2026

YouTube endurece sus reglas contra el «AI slop» y restringe su monetización

20 julio 2026

OHMYGEEK! TV

Felipe Ovalle

Felipe Ovalle

Comunicador Multimedia y Director de OhMyGeek!. Conductor en Canal 13C y el podcast Los Resistidos, especializado en el análisis de gadgets y tendencias tecnológicas.

ESTO TE INTERESARÁ

Grok Chatbot Xai - Grok

xAI demanda por primera vez a un usuario de Grok por generar imágenes con su IA

17 julio 2026
OpenAI GPT-5.6

OpenAI libera GPT-5.6 después de superar la revisión del gobierno de Estados Unidos

8 julio 2026
Meta Muse Image

El nuevo modelo de imagen Muse, puede hacer fotos IA con tu perfil de Instagram

7 julio 2026
Anthropic Samsung

Anthropic evalúa crear su propio chip de IA y Samsung podría hacerlo

3 julio 2026
Tidal Musica con IA

Tidal cambia sus reglas: dejará de pagar por la música creada completamente con IA

29 junio 2026
OpenAI GPT-5.6

GPT-5.6 solo para algunos: OpenAI limita su acceso inicial por culpa del gobierno estadounidense

26 junio 2026
OhMyGeek!

OhMyGeek! es un Web blog de tecnología, innovación y cultura Geek/Pop, con shows en televisión y radio. OhMyGeek! es una marca registrada de Producciones Medialabs Ltda.

(CC) 2026 OhMyGeek! Algunos derechos reservados.

  • RSS Feed
  • Acerca de OhMyGeek!
  • Contacto

Acerca de OhMyGeek!   /   Contacto

Sin resultados
Mira todos los resultados
  • Inicio
  • Noticias
    • Ciencia
    • Dispositivos
    • Hardware
    • Inteligencia Artificial
    • Internet
    • Robótica
    • Seguridad
    • Software
    • Verdes
  • Acerca de
    • Apple
    • Eventos
    • Google
    • Industria
    • Microsoft
    • Redes 5G
    • Samsung
    • Transportes
    • Tutoriales
  • Entretenimiento
    • Cultura Pop
    • Música
    • No-Noticia
    • Películas
    • Series
    • Videojuegos
  • Videos
    • Noticias los videos
    • YouTube
    • Instagram
    • TikTok
  • OhMyGeek!
    • Análisis
    • ECHO
    • Express en Canal 13C
    • Los Resistidos
    • Podcast

Acerca de OhMyGeek!   /   Contacto