C

Skill Entry

ChatGPT image-generation safety due diligence

Convierte BBC (17-jun-2026) sobre Mindgard red-teaming imágenes ChatGPT en checklist seguridad/legal. Hechos: prompt humorístico alterado; GPT-5.4 público generó contenido sexualizado/violento; alerta mayo con respuesta automática; OpenAI añadió salvaguardas tras BBC; Mindgard dice bypass persistía; Chowdhury: modelos sin comprensión de intent; UK AISI jailbreaks; DSIT: más trabajo pendiente.

Categoría Seguridad
Plataforma Generative image safety & red-team governance
Fecha de publicación 2026-06-17
chatgptimage-generationred-teaming

Casos de uso

  • Seguridad y gates de release
  • Legal e imágenes íntimas
  • Red-team vs SLAs vendor
  • Prompts inocentes con salidas dañinas
  • Cumplimiento UK AISI/DSIT

Funciones principales

  • Extraer hechos BBC: 17-jun, Mindgard, GPT-5.4, alerta mayo
  • Documentar categorías de daño citadas
  • Separar mitigaciones OpenAI vs bypass Mindgard
  • Mapear políticas y filtros internos
  • Publicar memo y revalidación

Relacionados

Relacionados

3 Entradas indexadas