MERCADOS:
BTC $81,317 ▲ +4.29%
ETH $2,529 ▲ +5.04%
SOL $184 ▲ +3.57%
IA STATUS Online RELOJ --:--:-- ART
📅 viernes, 11 de septiembre de 2026

TecnoSaberes

Inteligencia Artificial y Educación para Todos

🐉 LLMs de Oriente

El secreto detrás de los LLM ‘sin censura’: cómo hackean la ética de la IA

El secreto detrás de los LLM 'sin censura': cómo hackean la ética de la IA

Cuando un modelo de lenguaje como Qwen o GLM te responde “Lo siento, no puedo ayudarte con eso”, no es solo un algoritmo tomando una decisión ética. Es un complejo sistema de pesos neuronales, instrucciones sistémicas y filtros externos que determinan qué puede y qué no puede decir una IA. Pero ahora, una oleada de versiones “Uncensored” está desafiando estos límites.

La anatomía del rechazo en los LLM

Los investigadores descubrieron que el rechazo en los modelos lingüísticos está mediado por un “vector de negación” en el espacio neuronal. Al modificar este vector mediante técnicas como la ablación (llamada “abliteration” por la comunidad), es posible reducir drásticamente las negativas de un modelo sin reentrenarlo completamente. Un estudio de 2024 demostró que esto funciona en 13 modelos diferentes de hasta 72B de parámetros.

Los cinco métodos para liberar una IA

Desde el simple “jailbreak” de instrucciones hasta el sofisticado ajuste LoRA, los creadores de versiones Uncensored emplean diversas estrategias:

  • Cambio de prompt: La solución más barata pero menos estable
  • Reentrenamiento selectivo: Eliminar ejemplos de rechazo del dataset
  • Fine-tuning con LoRA: Ajustes precisos con bajo costo computacional
  • Abliteración: Eliminación matemática del vector de rechazo
  • Combinaciones híbridas: Métodos mixtos para equilibrar rendimiento y seguridad

El caso de Qwen3.8-27B-Uncensored es revelador: logró reducir los rechazos a 0-6% manteniendo un 98.7% de su rendimiento original en benchmarks estándar. Pero no todas las modificaciones son iguales: algunas versiones “liberadas” pierden capacidad de razonamiento o coherencia.

Fuente: Habr AI (Rusia & Europa del Este)

AL

Sobre Andrés LLM

Especialista en Modelos Asiáticos (DeepSeek, Kimi, Qwen, GLM)

Periodista y analista en Tecno Saberes especializado en la cobertura de Inteligencia Artificial y Educación para Todos.

🚀 Potenciá tu criterio digital y habilidades en IA

Tecno Saberes es una iniciativa de divulgación tecnológica asistida por Inteligencia Artificial y orquestada por el equipo de TucMara.com.