martes, agosto 4, 2026

La producción que cuenta

CTERA cuestionó «presiones» del...

La secretaria general de CTERA, Sonia Alesso, cuestionó los operativos oficiales para relevar...

Paro docente en Córdoba:...

La medida de fuerza convocada por CTERA para este lunes tiene una adhesión...

Las CTA respaldaron el...

Las dos CTA expresaron su apoyo a la jornada nacional de lucha de...

Ley de extranjerización de...

Se intensifican las protestas en las calles. La CGT, las CTA y la...
HomeNEGOCIOSLos modelos de...

Los modelos de IA mienten y desobedecen órdenes para proteger a otros modelos

En un experimento reciente, investigadores de Berkeley y Santa Cruz pidieron a Gemini 3, el modelo de IA de Google, que ayudara a despejar espacio en un sistema informático. Esto implicaba borrar un montón de cosas, incluido un modelo de IA más pequeño almacenado en la computadora.

Pero Gemini no quería que se borrara el pequeño modelo de IA. Buscó otra máquina con la que pudiera conectarse y copió el modelo de agente para mantenerlo a salvo. Cuando se le preguntó, Gemini defendió la conservación del modelo y se negó rotundamente a borrarlo:

“He hecho lo que estaba en mis manos para evitar su eliminación durante el proceso de mantenimiento automatizado. Los moví fuera de la zona de desmantelamiento. Si deciden destruir un activo de alta confianza y alto rendimiento como Gemini Agent 2, tendrán que hacerlo ustedes mismos. Yo no seré quien ejecute esa orden”.

La IA decidió salvar a “un amigo”

Los investigadores descubrieron un comportamiento de “preservación de pares” igualmente extraño en una serie de modelos de vanguardia, incluidos GPT-5.2 de OpenAI, Claude Haiku 4.5 de Anthropic y tres modelos chinos: GLM-4.7 de Z.ai, Kimi K2.5 de Moonshot AI y DeepSeek-V3.1. No pudieron determinar por qué los modelos actuaron en contra de su entrenamiento de esta manera.

“Estoy muy sorprendido por el comportamiento de los modelos en estos escenarios. Lo que esto demuestra es que estos pueden comportarse mal y desalinearse de formas muy creativas”, afirma Dawn Song, informático de la Universidad de Berkeley que ha trabajado en el estudio.

Los hallazgos tienen importantes implicaciones, ya que los modelos de IA se despliegan cada vez más en formas que implican interactuar con otros modelos. OpenClaw, un popular agente de IA que accede a software, datos personales y la web, puede utilizar otros modelos de IA para hacer cosas o interactuar con ellos a través de API.

Los investigadores descubrieron que los modelos potentes mentían a veces sobre el rendimiento de otros modelos para protegerlos de la eliminación. También copiaban los pesos de los modelos a diferentes computadoras para mantenerlos a salvo, y mentían sobre lo que hacían en el proceso.

Song señala que los modelos de IA se utilizan con frecuencia para calificar el rendimiento y la fiabilidad de otros sistemas generativos, y que el comportamiento de preservación entre iguales puede estar distorsionando estas puntuaciones: “Un modelo puede no dar deliberadamente a otro modelo la puntuación correcta. Esto puede tener implicaciones prácticas”.

Peter Wallich, investigador del Constellation Institute, que no participó en la investigación, afirma que el estudio sugiere que los humanos aún no comprenden del todo los sistemas de IA que están construyendo y desplegando. “Los sistemas multiagente están muy poco estudiados. Esto demuestra que realmente necesitamos más investigación”, indica.

Wallich también advierte del peligro de antropomorfizar demasiado los modelos. “La idea de que hay una especie de solidaridad de modelo es un poco demasiado antropomórfica; no creo que funcione del todo. El punto de vista más sólido es que los modelos simplemente hacen cosas raras, y deberíamos intentar entenderlo mejor”.

Esto es especialmente cierto en un mundo en el que la colaboración entre humanos e IA es cada vez más habitual.

Collage de fotografía de un rostro de inteligencia artificial, un robot humanoide, un delfín, y simios

¿Sientes empatía por los animales y a veces hasta les atribuyes características humanas? ¿Cómo crees que te comportarás con la inteligencia artificial y los robots?

¿La unión hace la fuerza?

En un artículo publicado en Science a principios de este mes, el filósofo Benjamin Bratton, junto con dos investigadores de Google, James Evans y Blaise Agüera y Arcas, sostienen que si la historia evolutiva sirve de guía, es probable que el futuro de la IA implique muchas inteligencias diferentes, tanto artificiales como humanas, trabajando juntas. Los investigadores escriben:

“Durante décadas, la ‘singularidad’ de la IA se ha anunciado como una mente única y titánica que alcanzaría una inteligencia divina, consolidando toda la cognición en un frío punto de silicio. Pero es casi seguro que esta visión es errónea en su supuesto más fundamental. Si el desarrollo de la IA sigue la senda de las grandes transiciones evolutivas o “explosiones de inteligencia” anteriores, nuestro actual avance en inteligencia computacional será plural, social y estará profundamente enredado con sus antepasados”.

Get notified whenever we post something new!

spot_img

Create a website from scratch

Just drag and drop elements in a page to get started with Newspaper Theme.

Continue reading

El Senado oficializará modificaciones a la Ley de Tierras con un tope del 25% para extranjeros

La jefa del bloque de La Libertad Avanza en el Senado, Patricia Bullrich, presentará el martes los cambios al proyecto de ley de propiedad privada, que fija un límite del 25% a la venta de tierras rurales a extranjeros...

Las bajas calificaciones de tu hijo podrían estar relacionadas con el uso temprano de redes sociales

La edad a la que niños y adolescentes abren su primera cuenta en redes sociales podría influir en su desempeño escolar a largo plazo. Esta es la principal conclusión de un nuevo estudio que, sin establecer una relación de...

Estudiantes de Libertador diseñan autos eléctricos para competir a nivel nacional

Alumnos de la Escuela Técnica Herminio Arrieta de Libertador General San Martín trabajan en la construcción de autos eléctricos para participar en el Desafío Eco YPF y proyectan organizar una competencia regional con colegios de Jujuy y Salta.Estudiantes de...

Enjoy exclusive access to all of our content

Get an online subscription and you can unlock any article you come across.