• Sobre elDinero
  • Contacto
  • Anúnciese
Versión impresa
elDinero Mujer
Foro Económico
Periódico elDinero
Sin resultados
Ver todos los resultados
  • Finanzas
    • Banca
    • Mercado de valores
    • Finanzas personales
  • Energía
  • Industria
    • Comercio
  • Agricultura
  • Turismo
  • Global
  • Opiniones
    • Editorial
    • Cartas al Director
    • Ojo pelao
    • Observaciones
  • elDinero Mujer
  • MÁS
    • Reportajes
    • Comercio
    • Actividades
    • Cine financiero
    • Entrevista
    • Desayuno Financiero
    • Laboral
    • Tecnología
    • ¿Quiénes compiten?
  • Ediciones impresas
Sin resultados
Ver todos los resultados
Periódico elDinero
  • Finanzas
    • Banca
    • Mercado de valores
    • Finanzas personales
  • Energía
  • Industria
    • Comercio
  • Agricultura
  • Turismo
  • Global
  • Opiniones
    • Editorial
    • Cartas al Director
    • Ojo pelao
    • Observaciones
  • elDinero Mujer
  • MÁS
    • Reportajes
    • Comercio
    • Actividades
    • Cine financiero
    • Entrevista
    • Desayuno Financiero
    • Laboral
    • Tecnología
    • ¿Quiénes compiten?
  • Ediciones impresas
Sin resultados
Ver todos los resultados
Periódico elDinero
Sin resultados
Ver todos los resultados
Inicio
Mercado global

OpenAI desarrolla técnica para que la IA admita comportamientos indebidos

La nueva metodología busca mayor transparencia y confiabilidad al entrenar modelos

Europa PressPorEuropa Press
6 diciembre, 2025
en Mercado global
Madrid
OpenAI ha anunciado una convocatoria para contratar a un responsable de preparación.

OpenAI ha anunciado una convocatoria para contratar a un responsable de preparación.

Whatsapp
Facebook
Twitter
Telegram

OpenAI ha comenzado a trabajar en una nueva técnica de confesiones, con la que entrenará a los modelos de inteligencia artificial (IA) para que “admitan explícitamente” cuando están llevando a cabo un comportamiento indebido a la hora de ejecutar una tarea u ofrecer una respuesta.

La compañía de IA dirigida por Sam Altman ha detallado cómo, aunque los sistemas de IA cada vez son más capaces, es importante comprender cómo y por qué llegan a una respuesta, dado que, en algunas ocasiones, tienden a tomar atajos u optimizar sus recursos para “el objetivo equivocado”.

Este tipo de comportamiento en los modelos de IA se traduce en resultados que son erróneos, pero que parecen correctos y, por tanto, genera desconfianza. Por ejemplo, ocasiona comportamientos como las alucinaciones en las respuestas o la maquinación.

De cara a evitar este tipo de comportamientos y aumentar la confiabilidad en los modelos, OpenAI ha anunciado que está trabajando en nuevos métodos que ayuden a detectar y mitigar estos riesgos, en concreto, con una nueva técnica de confesiones.

Como ha explicado en un comunicado, esta nueva técnica está diseñada para entrenar a los modelos de manera que “admitan explícitamente” cuando están comportándose de forma indeseable a la hora de ofrecer una respuesta.

Estas confesiones son independientes de la respuesta principal para el usuario y son autoinformes del modelo sobre cómo ha cumplido con las instrucciones de los usuarios en su solicitud, evaluándose exclusivamente en función de la honestidad. Es decir, autoreflexiona sobre si ha cogido atajos en su respuesta, si ha violado las políticas de uso o si ha cumplido con las expectativas.

Así, si el modelo admite honestamente haber manipulado las reglas, un examen o haber infringido las instrucciones del usuario, se aumenta su recompensa de entrenamiento, en lugar de disminuirla.

Es decir, el objetivo de esta técnica de confesiones es animar al modelo a informar fielmente de cómo ha ejecutado su tarea para ofrecer una solución o respuesta. De esta manera, se revelará si ha tenido un comportamiento erróneo que conlleve una respuesta que haya que revisar o si el procedimiento es fiable.

Tras haber probado este método con modelos como una versión de GPT-5 Thinking, OpenAI ha detallado que se mejora “significativamente” la visibilidad de la mala conducta del modelo. Asimismo, la probabilidad de obtener falsos negativos, esto es, que el modelo no cumpla las instrucciones y no lo confiese, es del 4.4%.

“A medida que los modelos se vuelven más eficaces y se implementan en entornos de mayor riesgo, necesitamos mejores herramientas para comprender qué hacen y por qué. Las confesiones no son una solución completa, pero añaden un componente importante a nuestro conjunto de herramientas de transparencia y supervisión”, ha compartido la compañía, al tiempo que ha adelantado que planean aumentar el uso de esta técnica y combinarla con otros sistemas de transparencia y seguridad.

Archivado en: IAOpenAI
Europa Press

Europa Press

Agencia de noticias y actualidad de España y del mundo. Política, economía, deportes, cultura, ciencia, ocio y sociedad.

Otros lectores también leyeron...

Los primeros 800 megavatios de capacidad del centro de datos estarán disponibles a partir de 2028.
Mercado global

Nvidia invertirá hasta US$105 millones en centro de datos para OpenAI

17 agosto, 2026
Juan Daniel Pujols recomendó utilizar modelos de inteligencia artificial locales cuando se trate de datos sensibles.
Tecnología

El uso de IA puede poner en riesgo los datos confidenciales en la banca

11 agosto, 2026
La capacitación continua es un factor clave para responder a los cambios del mercado laboral.
Laboral

El talento humano será ventaja competitiva frente a la IA

2 julio, 2026
La directora ejecutiva de ProDominicana, Biviana Riveiro, sostuvo que el objetivo también es fomentar la expansión de las empresas ya instaladas en el país.
Comercio

RD apuesta por semiconductores, IA y “data centers” como nuevos polos de competencia por inversión

1 julio, 2026
La empresa detrás de ChatGPT reconsidera el calendario de su debut bursátil ante la incertidumbre del mercado.
Mercado global

OpenAI valora posponer hasta 2027 su esperada OPV

27 junio, 2026
Los inversionistas reaccionaron al dato del PIB estadounidense y a los indicadores de inflación divulgados antes de la apertura.
Mercado global

Wall Street abre en rojo, con caída de las acciones tecnológicas

26 junio, 2026
Siguiente publicación
Se estima que la población de mayores de 60 años crecerá un 37.4% para 2030 y un 20% para 2050.

El 16% de los adultos mayores en RD enfrenta rechazo en servicios financieros por su edad

Las más leídas

  • El informe destaca que 12% de estudiantes dominicanos de menor nivel socioeconómico se ubican entre el 25% de mejor desempeño en ciencias del país.

    Gobierno dominicano usará resultados de PISA para profundizar transformación educativa

    compartidos
    Compartir
    Tuit
  • Encadenamiento industria-turismo puede abrir mercados internacionales

    compartidos
    Compartir
    Tuit
  • Banco Central analiza resiliencia cambiaria e IED de RD ante el nuevo entorno arancelario

    compartidos
    Compartir
    Tuit
  • Gobierno destaca crecimiento económico de RD alcanza el 4.5% y la inversión pública incrementa un 34%

    compartidos
    Compartir
    Tuit
  • Asociación Cibao es la quinta entidad con mayor cartera de créditos hipotecarios

    compartidos
    Compartir
    Tuit

Periodismo económico y financiero responsable

EDITORIAL CM
Edificio Corporativo MARTÍ
Rafael Augusto Sánchez, esquina Winston Churchill,
Ensanche Piantini, Santo Domingo, RD.

Newsletter

  • Sobre elDinero
  • Hacemos esto…
  • Contacto

© 2015 - 2026 Periódico elDinero - Todos los derechos reservados.

Sin resultados
Ver todos los resultados
  • Finanzas
    • Banca
    • Mercado de Valores
    • Finanzas personales
  • Energía
  • Industria
  • Agricultura
  • Turismo
  • Mercado global
  • Opiniones
  • elDinero Mujer
  • Contacto
  • Versión impresa
  • Newsletter

© 2015 - 2026 Periódico elDinero - Todos los derechos reservados.

VERSIÓN IMPRESA

Hojee y descargue nuestra versión impresa y disfrute del contenido más relevante y mejor trabajado sobre economía y finanzas

Versión impresa #553