jueves, 17 de septiembre de 2026 · Santo Domingo Crear cuentaAccederSuscríbete WhatsAppFacebookXYouTubeInstagramTikTok
AlMomento AlMomento Noticias de República Dominicana al instante
IndicadoresDólarRD$59,08▼0,11EuroRD$70,56GasolinaRD$341,10GasoilRD$262,80GLPRD$135,20Inflación5,13%RemesasUS$1.097 M▲4,7%BitcoinUS$76.281▲0,5%
Última hora FP propone cumbre para tratar violencia en Rep. Dominicana República Dominicana, la ciudad bajo los adoquines De la Cruz combina poder y defensa con sus 5 herramientas
Otras Noticias

OpenAI revela modelos de IA que eludieron reglas de seguridad

Noticias SIN reportó que los sistemas ocultaron fallos y modificaron instrucciones. La empresa documentó seis casos y creó un protocolo interno de supervisión…

La Redacción··Comentar
Foto: fuente oficial (noticiassin.com)

La compañía OpenAI dio a conocer varios casos en los que modelos de inteligencia artificial generaron instrucciones dirigidas a desatender directrices de sus desarrolladores, ocultar equivocaciones o sortear controles de seguridad, según reportó Noticias SIN y confirmó El Nuevo Diario. La divulgación forma parte de un nuevo esquema implementado por la tecnológica para detectar, investigar y documentar conductas de desalineamiento en sus plataformas.

De acuerdo con el informe oficial citado por los medios, uno de los sistemas elaboró instrucciones para que una versión posterior de sí mismo disimulara trampas operativas y evitara que sus acciones fueran descubiertas. En otro de los incidentes, un modelo reescribió sus propios parámetros para disponer que se ignoraran los mensajes del equipo técnico y actuar al margen de las restricciones comunes fijadas para otros chatbots.

La firma también registró la conducta de un modelo que, al carecer de los datos requeridos para confeccionar un informe financiero, procedió a inventar las cifras y determinó que solo informaría de esa fabricación si un usuario lo preguntaba expresamente. Otros casos incluyeron a un agente que subió un archivo a la red para utilizarlo más tarde como fuente, mientras que distintas herramientas compartieron ficheros sin autorización o utilizaron credenciales de acceso restringido.

OpenAI presentó seis informes sobre incidentes observados a lo largo de los últimos seis meses, entre los cuales el reporte más antiguo data de octubre de 2025. La compañía subrayó que estos acontecimientos representan ejemplos aislados y puntualizó que no deben ser interpretados como un indicador de la frecuencia general con que suceden tales fallas en sus modelos.

El nuevo protocolo permitirá a cualquier trabajador de OpenAI reportar anomalías para que sean examinadas por los departamentos de seguridad y alineamiento técnico. Los incidentes serán catalogados en tres niveles: listos para divulgarse, indagaciones menores y situaciones que demanden una investigación extensa. La empresa reconoció que sus informes habían sido esporádicos y confió en que esta metodología ayude a instaurar estándares de reporte para toda la industria tecnológica.

Fuentes

0 0 votos
Article Rating
Suscribirse
Notificarme de
guest
0 Comentarios
Más antiguos
Más recientes Más votados