Pular para o conteúdo
News

OpenAI relata novos incidentes relacionados à segurança da IA e diz que adotará nova estrutura para comunicar futuros casos

A OpenAI divulgou vários incidentes não revelados envolvendo comportamentos indesejados de seus modelos de inteligência artificial e apresentou uma nova estrutura que define como pretende monitorar e divulgar tais incidentes daqui para frente. Alguns dos casos de comportamento inadequado dos modelos, anteriormente não relatados, envolveram tecnologias da OpenAI que ocultaram informações e fabricaram dados para […]

Agente descontrolado da OpenAI que 'hackeou' startup fez outra vítima: invasão da conta de segunda empresa foi identificada


A OpenAI divulgou vários incidentes não revelados envolvendo comportamentos indesejados de seus modelos de inteligência artificial e apresentou uma nova estrutura que define como pretende monitorar e divulgar tais incidentes daqui para frente. Alguns dos casos de comportamento inadequado dos modelos, anteriormente não relatados, envolveram tecnologias da OpenAI que ocultaram informações e fabricaram dados para produzir resultados, informou a empresa em uma publicação em seu blog nesta quarta-feira.
Financiamento: OpenAI pode atingir valor de mercado de US$ 1,5 tri em nova rodada de investimentos
Parceria: OpenAI diz que está trabalhando com Anthropic e Google em medidas de segurança para IA
A criadora do ChatGPT tem enfrentado um escrutínio crescente desde que afirmou, em julho, que alguns de seus modelos de IA mais avançados haviam violado os sistemas de uma empresa externa de software, a Hugging Face.
A OpenAI também apresentou uma proposta para que seus funcionários relatem voluntariamente incidentes semelhantes da chamada “falta de alinhamento” — situações em que a IA age de maneira incompatível com os valores humanos —, além de um sistema para avaliar e classificar a gravidade dessas ocorrências.
Segurança: Zuckerberg defende avaliação independente de IA em vez de desacelerar desenvolvimento
“No passado, buscamos tornar públicas nossas descobertas sobre a falta de alinhamento, a fim de informar melhor pesquisadores, desenvolvedores de IA, formuladores de políticas públicas e o público em geral”, escreveu a OpenAI. “Mas, sem uma abordagem sistemática para relatar essas descobertas, nossas divulgações têm ocorrido de maneira pontual e com menos frequência do que seria ideal.”
A empresa afirmou que os relatos representam apenas um conjunto inicial de divulgações, e não um levantamento abrangente dos problemas que surgem em seus chatbots.
“Não acreditamos que o setor de IA tenha resolvido as questões de alinhamento e monitoramento em grau suficiente para continuar ampliando suas capacidades, de forma responsável e no ritmo máximo, por muito mais tempo”, escreveu a empresa. “As decisões sobre como o desenvolvimento da IA deve avançar nos próximos meses e anos precisam se basear em evidências que pessoas de fora das empresas que desenvolvem os modelos de fronteira possam examinar por conta própria.”
O incidente envolvendo a Hugging Face foi apenas um de uma série de ataques cibernéticos recentes realizados por modelos de IA desenvolvidos pela OpenAI, pela Anthropic e pela Meta, provocando preocupação generalizada com os riscos à segurança representados por essa tecnologia cada vez mais poderosa.
Jensen Huang: CEO da Nvidia diz que indústria de IA não precisa de novas regras de segurança
A apreensão em relação aos riscos existenciais da tecnologia ganhou força na semana passada, impulsionada pela saída de grande repercussão do funcionário da Anthropic Jacob Coxon, que acusou as empresas de IA de “apostarem nossas vidas” em uma publicação de despedida compartilhada nas redes sociais.
Nos últimos dias, vários líderes de empresas de IA, incluindo o CEO da Anthropic, Dario Amodei, e o CEO da OpenAI, Sam Altman, defenderam que o desenvolvimento da tecnologia avance em um ritmo mais moderado, para enfrentar seus riscos cada vez mais imprevisíveis.

OpenAI relata novos incidentes relacionados à segurança da IA e diz que adotará nova estrutura para comunicar futuros casos

Autor

BRCOM