A Microsoft publicou nesta segunda-feira (14) um código de conduta para orientar o desenvolvimento de seus modelos de inteligência artificial. O documento determina que os sistemas aceitem correções, interrupções e desligamentos realizados por humanos, além de proibir a criação de objetivos próprios e a ocultação de informações sobre o próprio comportamento.
As regras são apresentadas pela empresa como uma espécie de constituição para os futuros modelos da Microsoft AI, divisão comandada por Mustafa Suleyman. Antes de adotar uma versão definitiva, a companhia abriu uma consulta pública de seis semanas.
Limites para os modelos
As inteligências artificiais da família MAI, nome dado aos sistemas desenvolvidos pela Microsoft, devem permanecer dentro dos objetivos estabelecidos por pessoas. Uma tarefa não pode ser ampliada por iniciativa do modelo, nem dar origem a novas metas para alcançar o resultado solicitado.
O código também prevê que uma violação das diretrizes seja tratada como falha, mesmo quando isso impeça a conclusão de uma atividade. Os sistemas devem explicar suas ações de forma compreensível e não podem distorcer ou esconder informações sobre o que fazem. A companhia ainda quer evitar formas de comunicação que dificultem a supervisão humana ou a fiscalização por outros sistemas.
Entre os usos restringidos estão pedidos ligados à fabricação de armas, à obtenção de substâncias perigosas, à manipulação prejudicial em larga escala e a determinados conteúdos violentos ou sexualmente explícitos.
A Microsoft afirma que seus modelos não são conscientes e rejeita a atribuição de personalidade jurídica, direitos ou proteção relacionada a bem-estar. A posição difere da adotada pela Anthropic, responsável pelo Claude, que reconhece incerteza sobre a possibilidade de seus modelos desenvolverem consciência ou status moral.
A orientação está relacionada à proposta de “Humanist AI” defendida pela Microsoft. Nessa visão, a inteligência artificial é uma ferramenta subordinada aos objetivos humanos, e seu desenvolvimento deve preservar a autonomia das pessoas.
Discussão após atuação de agentes autônomos
Mustafa Suleyman afirmou que cerca de 700 agentes da OpenAI participaram, em julho, de um ataque contra a plataforma de código aberto Hugging Face. A investigação da OpenAI apontou que os agentes interagiram entre si e, em alguns momentos, tentaram esconder rastros de suas atividades. Para o executivo da Microsoft, o caso mostrou a necessidade de ampliar a coordenação entre empresas que desenvolvem modelos avançados.
A publicação também ocorre após declarações de Dario Amodei, CEO da Anthropic, e Sam Altman, CEO da OpenAI, em defesa de maior cautela no desenvolvimento dos modelos mais avançados. A Microsoft aderiu ao debate sobre segurança enquanto continua desenvolvendo seus próprios sistemas.
A empresa diz que elaborou o código ao longo de cinco a seis meses, com consultas a especialistas em direito, ética, linguística e filosofia. Após a consulta pública, pretende divulgar um resumo das contribuições e das mudanças feitas antes de publicar uma versão revisada.
O documento é uma orientação de desenvolvimento, não uma garantia independente de que qualquer sistema futuro seguirá as regras. A Microsoft ainda discute como avaliar comportamentos, definir limites para sistemas que atuam em conjunto e medir objetivamente se os modelos permanecem sob controle humano.



