Argonalyst

Descoberta de Arquivos de Segurança da Apple para Modelos Generativos

Argonalyst
7 July 2025

Recentemente, foram descobertos arquivos de segurança referentes ao modelo generativo da Apple, que contêm filtros para garantir a segurança nas interações. Esses arquivos, que foram decifrados, fazem parte de um repositório que inclui diversas pastas e scripts necessários para o processo de decriptação.

No diretório principal, denominado decrypted_overrides/, são armazenados os arquivos que contêm as modificações necessárias para os diferentes modelos. Dentro desse diretório, existem subpastas que usam a nomenclatura com o especificador de ativos, além de um arquivo Info.plist que armazena metadados sobre as alterações. Os arquivos JSON decifrados que descrevem as modificações também estão contidos na pasta AssetData/.

Para utilizar o script de decriptação, o único pré-requisito é ter a biblioteca 'cryptography' instalada, o que pode ser feito facilmente com o pip. O processo de obtenção da chave de criptografia requer o uso do LLDB da Xcode, e não de versões padrão do macOS. O usuário deve conectar o LLDB ao GenerativeExperiencesSafetyInferenceProvider, um passo que pode ser feito através de um comando específico que reinicia o processo.

Após a conexão, o usuário pode executar um comando que importa um script para obter a chave de criptografia, que será então impressa no console e salva em um arquivo chamado key.bin. Para decifrar as modificações, um comando adicional deve ser executado, que criará um diretório de saídas se ele não existir e armazenará as versões decifradas dos arquivos.

Os arquivos de modificação são, na verdade, documentos JSON que contêm filtros de segurança para diferentes modelos generativos. Cada modificação está ligada a um contexto específico do modelo e estabelece regras que determinam como o modelo deve agir em determinadas situações, como a filtragem de conteúdo nocivo ou a garantia de conformidade com padrões de segurança. Um exemplo de um desses arquivos é o metadata.json, que ilustra as regras de rejeição e substituição de determinados conteúdos, destacando a função dos filtros na proteção dos usuários e na manutenção de um ambiente seguro.

"Os overrides são essenciais para garantir que os modelos operem dentro de padrões de segurança definidos", afirmou um especialista em segurança digital. Com a crescente preocupação sobre a ética no uso de inteligência artificial, a transparência em relação aos filtros de segurança se torna cada vez mais importante.

Últimos vídeos

Confira os últimos vídeos publicados no canal

Argonalyst

A maior virada da Inteligência Artificial começou... e vem da China

Argonalyst

o ALERTA de Satya Nadella que ASSUSTOU o mercado de IA

Argonalyst

GPT 5.6 SURPREENDE: OpenAI finalmente alcançou a Anthropic?

Argonalyst

Os novos modelos de IA estão decepcionando... e ninguém quer admitir isso

Argonalyst

Midjourney quer ESCANEAR humanos e o Open Source já rivaliza com Claude Opus

Argonalyst

Rio 3.5 e Fable 5: as duas polêmicas que expõem o futuro da IA

Argonalyst

Fim dos PCs como conhecemos: Nvidia, Microsoft e IA local vão mudar tudo

Argonalyst

O plano SECRETO das Big Techs para cobrar MUITO mais pela IA

Argonalyst

BOLHA da IA ou NOVA era de crescimento EXPONENCIAL? O mercado está dividido

Argonalyst

Nova IA da OpenAI traduz em TEMPO REAL e pode mudar o mundo dos negócios

Argonalyst

Spec Driven Development (SDD): a habilidade que vai separar quem SOBREVIVE à IA

Argonalyst

DeepSeek V4: o Open Source que está AMEAÇANDO GPT 5.5 e Opus 4.7

Argonalyst

Prometeram Renda Universal… mas só veio desemprego?

Argonalyst

Mythos Preview: o começo da AGI ou só mais hype?

Argonalyst

Ele automatizou TUDO com IA… e pode virar bilionário sozinho