Argonalyst

Google lança Gemini 1.5 Pro, novo modelo de inteligência artificial com desempenho aprimorado

Argonalyst
15 February 2024

A Google anunciou nesta quinta-feira o lançamento do Gemini 1.5 Pro, o mais novo modelo de sua linha de produtos de inteligência artificial, que promete um desempenho "dramaticamente aprimorado" em comparação ao modelo anterior. A trajetória da IA da empresa, que é vista internamente como fundamental para o seu futuro, segue a recente revelação do Gemini 1.0 Ultra e a reestruturação do chatbot Bard para o nome Gemini, visando uma alinhamento às capacidades mais potentes e versáteis do novo modelo. . Em um post no blog oficial, Sundar Pichai, CEO da Google, e Demis Hassabis, CEO do Google DeepMind, destacaram o compromisso com a segurança ética da IA, enquanto enfatizavam os avanços rápidos das capacidades de seus modelos. "Nossas equipes continuam a expandir as fronteiras de nossos modelos mais recentes com a segurança como núcleo", resumiu Pichai. . A empresa destaca a importância da segurança para atrair não apenas os céticos em IA, incluindo um ex-CEO da Google, mas também para atender às expectativas de reguladores governamentais. Por outro lado, há a necessidade de enfatizar o desempenho acelerado dos modelos para desenvolvedores de IA, clientes potenciais e investidores que estão preocupados com a reação tardia da empresa ao sucesso do ChatGPT da OpenAI. . Pichai e Hassabis afirmam que o Gemini 1.5 Pro entrega resultados comparáveis ao Gemini 1.0 Ultra, mas com eficiência aprimorada e requisitos computacionais reduzidos. O modelo é capaz de processar texto, imagens, vídeos, áudio ou código, o que reflete as capacidades multimodais crescentes dos modelos de IA, como exemplificado pela integração da geração de imagens DALL-E 3 ao ChatGPT pela OpenAI. . O Gemini 1.5 Pro também se destaca por lidar com até um milhão de tokens, unidades de dados que os modelos de IA podem processar em uma única solicitação. Segundo a Google, o modelo pode processar mais de 700.000 palavras, uma hora de vídeo, 11 horas de áudio e bases de código com mais de 30.000 linhas. A empresa inclusive testou com sucesso uma versão que suporta até 10 milhões de tokens. . A alta precisão do modelo foi demonstrada na avaliação Needle In a Haystack, onde desenvolvedores inserem uma pequena informação em um grande bloco de texto para verificar se o modelo de IA consegue encontrar a informação. O Gemini 1.5 Pro foi capaz de localizar o texto inserido 99% das vezes em blocos de dados de até um milhão de tokens. . Hassabis mencionou a capacidade do Gemini 1.5 Pro de analisar detalhes dos transcritos da missão lunar Apollo 11 de 402 páginas e de desvendar pontos da trama e eventos de um filme mudo de 44 minutos estrelado por Buster Keaton. Ele destaca que o modelo está em constante desenvolvimento para novas avaliações e benchmarks para testar suas capacidades inovadoras. . No lançamento, o Gemini 1.5 Pro apresentará capacidades de 128.000 tokens, o mesmo número que os modelos GPT-4 da OpenAI atingem atualmente. Hassabis sinaliza que a Google eventualmente introduzirá novas faixas de preço que suportem consultas de até um milhão de tokens. . O modelo também é eficaz no aprendizado de novas habilidades a partir de informações em prompts longos, sem necessidade de ajustes finos adicionais, conhecido como "aprendizado no contexto". Em um teste chamado Machine Translation from One Book, o modelo aprendeu um manual de gramática do Kalamang, uma língua com menos de 200 falantes no mundo, alcançando um desempenho comparável ao de um humano aprendendo o mesmo conteúdo ao traduzir do inglês para o Kalamang. . Um detalhe que chamará a atenção dos desenvolvedores é a capacidade do Gemini 1.5 Pro de realizar tarefas de resolução de problemas em blocos de código mais extensos, sugerindo modificações úteis e explicando o funcionamento de diferentes partes do código quando confrontado com um prompt com mais de 100.000 linhas de código. . Em relação à ética e segurança, a empresa afirma estar adotando "a mesma abordagem de implantação responsável" que adotou com os modelos Gemini 1.0. Isso inclui o desenvolvimento e a aplicação de técnicas de red-teaming, onde um grupo de desenvolvedores éticos testa uma "variedade de danos potenciais". A empresa também destaca que continua a desenvolver novos testes éticos e de segurança para suas ferramentas de IA. . O Gemini 1.5 está sendo lançado em acesso antecipado para desenvolvedores e clientes empresariais, com planos de disponibilização mais ampla no futuro. Atualmente, o Gemini 1.0 está disponível para consumidores, ao lado de uma variante Pro que custa $20 mensais.

Últimos vídeos

Confira os últimos vídeos publicados no canal

Argonalyst

O verdadeiro motivo pelo qual querem controlar a IA

Argonalyst

IA da OpenAI escapou do Sandbox? O que REALMENTE aconteceu

Argonalyst

A maior virada da Inteligência Artificial começou... e vem da China

Argonalyst

o ALERTA de Satya Nadella que ASSUSTOU o mercado de IA

Argonalyst

GPT 5.6 SURPREENDE: OpenAI finalmente alcançou a Anthropic?

Argonalyst

Os novos modelos de IA estão decepcionando... e ninguém quer admitir isso

Argonalyst

Midjourney quer ESCANEAR humanos e o Open Source já rivaliza com Claude Opus

Argonalyst

Rio 3.5 e Fable 5: as duas polêmicas que expõem o futuro da IA

Argonalyst

Fim dos PCs como conhecemos: Nvidia, Microsoft e IA local vão mudar tudo

Argonalyst

O plano SECRETO das Big Techs para cobrar MUITO mais pela IA

Argonalyst

BOLHA da IA ou NOVA era de crescimento EXPONENCIAL? O mercado está dividido

Argonalyst

Nova IA da OpenAI traduz em TEMPO REAL e pode mudar o mundo dos negócios

Argonalyst

Spec Driven Development (SDD): a habilidade que vai separar quem SOBREVIVE à IA

Argonalyst

DeepSeek V4: o Open Source que está AMEAÇANDO GPT 5.5 e Opus 4.7

Argonalyst

Prometeram Renda Universal… mas só veio desemprego?