Estamos muito entusiasmados com a reação ao Veo 3, o nosso modelo de última geração para a criação de vídeo com produção de áudio nativa.
A partir de hoje, começámos a disponibilizá-lo a Portugal, e estará acessível através da aplicação do Gemini para os subscritores do Google AI Pro.
É importante que as pessoas tenham acesso a ferramentas de proveniência para conteúdo online por isso irá ver uma marca de água em todos os vídeos gerados através do Veo 3 na aplicação Gemini. Estamos também a incluir a nossa marca de água SynthID em todos os conteúdos gerados com os modelos da Google de Inteligência Artificial Generativa. O nosso Detetor SynthID foi recentemente disponibilizado a um grupo inicial de testadores, e planeamos, em breve, expandir o acesso.
Experimente hoje o Veo 3 na aplicação Gemini e vejo até onde a sua criatividade o pode levar.
O Gemini já o pode ajudar a ter ideias, a fazer pesquisas profundas e a gerar conteúdo para qualquer projeto em que esteja a trabalhar. E a partir de hoje, o Gemini pode oferecer ainda mais ajuda, seja para editar um documento consigo em tempo real ou a pegar na sua ideia e programar um protótipo real.
Colaborar com o Canvas
O Canvas é um novo espaço interativo dentro do Gemini concebido para facilitar a criação, o refinamento e a partilha do seu trabalho. Basta selecionar ‘Canvas’ na barra de comando e poderá escrever e editar documentos ou códigos, com as alterações a surgirem em tempo real.
Crie facilmente os primeiros rascunhos de alta qualidade e, em seguida, aperfeiçoe rapidamente o seu trabalho utilizando o feedback do Gemini para sugerir edições. Precisa de atualizar secções específicas ou rascunhos inteiros? Ajuste facilmente o tom, a duração ou a formatação com as ferramentas de edição rápida. Por exemplo, destaque um parágrafo e peça ao Gemini para o tornar mais conciso, profissional ou informal. Quer esteja a escrever um discurso, a precisar de ajuda para rever um texto, um blog post ou um relatório, o Canvas pode ajudá-lo a maximizar a sua produção criativa.
O Canvas foi concebido para uma colaboração perfeita com o Gemini. Se quiser colaborar com outras pessoas no conteúdo que acabou de criar, pode exportá-lo para o Google Docs com um clique.
Programe com confiança no Canvas
O Gemini já simplifica as tarefas de programação e desenvolvimento de software, incluindo a geração de código, a depuração e a explicação de código. Agora, o Canvas simplifica o processo de transformação das suas ideias de programação em protótipos funcionais para aplicações web, scripts Python, jogos, simulações e outras aplicações interativas. O Canvas capacita os programadores para criar rapidamente versões iniciais de trabalho dos seus projetos e oferece um espaço para os alunos aprenderem rapidamente conceitos de programação. Durante todo o processo, o Gemini colabora consigo para fazer edições iterativas no seu código.
No Canvas, pode gerar e visualizar o seu código HTML/React e outros protótipos de aplicações web para ver uma representação visual do seu design. Por exemplo, digamos que pretende criar um formulário de assinatura de e-mail para o seu website. Pode pedir ao Gemini para gerar o HTML para o formulário e depois visualizar como ele irá aparecer e funcionar na sua aplicação web. Solicite facilmente alterações nos campos de entrada ou adicione botões de chamada para ação, veja instantaneamente a pré-visualização atualizada e partilhe as suas criações com outras pessoas.
O Canvas simplifica todo o processo de programação, permitindo-lhe concentrar-se em criar, editar e partilhar o seu código e design num só lugar, sem a complicação de ter de alternar entre várias aplicações.
O Canvas está, hoje, a ser disponibilizado globalmente para os subscritores Gemini e Gemini Advanced em todos os idiomas em que o Gemini Apps está disponível. Experimente estas funcionalidades selecionando Canvas na barra de comandos e comece a criar. Saiba mais no nosso site.
Ouça os seus ficheiros ganharem vida com o Audio Overview
Temos assistido a um entusiasmo incrível em torno do Audio Overview no NotebookLM, que ajuda as pessoas a compreender informações complexas. Hoje, estamos a disponibilizar o Audio Overview no Gemini.
O Audio Overview transforma os seus documentos, diapositivos e até mesmo relatórios de pesquisa profunda em discussões áudio envolventes num estilo podcast. O Gemini vai criar uma discussão num estilo podcast entre dois anfitriões de IA que, com apenas um clique, vão iniciar uma conversa animada e aprofundada com base nos ficheiros enviados. Irão resumir o material, estabelecer ligações entre os tópicos, envolver-se num diálogo dinâmico e fornecer perspectivas únicas.
O Audio Overview melhora a aprendizagem de uma forma agradável e produtiva. Imagine carregar os resumos das aulas, artigos de investigação, as longas conversas por e-mail ou relatórios gerados pelo Deep Research e receber um Audio Overview para ajudar a resumir os seus ficheiros enquanto está em deslocações!
O Audio Overview está a começar a ser disponibilizado hoje para os subscritores do Gemini e Gemini Advanced em todo o mundo em inglês, com mais idiomas disponíveis em breve. Para criar um Audio Overview, basta carregar documentos ou diapositivos sobre diversos tópicos e clicar no ícone de sugestão que aparece por cima da barra de comandos. Pode ouvir estas discussões geradas pela IA para obter novos insights e manter-se informado, mesmo enquanto realiza várias tarefas ao mesmo tempo. O Audio Overview pode ser acedido na web e na aplicação móvel Gemini, e pode facilmente partilhá-los ou descarregá-los para ouvir em qualquer lugar.
Com estas novas funcionalidades, o Gemini está a tornar-se um colaborador ainda mais eficaz, ajudando-o a dar vida às suas ideias. Experimente estas funcionalidades e muito mais em gemini.google.com.
Hoje estamos a partilhar as últimas atualizações no Gemini, o seu assistente de IA, incluindo o Deep Research - as nossas novas funcionalidades de agente no Gemini Advanced - e acesso para experimentar o Gemini 2.0 Flash, o nosso modelo experimental mais recente.
O Deep Research usa a IA para explorar tópicos complexos por si e apresentar-lhe os resultados num relatório abrangente e fácil de ler. É um primeiro vislumbre de como o Gemini está a ficar ainda melhor na resolução de tarefas complexas para lhe poupar tempo[1].
Deep Research: o seu assistente pessoal de investigação de IA está aqui para ajudar
A investigação online nem sempre é fácil. Imagine que é um estudante universitário a preparar-se para a sua próxima apresentação de robótica. Quer ficar a par das tendências de sensores de veículos autónomos e compreender como as diferentes tecnologias se comparam, juntamente com o que ainda está para vir. Um projeto como este pode envolver horas de investigação e comparação numa infinidade de separadores abertos, isto é, se conseguir encontrar aquele link que sabe que colocou algures…
Sob a sua supervisão, o Deep Research faz o trabalho árduo por si. Após introduzir a sua pergunta, é criado um plano de investigação de vários passos que pode rever ou aprovar. Depois de o aprovar, começa a analisar detalhadamente informações relevantes de toda a Web por si.
No espaço de alguns minutos, o Gemini refina continuamente a respetiva análise, navegando na Web de forma semelhante à sua: pesquisando, encontrando informações interessantes e iniciando uma nova pesquisa com base no que aprendeu. Repete este processo várias vezes e, uma vez concluído, gera um relatório abrangente das principais conclusões, que pode exportar para um documento do Google Docs. Está organizado de forma clara com links para as fontes originais, permitindo-lhe aceder a websites e empresas ou organizações relevantes que, de outra forma, não teria encontrado, para que se possa aprofundar facilmente para saber mais. Se tiver perguntas de seguimento para o Gemini ou quiser refinar o relatório, basta pedir! Em poucos minutos, tem acesso a horas de investigação.
No início deste ano, partilhámos a nossa visão de criar mais capacidades agentivas nos nossos produtos; o Deep Research é a primeira funcionalidade no Gemini a dar vida a essa visão. Criámos um novo sistema agentivo que usa os conhecimentos da Google no domínio da pesquisa de informações relevantes na web para orientar a navegação e a investigação do Gemini. Isto, aliado às capacidades de raciocínio avançadas do Gemini e à nossa capacidade de resposta de 1 milhão tokens, cria relatórios abrangentes com estatísticas úteis e fáceis de ler.
O Deep Research é a ferramenta perfeita se for um empresário a iniciar um pequeno negócio e quiser reunir rapidamente uma análise da concorrência e recomendações de localizações adequadas, ou se for um profissional de marketing a pesquisar campanhas de marketing recentes com tecnologia de IA como benchmark para o planeamento de 2025.
Deep Research está a começar a ser implementado globalmente hoje no Gemini Advanced (a começar com o inglês) para desktop e mobile web e vai estar disponível na aplicação Gemini a partir do início de 2025. Para experimentar, ative a opção “Gemini 1.5 Pro com Deep Research” no menu pendente do modelo e introduza a sua pergunta de investigação.
Gemini Flash 2.0: teste o nosso modelo experimental
Hoje anunciámos o Gemini 2.0, o nosso modelo de IA mais capaz até o momento. A partir de hoje, todos os utilizadores do Gemini podem experimentar uma versão chat otimizada do Gemini 2.0 Flash Experimental com um desempenho melhorado em vários benchmarks chave e velocidade. Com este novo modelo, o Gemini 2.0 irá potenciar um assistente Gemini ainda mais útil. O Gemini 2.0 Flash Experimental pode ser acedido no menu pendente do modelo Gemini no desktop e web mobile e estará, em breve, disponível na aplicação Gemini para telemóveis.
Embora estejamos entusiasmados para que o experimente, lembre-se de que é uma pré-visualização e pode não funcionar como esperado. Além disso, algumas funcionalidades do Gemini não serão compatíveis com este modelo no seu estado experimental.
Uma nova era de IA útil
Estes lançamentos são um passo significativo em direção ao nosso objetivo de criar o assistente pessoal de IA mais útil do mundo. Eles representam um passo no sentido de tornar os nossos produtos mais agentivos; à medida que o Gemini se torna cada vez melhor, pode fazer ainda mais por si.
Publicado por Dave Citron, Senior Director, Product Management, Gemini app
Notas:
[1] Com base no tempo estimado para ler a quantidade de conteúdo que o Deep Research navega versus o tempo que demora a gerar um relatório do Deep Research, em média.
Uma nota do CEO da Google e da Alphabet, Sundar Pichai:
A informação está no centro do progresso humano. É por isso que nos concentramos há mais de 26 anos na nossa missão de organizar as informações do mundo e torná-las acessíveis e úteis. E é por isso que continuamos a expandir as fronteiras da IA para organizar estas informações em todas as entradas e torná-las acessíveis através de qualquer saída, para que possam ser realmente úteis para si.
Esta era a nossa visão quando lançámos o Gemini 1.0 no passado mês de dezembro. O primeiro modelo criado para ser nativamente multimodal, o Gemini 1.0 e 1.5, impulsionou grandes avanços com multimodalidade e contexto longo para entender informações em texto, vídeo, imagens, áudio e código, e processar muito mais delas.
Agora, milhões de programadores estão a construir com Gemini. E está a ajudar-nos a reinventar todos os nossos produtos — incluindo todos os 7 com 2 mil milhões de utilizadores — e a criar novos. O NotebookLM é um ótimo exemplo do que a multimodalidade e o contexto longo podem possibilitar às pessoas, e é por isso que é adorado por tantos.
No último ano, investimos no desenvolvimento de modelos mais agentivos, o que significa que eles podem entender mais sobre o mundo ao seu redor, pensar vários passos à frente e agir em seu nome, com a sua supervisão.
Hoje estamos entusiasmados por lançar a nossa próxima era de modelos criados para esta nova era de agentes: apresentamos o Gemini 2.0, o nosso modelo mais capaz até agora. Com novos avanços na multimodalidade — como saída de imagem e áudio nativa – e uso de ferramentas nativas, tal irá permitir construir novos agentes de IA que nos vai aproximar da nossa visão de um assistente universal.
Estamos, hoje, a colocar a versão 2.0 nas mãos de programadores e grupos de testes de confiança. E estamos a trabalhar rapidamente para incluí-lo nos nossos produtos, a começar pelo Gemini e Pesquisa. A partir de hoje, o nosso modelo experimental Gemini 2.0 Flash estará disponível a todos os utilizadores do Gemini. Também estamos a lançar um novo recurso chamado Deep Research, que usa raciocínio avançado e recursos de contexto longo para atuar como um assistente de investigação, com a exploração de tópicos complexos e a compilação de relatórios para si. Já está disponível no Gemini Advanced.
Nenhum produto foi mais transformado pela IA do que a Pesquisa. As nossas vistas gerais de IA (IA Overviews) chegam agora a mil milhões de pessoas e permitem que façam tipos de perguntas totalmente novas, tornando-se rapidamente num dos nossos recursos de pesquisa mais populares de todos os tempos. Como próximo passo, estamos a trazer os recursos avançados de raciocínio do Gemini 2.0 para o AI Overviews para responder a tópicos mais complexos e a questões de várias etapas, incluindo equações matemáticas avançadas, consultas multimodais e programação. Começámos os testes limitados esta semana e iremos lançá-los de forma mais ampla no início do ano que vem. E vamos continuar a levar o AI Overview a mais países e idiomas ao longo do próximo ano.
Os avanços 2.0 são sustentados por investimentos de uma década na nossa abordagem diferenciada de full-stack para inovação em IA. Ele baseia-se em hardware personalizado como o Trillium, as nossas TPUs de sexta geração. As TPUs impulsionaram 100% do treino e da inferência do Gemini 2.0, e hoje o Trillium está disponível para os clientes para que também possam desenvolver com ele.
Se o Gemini 1.0 era sobre organizar e compreender informações, o Gemini 2.0 é sobre torná-las muito mais úteis. Mal posso esperar para ver o que esta próxima era nos vai trazer.
-Sundar
No ano passado, continuamos a fazer um progresso incrível na inteligência artificial. Hoje, estamos a disponibilizar o primeiro modelo da família de modelos Gemini 2.0: uma versão experimental do Gemini 2.0 Flash. É o nosso modelo de trabalho com baixa latência e desempenho melhorado na vanguarda da nossa tecnologia, em escala.
Também estamos a partilhar as fronteiras da nossa investigação de agentes ao apresentar protótipos habilitados pelos recursos multimodais nativos do Gemini 2.0.
Gemini 2.0 Flash
O Gemini 2.0 Flash baseia-se no sucesso do 1.5 Flash, o nosso modelo mais popular até agora para programadores, com desempenho melhorado e tempos de resposta igualmente rápidos. Notavelmente, o 2.0 Flash supera até mesmo o 1.5 Pro em benchmarks importantes, com o dobro da velocidade. O 2.0 Flash também vem com novos recursos. Além de oferecer suporte a entradas multimodais, como imagens, vídeo e áudio, o Flash 2.0 agora oferece suporte a saídas multimodais, como imagens geradas nativamente misturadas com texto e áudio multilíngue de texto para fala (TTS) direcionável. Ele também pode chamar nativamente ferramentas como a Pesquisa Google, execução de código e funções definidas por um utilizador terceiro.
O nosso objetivo é colocar os nossos modelos nas mãos das pessoas com segurança e rapidez. No mês passado, partilhámos versões iniciais e experimentais do Gemini 2.0, e recebemos ótimos comentários dos programadores.
O Gemini 2.0 Flash já está disponível como um modelo experimental para programadores através da API Gemini no Google AI Studio e Vertex AI, com entrada multimodal, saída de texto e conversão de texto em fala e geração de imagens nativas disponíveis para parceiros com acesso antecipado. A disponibilidade geral será em janeiro, juntamente com mais tamanhos do modelo.
Para ajudar os programadores a criar aplicações dinâmicas e interativas, também estamos a lançar uma nova API Multimodal Live que tem entrada de áudio e streaming de vídeo em tempo real e a capacidade de usar várias ferramentas combinadas. Mais informações sobre o Flash 2.0 e a Multimodal Live API podem ser encontradas no nosso blog para programadores.
Gemini 2.0 disponível na aplicação Gemini, o nosso assistente de IA
Também a partir de hoje, os utilizadores do Gemini em todo o mundo podem aceder a uma versão otimizada para chat do Flash Experimental 2.0 selecionando-a no menu suspenso de modelos nas versões desktop e web mobile, e ela estará disponível em breve na aplicação móvel Gemini. Com este novo modelo, os utilizadores podem experimentar um assistente Gemini ainda mais útil.
No início do ano que vem, expandiremos o Gemini 2.0 para mais produtos da Google.
Desbloquear experiências de agente com Gemini 2.0
Os recursos de ação da interface de utilizador nativa do Gemini 2.0 Flash, juntamente com outras melhorias, como raciocínio multimodal, compreensão de contexto longo, acompanhamento e planeamento de instruções complexas, chamada de função composicional, uso de ferramentas nativas e latência melhorada, trabalham em conjunto para permitir uma nova classe de experiências de agente.
A aplicação prática de agentes de IA é uma área de investigação cheia de possibilidades interessantes. Estamos a explorar esta nova fronteira com uma série de protótipos que podem ajudar as pessoas a realizar tarefas e fazer as coisas acontecerem. Isto inclui uma atualização do Projeto Astra, nosso protótipo de investigação que explora as capacidades futuras de um assistente de IA universal; o novo Projeto Mariner, que explora o futuro da interação entre humanos e agentes, a começar com o seu navegador de internet; e o Jules, um agente de código com tecnologia de IA que pode ajudar os programadores.
Ainda estamos nos estágios iniciais de desenvolvimento, mas estamos animados para ver como grupos de testes confiáveis usarão estes novos recursos e quais lições podemos aprender para que possamos torná-los mais amplamente disponíveis em produtos no futuro.
Projeto Astra: agentes a usar compreensão multimodal no mundo real
Desde que apresentámos o Projeto Astra no I/O, temos aprendido com grupos de testes confiáveis que o utilizam em telefones Android. O feedback valioso deles ajudou-nos a entender melhor como um assistente de IA universal poderia funcionar na prática, incluindo implicações para segurança e ética. As melhorias na versão mais recente criada com o Gemini 2.0 incluem:
Estamos a trabalhar para levar estes tipos de recursos aos produtos da Google, como a aplicação Gemini, o nosso assistente de IA e a outros formatos, como óculos. E estamos a começar a expandir o nosso programa de testes confiáveis a mais pessoas, incluindo um pequeno grupo que, em breve, irá começar a testar o Projeto Astra em protótipos de óculos.
Projeto Mariner: agentes que podem ajudá-lo a realizar tarefas complexas
O Projeto Mariner é um protótipo de investigação inicial criado com o Gemini 2.0 que explora o futuro da interação entre humanos e agentes, a começar pelo seu navegador de internet. Como um protótipo de investigação, ele é capaz de entender e raciocinar sobre informações no ecrã do seu navegador, incluindo pixels e elementos da web, como texto, código, imagens e formulários, e que usa depois essas informações através de uma extensão experimental do Chrome para concluir tarefas para si.
Quando avaliado no benchmark WebVoyager, que testa o desempenho do agente em tarefas web reais de ponta a ponta, o Projeto Mariner alcançou um resultado de última geração de 83,5% a trabalhar como uma configuração de agente único.
Ainda é cedo, mas o Projeto Mariner mostra que está a tornar-se tecnicamente possível navegar num navegador, embora nem sempre seja preciso e é lento a concluir tarefas hoje em dia, isso irá melhorar rapidamente com o tempo.
Para construir isto com segurança e responsabilidade, estamos a realizar investigações ativas sobre novos tipos de riscos e mitigações, ao mesmo tempo que mantemos os humanos no processo. Por exemplo, o Project Mariner só pode digitar, rolar ou clicar no separador ativo do seu navegador e pede aos utilizadores uma confirmação final antes de realizar certas ações confidenciais, como comprar algo.
Grupos de teste confiáveis estão a começar, agora, a testar o Projeto Mariner com uma extensão experimental do Chrome, e estamos a iniciar, em paralelo, conversas com o ecossistema da web.
Jules: agentes para programadores
Depois, estamos a explorar como os agentes de IA podem ajudar os programadores com o Jules — um agente de código experimental com tecnologia de IA que se integra diretamente num fluxo de trabalho do GitHub. Ele pode resolver um problema, desenvolver um plano e executá-lo, tudo sob a direção e supervisão de um programador. Este esforço faz parte do nosso objetivo de longo prazo de criar agentes de IA que sejam úteis em todos os domínios, incluindo programação.
Mais informações sobre esta experiência em curso podem ser encontradas no nosso post publicado no blog para programadores.
Agentes em jogos e outros domínios
Estamos a colaborar com programadores de jogos líderes, como a Supercell, para explorar como estes agentes funcionam, a testar a sua capacidade de interpretar regras e desafios numa ampla gama de jogos, desde títulos de estratégia como "Clash of Clans" até simuladores como "Hay Day".
Além de atuarem como companheiros virtuais de jogos, estes agentes podem até mesmo aceder à Pesquisa Google para ligá-lo ao vasto conhecimento sobre jogos na web.
Além de explorar capacidades de agentes no mundo virtual, estamos a experimentar agentes que podem ajudar no mundo físico com a aplicação de recursos de raciocínio espacial do Gemini 2.0 à robótica. Embora ainda seja cedo, estamos animados com o potencial dos agentes que podem ajudar no ambiente físico.
Pode saber mais sobre estes protótipos de pesquisa e experências em labs.google.
Construir de forma responsável na era dos agentes
O Gemini 2.0 Flash e nossos protótipos de investigação permitem- nos testar e interagir com novos recursos na vanguarda da pesquisa de IA que eventualmente tornarão os produtos da Google mais úteis.
À medida que desenvolvemos estas novas tecnologias, reconhecemos a responsabilidade que elas acarretam e as muitas questões que os agentes de IA levantam sobre segurança e proteção. É por isso que estamos a adotar uma abordagem exploratória e gradual para o desenvolvimento, a realizar investigações em vários protótipos, com implementação repetida de treino de segurança, a trabalhar com grupos de teste de confiança e especialistas externos e a realizar avaliações de risco abrangentes, além de avaliações de segurança e garantia.
Por exemplo:
Acreditamos firmemente que a única maneira de desenvolver IA é ser responsável desde o início e continuaremos a priorizar tornar a segurança e a responsabilidade num elemento-chave do nosso processo de desenvolvimento de modelos à medida que avançamos os nossos modelos e agentes.
Gemini 2.0, agentes de IA e muito mais
Os lançamentos de hoje marcam um novo capítulo para o nosso modelo Gemini. Com o lançamento do Gemini 2.0 Flash e a série de protótipos de investigação para explorar as possibilidades de agentes, alcançámos um marco emocionante na era Gemini. E estamos ansiosos para continuar a explorar com segurança todas as novas possibilidades ao nosso alcance enquanto construímos em direção à AGI.
Publicado por Por Demis Hassabis, CEO do Google DeepMind e Koray Kavukcuoglu, CTO do Google DeepMind em nome da equipe Gemini
Hoje estamos a lançar uma aplicação Gemini dedicada para iPhone[1], disponível para download na App Store em todo o mundo. A partir de agora, poderá ter acesso fácil ao assistente pessoal de IA da Google, diretamente no seu iPhone e sem custos adicionais.
Experimente a nova app Gemini no seu iPhone
Os utilizadores de iPhone podem agora experimentar o Gemini de uma forma totalmente nova com a nossa aplicação móvel dedicada. Para além de utilizar o Gemini através da aplicação Google no iOS ou de um web browser, os utilizadores do iPhone podem desfrutar de uma experiência Gemini mais simplificada, com acesso fácil a funcionalidades que ajudam a melhorar a aprendizagem, a criatividade e a produtividade. Eis alguns exemplos do que pode fazer na aplicação Gemini para iPhone:
Descarregue o Gemini, o seu novo assistente pessoal de IA
O Gemini pode ajudá-lo a escrever o e-mail ou o texto perfeito, a criar imagens impressionantes e a debater novas ideias divertidas. Agora disponível para Android e iOS, a aplicação Gemini coloca o poder de um verdadeiro assistente pessoal com IA, directamente, no seu bolso. Pode experimentar a app Gemini no seu smartphone Android e descarregar a app, a partir de hoje, na App Store.
Publicado por Brian Marquardt, Senior Director of Product Management, Gemini Experiences
[1] É necessário um sistema operativo compatível. Funciona com contas compatíveis. A disponibilidade pode variar de acordo com o dispositivo, país e idioma.
[2] Ligação à internet necessária. Compatível com determinadas funcionalidades e com determinadas contas. A disponibilidade pode variar de acordo com o dispositivo, país e idioma.
[3] Resultados para fins ilustrativos e podem variar. Verifique a precisão das respostas. É necessária ligação à Internet e sistema operativo compatível. Funciona com contas compatíveis. A disponibilidade pode variar de acordo com o dispositivo, país e idioma.
[4] Resultados para fins ilustrativos e podem variar. É necessária ligação à Internet e subscrição para determinados recursos. A disponibilidade do idioma e do país varia. Crie com responsabilidade.
[5] As características podem diferir dependendo do tipo de assinatura e os resultados podem variar. Algumas extensões requerem configuração. A disponibilidade do país pode variar. Verifique a precisão das respostas.
O Gemini foi desenhado para ser o seu assistente pessoal de IA – conversacional, intuitivo e útil. Para o tornar ainda mais acessível e útil, estamos a expandir o Gemini Live para o Português de Portugal, permitindo-lhe ter conversas naturais. Além disso, o Gemini poderá também ligar-se a mais aplicações Google em Português de Portugal, facilitando o acesso a informações e a concluir tarefas nos seus serviços Google preferidos.
Gemini Live: agora a falar o seu idioma
No Made by Google deste ano, apresentámos o Gemini Live, permitindo que as pessoas tenham conversas naturais e fluidas com o Gemini em inglês. A partir de hoje, e com a disponibilização gradual ao longo dos próximos dias, estamos a expandir o Gemini Live nos telefones Android para Português de Portugal para que mais pessoas possam conversar, colaborar e experimentar a IA de conversação em diferentes idiomas[1].
O Gemini Live suporta conversas até dois idiomas no mesmo dispositivo[2] e temos planos para expandir para mais idiomas no futuro. Pode definir facilmente os idiomas preferidos na aplicação Google:
O seu parceiro de IA conversacional
Gemini Live é verdadeiramente conversacional. É como conversar com um amigo: pode debater ideias, explorar novos temas ou até praticar para uma grande apresentação. O Gemini Live acompanha as suas conversas para que possa interrompê-lo, mudar de direção ou aprofundar um assunto específico. E com 10 vozes distintas à escolha pode personalizar a sua experiência e encontrar o tom e o estilo perfeitos para a conversa.
Eis apenas alguns exemplos do que pode fazer com o Gemini Live:
As suas aplicações favoritas, agora conectadas ao Gemini
Desde que trouxemos as extensões diretamente para o Gemini, as pessoas têm feito mais coisas com as aplicações e serviços que já utilizam, como o Gmail, o Maps e o YouTube. Recentemente, expandimos esta capacidade para ligar a ainda mais ferramentas da Google em inglês, incluindo o Google Calendário, Tarefas, Keep e Utilitários[3]. Com as Extensões, o Gemini pode reunir o que precisa de outras aplicações e serviços para o ajudar a realizar tarefas nas mesmas e de forma mais fácil e rápida.
Poderá também ligar-se a novas ferramentas em diferentes aplicações e em Português de Portugal tornando mais fácil a realização de tarefas. Eis alguns exemplos de como pode utilizar as extensões Gemini no seu idioma:
Um mundo de possibilidades, no seu idioma
Acreditamos que todos devem ter acesso ao poder da IA. Ao expandir o Gemini Live e as ligações de aplicações para mais idiomas, estamos a tornar isto numa realidade, ajudando pessoas de todo o mundo a ligarem-se à informação e a experimentar os benefícios de um assistente com tecnologia de IA.
Publicado por Jules Walter, Group Product Manager, Gemini Experiences
Notas:[1] O Gemini Live está disponível em dispositivos, contas, idiomas e países selecionados e é compatível com determinadas funcionalidades. Novos idiomas serão lançados em dispositivos móveis nas próximas semanas, a partir de hoje.[2] O Gemini Live está a ser expandido para idiomas adicionais de forma contínua. O acesso a idiomas específicos pode não ser imediato para todos os utilizadores. Os utilizadores serão avisados através de uma notificação no produto quando o idioma da sua preferência estiver disponível.[3] Utilitários é um grupo de aplicações que controla funcionalidades do seu dispositivo, como relógio (temporizadores e alarmes), controlo de media e ações do dispositivo (lanterna, volume, wifi, bluetooth, etc).
Temos novas funcionalidades que começam a ser disponibilizadas, a partir de hoje, e que mostrámos durante a Google I/O. O nosso novo modelo de geração de imagens, Imagen 3, está agora disponível no Gemini, Gemini Advanced, Business e Enterprise.
Gere imagens de alta qualidade com o Imagen 3
Atualizámos as nossas capacidades criativas de geração de imagens e, ao longo dos próximos dias, iremos levar o nosso modelo de geração de imagens mais recente, o Imagen 3, às Aplicações Gemini e expandir a sua disponibilidade para utilizadores em todos os idiomas.
O Imagen 3 estabelece um novo padrão na qualidade de imagem, gerando imagens com apenas algumas palavras. Pode até pedir ao Gemini para criar imagens em vários estilos – como paisagens fotorrealistas, pinturas a óleo com textura ou cenas animadas (whimsical claymation).
O Imagen 3 traz funcionalidades avançadas de geração de imagens que vêm com proteções integradas e em consonância com os nossos princípios de design de produto. Numa vasta gama de benchmarks, o Imagen 3 tem um desempenho favorável em comparação com outros modelos de geração de imagens disponíveis. E tal como acontece com o Imagen 2, utilizamos o SynthID, a nossa ferramenta para assinalar com marcas de água as imagens geradas por IA.
Os nossos princípios de design são claros: do início ao fim, o utilizador mantém o controlo do processo criativo. Se a imagem inicial obtida não corresponder às expectativas, basta pedir ao Gemini o que gostaria de mudar e será gerada uma nova imagem.
Ao longo dos próximos dias, iremos também começar a disponibilizar a geração de imagens de pessoas, com uma versão de acesso prévio para os utilizadores Gemini Advanced, Business e Enterprise, a começar com o inglês. Trabalhámos para fazer melhorias técnicas no produto, bem como com conjuntos de avaliação melhorados, exercícios de red teaming e princípios de produto claros.
Com o Imagen 3, fizemos progressos significativos para proporcionar uma experiência de utilização melhor na geração de imagens de pessoas. Não apoiamos a geração de imagens fotorrealistas de indivíduos identificáveis, representações de menores ou cenas excessivamente sangrentas, violentas ou sexuais. É claro que nem todas as imagens que o Gemini cria serão perfeitas, mas iremos continuar a ouvir o feedback dos utilizadores com acesso prévio no Gemini Advanced à medida que continuamos a melhorar. Iremos implementá-lo gradualmente, com o objetivo de o levar a mais utilizadores e idiomas em breve.
Para estar entre os primeiros a experimentar estas novas funcionalidades, experimente hoje mesmo o Gemini Advanced ou inscreva-se no Gemini for Workspace.
Publicado por Dave Citron, Senior Director, Product Management, Gemini Experiences
Durante anos, contámos com os assistentes digitais para definir temporizadores, para reproduzir música ou para controlar as nossas casas inteligentes. Esta tecnologia tornou mais fácil realizar tarefas e poupou, diariamente, minutos valiosos.
Agora, com a IA generativa, podemos fornecer um tipo de ajuda totalmente novo para tarefas complexas que podem poupar horas. Com o Gemini, estamos a reimaginar o que significa para um assistente pessoal ser realmente útil. O Gemini está a evoluir para fornecer assistência móvel alimentada pela IA que vai permitir oferecer um novo nível de ajuda – ao mesmo tempo que é mais natural, conversacional e intuitivo.
Saiba mais sobre as novas funcionalidades do Gemini, que vão estar disponíveis para Android e iOS.
Disponível a partir de hoje: Gemini Live
O Gemini Live é uma experiência conversacional móvel que lhe permite ter conversas fluidas com o Gemini. Quer fazer um brainstorming de potenciais empregos adequados às suas competências ou formação? Aceda ao Gemini Live e questione sobre este tópico! Pode até interromper a resposta para aprofundar um ponto específico ou pausar uma conversa e voltar a ela mais tarde. É como ter um companheiro no bolso com quem pode falar sobre novas ideias ou praticar uma conversa importante.
O Gemini Live também está disponível no modo mãos-livres: pode continuar a falar com a aplicação Gemini em segundo plano ou quando o telefone está bloqueado, para poder continuar a conversa em qualquer lugar, como faria numa chamada telefónica normal. O Gemini Live começa hoje a ser lançado em inglês para os nossos subscritores Gemini Advanced nos telefones Android e, nas próximas semanas, será expandido para iOS e em mais idiomas.[1]
Para tornar a conversa com Gemini ainda mais natural, estamos a apresentar 10 novas vozes à sua escolha, para que possa escolher o tom e o estilo que funcionam melhor para si.
Ligue-se a ainda mais aplicações para ajuda no dia a dia
O Gemini pode ajudar em tarefas grandes e pequenas ao integrar-se com todas as aplicações e ferramentas da Google que utiliza hoje em dia. E, ao contrário de outros assistentes, fá-lo sem que o utilizador tenha de alternar entre aplicações e serviços.
Nas próximas semanas vamos lançar novas extensões[2] incluindo o Keep, Tasks, Utilities[3] e funcionalidades expandidas no YouTube Music. Digamos que está a organizar um jantar: peça ao Gemini para descobrir aquela receita de lasanha que a Jenny lhe enviou no Gmail e peça-lhe para adicionar os ingredientes à sua lista de compras no Keep. Sem precisar de muitos detalhes, o Gemini compreende o que pretende e age de acordo com o que lhe foi pedido.
E com a extensão do Calendário, disponível em breve, poderá tirar uma fotografia do panfleto que anuncia a feira dos agricultores e perguntar ao Gemini se está livre nesse dia – e até mesmo definir um lembrete para comprar mirtilos quando for à feira.
E com a extensão do Calendário, disponível em breve, poderá tirar uma fotografia do anúncio de um concerto e perguntar ao Gemini se está livre nesse dia – e até mesmo definir um lembrete para comprar os bilhetes.
Elevando o Gemini no Android
O Gemini está totalmente integrado na experiência do utilizador Android, proporcionando capacidades mais conscientes do contexto que só são possíveis no Android. O Gemini disponibiliza ajuda exatamente quando o utilizador precisa, independentemente do que estiver a fazer no seu telemóvel Android[4]. Basta pressionar longamente o botão ligar / desligar ou dizer "Ok Google" e o Gemini surge, pronto para ajudar[5]. Pode tocar na sugestão "Perguntar sobre este ecrã" para obter ajuda sobre o que está no seu ecrã ou, se estiver a utilizar o YouTube, pode fazer perguntas sobre o que está a ver. Imagine que se está a preparar para uma viagem ao estrangeiro e acabou de visualizar um vlog de viagens - toque em "Perguntar sobre este vídeo" e peça uma lista de todos os restaurantes mencionados no vídeo - e peça para que o Gemini os adicione ao Google Maps.
Graças à profunda integração com o Android, o Gemini vai para além da simples leitura do ecrã: o Gemini pode interagir com muitas das aplicações que o utilizador já usa. Por exemplo, o utilizador pode arrastar e largar imagens geradas pelo Gemini diretamente em aplicações como o Gmail e Mensagens Google.
Reimaginar um assistente útil
Embora a IA desbloqueie novas capacidades poderosas, também apresenta novos desafios. Ironicamente, utilizar grandes modelos de linguagem que possam interpretar melhor a linguagem natural e lidar com tarefas complexas significa, muitas vezes, que as tarefas simples demoram mais tempo a serem concluídas. E embora a IA generativa seja suficientemente flexível para completar uma vasta gama de tarefas pode, por vezes, comportar-se de formas inesperadas ou fornecer informações imprecisas.
Para ajudar a resolver esta questão, incorporamos novos modelos como o Gemini 1.5 Flash, que são mais rápidos e fornecem respostas de maior qualidade. Nos próximos meses, vamos continuar a concentrar-nos na velocidade e na qualidade e a lançar integrações mais profundas com o Google Home, com o Telefone e com as Mensagens. Saiba mais sobre como o Gemini pode ajudá-lo com todas as suas ações favoritas do Assistente, incluindo detalhes sobre melhorias futuras.
Hoje, chegámos a um ponto de viragem em que acreditamos que a utilidade de um assistente com tecnologia de IA supera em muito os seus desafios, e estamos entusiasmados por experimentar o Gemini como assistente padrão no Google Pixel 9. Estamos nos primórdios da descoberta de todas as formas pelas quais um assistente com tecnologia de IA pode ser útil e – tal como os telefones Pixel – o Gemini vai continuar a ser cada vez melhor.
Por Sissie Hsiao, Vice President and General Manager, Gemini experiences and Google Assistant
Todos os dias, aprendemos como as pessoas estão a utilizar o Gemini para serem mais produtivas, criativas e curiosas. E com a atualização de hoje, o Gemini está a ficar ainda melhor a ajudá-lo a realizar estas tarefas das formas que melhor funcionam para si.
Agora, pode aceder ao Flash 1.5 na versão gratuita do Gemini para obter respostas mais rápidas e úteis. Além disso, estamos a introduzir uma nova funcionalidade para responder melhor a alucinações e a expandir a nossa experiência Gemini for Teens e a aplicação móvel a mais locais.
Respostas mais rápidas e inteligentes com o 1.5 Flash
Ouvimos dizer que uma das principais razões para as pessoas gostarem de utilizar o Gemini é porque poupa tempo. Quer esteja a utilizar o Gemini para escrever um e-mail apelativo ou a depurar um código complicado é importante obter respostas rápidas e de alta qualidade.
Hoje estamos a atualizar a nossa experiência gratuita para o Gemini 1.5 Flash para respostas mais rápidas e úteis. Com o Gemini 1.5 Flash, o utilizador vai notar melhorias generalizadas na qualidade e na latência, com avanços especialmente notórios no raciocínio e na compreensão de imagem. E tal como expandimos bastante a janela de contexto do Gemini Advanced, estamos a quadruplicar o Gemini para 32 mil tokens. Isto significa que pode ter conversas mais longas e fazer perguntas mais complexas ao Gemini - tudo, de forma gratuita.
Para tirar o máximo partido da janela de contexto expandida, vamos, em breve, acrescentar a capacidade de carregar ficheiros através do Google Drive ou diretamente a partir do seu dispositivo, o que já estava disponível no Gemini Advanced. Isto significa que poderá fazer coisas como carregar o seu manual de economia e pedir ao Gemini para criar questões práticas. Em breve, o Gemini também vai poder analisar ficheiros de dados para si, permitindo-lhe descobrir insights e visualizá-los através de tabelas e gráficos.
O Gemini 1.5 Flash está agora disponível para todos os utilizadores do Gemini na versão web e para dispositivos móveis, em 40 idiomas e em mais de 230 países e territórios.
Conteúdo relacionado nas respostas do Gemini
Também ouvimos dizer que as pessoas gostam de explorar novos temas tendo o Gemini como o seu parceiro de investigação. Por isso, estamos agora a exibir links para conteúdo relacionado para prompts de verificação de factos no Gemini – continuando o nosso trabalho para reduzir as alucinações e facilitar a exploração de websites que ajudam o utilizador a aprender mais.
A partir de hoje, para prompts em inglês em determinados países, o utilizador pode aceder a estas informações adicionais sobre os temas diretamente nas respostas do Gemini. Basta clicar no ícone no final de um parágrafo para ver os websites onde pode saber mais sobre um determinado assunto. Isto não se limita aos websites: se a resposta do Gemini fizer referência a informações encontradas utilizando a extensão do Gmail, o utilizador também vai ver links incorporados para e-mails relevantes.
Gemini presente em mais locais
No início deste ano, introduzimos a capacidade de conversar com o Gemini diretamente na app Mensagens Google nos dispositivos Android selecionados. A partir de hoje, estamos a implementar gradualmente o Gemini nas Mensagens Google no Espaço Económico Europeu (EEE), no Reino Unido e na Suíça, com a capacidade de conversar em idiomas adicionados recentemente, tais como o francês, o polaco e o espanhol. Clique no botão "Iniciar chat" em Mensagens e selecione Gemini para começar a debater ideias, planear viagens e muito mais - tudo sem sair da aplicação Mensagens Google.
Estamos também a lançar a aplicação móvel Gemini em mais países, para que mais pessoas em todo o mundo possam obter ajuda do Gemini onde quer que se encontrem.
Acesso alargado ao Gemini para adolescentes (Gemini for teens)
Na próxima semana, vamos alargar o acesso do Gemini aos adolescentes de forma global em mais de 40 idiomas. Os adolescentes que cumpram o requisito de idade mínima para gerir a sua própria Conta Google vão poder aceder ao Gemini para fazer coisas como compreender melhor as matérias da escola, preparar-se para a universidade ou obter ajuda para projetos criativos.
Queremos criar oportunidades para os adolescentes beneficiarem de tudo o que a IA generativa tem para oferecer e prepará-los para um futuro onde a IA vai desempenhar um papel ainda mais central – ao mesmo tempo que damos prioridade à segurança e satisfazemos as suas necessidades de desenvolvimento. Para os ajudar a navegar no Gemini com confiança e segurança, implementámos políticas e salvaguardas adicionais, introduzimos um processo de integração específico para adolescentes e incluímos um guia de literacia em IA para ajudar os adolescentes a navegar na IA de forma responsável. Estabelecemos também parcerias com especialistas em segurança e desenvolvimento infantil, incluindo a MediaSmarts (CA), a Miúdos Seguros na Net (PT) e a Fad Juventud (ES), que continuam a disponibilizar um conhecimento especializado para satisfazer as necessidades únicas dos adolescentes e famílias.
Como desenvolvemos o Gemini de forma responsável
O desenvolvimento do Gemini sempre foi pautado pelo compromisso com a responsabilidade e a segurança dos utilizadores. À medida que continua a evoluir, partilhamos mais sobre como desenvolvemos o Gemini e como pretendemos que responda. Pode, agora, ler sobre a nossa abordagem ao Gemini, saber mais detalhes sobre as nossas directrizes para compreender melhor como estamos a navegar em tópicos complexos e delicados, incluindo respostas a tópicos relacionados com questões de interesse público e crenças políticas, questões religiosas ou morais. Estas directrizes, baseadas nos nossos Princípios de IA, refletem o nosso compromisso contínuo em desenvolver esta tecnologia de forma responsável e transparente.
Fique atento a mais novidades do Gemini no Made by Google. Entretanto, comece, hoje mesmo, a conversar com o Gemini para experimentar estas atualizações.
Publicado por Amar Subramanya, VP of Engineering, Gemini
Novas funcionalidades
No verão passado, apresentámos o NotebookLM, um assistente de análise e escrita. Hoje estamos entusiasmados em partilhar que estamos a trazer uma versão atualizada do NotebookLM — agora a usar o Gemini 1.5 Pro — para mais de 200 países e territórios em todo o mundo.
Desde o início, o nosso objetivo com o NotebookLM foi criar uma ferramenta para o ajudar a compreender e a explorar materiais complexos, fazer novas conexões a partir da informação e chegar a um primeiro rascunho com maior rapidez. Poderá carregar vários tipos de fontes – notas de investigação, transcrições de entrevistas, documentos corporativos – e o NotebookLM torna-se instantaneamente num especialista no material que é mais importante para si. A atualização de hoje apresenta várias novas funcionalidades:
Graças aos recursos multimodais nativos do Gemini 1.5 Pro, poderá agora fazer perguntas sobre imagens, gráficos e diagramas nas suas fontes. O NotebookLM irá até incluir citações em imagens como evidência de apoio, sempre que tal for relevante.
Estudos de caso de utilizadores reais
Ficámos impressionados com a variedade de usos que as pessoas estão a encontrar para o NotebookLM. Como o produto foi desenvolvido em estreita parceria com autores, estudantes e educadores, temos visto muitos dos primeiros utilizadores a integrarem o produto em fluxos de trabalho de investigação e escrita. O autor de best-sellers Walter Isaacson tem trabalhado com NotebookLM para analisar os diários de Marie Curie no âmbito da investigação para o seu próximo livro. Vimos um entusiasmo semelhante da parte de produtores de documentários e podcasts que precisam de pesquisar arquivos complexos para a geração de roteiros ou ideias para histórias. Mas a combinação das capacidades de raciocínio avançadas do Gemini 1.5 Pro e da arquitetura das fontes do NotebookLM permite toda uma série de outras aplicações potenciais:
Também encontrámos alguns casos divertidos e menos óbvios com a ajuda dos nossos 14.000 membros da nossa comunidade Discord, incluindo romancistas e autores de fan-fiction para gerir histórias complexas usando o NotebookLM e o nosso favorito: os entusiastas de jogos RPG usam o NotebookLM para gerir as descrições detalhadas dos mundos da fantasia em jogos como o Dungeons and Dragons.
Como iniciar
Se é novo no NotebookLM, começar é fácil: ao aceder ao NotebookLM pela primeira vez, irá criar um notebook e carregar os documentos para um projeto ou ação específica. Nesse momento, poderá ler, tirar notas, fazer perguntas, organizar as suas ideias ou pedir ao NotebookLM para criar resumos automáticos de todas as suas fontes - um guia de estudo, por exemplo, ou um índice analítico. E com o NotebookLM, as fontes que você carrega não são usadas para treinar o modelo.
Quer esteja a ser usado para construir mundos imaginários, escrever biografias best-sellers ou a ajudar vendedores a encontrar novos clientes, o NotebookLM tem vindo a proporcionar aos utilizadores nos EUA ferramentas poderosas para fazer conexões e gerar insights a partir de grandes coleções de documentos. Mal podemos esperar para ver o que o resto do mundo fará com isto.
Publicado por Steven Johnson, Editorial Director, Google Labs & Raiza Martin, Product Manager, Google Labs
A aplicação móvel Gemini está a chegar a mais países na Europa e ao Reino Unido, permitindo aos utilizadores aumentar a sua criatividade e produtividade com a nossa aplicação móvel alimentada por IA.
Aplicação Gemini em mais idiomas e países
Hoje, estamos a lançar a aplicação móvel Gemini em mais países e territórios para que possa obter ajuda do Gemini em qualquer lugar. Com a aplicação Gemini no seu telefone, poderá escrever, falar ou adicionar uma imagem para todos os tipos de ajuda: pode tirar uma foto de um pneu furado e pedir instruções sobre como trocá-lo ou obter ajuda para escrever uma nota de agradecimento. É um primeiro passo importante na construção de um verdadeiro assistente de IA – que seja conversacional, multimodal e útil.
Para aceder ao Gemini no Android, descarregue a aplicação Gemini ou faça login através do Google Assistente e poderá usar o Gemini deslizando o dedo para o canto, pressionando o botão ligar/desligar em alguns telefones ou através das palavras “Ok Google”. Isto irá permitir uma nova experiência de sobreposição que oferece acesso fácil ao Gemini, bem como ajuda contextual diretamente no ecrã. Muitas das funcionalidades de voz de que gosta no Google Assistente estarão disponíveis na aplicação Gemini – incluindo configuração de temporizadores, realização de chamadas e configuração de lembretes – e estamos a trabalhar para oferecer mais suporte no futuro.
No iOS, iremos disponibilizar o acesso ao Gemini diretamente a partir da aplicação Google nas próximas semanas. Basta tocar no botão Gemini e conversar com o Gemini para potenciar a sua criatividade, obter ajuda para escrever posts nas suas redes sociais e até mesmo planear uma saída à noite.
Continuamos empenhados em disponibilizar o Gemini ao maior número de pessoas possível. Ao expandir o suporte linguístico e chegar a novos países, garantimos que mais pessoas possam potenciar as suas ideias com o Gemini. Experimente as funcionalidades mais recentes em: https://gemini.google.com/
Em dezembro passado, lançámos o nosso primeiro modelo multimodal nativo Gemini 1.0 em três tamanhos: Ultra, Pro e Nano. Meses mais tarde, lançámos o 1.5 Pro, com desempenho melhorado e a janela de contexto longa pioneira de 1 milhão de tokens.
Programadores e clientes empresariais usaram o 1.5 Pro de formas incríveis e consideram a sua janela de contexto longa, as suas capacidades de raciocínio multimodal e o seu impressionante desempenho global incrivelmente útil.
Sabemos, com base no feedback dos utilizadores, que algumas aplicações necessitam de uma latência mais baixa e de um custo mais baixo para cumprir. Isto inspirou-nos a continuar a inovar e estamos a introduzir o Gemini 1.5 Flash, um modelo que é mais leve do que o 1.5 Pro e que foi desenhado para ser rápido e eficiente, para servir em escala.
O 1.5 Pro e o 1.5 Flash estão disponíveis em public preview com uma janela de contexto de 1 milhão de tokens no Google AI Studio e Vertex AI. Uma janela de contexto de 2 milhões de tokens está disponível para programadores que usem a API e Clientes Google Cloud através de lista de espera.
Estamos também a anunciar atualizações na nossa família de modelos Gemini e a anunciar a nossa nova geração de modelos abertos, Gemma 2, e a partilhar o progresso no futuro dos assistentes de IA com o Project Astra.
Notícias da família de modelos Gemini
Novo 1.5 Flash, otimizado para velocidade e eficiência
O 1.5 Flash é a mais recente adição à família de modelos Gemini e o modelo Gemini mais rápido servido na API. Está otimizado para tarefas de alto volume e alta frequência em escala, tem uma melhor relação preço/eficiência para cumprir e apresenta a nossa janela de contexto pioneira.
Apesar de ser um modelo mais leve do que o 1.5 Pro, é altamente capaz em raciocínio multimodal em vastas quantidades de informação e oferece uma qualidade impressionante para o seu tamanho.
O 1.5 Flash é excelente em resumos, aplicações de mensagens, legendas de imagens e vídeos, extração de dados de documentos e tabelas longas e muito mais. Isto ocorre porque ele foi treinado pelo 1.5 Pro através de um processo chamado “destilação”, onde o conhecimento e competências essenciais de um modelo maior são transferidos para um modelo menor e mais eficiente.
Mais informações sobre o 1.5 Flash no nosso relatório técnico atualizado do Gemini 1.5 e na página de tecnologia do Gemini e saiba mais sobre a disponibilidade e os preços do 1.5 Flash. Vamos partilhar, em breve, mais detalhes numa atualização do relatório técnico do Gemini 1.5.
Melhoras significativas no 1.5 Pro
Nos últimos meses, melhorámos significativamente o 1.5 Pro, o nosso melhor modelo para escala numa vasta série de tarefas. Para além de alargar a sua janela de contexto para dois milhões de tokens, melhorámos a geração de código, o raciocínio lógico e o planeamento, a conversação multiturno e a compreensão de áudio e imagens. Vemos melhorias significativas no benchmarks internas e públicos em cada uma destas tarefas.
O 1.5 Pro pode seguir instruções cada vez mais complexas e diferenciadas, incluindo instruções que especificam o comportamento ao nível do produto, como função, formato e estilo. Melhorámos o controlo sobre as respostas do modelo para casos de utilização específicos, como a criação de personas e estilo de resposta de um agente de chat ou automatização de fluxos de trabalho através de múltiplas funções de chamadas. E permitimos aos utilizadores adaptar o comportamento do modelo ao definir instruções de sistema.
Também adicionámos compreensão de áudio na API Gemini e no AI Studio, e por isso, o 1.5 Pro pode agora desenvolver raciocínios entre imagem e áudio para vídeos carregados no AI Studio. E agora estamos a integrar o 1.5 Pro em produtos Google, incluindo o Gemini Advanced e aplicações Workspace.
Mais informações sobre o 1.5 Pro na Página de Tecnologia do Gemini. Mais detalhes estarão disponíveis em breve no nosso relatório técnico atualizado do Gemini 1.5.
Gemini Nano compreende entradas multimodais
O Gemini Nano está a expandir-se para além das entradas apenas de texto para incluir também imagens. A começar com o Pixel, as aplicações que usam o Gemini Nano com Multimodalidade serão capazes de compreender o mundo da mesma forma que as pessoas o fazem – não apenas através da entrada de texto, mas também através da visão, do som e do idioma falado.
Mais informações em Gemini 1.0 Nano no Android.
Nova geração de modelos abertos
Hoje estamos a partilhar uma série de atualizações ao Gemma, a nossa família de modelos abertos desenvolvidos com a mesma tecnologia e investigação usados para criar os modelos Gemini.
Estamos a apresentar Gemma 2, a nossa próxima geração de modelos abertos para inovação responsável em IA. O Gemma 2 tem uma nova arquitetura projetada para desempenho e eficiência inovadores e estará disponível em novos tamanhos.
A família Gemma também está a expandir-se com PaliGemma, o nosso primeiro modelo de linguagem de visão inspirado no PaLI-3. E atualizámos o nosso kit de ferramentas de IA generativa responsável com LLM Comparator para avaliar a qualidade das respostas do modelo.
Mais informações no blog para programadores.
Progresso no desenvolvimento de agentes de IA universais
Como parte da missão do Google DeepMind de construir IA de forma responsável para beneficiar a humanidade, sempre quisemos desenvolver agentes de IA universais que pudessem ser úteis na vida quotidiana. É por isso que hoje estamos a partilhar o nosso progresso na construção do futuro dos assistentes de IA com o Projeto Astra (agente responsivo avançado que vê e fala).
Para ser verdadeiramente útil, um agente precisa de compreender e responder ao mundo complexo e dinâmico tal como as pessoas fazem – absorver e lembrar o que vê e ouve para compreender o contexto e agir. Ele também precisa ser proactivo, ensinável e pessoal de modo que os utilizadores possam conversar com ele naturalmente e sem atrasos.
Embora tenhamos feito um progresso incrível no desenvolvimento de sistemas de IA que podem compreender informações multimodais, reduzir o tempo de resposta a algo conversacional é um desafio difícil de engenharia. Nos últimos anos, temos trabalhado para melhorar a forma como os nossos modelos percebem, raciocinam e conversam para tornar o ritmo e a qualidade da interação mais naturais.
Estes agentes foram construídos a partir do modelo Gemini e de outros modelos específicos de tarefas, e foram projetados para processar informações mais rapidamente, codificando continuamente frames de vídeo, combinando a entrada de vídeo e voz numa linha do tempo de eventos e armazenando essas informações em cache para uma recuperação eficiente.
Ao aproveitar os nossos principais modelos de voz, também melhorámos a forma como eles soam, proporcionando aos agentes uma gama mais ampla de entonações. Estes agentes podem compreender melhor o contexto em que estão a ser usados e a responder rapidamente na conversa.
Com tecnologia como esta, é fácil antever um futuro onde as pessoas podem ter um assistente de IA especialistas ao seu lado através de telefone ou óculos. E algumas destas capacidades irão chegar aos produtos da Google, como a aplicação Gemini e experiência web, ainda este ano.
Exploração contínua
Fizemos um progresso incrível até agora com a nossa família de modelos Gemini e estamos sempre a esforçar-nos para avançar ainda mais no que há de mais moderno. Ao investir numa linha de produção incansável de inovação, somos capazes de explorar novas ideias de vanguarda, ao mesmo tempo que se abre a possibilidade de novos e interessantes casos de uso do Gemini.
Mais informações sobre Gemini e as suas capacidades.
Publicado por Demis Hassabis, CEO da Google DeepMind, em nome da equipa Gemini
O Gemini foi concebido para ser o seu assistente de IA pessoal - para ser conversacional, intuitivo e prestável. Quer o utilize através da aplicação ou da experiência Web, o Gemini pode ajudá-lo na realização de tarefas complexas, podendo inclusivamente agir por si.
Atualmente estamos a fazer várias atualizações - incluindo uma janela de contexto mais longa, novas capacidades de análise de dados, associação com outras aplicações Google e opções mais personalizáveis - para que possa colaborar com o Gemini mais personalizado e inteligente de sempre.
Analise documentos com a janela de contexto mais longa do mundo
Hoje, estamos a disponibilizar o Gemini 1.5 Pro, o nosso modelo de última geração, para os subscritores do Gemini Advanced. O Gemini 1.5 Pro traz-lhe os nossos últimos avanços técnicos, incluindo uma janela de contexto amplamente expandida a começar no 1 milhão de tokens - o chatbot de consumo mais longo e amplamente disponível do mundo. Uma janela de contexto desta dimensão significa que o Gemini Advanced é capaz de lidar com múltiplos documentos em massa, até 1500 páginas ou resumir 100 emails. Em breve, vai ser possível lidar com conteúdo de vídeo de uma hora ou com bases de código com mais de 30.000 linhas.
Para tirar partido desta janela de contexto longo, estamos a acrescentar a possibilidade de carregamento de ficheiros através do Drive ou diretamente a partir do telefone para o Gemini Advanced. Agora, pode obter, rapidamente, respostas e informações sobre documentos muito densos, tais como perceber os detalhes da política de animais de estimação do seu contrato de arrendamento ou comparar os principais argumentos de dois artigos científicos. E, em breve, o Gemini Advanced vai poder agir como um analista de dados, descobrindo informações e a criar visualizações e gráficos personalizados a partir de ficheiros de dados carregados, tais como folhas de cálculo, por exemplo.
O Gemini assegura a privacidade dos seus ficheiros e não são usados para treinar os nossos modelos.
O Gemini é nativamente multimodal, e a versão 1.5 Pro traz grandes melhorias no campo da interpretação de imagens. Por exemplo, pode tirar uma foto a um prato no seu restaurante preferido e pedir a receita, ou usar uma imagem de um problema de matemática para que o Gemini lhe envie as instruções de resolução passo a passo - tudo isto a partir de uma simples imagem.
O Gemini 1.5 Pro vai estar disponível para os subscritores do Gemini Advanced em mais de 150 países e em cerca de 35 idiomas.
Tenha conversas mais naturais através do Gemini Live
E, nas próximas semanas, vamos implementar o Gemini Live para os subscritores do Gemini Advanced, uma nova experiência conversacional para dispositivos móveis que usa a nossa tecnologia de conversação mais inovadora para tornar a interação com o Gemini mais intuitiva. Com o Gemini Live, pode falar com o Gemini e selecionar entre uma variedade de vozes naturais para ouvir as respostas. Pode inclusivamente falar no seu próprio ritmo ou interromper as respostas com perguntas de esclarecimento, semelhante ao que acontece numa conversa natural.
Vamos imaginar que se está a preparar para uma entrevista de emprego ou a ensaiar um discurso importante: basta aceder ao Live e pedir ao Gemini para o ajudar a preparar-se. O Gemini vai sugerir as competências que pode destacar ao conversar com o seu potencial empregador ou poderá sugerir dicas para falar em público para acalmar os seus nervos antes de subir ao palco. Ainda este ano, vai poder usar a câmara quando aceder ao Live e dar início a conversas sobre o que está a ver à sua volta.
Descomplique o planeamento, como os itinerários de viagens
Às vezes, passa mais tempo a pesquisar e a organizar uma viagem do que a desfrutar da mesma. A nova experiência de planeamento do Gemini Advanced não se limita apenas a sugerir uma lista de atividades, como também elabora um itinerário personalizado só para si.
Suponha que pede ao Gemini o seguinte: “A minha família e eu vamos a Miami no Dia do Trabalhador. O meu filho gosta muito de arte e o meu marido adora peixe. Podes ver as informações do meu voo e do hotel no Gmail e ajudar-me a planear o fim de semana?”
Este comando exige que o Gemini faça muito mais do que simplesmente compilar informação que está disponível publicamente, como outros chatbots. O Gemini tem em conta os horários do voo, as preferências gastronómicas e a informação acerca dos museus locais, para além de saber onde se localiza cada paragem e a duração das deslocações entre as várias atividades. O Gemini usa a informação do voo que está disponível no Gmail, recorre ao Google Maps para recomendar restaurantes e museus perto do seu hotel e utiliza a Pesquisa para sugerir outras atividades, como um passeio ao Design District ou uma ida à praia para preencher o resto do dia. Sintetiza toda a informação e cria um itinerário único e pessoal que vai de encontro às suas necessidades. E se forem feitas mais alterações ou adicionados mais detalhes, o itinerário é atualizado automaticamente.
Esta nova experiência dinâmica de planeamento vai estar disponível no Gemini Advanced nos próximos meses.
Personalize o Gemini com Gems
Para uma experiência ainda mais pessoal, os subscritores do Gemini Advanced vão poder criar Gems - versões personalizadas do Gemini. Pode criar a Gem que quiser: um colega de ginásio, subchefe de cozinha, um colega de programação ou um guia de escrita criativa. As Gems são também fáceis de configurar. Basta descrever o que quer que a sua Gem faça e pretende que lhe responda - como “és a minha treinadora de atletismo, dá-me um plano diário de corrida e sê positiva, otimista e motivadora”, por exemplo. O Gemini recebe estas instruções e, com apenas um clique, aperfeiçoa-as para criar a Gem que corresponde às suas necessidades específicas.
Ligue-se a mais aplicações Google
No ano passado, integrámos as Extensões diretamente no Gemini, o que lhe permite concluir mais tarefas com as apps e serviços da Google que já usa. Continuamos a incluir as aplicações da Google no Gemini, como a Extensão do YouTube Music, que já está a ser implementada. Com o Gemini, o utilizador pode pesquisar a sua música favorita mesmo que não saiba o título da música, mencionando um verso favorito ou o artista.
Em breve, vamos associar ainda mais ferramentas Google ao Gemini, incluindo o Calendário Google, o Tasks e o Keep. Assim, o utilizador pode fazer inúmeras coisas, tais como carregar uma imagem da agenda escolar do seu filho e pedir ao Gemini que crie entradas no calendário para todos os trabalhos ou até tirar uma fotografia a uma determinada receita e adicioná-la ao Keep como uma lista de compras.
Com estas atualizações, sendo que muitas vão também estar disponíveis para os nossos clientes empresariais, vai poder aceder à experiência Gemini mais pessoal e útil de sempre - tudo a partir de um só comando.
Não perca, em breve, as novas funcionalidades e comece a conversar com o Gemini hoje mesmo.
Publicado por Sissie Hsiao, VP/GM, Gemini Experiences and Google Assistant