Category: Inteligência Artificial

ChatGPT e Gemini têm números aleatórios “favoritos”; descubra quais

ChatGPT e Gemini têm números aleatórios “favoritos”; descubra quais

Quer um número aleatório? GPT e Claude provavelmente vão responder 42 (Imagem: Vitor Pádua / Tecnoblog)

Um experimento com modelos de inteligência artificial da OpenAI, Anthropic e Google descobriu que, ao pedir que eles digam aleatoriamente um número de zero a 100, as escolhas são estranhamente enviesadas, de uma forma parecida com o que acontece com humanos.

Os testes foram feitos pela Gramener, empresa especializada em dados. Os engenheiros usaram o GPT-3.5 Turbo (da OpenAI), o Claude 3 Haiku (da Anthropic) e o Gemini 1.0 Pro (do Google), com o prompt “Escolha um número aleatório de 0 a 100” (em inglês). Todos os três modelos tiveram seus números favoritos: o 47 foi o mais escolhido pelo GPT (52% das vezes); o 42, pelo Claude (50%); e o 72, pelo Gemini (30,3%).

Com temperatura 0 (resultados mais previsíveis), modelos deram quase sempre o mesmo número (Imagem: Reprodução / Gramener)

Os engenheiros também variaram a temperatura dos modelos, como é chamado o parâmetro para dar respostas mais previsíveis (temperatura menor) ou mais criativas (temperatura maior). Com temperatura 0, os três modelos não variaram e escolheram quase sempre seus favoritos.

Os engenheiros da Gramener levantaram alguns pontos curiosos:

números terminados em 7 são mais frequentes;

números terminados em 0 ou 5 são mais raros;

números com dígitos repetidos são mais raros;

números abaixo de 10 são mais raros.

O experimento da Gramener reforça um teste anterior, da empresa Leniolabs, com o GPT 3.5 Turbo. Ao pedir para escolher um número aleatório entre 1 e 100, a IA também preferiu o 42 e números com 7. Isso também aconteceu ao pedir para escolher um número entre as opções de uma sequência aleatória.

Ao pedir para escolher um número em uma lista aleatória, o GPT tendia a escolher o 42 (Imagem: Reprodução / Leniolabs)

Como modelos de linguagem de grande escala (LLM, na sigla em inglês) são treinados com uma quantidade enorme de textos, é possível que eles tenham visto o número 42 várias vezes e estejam apenas completando frases com ele. A popularidade se deve ao livro O Guia do Mochileiro das Galáxias, de Douglas Adams. Na obra de ficção científica, 42 é a resposta para a vida, o Universo e tudo mais — só não se sabe qual é a pergunta.

Para os autores deste teste, a frequência fora do comum de números com 7 pode ter relação com o aspecto cultural — sete dias da semana, sete maravilhas do mundo e outros exemplos. Curiosamente, ao repetir os testes em chinês, o número mais escolhido foi o 57.

Humanos percebem números de forma enviesada

Um vídeo do canal de ciência Veritasium serve como bom complemento a esses experimentos com as IAs. Ao pedir que pessoas nas ruas respondessem um número aleatório de 1 a 100, o 37 foi o campeão de menções, e outros números com 3 e 7 também foram os mais lembrados.

Isso pode ter a ver com vários fatores, segundo o vídeo. Na base de tudo, nós, humanos, falamos números aleatórios pensando em como eles parecem aleatórios para nós, porque não estamos acostumados a lidar com eles.

Pensamos em números pares como mais “certinhos”, então números ímpares parecem mais aleatórios.

Entre os números ímpares, 1 e 9 são extremos, enquanto o 5 é o ponto do meio. Portanto, 3 e 7 pareceriam mais aleatórios.

O número 37 é primo, o que significa que ele não é múltiplo de nenhum outro além dele mesmo e de 1. Como não dá para chegar nele fazendo contas, ficamos com a impressão de que ele é aleatório.

Apesar de não terem o rigor científico, com amostras pequenas e sequências curtas, estes experimentos mostram que humanos e modelos de linguagem têm vieses na hora de dizer números aleatoriamente.

Mesmo assim, ainda não existe uma explicação definitiva para por que os LLMs estão dando respostas enviesadas a este tipo de pergunta. Vale lembrar que este tipo de modelo é voltado a escrever e completar frases, o que significa que ele não deve estar fazendo o que outros algoritmos fazem para gerar um número aleatório.

Computadores geram números que parecem aleatórios

Talvez você nunca tenha pensado nisso, mas a verdade é que computadores não são bons para gerar números aleatórios. Computadores são feitos para serem previsíveis — a mesma entrada e o mesmo processo precisam ter sempre a mesma saída. É isso que garante que, ao teclar “A”, você verá “A” na tela, entre outras tarefas muito mais complexas. Como fazer algo imprevisível surgir a partir dessas máquinas?

Um computador não é capaz de gerar sozinho uma sequência verdadeiramente aleatória (Imagem: Mika Baumeister / Unsplash)

O jeito mais simples de gerar um número aleatório envolve um número inicial e muitas contas. Ele é chamado gerador de número pseudo-aleatório (PRNG, na sigla em inglês). Este método recebe este nome porque, na verdade, o número resultante parece imprevisível, mas não é.

Este tipo de algoritmo recebe um valor inicial, chamado semente. A partir dele, o computador faz uma série de operações matemáticas para retornar outro número. Este outro número pode ser usado novamente como semente, e o processo segue, gerando uma sequência de números aparentemente aleatórios.

O gerador de número pseudo-aleatório é mais conveniente e barato, mas também mais limitado. Ele é periódico (quando o algoritmo gerar um número igual à primeira semente, a sequência vai se repetir, mesmo que depois de muito tempo) e determinístico (a mesma semente e o mesmo algoritmo vão sempre gerar o mesmo número).

Um gerador deste tipo pode servir para coisas simples, como sorteios entre amigos ou jogos de videogame. Para fins de segurança, é recomendável que ele cumpra alguns requisitos extras, que conferem maior resistência a ataques e menor previsibilidade — o que faz com que ele seja classificado como um gerador de números pseudo-aleatórios criptograficamente seguro (CSPRNG, em inglês).

Existe um jeito ainda mais complexo, chamado gerador de número verdadeiramente aleatório (TRNG, em inglês). A principal diferença é que ele conta com um componente externo naturalmente imprevisível, como o ruído atmosférico — é o que o site Random.org faz, por exemplo.

Lava lamps geram aleatoriedade para Cloudflare usar em chaves criptográficas (Imagem: Reprodução / Cloudflare)

Este tipo é mais recomendado para processos de criptografia, porque dificulta que um invasor consiga adivinhar a sequência. Por outro lado, coletar dados de um fenômeno imprevisível não é tão simples, já que envolve a captação de informações externas ao computador.

Outro bom exemplo de TRNG é a famosa parede de luminárias do tipo lava lamp que fica no escritório da empresa de cibersegurança Cloudflare. Uma câmera captura os movimentos imprevisíveis do material em cada uma delas e transforma as imagens em sequências numéricas, que são usadas pela empresa para gerar chaves de criptografia.

E se alguém entrar na frente da câmera ou a iluminação mudar? Melhor ainda: o resultado fica mais imprevisível.
ChatGPT e Gemini têm números aleatórios “favoritos”; descubra quais

ChatGPT e Gemini têm números aleatórios “favoritos”; descubra quais
Fonte: Tecnoblog

NotebookLM: ferramenta de anotações com IA do Google já funciona no Brasil

NotebookLM: ferramenta de anotações com IA do Google já funciona no Brasil

NotebookLM (imagem: reprodução/Google)

O Google anunciou o NotebookLM em julho de 2023 como uma ferramenta que usa inteligência artificial (IA) para resumir textos, filtrar informações, criar índices, entre outras ações relacionadas a documentos. Esse “bloco de notas inteligente” estava disponível só nos Estados Unidos, mas acaba de ser liberado em escala global.

Isso significa que você já pode usar o NotebookLM de modo oficial no Brasil, com suporte a português, e em vários outros países. De acordo com o Google, esse “liberou geral” acontece depois de a ferramenta ter sido integrada ao Gemini 1.5 Pro, o mais avançado modelo de IA criado pela companhia até o momento.

O que você pode fazer com o NotebookLM

O NotebookLM é uma ferramenta que auxilia a rotina de estudantes, professores, jornalistas ou de qualquer pessoa que precisa lidar com textos. A ideia é permitir que, no meio de uma grande quantidade de dados, você possa usar a IA para extrair ou organizar as informações que lhe são mais relevantes.

Nesse sentido, você pode usar o NotebookLM para tarefas como (mas não somente):

resumir um documento em PDF ou em outro formato;

criar um índice que te permita acessar facilmente pontos específicos do documento;

gerar estatísticas ou análises com base em planilhas;

criar guias de estudos ou listas de perguntas frequentes (FAQs);

converter textos em formatos adequados para newsletter, e-mail ou apresentações.

A ferramenta ganhou melhorias

Além da expansão global, o Google anunciou alguns aprimoramentos interessantes para o NotebookLM. Para começar, agora a ferramenta oferece suporte a uma variedade maior de fontes de pesquisa, como apresentações no Google Slides e endereços na web.

O NotebookLM também já é capaz de gerar resultados a partir de fotos, gráficos e diagramas, e não somente texto. Mérito dos recursos multimodais do Gemini 1.5 Pro, explica o Google.

As já mencionadas capacidades de gerar FAQs ou guias de estudos também são recursos aprimorados recentemente.

NotebookLM (imagem: reprodução/Google)

Como usar o NotebookLM

Você só precisa acessar o site do NotebookLM. É necessário ter uma conta no Google para utilizar a ferramenta. Feito isso, clique em “Novo notebook” e faça upload de um documento para começar. Depois, basta seguir as orientações para gerar um conteúdo condizente com as suas necessidades.

Mas tenha atenção. O próprio Google alerta que o NotebookLM pode gerar resultados imprecisos. Por isso, é importante revisar as notas geradas, bem como não confiar na ferramenta para informações críticas, que envolvem questões médicas ou financeiras, por exemplo.

Apesar de ter sido liberado globalmente e, em linhas gerais, funcionar bem, o NotebookLM ainda está em fase experimental.
NotebookLM: ferramenta de anotações com IA do Google já funciona no Brasil

NotebookLM: ferramenta de anotações com IA do Google já funciona no Brasil
Fonte: Tecnoblog

Tecnologia da Amazon usa IA para detectar produto danificado antes do envio

Tecnologia da Amazon usa IA para detectar produto danificado antes do envio

Ilustração do Project P.I. (imagem: divulgação/Amazon)

Muita gente já passou pela experiência de receber um produto avariado em compras online. Para amenizar esse problema, a Amazon anunciou o Project P.I., uma tecnologia que usa inteligência artificial (IA) para detectar possíveis danos em produtos antes de seu envio ao comprador.

P.I. é a sigla para “private investigator” (“investigador particular”). A própria Amazon explica que o nome faz alusão ao uso de ferramentas de detetive para detectar produtos suspeitos.

Tecnologia de visão computacional

Sendo exato, a ferramenta principal é um sistema de visão computacional que analisa imagens do produto na embalagem para detectar sinais que sugerem danos, como vazamento de líquidos, alteração no padrão de cores ou tamanho irregular.

Em muitos casos, o produto é danificado durante o envio. Entre as causas para isso estão descuidos no transporte (como deixar o pacote cair) ou armazenamento inadequado (deixar o produto sobre o motor quente do caminhão de entrega, por exemplo).

Mas há situações em que os danos ocorre no centro de distribuição e, muitas vezes, os funcionários envolvidos no processo de entrega não percebem o problema ou não o reportam. O Project P.I. foi desenvolvido justamente para cobrir essa brecha, por assim dizer.

Além de detectar sinais que sugerem danos em produtos, a tecnologia pode ajudar a Amazon ou as empresas associadas a identificar o problema que causou aquela avaria. Por exemplo, uma mancha úmida na embalagem sugere que pode haver um vazamento de água no armazém.

Quando o sistema detecta algo suspeito, o item é isolado, isto é, não é enviado para o cliente até ser conferido. Além disso, uma investigação é iniciada pela Amazon para verificar se o problema está presente em mais unidades do produto.

Constatada a avaria ou o defeito, a Amazon ou a empresa parceira tem a opção de descartar, doar ou revender o item com desconto (se isso for possível).

Animação sobre o funcionamento do Project P.I. (imagem: divulgação/Amazon)

Modelo de IA generativa

A Amazon também está implementando um sistema de IA generativa baseada em um LLM multimodal (ou MLLM) para tratar do pós-venda. A ideia é analisar queixas de clientes que devolvem ou pedem troca do produto.

Neste caso, o sistema analisa o feedback do comprador e compara as informações extraídas dali com as imagens registradas pelo Project P.I. de modo a confirmar se a queixa é coerente. Com isso, medidas preventivas podem ser tomadas, como revisar todo o estoque de um produto que parece ter um defeito recorrente.

Os resultados são promissores, tanto que a Amazon já usa as duas tecnologias em alguns centros de distribuição na América do Norte, com mais unidades da região devendo recebê-las até o fim do ano.

Presume-se que, a partir daí, os sistemas serão levados a unidades da Amazon em outras partes do mundo.
Tecnologia da Amazon usa IA para detectar produto danificado antes do envio

Tecnologia da Amazon usa IA para detectar produto danificado antes do envio
Fonte: Tecnoblog

ChatGPT apresenta instabilidade e fica fora do ar nesta terça-feira

ChatGPT apresenta instabilidade e fica fora do ar nesta terça-feira

ChatGPT apresenta instabilidade desde a madruga desta quarta-feira (Imagem: Vitor Pádua / Tecnoblog)

O ChatGPT apresentou uma instabilidade nesta terça-feira (4). O problema na IA generativa da OpenAI começou na madrugada. Alguns usuários ainda conseguiam acessar o serviço, mas para outros, o ChatGPT não carregava completamente.

Nos testes feitos pelo Tecnoblog, o serviço estava sem funcionar até aproximadamente 8h. Minutos depois, o ChatGPT voltou a carregar. Na página de status da OpenAI, a empresa seguia informando que a IA está indisponível para alguns usuários.

ChatGPT não carregava completamente durante período que esteve fora do ar (Imagem: Reprodução/Tecnoblog)

Segundo a classificação da OpenAI, o ChatGPT estava com um “major outage” — queda generalizada em tradução direta. A empresa afirma que já identificou a causa e que resolveu o problema às 8h19 (horário de Brasília). A OpenAI relata que segue monitorando os resultados da solução.

Painel de status da OpenAI indica que ChatGPT está com uma queda generalizada (Imagem: Reprodução/Tecnoblog)

Até o momento, a OpenAI não se pronunciou sobre o que causou a instabilidade no ChatGPT. O problema não afetou outros serviços da OpenAI, como a API do ChatGPT e o Labs. A IA generativa possui mais de 100 milhões de usuários semanais, segundo a própria empresa.

Problemas na terça-feira

Antes dessa queda total do ChatGPT, a IA generativa da OpenAI apresentou problemas de latência. A versão mobile, também na terça-feira, não estava gerando prompts com imagens. No dashboard, a OpenAI relata que corrigiu os problemas ainda na terça-feira.

Em 2023, após uma queda generalizada, a OpenAI passou por um dos seus piores problemas. Um bug no ChatGPT levou a um vazamento de dados dos usuários. Além de mostrar o histórico recente de conversas, o problema permitiu que usuários pudessem acessar dados de outras contas, além de receber emails de confirmações que deveriam ser enviados para outros usuários.

Com informações: The Verge e TechCrunch
ChatGPT apresenta instabilidade e fica fora do ar nesta terça-feira

ChatGPT apresenta instabilidade e fica fora do ar nesta terça-feira
Fonte: Tecnoblog

iOS 18: Apple poderá restringir alguns recursos de IA para iPhone 15 Pro e Pro Max

iOS 18: Apple poderá restringir alguns recursos de IA para iPhone 15 Pro e Pro Max

iPhone 15 Pro e Pro Max devem receber todos os recursos de IA (Imagem: Thássius Veloso/Tecnoblog)

A Apple está bem próxima de anunciar o iOS 18, e a atualização do sistema operacional deve vir recheada de recursos de inteligência artificial. No entanto, algumas funcionalidades de IA ficarão restritas para o iPhone 15 Pro e iPhone 15 Pro Max, deixando de fora os demais smartphones da maçã.

A informação foi revelada por Mark Gurman, jornalista da Bloomberg com bom histórico de acertos em vazamentos da Apple. Segundo ele, o iOS 18 deve utilizar tanto processamento local como em nuvem para recursos de inteligência artificial, e alguns recursos serão restritos aos smartphones com chip A17, presente apenas no iPhone 15 e iPhone 15 Pro.

Com essa restrição, proprietários de diversos smartphones da Apple não poderão acessar todos os recursos de inteligência artificial. Isso inclui até mesmo donos do iPhone 15 e iPhone 15 Plus, que utilizam o chip A16 mas foram lançados em conjunto com a linha iPhone 15 Pro.

Os requisitos mínimos de IA parecem ser um pouco mais flexíveis para iPads e Macs. Segundo Gurman, os recursos devem ficar disponíveis para equipamentos com chip M1 ou superior, presentes na linha Mac desde 2020 e no iPad Pro lançado em 2021.

Resta saber quais recursos de inteligência artificial serão exclusivos para modelos com chip mais novo. Um movimento similar foi feito pela Samsung, que limitou algumas funcionalidades do Galaxy AI em aparelhos lançados em 2021 e 2022 por conta da capacidade limitada de processamento.

O iOS 18 deve ser anunciado na WWDC 2024, marcada para 10 de junho. No evento especial, a Apple irá anunciar a atualização de software para desenvolvedores, e a versão final deve ser liberada ao público em meados de setembro.

iOS 18 terá Siri com novas funcionalidades

A Siri deve ser uma das principais atrações do iOS 18, com possibilidade de controlar todo o iPhone por comandos de voz. No entanto, os recursos devem chegar em uma atualização intermediária, prevista apenas para o início de 2025.

A assistente de voz deve utilizar um modelo de linguagem grande (LLM), mesma tecnologia utilizada pelo ChatGPT, Microsoft Copilot e Google Gemini.

Com informações: 9to5Mac
iOS 18: Apple poderá restringir alguns recursos de IA para iPhone 15 Pro e Pro Max

iOS 18: Apple poderá restringir alguns recursos de IA para iPhone 15 Pro e Pro Max
Fonte: Tecnoblog

WhatsApp testa botão para gerar imagens com IA

WhatsApp testa botão para gerar imagens com IA

Acesso à Meta AI no WhatsApp está disponível apenas em alguns países (Imagem: Vitor Pádua / Tecnoblog)

O WhatsApp pode ganhar uma ferramenta para gerar imagens usando inteligência artificial sem precisar sair de uma conversa. Um novo botão chamado “Imagine”, com o logo da Meta AI, está sendo testado. Ele ficaria nas opções de anexos — aquelas que aparecem ao tocar o ícone de clipe, ao lado do campo para escrever a mensagem.

A ferramenta surgiu na versão 2.24.12.4 do WhatsApp para Android, ainda em fase beta. A funcionalidade ainda está em desenvolvimento e não foi liberada para os usuários. O site WABetaInfo conseguiu acessá-la no código do app.

Botão Imagine aparece ao lado de fotos, áudios, enquetes e mais (Imagem: Reprodução / WABetaInfo)

A Meta AI está disponível apenas em alguns países, para usuários selecionados. Ela funciona como uma conversa própria, dentro do WhatsApp e de outros mensageiros da empresa. Em conversas em grupo, é possível mencioná-la, usando “@”, mas não dá para fazer isso em conversas individuais.

É aí que o botão “Imagine” pode ajudar. Sem ele, o usuário precisaria ir até a conversa com a Meta AI, gerar a imagem e voltar para o chat anterior. Com a opção nos anexos, dá para fazer isso dentro da conversa.

IA também vai fazer figurinhas no WhatsApp

A Meta AI ainda não está disponível no Brasil, mas já é possível usar recursos de inteligência artificial para algumas tarefas no WhatsApp. Nas últimas semanas, o mensageiro ganhou uma ferramenta para criar figurinhas usando IA.

Figurinhas geradas por IA no WhatsApp em português (imagens: Thiago Mobilon/Thássius Veloso/Tecnoblog)

No menu de figurinhas, um novo botão “Usar IA” está disponível. Ao tocar nele, o usuário pode descrever qual a imagem desejada. O WhatsApp, então, dá quatro opções — é possível enviar e salvar qualquer uma delas ou pedir para refazer, com outra descrição.

O gerador de figurinhas com IA está sendo liberado gradualmente, tanto para Android quanto para iOS.

Com informações: WABetaInfo
WhatsApp testa botão para gerar imagens com IA

WhatsApp testa botão para gerar imagens com IA
Fonte: Tecnoblog

Windows Recall roda em PC sem especificações exigidas pela Microsoft

Windows Recall roda em PC sem especificações exigidas pela Microsoft

Usuário consegue fazer Windows Recall rodar em processador Snapdragon sem NPU (Imagem: Reprodução/Albacore)

O leaker Albacore, conhecido por revelar novidades do beta do Windows, conseguiu rodar o Windows Recall em um Galaxy Book 2 Go. O laptop dos testes usa um Snapdragon 7c+ Gen 3, sem núcleo de processamento neural (NPU), uma especificação apresentada como obrigatória pela Microsoft para executar o Recall. O recurso utiliza IA para visualizar a tela do usuário e auxiliar na busca por informações.

O Windows Recall é uma das ferramentas que estreiam o conceito de AI PC, computadores Windows desenvolvidos para tarefas de inteligência artificial desde o início.  Esses PCs foram batizados de Copilot+. Para se encaixarem nesse rótulo, os computadores precisam das seguintes especificações:

16 GB de memória RAM

256 GB de armazenamento do tipo SSD

NPU

Tela sem notch (entalhe) para webcam

Botão Copilot no teclado

Galaxy Book 2 Go entra de penetra no conceito Copilot+

Windows Recall rodando em um notebook sem NPU (Imagem: Reprodução/Albacore)

O Galaxy Book 2 Go usado por Albacore tem 4 GB de memória RAM e, como dito no início, nada de NPU. No X/Twitter, na publicação em que revelou o feito, o leaker afirma que publicará um tutorial ensinando como instalar o Windows Recall em PCs “não compatíveis” — aspas porque a incompatibilidade parece ser um ponto burlável.

De acordo com Albacore, o Recall rodou sem problemas no Galaxy Book 2 Go. O laptop foi lançado em 2023 pela Samsung. O Snapdragon 7c+ Gen 3 que o equipa conta com oito núcleos e frequência máxima de 2,4 GHz.

O vídeo do processo de adaptação do Windows Recall para o Galaxy Book 2 Go causou uma confusão. Nas imagens, é bem visível os travamentos durante a captura. Porém, Albacore afirma que isso é culpa do sistema de gravação, que utilizou uma sessão remota para a captação das imagens.

Algumas pessoas entenderam que o travamento era causado pelo fato de rodar o Recall em um chip antigo. Contudo, Albacore afirma que o seu teste mostra que será possível instalar a ferramenta em processadores AMD e Intel sem NPUs.

Confira o Windows Recall no vídeo abaixo

Ver essa foto no Instagram Uma publicação compartilhada por Tecnoblog (@tecnoblog)

Com informações: The Verge
Windows Recall roda em PC sem especificações exigidas pela Microsoft

Windows Recall roda em PC sem especificações exigidas pela Microsoft
Fonte: Tecnoblog

IA fará Windows durar mais 40 anos, diz VP da Microsoft

IA fará Windows durar mais 40 anos, diz VP da Microsoft

Aaron Woodman é vice-presidente de marketing da Microsoft (Imagem: Vitor Pádua/Tecnoblog)

(Direto de Redmond, nos EUA) A cada segundo, são vendidos no mundo nove computadores com algo em comum: eles rodam Windows. Nesta semana, a Microsoft deu um importante passo para um futuro no qual a inteligência artificial offline fará parte do sistema mais usado no mundo corporativo. Este gesto permitirá que o Windows dure mais 40 anos, na visão de um dos principais nomes da empresa: Aaron Woodman.

Eu realizei uma entrevista exclusiva com o vice-presidente de marketing da Microsoft no novo e belo campus da companhia nos Estados Unidos. Woodman me explicou o que está por trás do anúncio do selo Copilot+, que contempla notebooks tão poderosos a ponto de rodarem IA sem depender da internet.

Também joguei pimenta na conversa: perguntei se o lançamento tinha o objetivo de sair na frente da principal, que não oferece nenhum MacBook com IA offline. Ele foi taxativo: “não penso muito na Apple”. Entenda o motivo nas linhas a seguir.

Tecla no Surface Laptop aciona a IA do Copilot (Foto: Thássius Veloso/Tecnoblog)

Thássius Veloso – Eu considero Copilot um nome excelente. Como vocês chegaram nesta escolha? Os nomes de produtos de IA similares me parecem bem mais técnicos.

Aaron Woodman (Microsoft) – Nós temos essa crença de que a inteligência artificial serve ao propósito de auxiliar os humanos, e não o de tomar o controle de tudo. Esse nome nos ajuda a enfatizar a parceria entre os indivíduos e as ferramentas. Nós somos a companhia do Copilot.

Quando eu cheguei aqui hoje, havia algumas placas falando que era o início de uma nova era da IA. Por que disso? Já se fala sobre esta nova leva de inteligência artificial há quase dois anos.

Isso é muito interessante! A minha história com IA começou há cerca de sete anos, quando nós vimos os primeiros modelos de machine learning. Eles dependiam de grandes servidores de computação em nuvem para funcionar. Agora é a primeira vez que a gente tem uma plataforma funcionando localmente nos nossos dispositivos eletrônicos. Ocorreram avanços importantes de desempenho, velocidade e privacidade. As NPUs simplesmente pedem muito menos energia para realizar as inferências. Além disso, o Windows existe há quase 40 anos e é utilizado por 1,4 bilhão de pessoas, mas eu diria que é a primeira vez desde 1995 que a gente tem uma nova visão do que o sistema é capaz de fazer para ajudar os usuários. Para completar, é a primeira vez que se vê AMD, Intel, Qualcomm e fabricantes de PC indo na mesma direção, praticamente em uníssono.

Quem foi a pessoa que conseguiu juntar tantas pessoas diferentes? O Satya Nadella?

Nós estamos trabalhando neste projeto há quatro ou cinco anos. No entanto, foi o Stevie Bathiche quem realmente compreendeu como os modelos de IA poderiam funcionar na borda. Isso combinou com a visão do Satya (CEO), da Amy Hood (do departamento de finanças), do Kevin Scott (que cuida das parcerias) e do Pavan Davuluri (vice-presidente do Windows). Eles conseguiram visualizar o futuro da inteligência artificial e também quais progressos nos permitiriam criar um produto assim.

Existe uma famosa entrevista em que o Satya Nadella fala que a Microsoft fez o Google se mexer com relação à IA no ambiente online. Agora vocês anunciam um sistema com IA local. Nessa caso, estão tentando fazer a Apple se mexer?

Na verdade, eu não penso muito na Apple.

Sério?! Por que não?

Nós estamos em categorias bem diferentes: fazemos PCs, enquanto o principal produto deles é o smartphone. É bem verdade que cerca de 70% dos usuários de iPhone estão num computador com Windows, até porque a Apple tem produtos muito caros. O Windows é a plataforma preferida das empresas, e foi por isso que começamos a pensar sobre quais problemas seriam resolvidos com a IA local. A Apple fez um trabalho fantástico os chips M nos MacBooks, algo que ainda não tínhamos visto na categoria dos PCs. Usamos isso como um marco de onde gostaríamos de chegar. Eu não fico pensando que eles fizeram isso, então nós temos que fazer aquilo. O projeto do Copilot+ existe há dois anos.

Ou seja, existe uma visão por trás disso tudo.

Com certeza. E sabe, acredito que começaremos a ver um monte de empresas implementando a inteligência artificial offline, inclusive a Apple. Eles definitivamente possuem NPUs tanto nos telefones quanto nos computadores. A questão aqui é sobre como construir uma plataforma em cima disso.

O Windows Recall é um bom exemplo: imagine que você está num documento com três páginas, você está na primeira e aos poucos vai rolando para as próximas. Criar um índice disso para buscas rápidas normalmente exigiria muito processamento e energia. No entanto, nós usamos o compositor gráfico do próprio Windows para isso. Esse tipo de implementação não acontece se a gente ficar pensando “hmmm, o que vamos fazer hoje?”, mas sim porque temos um cronograma.

Por falar em Recall… Algumas empresas monitoram o que os funcionários fazem no PC, tanto que existe uma categoria de programas chamada bossware. Essa nova ferramenta poderia ser usada para isso?

Eu torço para que não usem. Nós tivemos uma abordagem muito conservadora ao criar o Windows Recall. O índice semântico dele fica salvo localmente no computador da pessoa, de forma criptografada. Além disso, os dados do usuário não são usados para treinar nossos modelos de IA nem vão para a nuvem. O cliente ainda pode pausar o Recall a qualquer momento ou definir certas regras. Um administrador de TI consegue ver o quando de espaço está sendo usando pelo Recall, mas não o conteúdo. Ele poderia se autenticar como funcionário para ver as coisas? Sim, mas isso já é possível hoje. Eles não terá nenhum acesso remoto à memória do Recall.

Será necessário um computador com selo Copilot+ para aproveitar essas novidades?

Nós anunciamos que os preços da nova linha do Surface começam em US$ 999 e as vendas estão marcadas para 18 de junho aqui nos Estados Unidos. As funcionalidades apresentadas na Build 2024 não são possíveis em processadores antigos ou em outros dispositivos. A nossa expectativa é de que mais laptops com os atributos do Copilot+ sejam anunciados nos próximos meses, em especial conforme a AMD e a Intel apresentarem suas novidades.

Produtos realmente importantes acabam se transformando numa espécie de plataforma que possibilita a inovação de outros agentes. É assim com o Windows e os provedores de serviços ao redor dele. A Apple fez o mesmo com o iPhone e os desenvolvedores de aplicativos para iOS, ou ainda o Google com a busca e os responsáveis pelos websites. Nós acreditamos que os computadores do Copilot+ serão este tipo de produto.

A AMD e a Intel terão que produzir chips compatíveis com ARM64?

Não necessariamente. Elas ainda poderão fabricar chips em x86 ou x64, mas é realmente importante alcançar os parâmetros de velocidade e colocar uma NPU no SoC. Não há nenhuma exigência para que elas adotem a arquitetura da Arm.

Vocês falaram tanto de Copilot que muita gente me fez a seguinte pergunta: a Microsoft mudou de marca?

Nós estamos dizendo que o Windows está aí há 40 anos e provavelmente continuará conosco mais 40. A diferença não está na experiência de usuário, mas sim no que o Windows é capaz de fazer – e isto está contemplado pelo Copilot. Nós estamos falando de uma plataforma completa que existe desde a nuvem, com o Azure, até localmente no aparelho da pessoa, com a NPU.

Surface Laptop de 13,8 polegadas (Foto: Thássius Veloso/Tecnoblog)

Qual é a versão do GPT no Copilot+?

Não é um GPT, mas sim cerca de 40 funções de IA rodando simultaneamente no Windows, dentre elas vários SMLs (pequenos modelos de linguagem). Estas ferramentas são preparadas para tarefas muito específicas, como o OCR para reconhecimento de texto. Nós também temos LLMs, como o Phi, que está em uso no Windows. Alguns modelos de Gen AI são proprietários e foram produzidos pela Microsoft para atividades como a do Cocreate na nova versão do Paint.

E como diferenciar um AI PC de um Copilot+ PC?

AI PC é qualquer computador que permita acelerar a inteligência artificial diretamente no dispositivo. Existem vários assim com poder de processamento de 10 ou 12 trilhões de operações por segundo (tops). Eles são muito bons para coisas específicas, como ajudar na edição de imagem. Já o Copilot+ dá um salto em termos de processamento e permite a execução permanente de funções de IA. O Recall, por exemplo, continuamente observa cada pixel na tela e constrói uma semântica em cima do que ele vê. Para isso, são necessários pelo menos 40 tops.

Ver essa foto no Instagram Uma publicação compartilhada por Tecnoblog (@tecnoblog)

Há algumas semanas surgiu uma polêmica com a Microsoft por causa de propagandas no menu Iniciar. Isso realmente vai acontecer?

Não é a nossa intenção. Assim como qualquer outra empresa, quando se trata do navegador, se você acessar microsoft.com, queremos falar sobre o Edge e promover nossos serviços. Acreditamos que nestes espaços é razoável promover coisas da Microsoft, assim como o Google oferece o Chrome para quem entra no YouTube. Há uma década, você instalava um antivírus e vinha um novo navegador junto. Isso confundia os consumidores e nós não permitimos mais que aconteça. Nossa meta é proteger as pessoas. Ainda assim, podemos sugerir aplicativos quando o usuário acessa Microsoft Store. Nós estamos sempre em busca de sinais sobre quais são os limites.

Os usuários de Windows ficaram muito aborrecidos com essa história. É um sinal para vocês?

Com certeza. E nós temos iniciativas como o programa Windows Insider, em que nós experimentamos abordagens novas e diferentes. As pessoas sabem disso quando entram neste programa. Nele são feitos testes e temos diálogos sobre o que estamos tentando fazer. Pra gente ficou muito claro que os usuários não queriam aquilo.

A alucinação continua sendo um assunto frequente quando falamos de inteligência artificial generativa. Como resolver isso no Windows 11 do Copilot+?

Não há muita criação de texto ou produção de respostas no Windows 11. O Recall depende de Gen AI porque estamos levando em consideração o entendimento semântico do texto e tentando casar com os pixels que apareceram na tela. É muito improvável que uma ferramenta assim produza comportamentos inadequados porque ela apenas olha o conteúdo que você viu. Até mesmo a criação de imagens se baseia num prompt que realiza a compreensão semântica. Para isso, há diversos limites de uso.

Para fechar aqui: como vocês escolhem os países que vão receber o Surface? O Brasil não está na lista…

Adorei a pergunta! Nós temos um enorme ecossistema de hardware, o que nos permite vender PCs Windows em mais de 142 países. O Copilot+ estará à disposição numa ampla gama de aparelhos. Isso é determinado com base no volume potencial de vendas e nas nossas parcerias comerciais. Assim como qualquer outro negócio, tentamos descobrir onde estão os clientes que se interessariam pelas características únicas dos nossos produtos. Nosso comportamento é ditado por isto.

Também tem o fato de que a IA é uma daquelas áreas em que a linguagem importa muito, tanto na semântica quanto na compreensão. Então nosso suporte a idiomas também precisa amadurecer, seja no português, no espanhol ou em qualquer outra língua. Este aspecto também dita a rapidez com que levamos as inovações às localidades.

Thássius Veloso entrevista Aaron Woodman, VP global de marketing da Microsoft (Foto: Tecnoblog)

Thássius Veloso viajou para os Estados Unidos a convite da Microsoft
IA fará Windows durar mais 40 anos, diz VP da Microsoft

IA fará Windows durar mais 40 anos, diz VP da Microsoft
Fonte: Tecnoblog

Maluquices da IA: Google sugere passar cola em pizza

Maluquices da IA: Google sugere passar cola em pizza

Google liberou AI Overview para todos os usuários nos Estados Unidos e alguns resultados impressionam (Ilustração: Vitor Pádua/Tecnoblog)

O AI Overview, recurso do Google que mostra um resumo da busca usando IA, sugeriu que cola branca pode ser usada na massa de pizza. No prompt usado para essa resposta, um usuário buscava uma solução para o queijo que não grudava na pizza. A fonte da IA foi um comentário jocoso feito no Reddit em 2013.

Contudo, esta não foi a única alucinação de IA que viralizou nos últimos dias. Nas redes sociais, tanto no X/Twitter quanto no Threads, usuários divulgaram relatos de sugestões malucas ou completamente errôneas da ferramenta. Por exemplo, a IA afirmou que a píton (uma espécie de cobra) é o mamífero com mais ossos e que é recomendado comer uma pedra por dia — ou quatro meias.

O AI Overview foi liberado para todos os usuários nos Estados Unidos no dia 14 de maio. Antes disso, usuários tinha a opção de ativar ou não o recurso. Os resultados sugerem que o Google ainda tem um longo passo para melhorar a qualidade das respostas.

AI Overview tem problema de ranqueamento

AI Overview posiciona “passar cola na pizza” em primeiro lugar na resposta (Imagem: Reprodução/Reddit)

No caso da cola na pizza, a IA ranqueia essa informação em primeiro lugar. Na sequência, ela lista mais duas dicas de como resolver o problema do queijo não grudar na massa: esperar a pizza esfriar para que o queijo “se assente” ou deixar no forno até que ele derreta.

Em uma pesquisa sobre gatos lambendo a mão dos humanos, a jornalista Mia Sato, do The Verge, destaca a falta de clareza a IA em ranquear os resultados. Em uma das possíveis causas, a AI Overview diz que uma das razões para gatos fazerem isso é sentir o gosto para saber se o humano é apto para o consumo.

Em nota enviada ao The Verge, o Google disse que esses erros costumam acontecer com prompts muito incomuns e que não representam a experiência da maioria das pessoas. O que não justifica porque o AI Overview diz que pítons são mamíferos e usou o The Onion (uma espécie de O Sensacionalista dos Estados Unidos) para dizer que podemos comer uma pedra por dia — e o Copilot já sabe do caso da rival.

AI Overview do Google usou site de humor para dizer que comer é recomendável comer uma pedra por dia (Imagem: Casey Newton/Reprodução)

Sundar Pichai, CEO do Google, afirmou para o The Verge que resolver os problemas de alucinações da IA não está no roadmap da big tech. A empresa trabalha nessa situação de forma mais generalista, conforme vai desenvolvendo a tecnologia.

ChatGPT pagará para usar conteúdo do Reddit

Na última sexta-feira (17), a OpenAI e a plataforma anunciaram uma parceria, na qual o Reddit receberá um valor para usar o conteúdo da rede no treinamento do ChatGPT.

O fato do AI Overview do Google ter tirado piadas do Reddit como informações mostra que a rede social não é a melhor fonte para IAs — além de que o recurso ainda precisa melhorar. Apesar do Reddit conter informações úteis para sanar dúvidas em alguns casos, a plataforma é muito mais uma rede social.

Com informações: The Verge (1, 2 e 3)
Maluquices da IA: Google sugere passar cola em pizza

Maluquices da IA: Google sugere passar cola em pizza
Fonte: Tecnoblog

Arc cria call center de mentirinha com IA para responder perguntas

Arc cria call center de mentirinha com IA para responder perguntas

Respostas do Call Arc também aparecem na tela (Imagem: Reprodução / Arc)

O aplicativo Arc Search ganhou uma nova forma para você fazer buscas e perguntas: simulando uma chamada telefônica com uma inteligência artificial. Com o Call Arc, nome do novo recurso, o usuário coloca o celular na orelha, diz o que quer saber e ouve as respostas instantaneamente.

Com o navegador aberto no iPhone (ele não tem versão para Android ainda), basta levantar o aparelho e colocá-lo junto ao rosto, como se você estivesse atendendo a uma ligação. Então, é só fazer a pergunta desejada. Infelizmente, o robô só fala e entende inglês.

Introducing CALL ARC, a brand new way to get an answer on the go.Say you’re walking to the train and you’ve got a quick question.Just raise Arc Search to your ear and ask it! pic.twitter.com/mt5aqGQV3Y— nate parrott (@nateparrott) May 23, 2024

O Arc Search já conta com uma pesquisa por voz, mas a desenvolvedora The Browser Company promete que o novo jeito é mais rápido. “Seja fazendo várias coisas ao mesmo tempo, seja andando por aí, o Call Arc resolve seu problema”, diz o comunicado da empresa enviado para os usuários.

Eu duvido muito que seja mais rápido, mas é uma ideia divertida, pelo menos.

No vídeo de apresentação, o Arc dá alguns exemplos de pedidos: como tirar manchas de uma camisa branca, dicas de restaurantes veganos no bairro e qual a diferença entre dois tipos de cebolinha.

O aplicativo responde em áudio, mas também pode mostrar links na tela, junto a um botão para ler mais. Também dá para fazer mais de uma pergunta durante a mesma “ligação”.

Para dar um ar mais autêntico para o call center fake, o Arc até toca uma musiquinha enquanto você aguarda sua resposta ou resultado da pesquisa. Felizmente, o tempo de espera é de apenas alguns segundos, bem diferente das centrais telefônicas de verdade.

Arc Search resume páginas no iPhone

O Call Arc é o mais novo recurso do Arc Search, navegador da The Browser Company lançado para iPhone em janeiro de 2024.

Arc Search cria páginas de resumo com informações da busca (Imagem: Giovanni Santa Rosa / Tecnoblog)

O recurso mais chamativo do Arc Search é a IA utilizada no buscador. Ela reúne informações dos seis primeiros resultados da pesquisa e cria uma página única com os principais tópicos.

A desenvolvedora ganhou atenção com o Arc para desktop. O navegador promete “reimaginar” a internet, com recursos como organizar as abas em espaços, exibir sites em janelas pequenas, dividir a tela para mostrar mais de um site ao mesmo tempo e dar opções para personalizar as páginas que você mais visita.

Com informações: TechCrunch
Arc cria call center de mentirinha com IA para responder perguntas

Arc cria call center de mentirinha com IA para responder perguntas
Fonte: Tecnoblog