A Amazon Web Services entrou esta semana na corrida cada vez mais feroz das plataformas de inteligência artificial generativa com o Amazon Bedrock, um serviço gerido concebido para permitir às empresas criar aplicações com base em modelos fundamentais da Amazon e de empresas externas de IA, sem terem de operar a infraestrutura subjacente.
A AWS anunciou na quinta-feira o Bedrock como um serviço em pré-visualização limitada que oferece acesso, através de APIs, a modelos da AI21 Labs, Anthropic, Stability AI e da nova família Titan da Amazon. A estratégia difere da de ligar os clientes a um único modelo: a AWS está a posicionar a sua cloud como uma camada onde as empresas podem comparar, personalizar e implementar várias famílias de modelos de base, mantendo as suas aplicações dentro do ambiente AWS mais amplo.
A Amazon está a transformar a escolha de modelos num recurso da nuvem
Inicialmente, o Bedrock inclui os modelos de linguagem Jurassic-2 da AI21, o modelo conversacional Claude da Anthropic, a tecnologia de texto para imagem da Stability AI e dois modelos Titan da Amazon. Um modelo Titan gera e resume texto; outro cria embeddings que traduzem texto em representações numéricas úteis para pesquisa, recomendação e outras tarefas de aprendizagem automática.
O serviço reflete uma mudança mais ampla na computação em nuvem. Durante anos, os principais fornecedores competiram por armazenamento, bases de dados, máquinas virtuais e infraestruturas especializadas em aprendizagem automática. Os modelos base acrescentam agora uma camada de aplicação superior: os clientes querem sistemas pré-treinados poderosos, mas muitos não querem montar clusters, treinar modelos de raiz ou gerir pipelines de implementação complexos.
O TechCrunch noticiou que o Bedrock tem como objetivo fornecer aos programadores acesso sem servidor a múltiplos modelos generativos e permitir que os clientes os personalizem com os seus próprios dados. Esta combinação — infraestrutura gerida mais adaptação específica para cada empresa — é fundamental para a proposta da AWS.
Os dados empresariais são o fator diferenciador
O entusiasmo dos consumidores em relação à IA generativa tem-se centrado nos chatbots públicos e nos geradores de imagens, mas a adoção empresarial depende de requisitos diferentes: governação de dados, segurança, custos previsíveis, integração com sistemas existentes e a capacidade de adaptar modelos a informações proprietárias.
A AWS afirma que os clientes do Bedrock poderão fornecer exemplos rotulados ou dados corporativos para personalizar um modelo básico sem terem de gerir diretamente a infraestrutura de formação. A empresa afirma ainda que os dados do cliente utilizados para a personalização permanecerão protegidos dentro dos acordos da AWS, em vez de serem expostos indiscriminadamente aos fornecedores de modelos.
A Forbes noticiou que o anúncio é dirigido diretamente a clientes empresariais e coloca a Amazon em maior destaque ao lado da Microsoft e da Google na competição de IA generativa. A Microsoft investiu fortemente na OpenAI e está a integrar os seus modelos no Azure e no software de produtividade; a Google está a desenvolver os seus próprios modelos de grande escala e serviços generativos.
A questão competitiva, portanto, não é simplesmente qual a empresa que possui o modelo mais eficiente. Os fornecedores de cloud estão a construir ecossistemas nos quais modelos, dados, identidade, monitorização, bases de dados e aplicações podem ser combinados. A Bedrock sugere que a Amazon acredita que as empresas irão valorizar a escolha de modelos e a neutralidade da infraestrutura o suficiente para compensar a sua entrada posterior no mercado de IA impulsionado pelos chatbots.
A Titan fornece à Amazon uma camada de modelos próprios
A introdução do Titan é importante porque a AWS não está apenas a alojar fornecedores externos. Agora, tem uma família de modelos básicos com marca própria que podem competir dentro da mesma plataforma. Isto cria uma estrutura de mercado invulgar, na qual a Amazon é simultaneamente operadora da plataforma e fornecedora de modelos.
Um relatório da altura do lançamento descreveu o Bedrock como a resposta da Amazon aos serviços de IA na nuvem que estavam a surgir da Microsoft e da Google. Os modelos Titan próprios dão à AWS uma participação direta no desempenho dos modelos, enquanto a linha de modelos de terceiros permite aos clientes evitar depender de um único fornecedor.
Esta abordagem pode ser especialmente atraente porque o campo está a mudar rapidamente. O lançamento do GPT-4 no mês passado demonstrou ganhos substanciais de capacidade em relação aos sistemas anteriores e intensificou as expectativas de que a qualidade dos modelos continuará a evoluir rapidamente. As empresas podem preferir uma arquitetura que facilite a troca ou a combinação de modelos, em vez de ligar uma aplicação a um fornecedor em rápida evolução.
A corrida pela IA está a tornar-se uma corrida pela infraestrutura
Os modelos de fundação requerem grandes quantidades de computação especializada. A AWS já vende acesso a GPUs da Nvidia e aos seus próprios chips Trainium e Inferentia, o que confere à empresa uma posição de destaque em hardware e infraestruturas mesmo antes do Bedrock. O novo serviço eleva a AWS a um patamar superior na cadeia de valor, permitindo-lhe captar receitas da camada de software construída sobre esta computação.
A reportagem da ForkLog de 14 de abril enfatizou a estrutura de múltiplos modelos e o esforço da Amazon para disponibilizar IA generativa através de APIs de cloud já conhecidas. A BigDATAwire também noticiou que a AWS está a integrar o novo serviço de modelos num conjunto mais amplo de ferramentas de IA generativa para programadores e empresas.
As questões técnicas e comerciais são ainda substanciais. Os modelos generativos podem gerar alucinações de informação falsa, reproduzir enviesamentos, expor material sensível se os limites dos dados estiverem mal definidos e criar custos imprevisíveis quando utilizados em larga escala. As empresas esperarão que os fornecedores de cloud ofereçam monitorização, controlos de acesso, ferramentas de avaliação e garantias contratuais que as experiências orientadas para o consumidor geralmente não possuem.
O Bedrock ainda está numa fase de pré-visualização limitada, pelo que o seu desempenho prático, preços e restrições operacionais ainda não foram estabelecidos para uma ampla base de clientes. Mas a direção estratégica é clara. A IA generativa está a migrar de demonstrações isoladas para os portfólios de produtos principais das maiores empresas de cloud.
A aposta da Amazon é que as empresas não vão escolher a IA de forma isolada. Vão escolhê-la em conjunto com as bases de dados, os sistemas de segurança, os serviços de computação e os ambientes de software que já utilizam. A confirmar-se esta tese, a próxima fase da competição da IA generativa poderá ser decidida tanto pela arquitetura e distribuição na cloud como pelos principais benchmarks de modelos.