A Amazon aceitou esta semana investir até 4 mil milhões de dólares na Anthropic, unindo uma das maiores plataformas de cloud do mundo à empresa de desenvolvimento da família de modelos de inteligência artificial Claude, num negócio que vai muito além de um investimento de risco convencional. A Anthropic fará da Amazon Web Services o seu principal fornecedor de cloud para cargas de trabalho de missão crítica, treinará e implementará modelos futuros em chips concebidos pela Amazon e dará aos clientes da AWS acesso às futuras gerações do Claude através do Amazon Bedrock.

O anúncio feito pelas empresas a 25 de setembro refere que a Amazon vai assumir uma participação minoritária e investir até 4 mil milhões de dólares. A Anthropic, cliente da AWS desde 2021, utilizará os aceleradores AWS Trainium e Inferentia para construir, treinar e implementar futuros modelos fundamentais e trabalhará com a Amazon no desenvolvimento de gerações posteriores destes chips.

O compromisso financeiro é apenas uma parte do acordo. Reportagens recentes do TechCrunch indicam que a Amazon está a investir inicialmente 1,25 mil milhões de dólares e tem a opção de aumentar o total para 4 mil milhões de dólares. A estrutura permite à Anthropic ter acesso a capital para um programa de investigação computacional intensiva, ao mesmo tempo que concede à Amazon uma participação estratégica numa empresa de desenvolvimento de modelos independente líder de mercado.

As empresas estão também a ligar o futuro roteiro técnico da Anthropic diretamente à infraestrutura da AWS. A Anthropic planeia executar a maior parte das suas cargas de trabalho na AWS e utilizar o Trainium para o treino de modelos e o Inferentia para a implementação. Estes chips são a tentativa da Amazon de oferecer alternativas ao hardware de processamento gráfico que domina o desenvolvimento de modelos de grande escala, dando à AWS mais controlo sobre a economia e a cadeia de fornecimento da computação de IA.

The Guardian de 25 de setembro enfatizou que a AWS se torna o principal fornecedor de cloud da Anthropic, em vez de um fornecedor exclusivo. Esta distinção permite à Anthropic manter outras relações de infraestrutura, ao mesmo tempo que torna a Amazon a plataforma central para a investigação de segurança e o desenvolvimento futuro do modelo de fundação.

A Bedrock transforma a parceria num produto para os clientes da AWS

O acordo também fortalece o Amazon Bedrock, o serviço gerido de modelos de base que a AWS lançou no início deste ano. A Anthropic comprometeu-se a disponibilizar as futuras gerações dos seus modelos aos clientes da AWS através do Bedrock e a fornecer acesso antecipado a funcionalidades de personalização e afinação dos modelos. Isto oferece à Amazon uma resposta direta aos concorrentes da cloud que estão a combinar a infraestrutura com modelos de IA proprietários ou estrategicamente alinhados.

O Claude 2 já estava disponível na Bedrock antes do investimento. Um comunicado da AWS de 1 de agosto descrevia o Claude 2 como compatível com prompts até 100.000 tokens, permitindo aos clientes trabalhar com documentos longos, bases de código, transcrições e outras entradas de texto extensas. A presença já existente do modelo na AWS significa que o acordo de setembro expande uma relação operacional, em vez de criar uma de raiz.

Três dias depois de ter anunciado o investimento da Anthropic, a AWS informou que o Amazon Bedrock passou a estar disponível para o público em geral nas regiões Leste e Oeste dos EUA. O serviço oferece modelos da Anthropic, AI21 Labs, Cohere, Meta, Stability AI e da própria Amazon através de um ambiente gerido comum. A AWS afirmou que o Bedrock inclui capacidade de processamento provisionada e integrações com o CloudWatch e o CloudTrail, além de ter obtido a certificação HIPAA e a conformidade com o RGPD.

Uma publicação separada da AWS, datada de 28 de setembro, apresentou o Bedrock como uma infraestrutura que permite aos clientes escolher entre vários fornecedores de modelos sem terem de gerir os servidores subjacentes. O compromisso mais profundo da Anthropic oferece, portanto, à Amazon uma família de modelos proeminente dentro de um serviço concebido em torno da escolha do cliente, em vez de um único modelo próprio.

A Anthropic está a construir uma rede de distribuição empresarial em torno de Claude

A Anthropic dedicou grande parte de 2023 a expandir as possibilidades de utilização do Claude no meio corporativo. Em abril, a empresa anunciou uma parceria com a Scale AI que combina o Claude com a implementação empresarial, os conectores de dados e os serviços de avaliação de modelos. Este acordo já previa clientes a executar aplicações em ambientes AWS privados, ilustrando como a infraestrutura na cloud já fazia parte da estratégia corporativa da Anthropic antes do investimento desta semana.

No início deste mês, a Anthropic anunciou também uma parceria com o Boston Consulting Group para disponibilizar o Claude em projetos corporativos que envolvem gestão do conhecimento, estudos de mercado, deteção de fraudes, previsão, relatórios e análise de negócios. Em conjunto, estas parcerias demonstram a tentativa da Anthropic de migrar de um laboratório de projetos-modelo para um fornecedor de plataformas comerciais, mantendo o foco na segurança e controlabilidade da IA.

A parceria com a Amazon confere a esta estratégia muito mais infraestruturas e escala de distribuição. A AWS conta com milhões de clientes, uma grande organização de vendas empresariais e uma rede global de parceiros. Se estes clientes conseguirem aceder ao Claude através do Bedrock, utilizando contratos de cloud e controlos de segurança existentes, a Anthropic poderá alcançar organizações que talvez estejam relutantes em desenvolver integrações diretas com uma empresa de IA mais pequena.

O acordo intensifica a concorrência entre as maiores plataformas de cloud

O contexto estratégico é indissociável da relação bilionária da Microsoft com a OpenAI e dos investimentos da própria Google em IA generativa. O desenvolvimento de modelos de grande escala exige enormes gastos em chips, data centers e energia. Os fornecedores de cloud podem fornecer esta infraestrutura, ao mesmo tempo que utilizam parcerias de modelos para tornar as suas plataformas mais atrativas para os programadores e empresas.

O anúncio da Amazon combina, portanto, três objetivos competitivos. Proporciona à AWS uma relação mais profunda com uma empresa de desenvolvimento de modelos de destaque, cria um importante cliente potencial para os chips de IA personalizados da Amazon e fortalece a Bedrock com futuros modelos Claude e capacidades de personalização. A Anthropic recebe capital, capacidade computacional e acesso à rede de distribuição da Amazon.

O acordo não transforma a Anthropic numa subsidiária da Amazon. A Amazon está a adquirir uma participação minoritária, e a Anthropic continua a operar de forma independente. Esta separação é importante porque a Anthropic construiu a sua identidade em torno da investigação de sistemas de IA fiáveis, interpretáveis ​​e controláveis, e tem parcerias para além da Amazon. O CEO da empresa, Dario Amodei, afirmou no anúncio conjunto que a utilização alargada da AWS ajudaria a Anthropic a avançar na investigação de segurança de IA e a escalar o Claude de forma responsável.

A economia da IA ​​de ponta está a tornar-se inseparável da infraestrutura em nuvem

A dimensão do compromisso da Amazon ilustra uma característica estrutural do mercado de IA generativa: os modelos mais avançados são extraordinariamente dispendiosos de treinar e disponibilizar. Os criadores de modelos precisam de acesso a milhares de aceleradores, redes de alta largura de banda, armazenamento e energia, enquanto os fornecedores de cloud precisam de modelos robustos que possam impulsionar novas cargas de trabalho nas suas plataformas.

Isto cria um forte incentivo para parcerias em que o investimento, as infraestruturas e a distribuição de modelos são negociados em conjunto. A Amazon não está simplesmente a financiar a Anthropic e a esperar que a sua participação se valorize. Está a tentar garantir que o desenvolvimento futuro de modelos da Anthropic consuma poder computacional da AWS, utilize os recursos de silício da Amazon e produza serviços que a AWS possa vender aos clientes.

Para a Anthropic, o acordo fornece recursos para continuar a competir com empresas tecnológicas muito maiores, preservando a participação minoritária e uma identidade corporativa separada. Para a Amazon, é a iniciativa mais clara até à data para integrar um laboratório de IA externo de ponta na AWS. O resultado é uma parceria cujo valor será medido não só pela dimensão do investimento, mas também pela capacidade de Claude impulsionar a adopção do Bedrock pelas empresas e de consolidar a Trainium e a Inferentia como uma infra-estrutura fiável para o desenvolvimento de modelos de vanguarda.