A Meta lançou o Llama 2, a próxima geração da sua família de modelos de linguagem de grande dimensão, numa iniciativa que visa alargar o acesso comercial à inteligência artificial generativa e desafiar a estratégia de modelos fechados utilizada por vários concorrentes líderes. O anúncio da empresa, feito a 18 de julho, refere que o Llama 2 estará disponível gratuitamente para uso comercial e em investigação, com a Microsoft como parceiro preferencial da Meta para distribuição através do Azure e do Windows.
O lançamento inclui modelos pré-treinados e otimizados para chat com 7 mil milhões, 13 mil milhões e 70 mil milhões de parâmetros. A Meta fornece os pesos dos modelos e o código inicial, oferecendo aos programadores um controlo substancialmente maior sobre a implementação e o ajuste fino do que os sistemas que dependem exclusivamente de APIs. Isto faz do Llama 2 não apenas mais um modelo de chatbot, mas uma tentativa estratégica de estabelecer um ecossistema aberto em torno da infraestrutura de IA generativa.
A Meta aposta que a distribuição pode ser mais valiosa do que a exclusividade
O artigo técnico, Llama 2: Open Foundation and Fine-Tuned Chat Models, descreve uma família de modelos pré-treinados e versões focadas no diálogo, treinados com ajuste fino supervisionado e aprendizagem por reforço a partir de feedback humano. A Meta afirma que os modelos de chat superam outros sistemas disponíveis publicamente em diversos benchmarks e foram avaliados quanto à sua utilidade e segurança através de testes automatizados e com humanos.
A própria publicação de investigação da Meta sublinha que o lançamento visa tornar o desenvolvimento de modelos de grande dimensão mais acessível a investigadores e empresas que não dispõem de recursos para treinar sistemas de ponta a partir do zero. O modelo de 70 mil milhões de parâmetros é particularmente significativo porque coloca um modelo de escala substancial num ecossistema onde os programadores podem examiná-lo, adaptá-lo e implementá-lo por conta própria.
Esta abordagem difere do modelo utilizado pela OpenAI e pela Google para os seus principais sistemas de consumo, onde os modelos mais avançados geralmente permanecem protegidos por interfaces proprietárias. A Meta aposta que a ampla adoção por parte dos programadores, a disponibilidade na cloud e a experimentação externa podem criar uma plataforma mais robusta para o Llama do que manter a tecnologia sob um controlo apertado.
A Microsoft ganha mais uma importante plataforma de IA sem abandonar a OpenAI
A Microsoft afirmou, no seu anúncio de parceria , que os clientes do Azure poderão ajustar e implementar modelos do Llama 2 através do catálogo de modelos de IA do Azure, enquanto os programadores do Windows poderão executar versões otimizadas localmente utilizando o ONNX Runtime e o DirectML.
A parceria é notável porque a Microsoft é também o maior parceiro estratégico da OpenAI. O suporte do Llama 2 oferece aos clientes do Azure a opção de escolher entre modelos proprietários e modelos distribuídos mais abertos, além de reforçar a posição da Microsoft como fornecedor de cloud, independentemente da família de modelos preferida pelos programadores.
A Meta afirma ainda que o Llama 2 estará disponível através da Amazon Web Services, Hugging Face e outros fornecedores. Este alcance multicloud reduz a probabilidade de o modelo ficar ligado a um único fornecedor de infraestruturas e pode acelerar a experimentação por parte de startups, universidades e equipas de software empresarial.
“Aberto” não significa irrestrito
A Meta descreve o Llama 2 como de código aberto, mas a licença inclui restrições de utilização e não é idêntica às licenças de software permissivas normalmente utilizadas em projetos de código aberto. A empresa publicou também uma política de utilização aceitável e diretrizes de utilização responsável com o objetivo de limitar as aplicações prejudiciais ou ilegais.
O documento de avaliação detalha o ajuste de segurança, os testes adversários e as limitações conhecidas. A Meta reconhece que o Llama 2 pode gerar material impreciso, tendencioso ou inseguro e que os resultados dos testes de benchmark não conseguem abranger todos os casos de utilização do mundo real. A empresa afirma ter utilizado testes externos de equipa vermelha e ajustes iterativos de segurança para as versões de chat.
Uma análise da TechCrunch sobre o lançamento destacou tanto o desempenho melhorado nos benchmarks como os próprios alertas da Meta sobre o viés, a toxicidade e o desempenho desigual entre tarefas. Estas limitações são particularmente importantes porque o fornecimento de pesos aos modelos facilita a modificação do comportamento fora das salvaguardas de uma API controlada centralmente.
O impacto comercial poderá ser maior do que o da corrida de referência
Para as empresas, a funcionalidade mais importante pode ser a capacidade de executar ou ajustar um modelo num ambiente que controlam. As empresas que lidam com dados sensíveis podem preferir um modelo que possa ser implementado na sua própria infraestrutura ou ambiente de cloud, em vez de enviar pedidos para um serviço alojado externo.
Esta flexibilidade pode também pressionar a viabilidade económica da IA genérica. Se estiverem disponíveis modelos capazes sem taxas de licenciamento por consulta, os programadores podem comparar o custo do alojamento próprio com o das APIs pagas. Uma notícia da Bloomberg sobre o lançamento destacou a decisão da Meta de não cobrar pelo acesso aos modelos e o papel da Microsoft e de outros fornecedores de cloud em torná-los comercialmente viáveis.
A decisão não está isenta de riscos para a Meta. A distribuição alargada pode aumentar a probabilidade de um modelo ser adaptado para utilização indevida, e a empresa terá menos controlo sobre as implementações subsequentes do que os fornecedores que mantêm os seus sistemas inteiramente protegidos por interfaces alojadas. A Meta defende que a abertura também pode melhorar a segurança, permitindo que mais investigadores testem, identifiquem e reportem vulnerabilidades.
O Llama 2 representa, portanto, uma disputa estratégica sobre a forma como a IA fundamental deve ser distribuída, e não apenas qual a empresa com a pontuação mais elevada no benchmark. Se os programadores adotarem o modelo de forma ampla, a Meta poderá moldar um padrão aberto de facto para a IA generativa, enquanto a Microsoft ganha mais uma carga de trabalho para o Azure e o Windows. Se as preocupações com a segurança, o licenciamento ou o desempenho limitarem a adoção, o mercado poderá continuar a favorecer os sistemas proprietários com um controlo apertado. O primeiro teste começa agora, à medida que os programadores obtêm acesso a uma das maiores famílias de modelos amplamente disponíveis já lançadas.