Os modelos abertos de IA da China estão desafiando o manual do Vale do Silício


A indústria de IA não está experimentando uma Momento DeepSeek 2.0mas parece muito próximo. O líder Laboratórios chineses de IA têm estado em alta ultimamente, lançando uma série de modelos de código aberto quase de última geração. Z.ai lançou o GLM 5.2 em junho, Moonshot AI lançou Kimi K3 na semana passada e Alibaba lançou Qwen 3.8 nesta segunda-feira.

O Vale do Silício e Washington começaram a falar imediatamente sobre os modelos, especialmente o K3, que é amplamente visto como o melhor do grupo. David Sacks, capitalista de risco e conselheiro de IA do presidente Donald Trump, chamou o desempenho do modelo de Moonshot de “relativo.” No início desta semana, o secretário do Comércio, Scott Bessent, sugeriu que os EUA pode impor sanções às empresas chinesas de IA.

Na quarta-feira, Michael Kratsios, diretor do Escritório de Política Científica e Tecnológica da Casa Branca, alegado que a administração Trump tem “informações de que a Moonshot AI destilou o Anthropic’s Fable para o desenvolvimento do seu modelo K3”, o que, segundo ele, equivalia a “roubar tecnologia proprietária dos EUA e minar a investigação americana” e era “inaceitável”. (Moonshot AI não respondeu imediatamente a um pedido de comentário.)

Os novos modelos chineses têm algumas coisas em comum: os benchmarks de terceiros mostram que o seu desempenho é quase tão bom quanto o dos melhores modelos ocidentais; eles são otimizados para tarefas de codificação de agentes (a novidade em IA deste ano); e são ou serão lançados em breve com pesos abertos, tornando-os acessíveis e transparentes.

Mas talvez o maior paralelo entre o momento atual e janeiro de 2025 – quando o mundo ficou chocado com o modelo R1 da DeepSeek – é que ele reafirma como os laboratórios de IA americanos e chineses estão a seguir caminhos divergentes quando se trata de serem abertos ou fechados.

Quando entrou em cena pela primeira vez, o DeepSeek desafiou a premissa de que apenas modelos de código fechado construídos com bilhões de dólares de investimento em infraestrutura computacional e treinamento poderiam alcançar desempenho de ponta. Mas desde então, os laboratórios ocidentais de IA continuaram a desenvolver a IA da mesma forma, e agora os modelos da fronteira americana parecem mais isolados do que há um ano.

A Anthropic disse durante meses que seu último modelo Mythos era tão perigosamente bom em hackear que apenas colaboradores aprovados poderia usá-lo. Quando finalmente foi divulgado de forma mais ampla, a Casa Branca respondeu emitindo amplas controles de exportaçãoo que forçou a Anthropic a colocar Mythos e seu modelo irmão menos capaz, Fable 5, offline temporariamente. A OpenAI também atrasou o lançamento do GPT 5.6 depois dele recebeu um pedido da Casa Branca.

Enquanto isso, na China a situação parece muito diferente. As startups chinesas e os gigantes da tecnologia duplicaram a aposta no código aberto: qualquer pessoa com um ambiente informático suficientemente bom pode agora descarregar um modelo aberto, executá-lo localmente, adicionar personalizações e, em geral, desfrutar de um grau de liberdade muito maior do que o OpenAI e o Anthropic alguma vez permitiriam. Em muitos aspectos, o debate aberto versus fechado está mais emaranhado do que nunca com o debate entre EUA e China.

Há muitas razões pelas quais os laboratórios chineses escolheram uma estratégia de negócios baseada em modelos de código aberto. Sendo os peixes mais novos e mais pequenos no campo da IA, tornar os seus modelos livres e abertos pode ajudar as empresas chinesas a atrair mais utilizadores, colaboradores e destaque nos meios de comunicação social. Isso também os coloca em uma faixa de competição separada daquela em que OpenAI, Anthropic, Google, SpaceX e outros gigantes endinheirados estão.

No início deste ano, espalharam-se rumores de que o Alibaba poderia ser considerando ingressar no código fechado corrida depois de reorganizar suas equipes corporativas de desenvolvimento de modelos de IA. Mas a gigante da tecnologia anunciou na segunda-feira que lançaria novamente a versão mais recente do Qwen – sua linha de modelos de código aberto amado pela comunidade global de tecnologia—com pesos abertos, sinalizando aos clientes e ao público que ainda não está se afastando.



Source link