stamatios
← Voltar ao feed
Fundador da DeepSeek fala sobre open source e roadmap para AGI
IA & Modelos · China & Geopolítica

Fundador da DeepSeek fala sobre open source e roadmap para AGI

resumo de ~3 min

Visão e cultura organizacional

Liang Wenfeng, fundador da DeepSeek, descreve a empresa como movida por visão, não por KPIs ou metas de IPO. Não há organograma formal nem visão escrita - a organização se estrutura em torno de consenso e boa vontade. Metade do tempo dos funcionários é livre para exploração, sem horas extras. "Somos apenas um bando de pessoas muito comuns", afirma.

Estratégia de open source

O open source não é tática, é o ponto central. Mesmo o modelo mais forte será aberto. Liang não teme concorrência: "Só me preocupo que não consigam fazer o deploy." Os modelos abertos são idênticos aos usados internamente. A lógica é que a IA pode representar 10% do PIB global - ninguém consegue monopolizar isso.

Precificação e contenção

A precificação da API visa recuperar o custo do hardware em dez meses - considerado lucro razoável, não maximização. Liang argumenta que, nesse patamar, a demanda é inelástica: subir o preço em 50% não mudaria o volume de tokens. A contenção é estratégica: quem aceita menos margem vence quem quer mais. Empresas como Alibaba e Tencent, sem as otimizações da DeepSeek, teriam custos várias vezes maiores.

Roadmap para AGI

A sequência técnica é: Chain-of-Thought → Agentes → aprendizado contínuo → "singularidade" → inteligência incorporada (robótica). O aprendizado contínuo é visto como o gargalo atual - a IA já tem bom gosto e intuição, mas não aprende de forma persistente como humanos. A "singularidade" seria um processo gradual em que o modelo desenvolve suas próprias versões. Internamente, o primeiro uso do próximo modelo é melhorar a eficiência da própria DeepSeek.

Compute e gap China–EUA

A DeepSeek opera com cerca de 20.000 GPUs equivalentes a H100, a maioria recebida nos últimos meses. O atraso em relação aos EUA é estimado em 12–18 meses, mas com um vigésimo do compute americano. Para treinar modelos de 800B parâmetros ativos (como os líderes), seriam necessárias 200.000 placas. O CUDA da Nvidia está sendo erodido por IA que escreve código e por linguagens de alto nível como TileLang. Chips domésticos (Huawei 950) devem ser validados dentro de um ano, com desempenho comparável a GB200/GB300, mas com quatro placas Huawei equivalendo a uma Nvidia e dois anos de atraso temporal.

O que a DeepSeek não fará

Geração de vídeo, 3D e world models estão fora do escopo - não elevam o teto da inteligência. Multimodalidade será incluída (V4 em diante), mas como componente, não como linha principal.

Competição e convergência

Há empresas demais fazendo modelos base na China; o mercado deve convergir. O maior interesse da DeepSeek é manter a equipe estável. Liang prevê que a China pode igualar modelos estrangeiros este ano no paradigma atual, mas reforça: "Isso ainda não é AGI." O scaling ainda traz retornos evidentes - o "muro do scaling" está longe para a China.