A OpenAI está trabalhando com a TSMC e a Broadcom para construir seu próprio chip de inferência de IA.
De acordo com a Reuters, a OpenAI, pelo menos por enquanto, abandonou seus planos de montar suas próprias fundições devido a restrições de custo e tempo e, em vez disso, está concentrando todos os seus esforços no design interno de chips.
Citando fontes com conhecimento da situação, o relatório diz que a OpenAI garantiu a capacidade de fabricação com a TSMC e espera ter seus primeiros chips de IA personalizados fabricados até 2026, embora esse cronograma esteja sujeito a alterações.
Em julho de 2024, foi relatado pela primeira vez que a OpenAI estava em negociações com designers de chips para discutir a possibilidade de desenvolver um novo chip de servidor de IA, embora rumores de que estava considerando fazer seus próprios chips de IA tenham surgido pela primeira vez no final de 2023.
O CEO da empresa, Sam Altman, há muito pressiona para que a empresa desenvolva seus próprios chips de IA e buscava investimentos para construir uma empresa de chips de IA com o codinome 'Tigris' antes de ser repentinamente demitido e recontratado pela OpenAI em novembro de 2023.
Atualmente, a empresa conta com aproximadamente 20 pessoas trabalhando em sua equipe de chips. No ano passado, a DCD informou exclusivamente que a OpenAI havia contratado Richard Ho, ex-diretor de engenharia de chips da Lightmatter e chefe do Google TPU, como chefe de hardware da empresa de IA generativa.
A Broadcom esteve fortemente envolvida no desenvolvimento do chip AI TPU do Google.
A Reuters também indicou que, além de projetar seus próprios chips de IA, a gigante da IA generativa também começou a diversificar sua implementação de hardware, com a empresa agora usando chips AMD junto com GPUs Nvidia para treinar seus modelos de IA.
Uma das razões originalmente citadas por fontes sobre o motivo pelo qual a OpenAI estava considerando entrar no espaço de design de chips personalizados era reduzir sua dependência da Nvidia, cujas GPUs são caras e já lutaram para atender à demanda.
Em maio de 2024, a Microsoft, que investiu quase 14 bilhões de dólares (80 bilhões de reais) na OpenAI, tornando-se o maior investidor da empresa, anunciou que disponibilizaria os aceleradores MI300X da AMD aos clientes por meio do serviço de computação em nuvem Azure da empresa.
É por meio da plataforma de nuvem Azure da Microsoft que a OpenAI acessará os chips AMD.
Na época, o vice-presidente executivo do grupo de nuvem e IA da Microsoft, Scott Guthrie, descreveu o MI300X como a “GPU mais econômica disponível no momento para o Azure OpenAI”.
Comments