2,8 trilhões de parâmetros. 1 milhão de token de contexto. Multimodal nativo.


A Atenção Kimi Delta entrega até 6,3x mais rapidez na decodificação em contexto de milhão de tokens, reduzindo a memória do KV-cache em até 75% no caminho.
Residuals de Atenção proporcionam cerca de 25% mais eficiência de treinamento com menos de 2% de custo computacional adicional.
Feito para codificação de agentes com horizontes longos e fluxos de trabalho autoevolutivos, mantendo sessões longas de engenharia com mínima supervisão humana.
Ver original
post-image
post-image
Esta página pode conter conteúdo de terceiros, que é fornecido apenas para fins informativos (não para representações/garantias) e não deve ser considerada como um endosso de suas opiniões pela Gate nem como aconselhamento financeiro ou profissional. Consulte a Isenção de responsabilidade para obter detalhes.
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
Comentário
Adicionar um comentário
Adicionar um comentário
Sem comentários
  • Fixado