llama.cpp

Motor de inferência em C/C++ para LLMs em CPU e GPU, com formato GGUF e quantização.

por ggml.ai Nenhuma avaliação ainda Código aberto Grátis b11030 Atualizado há 1 dia 9 92,6 =

Visão geral

Motor de inferência em C/C++ para LLMs em CPU e GPU, com formato GGUF e quantização.

Categoria
Execução de LLMs · Ferramentas de IA
Plataformas
Linux, macOS, Windows, Somente API
Preço
Grátis
Licença
MIT
Código-fonte
ggml-org/llama.cpp
Estrelas no repositório
128.722
API
Sem descrição pública de API

Histórico de versões

Atualizado há 1 dia

10 versões nos últimos 12 meses.

  1. b11030
  2. b11033
  3. b11034
  4. b11035
  5. b11036
  6. b11037

O que os usuários dizem

Nenhuma avaliação ainda

As notas aparecem quando chegarem avaliações verificadas. Até lá, o ranking usa apenas sinais públicos: atualização de versões e adoção do repositório.

Alternativas ao llama.cpp

Ver todas as alternativas