ollama
ollama/ollama
A tool for running and managing large language models locally.
ToolAI.io · Canal do GitHub
Um índice baseado em fatos de projetos de desenvolvimento de LLM, agentes, MCP, RAG e AI, com licença, configuração, download, capturas de tela e recursos relacionados para cada item.
Dados do repositório público
ollama/ollama
A tool for running and managing large language models locally.
hal0ai/hal0
An open-source, self-hosted home AI inference platform designed to turn a Linux box into an OpenAI-compatible inference appliance, with native optimization for AMD Strix Halo hardware.
NVIDIA/Model-Optimizer
A unified library of SOTA model optimization techniques like quantization, distillation, pruning, neural architecture search, speculative decoding, etc. It compresses deep learning models for downstream deployment frameworks like TensorRT-LLM, TensorRT, vLLM, etc. to optimize inference speed.
mudler/LocalAI
A local inference engine for self-hosting models and AI services.
ray-project/ray
A distributed computing runtime for machine learning training, tuning and model serving.
MoonshotAI/checkpoint-engine
Checkpoint-engine is a simple middleware to update model weights in LLM inference engines
janhq/jan
A local AI chat application for running models on a personal computer.
Página 2 / 2 · 19 projetos