| FazBrowse GitHub Viewer | Trending | | Home |
| Tools: [Original HTTPS Page] |
CLI to use Fireworks AI models in Claude Code, Codex, OpenCode, Pi, and other coding agents.
Forked from meta-llama/llama
Example of applying CUDA graphs to LLaMA-v2
DeepGEMM: clean and efficient FP8 GEMM kernels with fine-grained scaling
CLI to use Fireworks AI models in Claude Code, Codex, OpenCode, Pi, and other coding agents.
TokenSpeed is a speed-of-light LLM inference engine.
Loading…
Loading…
| Back | FazBrowse Home | New Git URL |