Sign in Sign up
go

github.com/townsendmerino/goinfer/cuda

Pure-Go, no-cgo local LLM inference — run Gemma, Qwen, Llama and friends from safetensors or GGUF in a single static binary.

Activity

Latest release
1d ago
Total releases
15
Cadence
~daily
Last 12 months
15

Reach

Stars
14

Details

First release
Aug 05, 2026
Releases
Version Released
v0.18.0 minor
v0.17.2 minor
v0.17.1 patch
v0.17.0 minor
v0.16.0 minor
v0.15.0 minor
v0.14.0 minor
v0.13.0 minor
v0.12.0 minor
v0.11.0 minor
v0.10.3 patch
v0.10.2 patch
v0.10.1 patch
v0.10.0 minor
v0.9.0 initial