This website requires JavaScript.
Explore
Help
Sign In
wmantly
/
turing-multi-gpu-llm-server
Watch
1
Star
0
Fork
0
Code
Issues
Pull Requests
Actions
Packages
Projects
Releases
Wiki
Activity
3
Commits
1
Branch
0
Tags
2b4e826437b5d46ccb895cebaa6ea064d5c2d768
Commit Graph
2 Commits
Include renames
Author
SHA1
Message
Date
wmantly
2b4e826437
Add sglang-inspired low-latency NCCL ring buffer and CUDA connection optimization flags to start-server.sh
2026-09-01 14:55:56 +00:00
wmantly
aeb72cecfa
Initial commit: Complete deployment scripts, power governor, systemd units, and architecture documentation for Turing multi-GPU LLM rig
2026-09-01 01:55:19 +00:00