Community User
Ampere Computing AI
Santa Clara, CA
Displaying 1 to 5 of 5 repositories
Ampere® optimized llama.cpp with full support for GGUF models available on HuggingFace.
3m
10K+
4
Ampere® optimized ONNXRunTime (https://solutions.amperecomputing.com/solutions/ampere-ai)
2y
3.0K
Ampere® optimized TensorFlow (https://solutions.amperecomputing.com/solutions/ampere-ai)
2y
5.0K
Ampere® optimized PyTorch (https://solutions.amperecomputing.com/solutions/ampere-ai)
2y
6.5K
2