GitHub热度

0xSero/glm53-flash-offload

来源:GitHub Trending 作者:0xSero 阅读原文 →
Python MIT

GLM-5.3-Flash EXL3 on one 24 GB RTX 3090 + DDR4: elastic GPU expert cache, zero-copy experts, AVX2 CPU tier, OpenAI API