回首頁 / 🧱 AI 基礎堆疊 / 📚 RAG/檢索/向量庫

Sandermage/sndr_core_engine

Qwen3.6 和 Gemma4 的 vLLM 執行時程式覆蓋,支援 NVIDIA Ampere 裝置。

🧱 AI 基礎堆疊 ✓ 可商用 ★ 125Python

為何上榜

125★ · 近期活躍

商用授權

✓ 可商用Apache-2.0

可商用,通常只需保留著作權聲明/授權條款

Topics

awqconsumer-gpucudagemmakv-cache-quantizationllm-inferencellm-servinglocal-llmmemorypgvectorquantizationqwen
廣告