模型 / 資料集
syv-ai/qwen38-27b-rtx3090 avatar
syv-ai/qwen38-27b-rtx3090

qwen38-27b-rtx3090

Qwen3.8-27B on a single RTX 3090 with vLLM: ~1,000 tok/s at 64 concurrent (int8 tensor-core GEMMs, fp16 DeltaNet state), ~114 tok/s single-user at default sampling / ~124 greedy (MTP drafts, own-output draft vocab, calibrated int4 lm_head, split-KV verify attention), 150k-262k context; patches, requant scripts, benchmarks

1,422 個 Star199 個 ForkPythonApache-2.0
GitHub

秒懂

它是什麼?
Qwen3.8-27B on a single RTX 3090 with vLLM: ~1,000 tok/s at 64 concurrent (int8 tensor-core GEMMs, fp16 DeltaNet state), ~114 tok/s single-user at default sampling / ~124 greedy (MTP drafts, own-output draft vocab, calibrated int4 lm_head, split-KV verify attention), 150k-262k context; patches, requant scripts, benchmarks
可以商用嗎?
可以。Apache-2.0 是寬鬆授權:你可以使用、修改並販售以它為基礎的軟體,只需保留著作權與授權聲明。
還在維護嗎?
有在維護。儲存庫最近一次提交在 1 天前。
用什麼語言寫的?
主要是 Python(依據 GitHub 的語言統計)。

以上回答依據專案的 GitHub 資料(最近同步於 2026年9月16日)與我們的分析,不構成法律意見。

資料新鮮度

編輯狀態

本專案的完整編輯分析尚未發布。上方的資訊來自專案的公開 GitHub 中繼資料。在正式環境採用前,請先查看倉庫、授權條款與 issue 追蹤。

社群筆記

社群筆記