Swift-Qwen3.8-27B 是 UkisAI 在 Qwen3.8-27B 上做的高效推理衍生。卡片在 ukisai/Swift-Qwen3.8-27b。Hugging Face API 于 2026-09-15 列出 152 likes、近月下载 459,管线 image-text-to-text,createdAt 2026-09-08,lastModified 2026-09-13。许可证名 swift-open-license-1.0。仓库 gated。基座是 Qwen/Qwen3.8-27B(finetune)。r/LocalLLaMA 热门在 2026-09-15 标题为 "UkisAI Swift-Qwen3.8-27B / -58.3% thinking, x1.95 speed",556 赞。
卡片声称:思考 token 少 58.3%,均分损失 不到 1%,若干任务约 x1.95 速度。这些是厂商评测。我们没有复跑。
若要稠密基座,看 Qwen3.8-27B。若要更小的本地 flash,看 Qwen3.8-Flash-Next。若要另一款约 30B 开源闲聊,看 Muse Glimmer。
核心功能
- 更短思维链:卡片说惩罚会触发过度思考的推理标记 token,并吸收 BottleCap AI ThinkingCap-Qwen3.6-27B 的迁移成分。
- GPQA-Diamond(卡片,xhigh):基座 88.38% / 15,014 均 token,Swift 88.28% / 8,855。中位数降幅写 58.3%。
- LiveCodeBench v6(卡片):Swift 81.55% 对基座 76.76%,token 更少。
- AIME 2026(卡片):Swift 94.00% 对基座 98.67%。token 少了,竞赛数学丢分。
- 部署:BF16,vLLM 0.27.1,Qwen3 parser,上下文 262,144,thinking xhigh。采样:temperature 1.0,topp 0.95,topk 20。
- 研究 API 免费:
https://ukisai.com/api/swift/v1,模型 idswift,key 填none。
局限:152 likes 是热度,不是审计。卡片 gated。年经常性收入(含关联方)超过 100 万美元 的商业使用需要 Swift Enterprise License。INT4 行用了不同设置和更短的 AIME 上限。BF16 仍是 27B 级机器。
规格
| 项 | 值 | 来源 |
|---|---|---|
| 参数 | 约 28B BF16 | HF 卡片,2026-09-15 |
| 上下文(serve 配方) | 262,144 token | 同一卡片 |
| 许可证 | Swift Open License v1.0,gated | HF cardData |
| Likes / 近月下载 | 152 / 459 | HF API,2026-09-15 |
| 研究 API | 免费,无 key | ukisai.com |
| 企业许可 | ARR 超 $1M 需要 | 同一卡片 |
适用场景
- 本地已经能跑 Qwen3.8-27B,想保住 xhigh 分数、少花思考 token。
- 看到 r/LocalLLaMA 556 赞帖,需要把 AIME 掉分说清楚。
- 要竞赛数学峰值 的人,应留在基座。
快速开始
- 在 ukisai/Swift-Qwen3.8-27b 接受 gate。
- llama.cpp 用 ukisai/Swift-Qwen3.8-27B-GGUF。
- 或研究用途调用
https://ukisai.com/api/swift/v1,模型swift。 - vLLM 按卡片:
--reasoning-parser qwen3,max len 262,144。
第一方资源:模型卡 与 ukisai.com/products/swift。
常见问题
这是带 LoRA 的 Qwen3.8-27B 吗?
卡片是 Qwen3.8-27B 的 finetune。量化行比较的是同一量化基座加不加 Swift adapter。
公司能免费商用吗?
个人、研究、教育、评估,以及含关联方 ARR 不超过 100 万美元的商用免费。超过要联系 UkisAI。
Swift 能打过基座的 medium 吗?
GPQA-Diamond 上,卡片说 Swift xhigh 接近 xhigh 精度、token 大约一半,大约是基座 medium(84.14%)的两倍 token。
替代方案
- Qwen3.8-27B:没有 Swift 许可证门的稠密基座。
- Qwen3.8-Flash-Next:更小的本地 flash。
- DeepSeek-V4-Flash:不想自托管 27B 时的托管 flash。
使用技巧
- 不要把 58.3% 中位数当成万能加速。它是卡片上 GPQA-Diamond xhigh。
- 除非自己复测,保持 temperature 1.0、top_p 0.95。
- 分清 GGUF 和 BF16。混合 W4A16 是另一张表。
评论
还没有评论。成为第一个评论的人!
相关工具
相关洞察
GPT-6 Astra 没追上 Fable 5.1,追上的是账单
Artificial Analysis 智能指数上 Fable 5.1 66 分、Astra 61 分,Astra 没追上智力。但完成同一批任务的成本只要 Fable 5.1 的不到一半,真正收紧的是账单,不是脑子。

Grok Bot、Hermes Bot:一个人,终于配上了智囊团和秘书处
Grok Bot 进了 Cursor Pro+,Hermes Bot 能跑在 VPS 上。它们不是更聪明的聊天框。出主意的是智囊团,抓落实的是秘书处,拍板的还是你。
Windows 上把 OpenCode Go 接进 Codex,别再新开一套工具
ChatGPT 登录的 Codex 桌面版,默认选择器几乎只露出 GPT。Windows 上只开 OpenCode Go 这一家,就能把已经付过钱的 Grok、GLM、Kimi、DeepSeek、MiniMax 接回同一个 picker。密钥不出本机,原生 GPT 也不动。