Swift-Qwen3.8-27B は UkisAI が Qwen3.8-27B から作った推論効率化の派生です。カードは ukisai/Swift-Qwen3.8-27b。Hugging Face API は 2026-09-15 時点で 152 likes、直近月ダウンロード 459、パイプライン image-text-to-text、createdAt 2026-09-08、lastModified 2026-09-13。ライセンス名 swift-open-license-1.0。リポジトリは gated。ベースは Qwen/Qwen3.8-27B(finetune)。r/LocalLLaMA hot は 2026-09-15 に "UkisAI Swift-Qwen3.8-27B / -58.3% thinking, x1.95 speed" で 556 upvotes。
カードの主張:思考トークン 58.3% 減、平均スコア損失 1% 未満、いくつかのタスクで約 x1.95。ベンダーベンチであり、こちらでは再測定していない。
密なベースが欲しいなら Qwen3.8-27B。より小さいローカル flash なら Qwen3.8-Flash-Next。別の約 30B オープンチャットなら Muse Glimmer。
主な機能
- 短いトレース:過思考を誘発する reasoning マーカーを罰し、BottleCap AI ThinkingCap-Qwen3.6-27B 由来の転移も含む、とカードは書く。
- GPQA-Diamond(カード、xhigh):ベース 88.38% / 平均 15,014 トークン対 Swift 88.28% / 8,855。中央値の減少は 58.3%。
- LiveCodeBench v6(カード):Swift 81.55% 対ベース 76.76%。トークンは少ない。
- AIME 2026(カード):Swift 94.00% 対ベース 98.67%。トークンは減るがコンテスト数学は落ちる。
- サーブ:BF16、vLLM 0.27.1、Qwen3 parser、コンテキスト 262,144、thinking xhigh。サンプリングは temperature 1.0、topp 0.95、topk 20。
- 研究 API 無料:
https://ukisai.com/api/swift/v1、モデル idswift、キーはnone。
制約:152 likes は熱量であり監査ではない。カードは gated。年間経常収益(関連会社含む)が 100 万米ドルを超える商用は Swift Enterprise License が要る。INT4 行は設定が混在し、AIME の上限も短い。BF16 は 27B 級の箱のまま。
仕様
| 項目 | 値 | 出典 |
|---|---|---|
| パラメータ | 約 28B BF16 | HF カード、2026-09-15 |
| コンテキスト(serve レシピ) | 262,144 トークン | 同カード |
| ライセンス | Swift Open License v1.0、gated | HF cardData |
| Likes / 直近月 DL | 152 / 459 | HF API、2026-09-15 |
| 研究 API | 無料、キーなし | ukisai.com |
| Enterprise | ARR $1M 超で必要 | 同カード |
使用シナリオ
- すでに Qwen3.8-27B をローカルで回せる箱で、xhigh 精度を保ちつつ思考トークンを減らしたいとき。
- r/LocalLLaMA の 556 upvote 投稿を見て、AIME の低下を切り分けたいとき。
- コンテスト数学のピークが要る人はベースに留まるべき。
はじめに
- ukisai/Swift-Qwen3.8-27b でゲートを承認する。
- llama.cpp なら ukisai/Swift-Qwen3.8-27B-GGUF。
- 研究用途なら
https://ukisai.com/api/swift/v1、モデルswift。 - vLLM はカードどおり
--reasoning-parser qwen3、max len 262,144。
第一方リソース:モデルカード と ukisai.com/products/swift。
よくある質問
LoRA を載せた Qwen3.8-27B ですか?
カードは Qwen3.8-27B の finetune。量子化行は同じ量子化ベースに Swift adapter の有無を比べる。
企業は無料で使えますか?
個人・研究・教育・評価、および関連会社込み ARR 100 万米ドル以下の商用は無料。超えたら UkisAI に連絡。
ベースの medium より速くて強いですか?
GPQA-Diamond では、カードは Swift xhigh が xhigh 精度を保ちトークン約半分、ベース medium(84.14%)の約 2 倍トークンだと書く。
代替案
- Qwen3.8-27B:Swift ライセンスゲートのない密ベース。
- Qwen3.8-Flash-Next:より小さいローカル flash。
- DeepSeek-V4-Flash:27B を自前ホストしたくないときのホスト型 flash。
ヒント
- 58.3% の中央値を万能高速化として貼らない。カード上の GPQA-Diamond xhigh。
- 再測定するまで temperature 1.0、top_p 0.95 を保つ。
- GGUF と BF16 を混同しない。W4A16 混合は別表。
コメント
まだコメントがありません。最初のコメントを投稿してください!
関連ツール
関連インサイト

Grok Bot と Hermes Bot:一人に、ようやく参謀本部と事務局がつく
Grok Bot は Cursor Pro+ に入った。Hermes Bot は VPS で走る。より賢いチャット窓ではない。助言するのは参謀本部、実行するのは事務局、決裁するのはあなただ。
Windows で OpenCode Go を Codex に繋ぐ。二セット目のツールは開くな
ChatGPT でログインした Codex デスクトップは、ピッカーにほぼ GPT しか出さない。Windows では OpenCode Go だけを開けば、すでに課金している Grok、GLM、Kimi、DeepSeek、MiniMax が同じセレクタに戻る。鍵はマシンから出ず、ネイティブ GPT もそのまま残る。
Codex を閉じ込めているのはモデルではなく、ピッカーだ
OpenCode Go、Grok、Z.ai にはすでに課金しているのに、Codex のピッカーはほぼ GPT しか出さない。コミュニティ製の codex-router が教えるのは手順ではない。すでに買ったモデル能力をセレクタに戻すこと。鍵はマシンから出ず、ネイティブ GPT もそのまま残る。