Swift-Qwen3.8-27B logo

Swift-Qwen3.8-27B

開く

Swift-Qwen3.8-27B は UkisAI による Qwen3.8-27B の推論効率化ファインチューンで、思考トークンを約 58% 減らし、得点損失は 1% 未満です。

共有:
代替ツールを見る

Swift-Qwen3.8-27B は UkisAI が Qwen3.8-27B から作った推論効率化の派生です。カードは ukisai/Swift-Qwen3.8-27b。Hugging Face API は 2026-09-15 時点で 152 likes、直近月ダウンロード 459、パイプライン image-text-to-textcreatedAt 2026-09-08、lastModified 2026-09-13。ライセンス名 swift-open-license-1.0。リポジトリは gated。ベースは Qwen/Qwen3.8-27B(finetune)。r/LocalLLaMA hot は 2026-09-15 に "UkisAI Swift-Qwen3.8-27B / -58.3% thinking, x1.95 speed" で 556 upvotes。

カードの主張:思考トークン 58.3% 減、平均スコア損失 1% 未満、いくつかのタスクで約 x1.95。ベンダーベンチであり、こちらでは再測定していない。

密なベースが欲しいなら Qwen3.8-27B。より小さいローカル flash なら Qwen3.8-Flash-Next。別の約 30B オープンチャットなら Muse Glimmer

主な機能

  • 短いトレース:過思考を誘発する reasoning マーカーを罰し、BottleCap AI ThinkingCap-Qwen3.6-27B 由来の転移も含む、とカードは書く。
  • GPQA-Diamond(カード、xhigh):ベース 88.38% / 平均 15,014 トークン対 Swift 88.28% / 8,855。中央値の減少は 58.3%。
  • LiveCodeBench v6(カード):Swift 81.55% 対ベース 76.76%。トークンは少ない。
  • AIME 2026(カード):Swift 94.00% 対ベース 98.67%。トークンは減るがコンテスト数学は落ちる。
  • サーブ:BF16、vLLM 0.27.1、Qwen3 parser、コンテキスト 262,144、thinking xhigh。サンプリングは temperature 1.0、topp 0.95、topk 20。
  • 研究 API 無料https://ukisai.com/api/swift/v1、モデル id swift、キーは none

制約:152 likes は熱量であり監査ではない。カードは gated。年間経常収益(関連会社含む)が 100 万米ドルを超える商用は Swift Enterprise License が要る。INT4 行は設定が混在し、AIME の上限も短い。BF16 は 27B 級の箱のまま。

仕様

項目 出典
パラメータ 約 28B BF16 HF カード、2026-09-15
コンテキスト(serve レシピ) 262,144 トークン 同カード
ライセンス Swift Open License v1.0、gated HF cardData
Likes / 直近月 DL 152 / 459 HF API、2026-09-15
研究 API 無料、キーなし ukisai.com
Enterprise ARR $1M 超で必要 同カード

使用シナリオ

  • すでに Qwen3.8-27B をローカルで回せる箱で、xhigh 精度を保ちつつ思考トークンを減らしたいとき。
  • r/LocalLLaMA の 556 upvote 投稿を見て、AIME の低下を切り分けたいとき。
  • コンテスト数学のピークが要る人はベースに留まるべき。

はじめに

  1. ukisai/Swift-Qwen3.8-27b でゲートを承認する。
  2. llama.cpp なら ukisai/Swift-Qwen3.8-27B-GGUF
  3. 研究用途なら https://ukisai.com/api/swift/v1、モデル swift
  4. vLLM はカードどおり --reasoning-parser qwen3、max len 262,144。

第一方リソース:モデルカードukisai.com/products/swift

よくある質問

LoRA を載せた Qwen3.8-27B ですか?

カードは Qwen3.8-27B の finetune。量子化行は同じ量子化ベースに Swift adapter の有無を比べる。

企業は無料で使えますか?

個人・研究・教育・評価、および関連会社込み ARR 100 万米ドル以下の商用は無料。超えたら UkisAI に連絡。

ベースの medium より速くて強いですか?

GPQA-Diamond では、カードは Swift xhigh が xhigh 精度を保ちトークン約半分、ベース medium(84.14%)の約 2 倍トークンだと書く。

代替案

ヒント

  1. 58.3% の中央値を万能高速化として貼らない。カード上の GPQA-Diamond xhigh。
  2. 再測定するまで temperature 1.0、top_p 0.95 を保つ。
  3. GGUF と BF16 を混同しない。W4A16 混合は別表。

コメント

まだコメントがありません。最初のコメントを投稿してください!