混合专家全部工具(共 27 款)
StrataStrata 是面向 Windows 与 Linux 的开源本地推理引擎,支持 Qwen3.8-Flash-Next,提…
Cohere Command A+Command A+ 是 Cohere 首个混合专家旗舰:218B 总参数、25B 激活参数,支持 48 种语言与图像输…
DeepSeek V3上一代 DeepSeek V3 快照。活路径已经是 V4 Flash/Pro。不是 GPT-4o / Claude 3.…
DeepSeek-V4.1-FlashDeepSeek-V4.1-Flash 是 MIT 的 552B 多模态 MoE,预填充 8B、解码 16B 激活,1M…
DeepSeek-V4-Flash-Vision-ExpDeepSeek-V4-Flash-Vision-Exp 是 V4 家族首个多模态实验:Flash 架构加视觉模块,MI…
DeepSeek V4 FlashDeepSeek 官方小型智能体模型:284B 总参 / 13B 激活 MoE 架构、1M token 上下文、MIT…
DeepSeek V4DeepSeek V4 预计将是 DeepSeek 旗舰模型系列的下一个重大版本,继备受赞誉的 V3 和 V3.2 之后…
Ember-1Fireworks Research 把 Kimi K3 改造成「想得更少」的版本:基准分数基本不变而 token 少约…
Gemma 4 26B A4BGoogle DeepMind 开源权重模型,25.2B 总参数 MoE 架构每 token 仅激活 3.8B,256K…
GLM-5.3-Flash智谱首个原生多模态 GLM 系列模型(即此前匿名的 'Ox Alpha'):320B MoE、仅 18B 激活、1M 上…
Hy4 preview腾讯新一代开源权重 MoE 旗舰:总计 770B、每 token 激活 49B,1M 上下文,Apache 2.0。采用…
KAT-Coder V2.5Kwaipilot 开源智能体编程模型:35B MoE、每 token 激活 3B,基于 Qwen3.6 基座,Apac…
Kolibri-1Aleph Alpha 发布的德英双语开放权重推理模型,总参数约 78B、每 token 激活约 3.46B,支持工具调…
Laguna S 2.1Poolside 开源权重编程模型:118B 总参 / 8B 激活 MoE、100 万 token 上下文、原生交错推理…
Ling-3.0-flash-VLLing-3.0-flash-VL 是 inclusionAI 的 MIT 多模态 MoE:总参 124B,激活 5.5…
LongCat 2.0美团开源 MoE 大模型:总参数 1.6T / 激活约 48B,1M 上下文,MIT 协议,擅长编码与智能体任务(202…
MiMo-V2.6小米 MiMo-V2.6 开源权重系列:旗舰 Pro 为 1.02T 总参数、42B 激活的稀疏 MoE,另有 309B…
mini-AGImini-AGI 是一个字节级模型,在 8GB 显存显卡上从零开始训练,并能持续从单一数据流中学习而不遗忘已掌握的内容。
MiniMax M2.1开源的 230B 参数 MoE 模型,专为多语言编程、智能体工作流和真实世界开发任务优化,SWE-bench 性能达到…
NVIDIA Nemotron 3.5 Lightning 30B A3BNVIDIA 高效开源权重模型,30B 总参数仅激活 3B,MoE 混合架构,最长 1M token 上下文,单卡部署,…
Qwen 4阿里下一代旗舰 Qwen 4 正在训练中,官方路线图显示 Qwen 4.5 与 Qwen 5 系列预计将扩展到 5 万亿…
Qwen3.8-Flash-Next阿里通义千问公开的 Qwen4 架构预览:125B 多模态 MoE、每 token 仅激活 6B,外加 51B N-gr…
Qwen3.8-Max阿里 2.4T 参数开源旗舰:95B 激活的 MoE,原生文本/图片/视频输入,1M 上下文,输入 $2 / 输出 $6…
Upstage: Solar Mini 4Upstage 的 35B 混合专家模型,仅 3B 激活参数,512K 上下文,输入 $0.10/百万 token,主打…
Tiel-Coder 35B A3B智能体编码 MoE。
WeLM-617B微信 AI 的 617B MoE 模型,每 token 激活 23B,通过 Hidden Decoding 首次在前沿规…
WizardLM-2 8x22B上一代 WizardLM-2 8x22B 快照。不是 Microsoft 2026 默认。旧的最先进 / 开源 SoTA…
所有标签
A2A协议AI内容生成AI助手AI搜索AI支付AI智能体AnthropicAPIAWSBlack Forest LabsClaudeClaude CodeCloudflareCodexCohereCursorDeepgramDeepSeekElevenLabsFLUXGeminiGemmaGitGoGoogleGPTGPUGrokHugging FaceIBMJina AIKimiLangChainLangGraphLinuxLlamamacOSMarkdownMCPMetaMicrosoftMiniMaxMistralMixedbread AINous ResearchNVIDIAObsidianOpenAIOpenClawOpenCodeOpenHandsOpenRouterPerplexityPythonRAGReplitRustStability AITypeScriptVoyage AIxAI云计算代码助手代码审查代码质量企业级健康写作前沿模型加密与Web3协议可观测性向量嵌入向量数据库命令行图像生成多智能体多模态多语言字节跳动安全实时工作流开发者工具开放权重开源微调推理效率教育数据可视化数据库数据科学文档文档处理无代码/低代码智源研究院智能体框架智能体编排智能体运行时智能体钱包智谱AI月之暗面本地AI模型路由沙箱沟通测试浏览器自动化深度研究混合专家
标签为 混合专家 的内容 (27 个)
Month Visit45000000DR: 95AS: 88
Month Visit500000DR: 80AS: 75
Month Visit500000DR: 68AS: 72
Month Visit345DR: 100AS: 100
Month Visit100DR: 100AS: 100
Month Visit135DR: 95AS: 88
Month Visit135DR: 95AS: 88
Month Visit—DR: —AS: —
Month Visit—DR: —AS: —
Month Visit—DR: —AS: —
Month Visit—DR: —AS: —
Month Visit—DR: —AS: —
Month Visit—DR: —AS: —
Month Visit—DR: —AS: —
Month Visit—DR: —AS: —
Kwaipilot 开源智能体编程模型:35B MoE、每 token 激活 3B,基于 Qwen3.6 基座,Apache 2.0 协议,原生 262K 上下文,PinchBench 工具调用榜首。
Month Visit—DR: —AS: —
Month Visit—DR: —AS: —
Month Visit—DR: —AS: —
Month Visit—DR: —AS: —
Month Visit—DR: —AS: —
Month Visit—DR: —AS: —
Month Visit—DR: —AS: —
Month Visit—DR: —AS: —