推論のすべてのツール(31件)
- Apodex深層リサーチとエージェント業務のための自己進化型ヘビーデューティ・ソルバー。推論器と検証器を分離し、訓練済みAgent Team、オープンウェイト35B、FrontierAgentハーネスを提供。
- Claude Opus 4.5Anthropic の前世代 Opus スナップショット。20 万コンテキスト、100 万トークン $5/$25。後の課金ラインに Opus 4.6 と Opus 5。
- Claude Fable 5.1Anthropic の一般提供 Fable クラスモデル。コーディングと知識業務向け。入力/出力 $10/$50 /100万トークン、キャッシュ読み $0.25。API id は claude-fable-5-1。
- Claude Fable 5Anthropic が初めて一般公開した Mythos クラスのフラッグシップ。100万トークンコンテキスト、フロンティア級のコーディングとビジョン、数日間にわたる自律エージェント実行、100万トークンあたり入力$10/出力$50。
- Claude Mythos 5.1Anthropic のサイバーセキュリティ・生命科学向け最強モデル。限定的な信頼アクセスで提供。Claude Fable 5.1 と同一エンジンだが、審査済み機関向けにガードレールを緩和。
- Claude Opus 4.6Anthropic 最強のハイブリッド推論モデル:100万トークンのコンテキスト、適応的思考、エージェント型コーディングと専門知識業務で業界トップ。
- Claude Opus 5Anthropic の最上位 Opus モデル。1M トークンのコンテキストと調整可能な思考強度を備え、Opus 4.8 と同じ価格で Fable 5 に迫る性能を発揮。エージェントと長期コーディング向け。
- DeepSeek-R1以前の DeepSeek-R1 スナップショット。再確認:生きた経路は V4 Flash/Pro。o1 / 2026推論既定ではない。
- DeepSeek V4 Pro 0813DeepSeek のフラッグシップ 1.6T MoE モデル。活性化パラメータ 49B、1M トークンのコンテキスト、MIT ライセンスのオープンウェイトを備え、世界トップのコーディングスコアをクローズドモデルのごく一部の価格で実現。
- Gemini 2.0 Flash Thinking以前のGemini 2.0 Flash Thinkingスナップショット。再確認:2.0 Flash系列は2026-06-01に停止。2026年のo1-mini代替ではない。
- Google: Gemini 3.5 Flashアクション志向の Google 最前線モデル:エージェントとコーディング向けに設計され、100万トークンのコンテキストとFlash級の速度・コストを両立。
- Google: Gemini 3.7 Flashエージェントワークフローとマルチモーダル推論向けの Google 最強 Flash モデル。100万トークンコンテキスト、65k出力トークン、Computer Use プレビューに対応。
- GPT-5.6 LunaOpenAI GPT-5.6 Luna:5.6ファミリーの高速で手頃な段。12.8万コンテキスト、1M tokensあたり入力$1/出力$6。
- GPT-5.6 TerraOpenAI GPT-5.6 Terra:5.6ファミリーの均衡な日常主力。40万コンテキスト、1M tokensあたり入力$2.50/出力$15。
- GPT-5.2OpenAI の前世代フロンティア。40万コンテキスト、最大出力12.8万、100万トークン $1.75/$14。文書は GPT-5.6 Sol を推奨。
- GPT-5.6 SolOpenAI のフロンティアフラッグシップ。105万トークンコンテキスト、最大 max の推論強度と ultra サブエージェントモード、Terminal Bench 2.1 で SOTA のコーディング、100万トークン $5/$30 の料金。
- GPT-6 AstraOpenAI フラッグシップ GPT-6 Astra。105万トークンコンテキスト、コンピュータ操作とコーディングで新記録、100万トークン $10/$50。
- IBM Granite 4.2 30BIBMのオープンウェイト・デンス推論LLM。30Bパラメータ、Apache 2.0、ネイティブ128Kコンテキスト(512K拡張可)、内蔵チェーン・オブ・ソートと推論強化ツール呼び出し。
- Grok 4.6SpaceXAI の最先端 1.5T パラメータ推論モデル。50 万トークンのコンテキストとエージェント的なコーディングの強さを備え、リアルタイムの X データにアクセス可能。競合フロンティアモデルの約半額で提供される。
- GrokxAI / SpaceXAI の Grok 家族。現行ドキュメントの旗艦は grok-4.6。50 万トークン文脈、$2/$6 per 1M、Imagine 画像/動画と Voice API 付き。
- Hy4 previewTencentの次世代オープンウェイトMoEフラッグシップ。合計770B・トークン毎に49Bアクティブ、1Mトークンコンテキスト。Apache 2.0で、ゲーテッドDSA注意を採用。長時間コーディングとプロダクティビティに強み。
- KAT-Coder V2.5Kwaipilot のオープンウェイト・エージェント型コーディングモデル。35B MoE/活性 3B、Qwen3.6 ベース、Apache 2.0、262K コンテキスト、PinchBench ツール使用で首位。
- Laguna S 2.1Poolsideのオープンウェイト118B MoEコーディングモデル。8Bアクティブ、100万トークンコンテキスト、ネイティブ推論、OpenMDW-1.1ライセンスでエージェントコーディング向け。
- LongCat 2.0MeituanのオープンウェイトMoEモデル:総パラメータ1.6T/活性約48B、1Mコンテキスト、MITライセンス。コーディングとエージェントタスクに強み(2026-08-25)。
- NVIDIA Nemotron 3.5 Lightning 30B A3BNVIDIA の効率的なオープンウェイトモデル。総パラメータ 30B で活性化はわずか 3B。MoE ハイブリッド構成、最大 1M トークンのコンテキスト、単一 GPU 展開でローカル推論とポストトレーニング研究に対応。
- OpenAI: o1-mini以前のo1-miniスナップショット。再確認:まだ$1.10/$4.40。日付付き双子はdeprecated。2026年の推論既定ではない。
- OpenAI: o1-preview以前のo1-previewスナップショット。再確認:まだ$15/$60。日付付き双子はdeprecated。より安いo1でも2026既定でもない。
- QwQ-32B-Preview以前の QwQ-32B-Preview スナップショット。再確認:leftover 2024年11月推論器。旧 o1-preview / DeepSeek-R1 / 24GB センサスは捨てる。
- Spark-X2.5-4BXHToken の効率的な 4B オープンウェイトモデル。ハイブリッド滑り窓注意機構でネイティブ 1M コンテキストを実現。コーディング・エージェント性能が高く、Apache 2.0、多言語。
- xAI: Grok Beta以前の xAI Grok Beta スナップショット。再確認:現行文書は grok-4.6。2026年の推論既定ではなく、Grok 2 の後継でもない。
- Scientific Critical Thinking Skill研究の厳密さを系統的に評価 - GRADE と Cochrane ROB を使用して方法論、実験デザイン、統計的妥当性、バイアス、交絡、エビデンスの質を評価。
すべてのタグ
A2AプロトコルAIアシスタントAIエージェントAIコンテンツAI検索AI決済AlibabaAnthropicAPIAWSBAAIBlack Forest LabsByteDanceClaudeClaude CodeCLICloudflareCodexCohereCursorDeepgramDeepSeekElevenLabsFLUXGeminiGemmaGitGoGoogleGPTGPUGrokHugging FaceIBMJina AIKimiLangChainLangGraphLinuxLlamamacOSMarkdownMCPMetaMicrosoftMiniMaxMistralMixedbread AIMoEMoonshot AINous ResearchNVIDIAObsidianOpenAIOpenClawOpenCodeOpenHandsOpenRouterPerplexityPythonQwenRAGReplitRustStability AITencentTypeScriptVoyage AIxAIZhipu AIエージェントウォレットエージェントオーケストレーションエージェントフレームワークエージェントランタイムエンタープライズエンベディングオープンウェイトオープンソースクラウドコーディングエージェントコードアシスタントコードレビューコード品質コミュニケーションコンピューター操作サンドボックスステーブルコインスプレッドシートセキュリティセルフホストソーシャルメディアチャットボットデータサイエンスデータベースデータ可視化ディープリサーチデザインテストデバッグデプロイドキュメントドキュメント処理ナレッジベースノーコード/ローコードファインチューニングプライバシーブラウザ自動化プレゼンテーションプロジェクト管理プロトコルフロンティアモデルベクトルデータベースマルチエージェントマルチモーダルモデルルーティングライティングリアルタイムリランキングローカルAIワークフロー健康動画動画生成可観測性多言語推論
推論 にタグ付けされた項目 (31 個)
Month Visit45000000DR: 95AS: 88
Month Visit15000000DR: 95AS: 95
Month Visit2500000DR: 92AS: 95
Month Visit15000000DR: 95AS: 95
Month Visit15000000DR: 95AS: 95
Month Visit15000000DR: 95AS: 95
Month Visit12000000DR: 88AS: 90
Month Visit12000000DR: 88AS: 90
Month Visit5000000DR: 95AS: 85
Month Visit3000000DR: 92AS: 95
Month Visit2500000DR: 92AS: 95
Month Visit5000DR: 88AS: 90
Month Visit1500DR: 100AS: 100
Month Visit345DR: 100AS: 100
Month Visit100DR: 100AS: 100
Month Visit245DR: 94AS: 88
Month Visit302DR: 93AS: 87
Month Visit1000DR: 85AS: 82
Month Visit1000DR: 80AS: 80
Month Visit1000DR: 80AS: 80
Month Visit1000DR: 80AS: 80
Month Visit1000DR: 80AS: 80
Month Visit1000DR: 80AS: 80