Inkling
Inklingは、人間の意思と判断を拡張するAIを構築するというミッションのもと、ゼロから学習されたオープンウェイトの大規模言語モデルです。975Bの総パラメータ(アクティブ41B)を持つMixture-of-Expertsアーキテクチャで、最大100万トークンのコンテキストウィンドウに対応し、テキスト・画像・音声・動画をネイティブに理解する本格的多モーダルモデルです。独自のプラットフォーム「Tinker」でのファインチューニングに対応し、企業や開発者が自身のユースケースに最適化したAIを構築できる、次世代のカスタマイズ可能な基盤モデルとして誕生しました。
製品の主な特徴
- 効率的な思考制御: 「思考努力度」を0.2から0.99まで調整可能で、Nemotron 3 Ultraと同等の性能を約3分の1のトークンで達成。コストとレイテンシの厳しい制約下でも最適な動作ポイントを選択できます
- 本格的多モーダル対応: エンコーダーフリーアーキテクチャにより、音声(dMelスペクトログラム)、画像(40x40パッチhMLP)、テキストを統合処理。VoiceBench、MMAU、MMMU Proなどでオープンウェイトモデル中最速クラスの性能を実現
- 高度な推論とコーディング: AIME 2026で97.1%、GPQA Diamondで87.2%、SWEBench Verifiedで77.6%を達成。エージェンティックなツール使用と長期の改良フィードバックループに対応し、実用的なアプリケーション構築を支援
- 信頼性と安全性の両立: 予測・予報タスクでの適切な不確実性表現(キャリブレーション)、複雑な指示追従、検閲耐性を「エピステミクス」として統合。FORTRESS(有害リクエスト拒否)で78.0%、StrongREJECTで98.6%という安全性基準も満たしています
- Tinkerでの即座のカスタマイズ: 独自のファインチューニングプラットフォーム「Tinker」上で、組織固有の知識を活用した高速な適応が可能。Inkling Playgroundによる対話的な動作確認も提供
活用シーン
- 企業特化型AIエージェントの構築: 金融、医療、法律など専門領域の内部データでファインチューニングし、組織固有の判断基準と知識を持つカスタムエージェントを開発。コントローラブルな思考努力度により、リアルタイム対話から高度な分析まで使い分けが可能です
- マルチモーダルインタラクションシステム: 音声・画像・テキストを統合したリアルタイム協働環境を実現。カスタマーサポート、教育・研修、クリエイティブ制作など、自然な対話形式で情報を収集・提供するインタラクティブなアプリケーションに最適です
- 効率的な開発支援とコード生成: ワンショットで機能的なWebアプリを構築し、40回以上の反復改良を継続可能。SWEBenchやTerminal Benchでの高いスコアを活かし、エージェンティックなコーディング支援、自動化ツール構築、長期プロジェクトでの継続的なコード改善を実現します
対象ユーザー
AIモデルのカスタマイズを通じて競争優位を築きたい企業の技術責任者、プロダクトマネージャー、および機械学習エンジニア向けです。特に、多モーダル入力処理、コスト効率の良い推論、専門領域への適応が必要なユースケースで、オープンウェイトモデルの柔軟性と商用APIの利便性の両方を求める組織に最適です。