メインコンテンツへスキップ
ToolPotion

インクリングモデルカード - シンキングマシーンズラボ

注目

インクリングは、開発者向けに設計された975BパラメータのマルチモーダルAIモデルです。テキスト、画像、音声入力を受け付け、チャットボットやコーディングアシスタントなどのさまざまなアプリケーション向けにテキスト出力を生成します。オープンウェイトでリリースされており、研究やサードパーティ製品への統合をサポートします。

URLを訪問

説明

インクリングは、シンキングマシーンズラボ株式会社が開発した汎用マルチモーダルAIモデルです。合計9750億のパラメータを持ち、アクティブなパラメータは410億で、テキスト、画像、音声入力を受け付け、テキスト出力を生成するように設計されています。このモデルは英語および他の言語での使用を意図しており、さまざまなアプリケーションに対応できる柔軟性を持っています。開発者はインクリングを利用して、エージェントシステムやツール使用システム、コーディングアシスタント、チャットボット、情報検索を強化した生成システムなどのAI駆動アプリケーションを構築できます。その設計は、汎用的な会話の使用、指示に従うこと、その他の自然言語およびマルチモーダルタスクをサポートしています。インクリングはオープンウェイトでリリースされており、下流の開発者による研究、ファインチューニング、サードパーティ製品への統合が可能です。

インクリングのアーキテクチャは、スパースなMixture-of-Experts(MoE)フィードフォワードバックボーンを持つ66層のデコーダ専用トランスフォーマーに基づいています。各トークンは256の専門家のうち6つにルーティングされ、すべてのトークンで2つの共有専門家がアクティブになります。このモデルはネイティブにマルチモーダルであり、階層的パッチエンコーダーを介して画像をエンコードし、離散トークンエンコーディングを通じて音声をエンコードします。すべてのモダリティは共有された隠れ空間に投影され、デコーダによって共同で処理されます。インクリングは最大100万トークンのコンテキストウィンドウをサポートしており、大規模な入力データを処理する能力があります。

インクリングは、ファインチューニングサービスであるティンカーを介してAPIアクセスを通じて利用可能であり、サードパーティの推論プロバイダーを通じても利用できます。モデルのウェイトはHugging Faceからダウンロードできます。最適なパフォーマンスを得るためには、十分なVRAMを持つGPUクラスターなど、特定のハードウェア構成が必要です。このモデルは、マルチモーダルインタラクションに関連するリスクを軽減するために広範な安全評価を受けており、既存のオープンウェイトモデルを超える実質的なリフトを示さないことを保証しています。ただし、高リスクのコンテキストでインクリングを展開する際には、追加の安全策と人間の監視を実施することが推奨されます。

インクリングモデルカードのハイライト

  • モデルタイプ: マルチモーダル自己回帰トランスフォーマー

  • API利用可能: はい

  • ライセンス: Apache 2.0

  • パラメータ: 合計975B、アクティブ41B

  • ファインチューニングサポート: はい

  • マルチモーダル: はい

  • 数値サポート: BF16, MXFP8, NVFP4

  • コンテキストウィンドウ: 1Mトークン

インクリングモデルカードをはじめる

  1. モデルにアクセス: APIアクセスのためにティンカーサービスを訪問してください。

  2. 認証: アカウントを設定し、APIキーを取得します。

  3. 環境を設定: ハードウェアがモデルの要件を満たしていることを確認します。

  4. API経由で統合: 提供されたドキュメントを使用してインクリングをアプリケーションに統合します。

  5. 最適化: 特定のユースケースに応じてモデルをファインチューニングします。

インクリングモデルカードの使用例

  • チャットボット
  • コーディングアシスタント
  • マルチモーダルアプリケーション
  • 指示に従う
  • 情報検索を強化した生成

インクリングモデルカードのFAQ

インクリングモデルカード のレビュー

読み込み中...

インクリングモデルカード に似た人気のAIツール

Command A+ は、複雑な推論、視覚、48 言語にわたる多言語タスクのために設計された、25B のアクティブパラメータと 218B の総パラメータを持つ専門家の混合モデルです。企業向けに効率的で正確なソリューションを提供します。

注目AIモデルとLLM

Fuyu-8Bは、デジタルエージェント向けに設計されたオープンソースのマルチモーダルAIモデルです。そのシンプルなアーキテクチャは、任意の画像解像度をサポートし、グラフ、図、UI要素に関する質問に高速に応答することを可能にします。標準的なベンチマークで高い性能を発揮し、HuggingFaceで利用可能です。

AIモデルとLLM

AI モデル

Intern Large Models(InternLM)は、Shanghai AI Laboratoryが開発したオープンソースのLLMおよびMLLMを提供します。そのスイートには、InternVLやInternLM-XComposerなどのモデルに加え、ファインチューニング用のXTunerやデプロイ用のLMDeployを含む開発およびアプリケーション用の…

AIモデルとLLM

Mistral Large 3は、企業向けに設計された最先端のAIモデルで、AIアシスタントやエージェントのカスタマイズ、ファインチューニング、展開を可能にします。41Bのアクティブパラメータを持つスパースミクスチャーオブエキスパートアーキテクチャを特徴としており、マルチモーダルおよび多言語アプリケーションにおいて高度な機能を提供します。

注目AIモデルとLLM

AI モデル

Olmo from Ai2は、高度なAI研究とアプリケーションのために設計された完全にオープンな言語モデルです。プログラミング、推論、対話に最適化されたさまざまなモデルバリアントを提供し、開発者や研究者に対して透明性とアクセス可能性を確保します。

注目AIモデルとLLM

Mistral Small 4は、推論、コーディング、マルチモーダル機能を1つのプラットフォームに統合した多用途のAIモデルです。ユーザーはAIアシスタントやエージェントを効率的にカスタマイズ、ファインチューニング、展開できるため、さまざまな企業アプリケーションに最適です。

注目AIモデルとLLM

IDEFICSは、最先端の機能を再現するオープンアクセス可能なビジュアル言語モデルです。画像とテキストのインターリーブ入力を受け付け、テキスト出力を生成し、Flamingoのようなプロプライエタリモデルに匹敵します。9Bおよび80Bのパラメータサイズで利用可能で、マルチモーダルAIの研究開発をサポートします。

AIモデルとLLM

Flamingoは、Google DeepMindが開発した単一のビジュアル言語モデル(VLM)であり、多様なマルチモーダルタスクにおける少数の例からの学習(few-shot learning)に優れています。画像、動画、テキストが混在した入力を処理し、関連する言語出力を生成します。追加のトレーニングなしで、タスク固有の例を最小限で済ませることができます。

AIモデルとLLM