メインコンテンツへスキップ
ToolPotion

Code Llama

Code Llamaは、コード向けの Сode Llama モデルファミリーの推論コードを提供します。これらのモデルは、最先端のパフォーマンス、インフィル機能、および大規模な入力コンテキストのサポートを提供し、さまざまなプログラミングタスクや研究に適しています。

URLを訪問

説明

Code Llamaは、Metaが開発した、Llama 2を基盤としコード関連タスクに特化した大規模言語モデルファミリーです。このリポジトリは、これらの強力なモデルを実行するために必要な推論コードを提供します。Code Llamaモデルは、オープンモデルの中で最先端のパフォーマンスを発揮し、コードのインフィル機能、最大10万トークンまでの拡張入力コンテキストのサポート、プログラミングのためのゼロショット命令追従などの機能を提供します。

このファミリーには、基盤モデル(Code Llama)、Python専用バージョン(Code Llama - Python)、および命令追従モデル(Code Llama - Instruct)が含まれます。これらは、7B、13B、34B、70Bのさまざまなパラメータサイズで利用可能です。すべてのモデルは16kトークンのシーケンスでトレーニングされており、最大100kトークンの入力でパフォーマンスが向上しています。Code LlamaおよびCode Llama - Instructの7Bおよび13Bバリアントは、周囲のコンテンツに基づいてコードをインフィルする能力があります。

コードのサンプリングレートを高くしてLlama 2をファインチューニングすることで開発されたCode Llamaは、かなりの安全対策を組み込んでいます。リポジトリは、これらの事前トレーニング済みおよびファインチューニング済みモデルのモデルウェイトと開始コードを提供します。これは、Code Llamaモデルのロードと推論の実行のための最小限の例として機能します。ユーザーは、ライセンスに同意した後、Metaのウェブサイトからモデルウェイトとトークナイザーをダウンロードし、提供されている`download.sh`スクリプトを使用できます。

セットアップには、リポジトリのクローン作成と、PyTorch/CUDAを備えたconda環境内での依存関係のインストールが含まれます。推論には、モデルサイズに応じて異なるモデル並列(MP)値を指定する必要があります(例:7Bの場合は1、70Bの場合は8)。リポジトリには、コード補完(`example_completion.py`)、コードインフィル(`example_infilling.py`)、および命令追従(`example_instructions.py`)のサンプルスクリプトが含まれており、さまざまなモデルタイプを効果的にプロンプトし実行する方法を示しています。

Code Llama - Instructモデルは、命令を追従するように特別にファインチューニングされており、最適な結果を得るためには特定のフォーマットが必要です。リポジトリはまた、AI技術に関連する潜在的なリスクを強調し、ユーザーを責任ある使用ガイドと研究論文に誘導して、さらなる情報を提供します。ソフトウェアバグやモデルの動作に関連する問題は、提供されているGitHubリンクを通じて報告できます。

Code Llamaの主要機能

  • Code Llamaモデルの推論コード

  • 基盤モデル、Python特化モデル、命令追従モデルをサポート

  • 7B、13B、34B、70Bのパラメータサイズで利用可能

  • オープンコードモデルの中で最先端のパフォーマンス

  • 7Bおよび13Bモデルのコードインフィル機能

  • 最大10万トークンまでの大規模入力コンテキストをサポート

  • プログラミングタスクのためのゼロショット命令追従

  • 16kトークンのシーケンスでトレーニング済み

  • モデルウェイトと開始コードを含む

  • 補完、インフィル、命令追従のためのサンプルスクリプトを提供

  • 安全対策を組み込み

  • 研究者および商用エンティティ向けにライセンス供与

Code Llamaをはじめる

  1. クローン: GitHubからリポジトリをクローンします。

  2. インストール: PyTorch/CUDAを備えたconda環境をセットアップし、`pip install -e .`を使用して依存関係をインストールします。

  3. ダウンロード: Metaのウェブサイトからモデルウェイトとトークナイザーを入手し、`download.sh`を使用します。

  4. 設定: モデルサイズに基づいて適切なモデル並列(MP)値を決定します。

  5. 実行: 提供されているサンプルスクリプト(例:`example_completion.py`、`example_infilling.py`、`example_instructions.py`)を使用して推論を実行します。

  6. 最適化: ハードウェアとユースケースに基づいて`max_seq_len`と`max_batch_size`を調整します。

Code Llamaの使用例

  • コード生成
  • コード補完
  • コードインフィル
  • 命令追従
  • Python開発
  • 研究
  • 大規模コンテキストタスク

Code LlamaのFAQ

Code Llama のレビュー

読み込み中...

Code Llama に似た人気のAIツール

AI GitHub リポジトリ

StarCoderは、ソースコードと自然言語でトレーニングされた大規模言語モデルです。コード生成、補完、テキスト生成タスクに優れています。このリポジトリは、ファインチューニングと推論のためのリソースを提供し、開発者がその機能をさまざまなアプリケーションに統合できるようにします。

AIモデルとLLM

ggml-org/llama.cppは、C/C++におけるLLM推論に特化したGitHubリポジトリです。開発者がその開発に貢献し、機械学習アプリケーションのためにその機能を活用することができます。

注目AIモデルとLLM

LLaVAは、大規模言語とビジョン機能を組み合わせたビジュアル指示チューニングモデルです。GPT-4Vレベルのパフォーマンスを目指し、マルチモーダルな理解とインタラクションを可能にします。このプロジェクトは、研究者や開発者向けにコード、モデル、リソースを提供します。

AIモデルとLLM

AI GitHub リポジトリ

StableLM は、Stability AI によって開発されたオープンソースの言語モデルシリーズです。この GitHub リポジトリは継続的な開発をホストしており、StableLM-3B-4E1T や StableLM-Alpha v2 などの様々なチェックポイントへのアクセスを提供します。高度な AI…

AIモデルとLLM

LlamaFactoryは、100以上の大規模言語モデル(LLM)および視覚言語モデル(VLM)の統一的かつ効率的なファインチューニングに焦点を当てたGitHubリポジトリです。AI分野の研究者や開発者のためにファインチューニングプロセスを簡素化することを目的としています。

注目機械学習プラットフォーム

AI GitHub リポジトリ

Qwen3は、Alibaba CloudのQwenチームによって開発された大規模言語モデルシリーズです。指示追従、推論、テキスト理解、多言語サポートにおいて強化された能力を提供します。モデルは、思考モードと非思考モードを含む様々なサイズと構成で利用可能であり、長文脈理解に対応しています。

AIモデルとLLM

AI モデル

OpenLLaMAは、Meta AIのLLaMA 7Bモデルを許可なく利用可能なライセンスで再現したオープンソースモデルです。RedPajamaデータセットで学習され、3B、7B、13Bのパラメータバージョンを提供し、既存のLLaMA実装にシームレスに統合するためのPyTorchおよびJAXウェイトを提供します。

AIモデルとLLM

AI GitHub リポジトリ

Anthropic SDK for Python は、開発者が Claude API に直接アクセスするためのツールを提供します。このオープンソースライブラリは、高度なAI機能をPythonアプリケーションに容易に統合できるようにし、Anthropicの言語モデルとのプログラムによる対話を通じて、様々な自然言語処理タスクを実現します。

AIモデルとLLM