説明
TaxyAI のブラウザ拡張機能は、GPT-4 を活用してブラウザ操作を自動化し、ユーザーが反復的なタスクを効率的に実行できるようにします。この拡張機能は、ユーザー定義の指示に基づいてアクションを実行するように設計されており、ブラウザ環境内でのワークフローを合理化します。
その中核的な機能には、Web ページの Document Object Model (DOM) を簡素化して、インタラクティブな要素のみを含めることが含まれます。この簡素化された DOM は、ユーザーの指示とともに、現在 GPT-3.5 および GPT-4 をサポートしている、選択された大規模言語モデル (LLM) に送信されます。LLM は情報を処理してアクションを生成し、拡張機能は chrome.debugger API を使用してそれらを実行します。アクションサイクルには、要素のクリックやテキストの入力などの手順が含まれ、1 つのタスクあたり最大 50 個のアクションが可能です。
この拡張機能は現在 GitHub を通じて利用可能であり、非技術的なユーザーの使いやすさを高める機能を追加した後、Chrome ウェブストアでリリースされる予定です。ユーザーは、リポジトリをクローンし、yarn を使用して依存関係をインストールし、パッケージをビルドすることで、拡張機能をインストールできます。インストール後、拡張機能はポップアップまたは devtools パネルとしてアクティブ化できます。ユーザーは OpenAI API キーを提供する必要があり、これはブラウザ内に安全に保存されます。
主な機能には、会議のスケジュール設定、コンテンツの検索、エッセイの作成などのタスクを自動化する機能が含まれます。この拡張機能のアーキテクチャは安全性を優先し、予期しない応答が発生した場合に実行を停止します。このプロジェクトはオープンソースであり、透明性とコミュニティの貢献を保証します。技術スタックには、Chrome Extension Manifest V3、React 17、Webpack 5、TypeScript などが含まれます。このプロジェクトは積極的に保守されており、更新と改善が定期的に追加されています。
GitHubの主要機能
GPT-4 を使用してブラウザ操作を自動化
アドホックな指示をサポート
LLM 処理のために Web ページの DOM を簡素化
アクション実行に chrome.debugger API を使用
GPT-3.5 および GPT-4 をサポート
ユーザーがカスタムワークフローを定義できるようにする
オープンソースでコミュニティ主導
一般的なタスクのデモ例を含む
デバッグ用の devtools パネルを提供する
OpenAI API キーを安全に保存
より幅広い使用のためのウェイティングリストを提供する
React 17 および TypeScript を使用
1 つのタスクあたり最大 50 個のアクションをサポート
GitHubをはじめる
Clone: GitHub リポジトリをクローンします。
Install Dependencies: `yarn` を実行して、必要な依存関係をインストールします。
Build: `yarn start` を実行して、パッケージをビルドします。
Load Extension: `chrome://extensions/` に移動し、開発者モードを有効にします。
Load Unpacked: 「パッケージ化されていないものを読み込む」をクリックし、`yarn start` によって生成されたビルドフォルダーを選択します。
Activate: ポップアップ (mac では cmd+shift+y、windows/linux では ctrl+shift+y) または devtools パネルを介して拡張機能をアクティブ化します。
Enter API Key: 提供されたボックスに OpenAI API キーを入力します。
Experiment: Web ページに移動し、TaxyAI で実験を開始します。
GitHubの使用例
- 自動化された Web タスク
- コンテンツ作成
- ワークフローの自動化
- Web アプリケーションのテスト
- データ入力
- 情報収集
- タスクのスケジュール設定
- ブラウザの自動化







