このページの内容

Awesome Artificial Intelligence

Artificial Intelligenceを扱う資料や関連プロジェクトをまとめたAwesomeリストです。

学ぶ

書籍

コース

基礎論文

AIシステムを構築する

ガイドとプレイブック

  • Building Effective Agents: エージェントシステムの実践的パターンとトレードオフに関するAnthropicの解説。
  • A Practical Guide to Building Agents: モデル、ツール、指示、オーケストレーション、ガードレールを扱うOpenAIのガイド。
  • Awesome DeepSeek Agent: Claude Code、Codex、Cline、OpenCode、Piを含むコーディングエージェントにモデルを統合するDeepSeek公式セットアップガイド。

LLMアプリケーションエンジニアリング

プロトコルと相互運用性

  • Model Context Protocol: AIアプリケーションを外部ツール、データソース、プロンプト、対話型アプリへ接続するオープン仕様。
  • Agent2Agent Protocol: エージェント発見、タスク委譲、ストリーミング、非同期更新、クロスプラットフォーム通信のベンダー中立仕様。

エージェントフレームワーク

  • Pydantic AI: Pydanticを中心にした型付きエージェント開発。
  • LangGraph: 長時間実行・ステートフルなエージェント向け低レベルオーケストレーション。
  • OpenAI Agents SDK: ツール、ハンドオフ、ガードレール、トレーシング、エージェントオーケストレーション向け小規模SDK。
  • Google Agent Development Kit: エージェントの開発・評価のためのGoogleフレームワーク。
  • Microsoft Agent Framework: AutoGenとSemantic Kernelの後継で、エージェントおよびグラフベースワークフローを扱うMicrosoftのフレームワーク。

永続的・非同期的なエージェント

  • Effective Harnesses for Long-Running Agents: 複数のコンテキストウィンドウをまたいで進行し、失敗から回復するエージェントのパターン。
  • Running Agents: OpenAI Agents SDKにおけるライフサイクル、セッション、例外、永続実行のパターン。
  • Human-in-the-Loop: エージェント状態を失わずにツール呼び出しを一時停止、検査、承認、却下、再開。
  • Gemini and Temporal Durable Agent: エージェントワークフローにおける永続実行、再試行、人間の承認の具体的実装。

検索とデータ

  • LlamaIndex: データ取り込み、索引化、検索、エージェントワークフロー。
  • Haystack: 検索・生成AIアプリケーション向けモジュラー型パイプライン。
  • Docling: AIアプリケーション向け文書解析・変換。

評価と信頼性

  • Demystifying Evals for AI Agents: タスクスイート、採点器、トランスクリプト、評価ハーネスを構築する実践的手法。
  • OpenAI Evals: 言語モデル・システム評価のオープンソースフレームワークとレジストリ。
  • Promptfoo: テストケース、アサーション、モデル比較、LLMアプリケーションのレッドチーム検査。
  • Ragas: 検索・生成AIアプリケーションの評価と実験。

デプロイと可観測性

  • Langfuse: LLMアプリケーション向けトレーシング、評価、プロンプト管理、メトリクス。
  • vLLM: 言語モデルの推論・サービングエンジン。
  • LiteLLM: 複数モデルプロバイダー向けモデルゲートウェイと統一インターフェイス。

エージェント型ソフトウェアエンジニアリング

コーディングエージェントは、開発者による計画、実装、レビュー、テスト、デバッグを支援します。独立した能力比較についてはSWE-benchTerminal-Benchを参照してください。

コーディングエージェント

  • Neo: サブエージェント、スキル、サンドボックス化ツール、複数モデルプロバイダーを備える、オープンソースのワークフロー優先ターミナルコーディングエージェント。
  • Claude Code: フック、サブエージェント、スキル、リポジトリレベルの指示を備えるターミナルエージェント。
  • Codex CLI: サンドボックスと承認制御を備えるオープンソースのターミナルエージェント。
  • Gemini CLI: Geminiを中心に構築され、拡張可能なツールを備えたオープンソースのターミナルエージェント。
  • Cursor CLI: Cursorのエディタとクラウドワークフローに接続するターミナルエージェント。
  • GitHub Copilot coding agent: GitHub Issueから作業し、プルリクエストを作成する非同期エージェント。
  • Aider: Git統合と幅広いモデル対応を備えるオープンソースのペアプログラマー。
  • OpenCode: クライアント・サーバーアーキテクチャを採るオープンソースでプロバイダー非依存のターミナルエージェント。
  • OpenHands: ソフトウェア開発エージェントをローカルまたはクラウドで実行するオープンソースプラットフォーム。
  • Cline: エディタ拡張、CLI、SDKとして利用できるオープンソースのコーディングエージェント。
  • Continue: ソース管理下の設定を用いるIDE・CIワークフロー向けオープンソースコーディングエージェント。

Build Your Own Coding Agent Like Piでは、エージェントループ、ツール、ファイルを中心に据えた最小限のGoハーネスの実装を解説します。

エージェントスキルとワークフロー

  • Blueprint: ソフトウェア変更の設計、実装、テスト、レビュー、出荷を行うための焦点を絞ったオープンソースのエージェントスキル集。

ソフトウェアファクトリーとエージェントオーケストレーション

  • Harness Engineering: コーディングエージェント、リポジトリ制約、自動チェック、人間による誘導を使うソフトウェア構築に関するOpenAIのフィールドレポート。
  • Codex Orchestration with Symphony: プロジェクト作業を分離・観測可能なコーディングエージェント実行に変えるリファレンスアーキテクチャ。
  • How We Built Our Multi-Agent Research System: オーケストレーター・ワーカー、並列検索、評価、運用信頼性に関する本番環境の教訓。

Factoryは、GitリポジトリをまたいでPi、Codex、Claude Codeワーカーをスケジュール・調整する開発者プレビューのコントロールプレーンです。

貢献

提案を歓迎しますが、このリストは意図的に選別されています。Issueまたはプルリクエストを開く前に貢献ガイドキュレーションポリシーを読んでください。

提案するリソースは次を満たす必要があります。

  • AIエンジニアリングを学ぶ・実践するソフトウェア開発者に役立つこと。
  • 製品ホームページを超える技術的または実用的価値を提供すること。
  • 基礎的かつ永続的な価値がある場合を除き、最新で保守されていること。
  • 既存エントリーと意味のある違いがあること。
  • 一次情報で裏付けられた事実に基づく説明であること。

そのリソースが解決する開発者の問題と、なぜ基準を満たすかを説明してください。既存エントリーと重複する場合は、実質的に優れている理由を説明します。リソースとの関係があれば開示してください。

コーディングエージェントとAIエンジニアリングの継続的な実践チュートリアルについては、AI Engineer YouTube channelを参照してください。