arXivをAIエージェント向けのインターフェースに変換(ブラウザ視覚不要)
MediaUse CLIがarXivスキルを公開。AIエージェントはコマンドラインから論文検索、カテゴリ別最新論文、詳細取得、著者検索を実行可能。すべての操作は読み取り専用でログイン不要。インストール手順、コマンド一覧、ワークフロー例、レート制限ガイドを提供。
MediaUse CLIは、arXivをAIエージェントがプログラム可能に操作できるインターフェースに変える新しいスキルをリリースしました。このスキルにより、エージェントは従来のブラウザ視覚操作を必要とせず、コマンドラインから直接arXivの公開研究リソースにアクセスできます。
インストールと設定
ユーザーはWindowsシステムにMediaUse CLIをインストールする必要があります(現時点ではWindowsのみ対応)。インストールコマンド:
powershell -C "iwr https://release.mediause.dev/install.ps1 -UseBasicParsing | iex"
インストール後、バージョン確認:mediause --version。
次に[mediause.dev](https://mediause.dev)でアカウント登録しAPIキーを取得、mediause manage key --jsonで設定します。その後、arXivプラグインを追加:mediause plugin add arxiv --json、ゲストアカウントをバインド:mediause use account arxiv:guest --show --json。arXivは公開読み取り専用リソースのため、ログインは不要です。
主要コマンド
スキルは5つの主要操作を提供します:
account.health:プラグインの動作状態を確認。search.papers:キーワードで論文検索、最大25件、呼び出し間隔3秒以上。get.recent:指定カテゴリの最新論文を取得、最大50件、間隔3秒以上。get.paper:arXiv IDで論文の完全な詳細(要約、著者、カテゴリ等)を取得、間隔1秒以上。user.author:著者名で論文を検索(あいまい一致対応)、最大50件、間隔3秒以上。
すべてのコマンドは --json パラメータを使用して構造化出力を得ます。
ワークフロー例
記事では3つの典型的なワークフローを提示:
- 新着論文の発見:
cs.CLカテゴリの最新論文を閲覧後、特定の論文の詳細を取得。 - キーワード検索と著者追跡:「large language model reasoning」を検索し、著者Jason Weiの他の論文を確認。
- 日常モニタリング:毎日
cs.AIとcs.LGの最新論文を取得し、特定概念を検索。
レート制限とエラー処理
arXiv公開APIにはソフトなレート制限があり、最低間隔を遵守する必要があります。HTTP 429やキャプチャが発生した場合は30秒以上待ってから再試行。よくあるエラーとして、クエリが具体的すぎる、ID形式が間違っている、カテゴリコードのタイプミスなどがあります。キャプチャの問題は --show パラメータで手動解決することを推奨。
利用制約
すべての操作は読み取り専用。論文の要約や全文を無断で公開してはならず、データをスクレイピングして競合インデックスを構築することは禁止。arXivの利用ポリシーを遵守する必要があります。
このスキルにより、AIエージェントはarXivの膨大な研究リソースを標準化されたプログラム可能な方法で効率的に活用でき、自動化された文献検索と分析の強力なツールとなります。