「ax」に替えたら、エージェントのHTML抽出コストが最大67%減った

ax
コーディングエージェント向けに、Web ページの取得・構造把握・構造化抽出を1コマンドで行う CLI
GitHub公式サイト
公開
正式公開 2026-07-06(GitHub リポジトリ作成日)
作り手
Yusuke Wada(yusukebe)(個人)
対応
CLI
価格
無料(MIT ライセンス)
アカウント・広告
API キー不要
評価
GitHub のスター 719(2026-10-09)

どんなアプリか

ax は、コーディングエージェントが curl と使い捨てのパース用スクリプトの代わりに使うための CLI です。ページを取得し、構造をつかみ、構造化したデータを取り出すまでを1つのコマンドで行います。

Local HTTP and HTML I/O for coding agents. One command instead of curl + throwaway Python — structured, token-cheap, capped by default, never silent.

Yusuke Wada さん、ax 公式サイト

作り手は Cloudflare の Developer Advocate で、Web フレームワーク Hono の作者です。

取得では、本文が空のときやエラーのときも、ステータス・ヘッダー・かかった時間などをまとめた報告を必ず返します。README では、curl は空の 200 応答で何も表示しないため、エージェントがオプションを変えて推測しながら再実行することになると説明しています。

知らないページは、–outline で繰り返し出てくる構造を一覧にし、–locate で指定した文字列がどのセレクタにあるかを調べられます。生の HTML をコンテキストに流し込まずにページの形をつかむための機能です。

取り出しは CSS セレクタで指定します。–row で複数の項目を一度に行として取り出し、–table で表を行に変え、–where で絞り込めます。正規表現より、マークアップが変わったときにエージェントが直しやすいとしています。

出力の量も抑える作りです。結果は標準で 50 までに区切られ、打ち切ったことは標準エラーに知らせます。–budget でおおよそのトークン量を指定でき、項目の途中では切りません。

エージェントに使い方を覚えさせるには、ax agent-context で説明書をオフラインで出力させるか、npx skills add yusukebe/ax でスキルとして入れます。

作り手は、Claude Code のセッションで同じ課題を ax ありとなしで比べた結果を公開しています。60 の項目を持つカタログページからの抽出(Opus 4.8)では、費用が $0.296 から $0.104 に、時間が24秒から14秒になったとしています。ax が負けた回を含む手順もリポジトリに載せています。

料金とデータの置き場所

MIT ライセンスで公開されています。インストールは curl のスクリプト、Homebrew、Nix、ソースからのビルドの方法が案内されています。

処理は手元で行い、API キーは要りません。取得モードはキャッシュを持たず毎回取りに行きます。解析モードでは URL を約2分キャッシュし、–no-cache を付けるとディスクに書きません。

同じ分野のアプリ

名前型仕掛け対応料金
axWeb 取得・抽出取得・構造把握・構造化抽出を1コマンドでCLI無料(OSS, MIT)
o3-search-mcpWeb 検索・相談エージェントから o3 の Web 検索付き推論を呼び出すMCP サーバー(npm)無料(OSS, MIT)
ffmpeg-skillスキル集ローカルの FFmpeg で動画編集をさせるClaude Code / Cursor / Codex / MCP(npx)無料(OSS, MIT)
agent-lens静的解析編集時に hooks 経由で重複や複雑度を伝えるCLI(Rust、単一バイナリ)無料(OSS)

入れる前に

JavaScript を多用する SPA には引き続きブラウザ系の道具が必要だと、作り手自身が README に書いています。ax はそれ以外のページ向けの道具という位置づけです。

Bun で単一ファイルのバイナリにまとめられていて、実行時の依存は DOM の解析に使う linkedom の1つです。