amenbo
amenbo is an MCP server optimized for fetching Japanese web content with low server impact and token-efficient responses. It provides the following capabilities:
Fetch pages (
fetch): Retrieve any HTTP/HTTPS URL (including PDFs) as Markdown or screenshot. Modes:auto,markdown,outline(headings summary with token counts), orscreenshot. Features include CSS selector filtering, pagination (page), token budget (max_tokens), section-level fetching, and diff-based re-fetch responses (unchanged/diff) to save tokens. Automatic encoding detection (Shift_JIS, EUC-JP, etc.) and ruby/furigana stripping included.List links (
links): Enumerate site links by prioritizing sitemap.xml, RSS, and Atom feeds before falling back to in-page links. Supports glob and partial-match filtering — low-impact by design.Screenshots (
screenshot): Render pages via headless Chromium and return tiled PNGs. Control resolution withscale(0.5–1.0) andwidth; capture full page or viewport only.CLI mode: All server features are also available from the command line, with file output support for piping to tools like
grep.Low-impact & secure design: Respects robots.txt, applies rate limiting (1 req/sec per domain), uses HTTP caching (ETag/If-Modified-Since), performs two-stage fetching (HTTP GET first, browser only if needed), blocks private IPs (SSRF protection), and enforces body size limits.
Provides a specialized adapter for Qiita, enabling efficient fetching of articles with optimized extraction for Japanese web content.
Supports discovery and collection of links from RSS/Atom feeds for efficient web crawling.
Provides a specialized adapter for Japanese Wikipedia, enabling efficient fetching of articles with optimized extraction.
Provides a specialized adapter for Zenn, enabling efficient fetching of articles with optimized extraction for Japanese web content.
Click on "Install Server".
Wait a few minutes for the server to deploy. Once ready, it will show a "Started" state.
In the chat, type
@followed by the MCP server name and your instructions, e.g., "@amenbofetch outline of https://zenn.dev"
That's it! The server will respond to your query, and you can continue using it as needed.
Here is a step-by-step guide with screenshots.
amenbo 🐜💧
English | 日本語
Skims the web without making waves — a Japanese-web-native MCP server for low-impact, token-efficient web collection: outline→section progressive disclosure and diff-only refetches keep context small.
amenbo(アメンボ / water strider)は、Claude Code や Codex のようなコーディングエージェント向けの MCP サーバーです。水面に波を立てずに滑る虫のように、収集先に負荷をかけず、少ないトークンで Web から情報を集めます。とりわけ日本語サイトに最適化しています。MCP クライアントを持たないシェル環境からは、同じコアを共有する CLI としても使えます(CLIとして使う参照)。
なぜ amenbo か
汎用のスクレイピングツールの多くは英語圏の Web を前提に作られており、日本語サイトでは次のような取りこぼしが起きがちです。amenbo はこれらの課題に対応します。
構造化が甘いサイト:div の入れ子やテーブルレイアウトが多い日本語サイトでも、レンダリング結果のジオメトリ(見た目の配置)から本文領域を推定します
文字化け:Shift_JIS / EUC-JP / ISO-2022-JP を自動判別
ふりがな:
<ruby>の振り仮名を除去し、本文の二重化を防止画像で出す情報:画像化された料金表やバナー中心のページは、テキスト抽出が貧弱なとき自動でスクリーンショットに切り替え
表の欠落・崩れ:リンク密度の高いデータ表(比較表など)は本文抽出時に丸ごと落ちることがあり、そうした表を検出して元の位置へ復元します。本文に残った表も colspan/rowspan・多段ヘッダを正規化し、列ズレを防ぎます
見出しの消失:見出しが編集リンク付きラッパーに包まれたページ(Wiki系など)では本文抽出時に見出し構造が丸ごと失われることがあり、本文が残っている節の見出しを検出して元の位置へ復元します(outline / section の段階開示が安定)
国内主要サイト:Qiita / Zenn / note / はてなブログ / Yahoo!ニュース / PR TIMES に専用アダプタ
類似ツール(公式 fetch MCP / Jina Reader / Playwright MCP / PixelRAG pixelshot)との実測比較は、記事「エージェントのWeb取得、ツール次第でトークンが5000倍違った話」を参照してください。ハーネスと生ログは bench/ にあります。
Related MCP server: Charlotte
トークンを節約する仕組み
段階開示:
mode: outlineで見出しツリーと各節のトークン量だけ先に返し、必要な節だけsection指定で取得。長大なページを丸ごと流し込みませんCJK 対応の本文プルーニング:句読点密度、文字種比率、リンク密度でナビ/広告/フッターを除去
差分応答:一度取得した URL の再取得時、変更が無ければ
unchanged、あれば変更された節だけを返します自動 Markdown/画像切替:品質スコアが低いページだけスクリーンショットにし、壊れた Markdown を読ませて取り直す往復を避けます
CJK トークン見積り:日本語は英語よりトークン単価が重いため、文字種別の係数でページ分割の予算を計算します
収集先への低負荷
二段フェッチ:まず素の HTTP GET。JS 描画が必要なページだけ headless Chromium に昇格するので、大半の取得でブラウザを起動しません
礼儀正しいクローラ:robots.txt と Crawl-Delay を尊重、同一ドメインへは直列 + 既定 1 req/秒。リンク列挙は sitemap / RSS を優先しページを舐めません
正直な User-Agent:ボットであることを明示します。anti-bot 回避は実装しません
キャッシュ:ETag / If-Modified-Since で再検証し、無駄な再取得を避けます
インストール
npm install -g amenboMarkdown 取得(通常の fetch / links)はこれだけで動きます。JS 描画が必要な SPA への昇格やスクリーンショットなど、ブラウザ(Chromium)経由の取得を使う場合のみ、初回に一度だけ実行してください(約 170MB のダウンロード):
npx -y amenbo install-browserまたは開発用途:
git clone https://github.com/Rererr/amenbo.git
cd amenbo
npm install
npm run buildMCP クライアントへの登録
Claude Code(--scope user は全プロジェクト共通。プロジェクト単位なら外す):
claude mcp add --scope user amenbo -- amenboCodex CLI:
codex mcp add amenbo -- amenboVS Code:
code --add-mcp '{"name":"amenbo","command":"amenbo"}'その他のクライアント(Cursor / Cline など)は、各クライアントの MCP 設定(Cursor: ~/.cursor/mcp.json、Cline: MCP Servers 画面の settings JSON)に次のエントリを追加します:
{
"mcpServers": {
"amenbo": {
"command": "amenbo"
}
}
}グローバルインストールを避ける場合は "command": "npx", "args": ["-y", "amenbo"]、ローカルビルドを使う場合は "command": "node", "args": ["/path/to/amenbo/dist/server.js"] を指定してください。
エージェントに使い方を教える(推奨プロンプト)
ツール定義だけでは「段階開示で取る」といった使い方の作法までは伝わりません。以下を CLAUDE.md や AGENTS.md にコピペすると、エージェントが amenbo を効率よく使うようになります。
## Web取得は amenbo を使う
- ページ取得は `fetch`(mode 既定 `auto`)。長そうなページや一部しか要らないページは、
まず `mode: "outline"` で見出しと各節のトークン量を確認し、必要な節だけ `section` 指定で取得する
- 同じ URL の再取得で `unchanged` / `diff` が返るのは正常(変更なし / 変更節のみ)。
全文が必要なときだけ `force_full: true` を使う
- サイト内のページを探すときは URL を推測せず `links`(`filter` で絞り込み)で列挙する
- シェルが使える環境で、キーワードで探したいだけの長いページや複数ページの一括収集は、
CLI で `amenbo fetch <url> > page.md` に落として grep / 部分読みする(本文をコンテキストに入れない)。
構造を見ながら判断したいページは従来どおり MCP の outline → section が向く
- 日本語以外のサイトにも使える(段階開示・キャッシュ・低負荷は言語非依存)。ただし本文抽出は
日本語向けに調整しているため、非日本語ページで本文が欠けて見えるときは `selector` 指定か
`mode: "screenshot"` で取り直す
- 料金表・レイアウトなど視覚情報が目的なら `screenshot`。`scale: 0.5` 程度で画像トークンを減らせる
- robots.txt 拒否や bot 対策による取得失敗は仕様(回避しない)。失敗はそのままユーザーに報告するCLAUDE.md に書かず、その場のセッションだけに読み込むこともできます。MCP プロンプト対応クライアントでは、サーバーが同じ作法を usage プロンプトとして配布しています(Claude Code では /mcp__amenbo__usage)。
CLIとして使う
amenbo は MCP サーバーと同一のコア(取得、キャッシュ、politeness、抽出ロジック)を共有する CLI としても動作します。引数なし、または amenbo serve は従来通り MCP サーバーとして起動する(.mcp.json の "command": "amenbo" はそのまま動きます)ので、既存の MCP 登録には影響しません。
# ページをMarkdownとして取得(標準出力へ)
amenbo fetch https://example.com/
# 長いページはまずoutlineで見出しとトークン量だけ確認
amenbo fetch https://example.com/ --mode outline
# 出力をファイルに落として grep や部分読み(head/sed)する
amenbo fetch https://example.com/ > page.md
grep -A3 "料金" page.md
# サイト内のリンクを列挙(sitemap/RSS優先)
amenbo links https://example.com/ --filter "blog/*"
# スクリーンショット(タイルPNGは--out-dirへ保存され、パスが標準出力に列挙される)
amenbo screenshot https://example.com/ --viewport-only --scale 0.5 --out-dir ./shots各サブコマンドの詳細は amenbo <fetch|links|screenshot> --help を参照してください。
MCP と CLI の使い分け:
MCP:エージェントの主経路。ブラウザ(Chromium)がプロセス内でウォームに保たれ、スクリーンショット等の画像を会話へ直接返せる。claude.ai のようにシェルを持たないホストのエージェントにも届く
CLI:シェルスクリプト、CI、デバッグ用途、出力をファイルに落として
grep/部分読みしたい場合、または MCP 非対応のエージェント/ツールチェーンから使う場合に向く。1 コマンド= 1 プロセスのためブラウザは毎回起動する
キャッシュ、差分応答(unchanged/diff)、レート制御(robots.txt/ドメイン毎の直列アクセス)の状態は MCP サーバーと CLI で共有されます(同じ ~/.cache/amenbo を使うため)。ただしレート制御のプロセス間共有はベストエフォートです。同一ドメインへの直列化は各プロセス内でのみ厳密に保証され、MCP サーバーと複数の CLI 実行が同時に同じドメインへアクセスした場合、最小間隔が多少すり抜けることがあります。
ツール
fetch でページを取得
パラメータ | 説明 |
| 取得対象 URL(http/https のみ。PDF 可) |
|
|
| 本文を絞り込む CSS セレクタ |
| outline で得た section ID。その節の Markdown のみ返す(祖先見出しがあれば応答に |
| ページ番号(既定 1) |
| 1 ページの概算トークン上限(既定 8000) |
| true で差分応答・定型ブロック除去を無効化し常に全文を返す |
links でリンクを列挙
パラメータ | 説明 |
| 起点 URL |
| URL/リンクテキストの部分一致、または |
sitemap → RSS/Atom → ページ内リンクの順で探索します。
screenshot でスクリーンショットを撮影
パラメータ | 説明 |
| 撮影対象 URL(http/https のみ) |
| 既定 true。false で最初のビューポート分のみ |
| タイル幅 px(既定 1280) |
| 解像度スケール 0.5〜1.0(既定 1.0)。小さいほど画像トークン減 |
環境変数
変数 | 既定 | 説明 |
|
| キャッシュ(SQLite + PNG)の保存先 |
|
| キャッシュの有効期限 |
|
| 取得ボディの上限サイズ |
セキュリティ
SSRF 対策:http/https 以外のスキーム(
file:,ftp:等)を拒否。DNS 解決した接続先が private / loopback / link-local / 予約アドレスなら拒否。DNS rebinding(TOCTOU)対策として実接続を検証済み IP に固定しますボディサイズ上限:巨大レスポンスによる OOM を防止
既知の制限
HTTP プロキシ非対応:
HTTP_PROXY/HTTPS_PROXY等の環境変数は尊重しません。SSRF 対策として接続先を検証済み IP に固定する設計(DNS rebinding 対策)と、プロキシへ名前解決を委ねる方式が両立しないためです。上流プロキシ必須のネットワークでは現状ご利用いただけませんanti-bot 回避は実装しません:robots.txt 拒否やボット対策による取得失敗は仕様です。失敗はそのまま報告します(収集先への低負荷参照)
開発
npm run typecheck # strict 型チェック
npm test # vitest
npm run build # dist/ へビルド引用
記事や研究で参照する場合は Zenodo の DOI を使ってください。上のバッジの 10.5281/zenodo.21553636 は全バージョン共通の Concept DOI で、常に最新版へ解決されます。特定の版を指す場合は、その版の DOI を Zenodo のレコードから取得してください。
機械可読な引用情報は CITATION.cff にあります(GitHub の "Cite this repository" から BibTeX / APA を生成できます)。
ライセンス
Maintenance
Resources
Unclaimed servers have limited discoverability.
Looking for Admin?
If you are the server author, to access and configure the admin panel.
Tools
Related MCP Servers
- AlicenseAqualityDmaintenanceA comprehensive MCP server providing 15 web tools including search, scraping, screenshots, SEO audits, and DNS/SSL checks through a single installation. It delivers clean, LLM-optimized outputs so AI agents can focus on reasoning rather than parsing raw HTML.Last updated1525MIT
- AlicenseAqualityAmaintenanceA token-efficient MCP server that gives AI agents structured access to the web, returning compact page summaries and targeted queries instead of full accessibility dumps.Last updated23334169MIT

Yutori MCPofficial
AlicenseAqualityAmaintenanceMCP server enabling web monitoring, deep research, and browser automation through Yutori's web agentic technology.Last updated1319Apache 2.0- AlicenseAqualityCmaintenanceAn MCP server that enables AI assistants to fetch web content in multiple formats (HTML, JSON, text, Markdown) with intelligent content extraction, chunk management, and browser automation support.Last updated58115MIT
Related MCP Connectors
Reliable web access for AI agents: smart HTTP, rotating proxies, and full-browser rendering.
SEO MCP server: crawl your site, find AI-visibility gaps, and ship the fix from your coding agent.
Hosted MCP with 91 agent tools: X, domains, SEO, Maps, Trends, Search, YouTube, TikTok, and more.
Latest Blog Posts
- Who's Calling? MCP Hosts Are an Identity Blind Spot (And the Spec Knows It)By Om-Shree-0709 on .mcpAgent IdentityOAuth 2.1
- Your AI Chatbot Just Exposed Your CEO's Salary to an InternBy Om-Shree-0709 on .Agent IdentityMCP SecurityOAuth Delegation
- Why MCP Servers Need Execution Sandboxing (And Why Your Current Stack Isn't Enough)By Om-Shree-0709 on .Agentic AiPrompt InjectionWebAssembly
MCP directory API
We provide all the information about MCP servers via our MCP API.
curl -X GET 'https://glama.ai/api/mcp/v1/servers/Rererr/amenbo'
If you have feedback or need assistance with the MCP directory API, please join our Discord server