Claude Code baut dir eine Funktion in zehn Minuten. Ein YouTube-Transkript holt es ohne Hilfe nicht.
Genau da setzen zwei Open-Source-Projekte an. Agent Reach gibt einem KI-Agenten Lesezugriff auf YouTube, RSS-Feeds, GitHub und eine semantische Websuche. Scrapling holt einzelne Webseiten, die normale Abrufe abblocken. Den Anstoß gab mir die Anleitung von Alan Langhammer (@alan.buildz). Ich habe beide Werkzeuge am 7. Oktober 2026 auf meinem Mac und auf meinem Server eingerichtet, in meinen Arbeitsablauf eingebaut und dabei zwei Stellen gefunden, an denen ich die Voreinstellungen nicht übernehme.
Was Agent Reach macht
Agent Reach ist kein eigener Scraper. Das Projekt sucht für jede Plattform das freie Werkzeug heraus, das gerade funktioniert, installiert es und prüft regelmäßig, ob der Weg noch offen ist. Für YouTube ist das yt-dlp, für Feeds feedparser, für die Websuche Exa über mcporter, für GitHub die offizielle gh-CLI. Fällt ein Weg aus, nimmt Agent Reach den nächsten aus einer festen Kette.
fällt ein weg aus, übernimmt der nächste
- Bilibiliyt-dlp (gesperrt)bili-cli (aktiv)OpenCLI
- Twitter / Xtwitter-cli (aktiv)OpenCLIbird
- XiaohongshuOpenCLI (aktiv)xiaohongshu-mcpxhs-cli
Beispiel aus dem Projekt: Als Bilibili im Juni 2026 yt-dlp aussperrte, wechselte Agent Reach auf bili-cli. Welcher Weg gerade aktiv ist, zeigt agent-reach doctor.
Den Zustand aller Kanäle zeigt ein einziger Befehl: agent-reach doctor. Er listet jeden Kanal, den gerade aktiven Weg und fehlende Anmeldungen. Bei jedem Problem ist das der erste Befehl.
Stand 7. Oktober 2026
Zwei Open-Source-Projekte, fast 180.000 Sterne, keine API-Rechnung.
GitHub-Sterne für Agent Reach (MIT-Lizenz, Release v1.5.0 vom 11. Juni 2026).
github.com/Panniantong/Agent-ReachGitHub-Sterne für Scrapling (BSD-3-Lizenz, Release v0.4.15 vom 23. August 2026).
github.com/D4Vinci/Scraplingkennt Agent Reach insgesamt. Die Hälfte davon funktioniert nur mit deinem eigenen Login.
agent-reach doctorAPI-Gebühren. Kostenlos heißt nicht garantiert: Eine Plattform kann einen Weg jederzeit schließen.
ProjektbeschreibungSterne zeigen Aufmerksamkeit, keine tägliche Nutzung. Der Mac zählt mehr, weil eine ältere OpenCLI-Installation X, Reddit und Xiaohongshu als verfügbar meldet. Genau diese Kanäle sperre ich, siehe unten.
Wo Scrapling ins Spiel kommt
Agent Reach denkt in Plattformen. Für eine einzelne Seite, die Bots abweist, reicht das nicht. Scrapling von Karim Shoair (D4Vinci) schließt diese Lücke. Der StealthyFetcher kommt laut Projekt an Cloudflare Turnstile vorbei. Mit auto_save=True merkt sich Scrapling, wie ein Element aussah, und findet es mit adaptive=True nach einem Umbau der Seite wieder. Für Claude Code bringt Scrapling einen MCP-Server mit. Er schneidet Seiten per CSS-Selektor zu und entfernt laut Dokumentation versteckten Text, der den Agenten umlenken soll.
Firecrawl bleibt bei mir für Suche mit strukturierten Datenquellen zuständig. Die drei Werkzeuge überschneiden sich weniger, als die Produktseiten vermuten lassen.
die entscheidungsmatrix
Drei Werkzeuge, drei Aufgaben. Die Überschneidung ist kleiner, als sie wirkt.
| aufgabe | Agent Reach | Scrapling | Firecrawl |
|---|---|---|---|
| YouTube-Transkript ziehenyt-dlp über Agent Reach, Untertitel als Datei | ● | ||
| RSS-Feeds täglich auswertenfeedparser, ohne Login, ohne Kosten | ● | ||
| Breit recherchierenExa-Suche per mcporter, liefert Quellen mit Auszug | ● | ||
| Öffentliches Repo verstehengh-CLI, Issues und Releases inklusive | ● | ||
| Geschützte Seite lesenStealthyFetcher kommt an Cloudflare Turnstile vorbei | ● | ||
| Preise einer Seite regelmäßig prüfenadaptive Selektoren überstehen Layout-Wechsel | ● | ||
| Suche plus strukturierte DatenFirecrawl-Connector mit Alexandria-Datenquellen | ● | ||
| Eingeloggt auf Reddit, X, Instagramtechnisch möglich, bei mir gesperrt | × |
Faustregel: Plattform-Inhalte an Agent Reach, eine einzelne störrische Seite an Scrapling, Suche mit strukturierten Daten an Firecrawl.
Installation mit einer Zeile oder mit vier Befehlen
Der bequeme Weg steht in der README von Agent Reach. Du fügst Claude Code eine einzige Zeile mit der Adresse der Installationsanleitung ein, der Agent liest sie und arbeitet sie ab. Das funktioniert. Es installiert aber den aktuellen Stand von main, also Code, den vorher niemand als Release markiert hat.
Ich installiere deshalb eine feste Version in eine eigene Python-Umgebung. Vorher habe ich das Paket von v1.5.0 heruntergeladen und den Installer nach sudo, Pipes in die Shell und globalen Installationen durchsucht. Gefunden habe ich nur Hinweistexte, keine automatischen Systemeingriffe.
installation in vier blöcken
Install Agent Reach: https://raw.githubusercontent.com/Panniantong/agent-reach/main/docs/install.mdpython3 -m venv ~/.agent-reach-venv
~/.agent-reach-venv/bin/pip install https://github.com/Panniantong/agent-reach/archive/refs/tags/v1.5.0.zip
mkdir -p ~/.local/bin && ln -sf ~/.agent-reach-venv/bin/agent-reach ~/.local/bin/agent-reachagent-reach install --env=auto --dry-run # zeigt nur, was passieren würde
agent-reach install --env=auto # installiert die fehlenden Basis-Werkzeuge
agent-reach doctor # Status jedes Kanalspython3 -m venv ~/.scrapling-venv
~/.scrapling-venv/bin/pip install "scrapling[ai]==0.4.15"
~/.scrapling-venv/bin/scrapling install
claude mcp add ScraplingServer ~/.scrapling-venv/bin/scrapling-mcpAgent Reach v1.5.0 kennt den Schalter --system noch nicht, die README auf main beschreibt ihn bereits. Prüf vor dem Kopieren von Schaltern agent-reach --help in deiner Version.
Auf meinem Mac wollte der Probelauf nur mcporter installieren und die Exa-Suche einrichten. Danach meldete doctor noch einen Hinweis für YouTube. yt-dlp braucht eine JavaScript-Laufzeit, eine Zeile in seiner Konfigurationsdatei löst das. Auf dem Server lief ein YouTube-Abruf danach in drei Sekunden durch, die Untertiteldatei hatte 14,5 KB.
Zwei Voreinstellungen, die ich nicht übernehme
Erstens schreibt agent-reach doctor ungefragt einen Skill in die Skill-Ordner von Claude Code, OpenClaw und weiteren Agenten. Dessen Beschreibung beansprucht jede Webadresse für sich. In meinem Setup lesen Firecrawl, Scrapling und ein Browser-Werkzeug normale Seiten. Ich habe die Beschreibung deshalb auf YouTube, Feeds, Exa-Suche und öffentliches GitHub eingegrenzt. Ein Update überschreibt diese Eingrenzung, also aktualisiere ich nur von Hand.
Zweitens die Login-Kanäle. Auf meinem Mac lag aus einer früheren Installation OpenCLI. Damit meldet Agent Reach X, Reddit und Xiaohongshu als verfügbar, und zwar über meine eingeloggte Chrome-Sitzung. Das sind meine Hauptkonten. Das Projekt rät selbst zu Testaccounts, weil Plattformen automatisierte Zugriffe erkennen und Konten sperren. Ich sperre diese Kanäle deshalb in der Skill-Beschreibung und in meinen globalen Regeln.
was sofort geht
Die Hälfte läuft ohne Einrichtung. Die andere Hälfte will dein Konto.
ohne Login 8
- Webseiten (Jina Reader)
- YouTube: Untertitel, Suche
- RSS und Atom
- Exa-Websuche
- GitHub öffentlich
- V2EX
- einzelne Tweets
- Bilibili Basis
mit Login 7
- X: Suche, Timeline, Threadsgesperrt
- Redditgesperrt
- Instagramgesperrt
- Facebookgesperrt
- LinkedIngesperrt
- Xiaohongshugesperrt
- GitHub privat
Mein Setup: OpenCLI würde die eingeloggte Chrome-Sitzung mit meinen Hauptkonten nutzen. Deshalb bleiben diese Kanäle aus.
TikTok steht nicht in der offiziellen Kanaltabelle. Einzelne TikTok-Seiten lassen sich wie jede Webseite lesen, eine echte Suche gibt es nicht.
So hängt es in meinem Arbeitsablauf
Ich arbeite mit einer festen Schleife. Das Hauptmodell plant und prüft, ein kleineres Modell setzt einzelne Schritte um. Agent Reach und Scrapling sitzen vor dem Plan. Hängt eine Aufgabe an fremden Quellen, holt das Hauptmodell sie zuerst und legt sie als Datei ab. Erst dann entsteht der Plan, und der ausführende Agent liest nur noch Dateien.
quellen-schritt vor dem plan
Transkript, Feed oder Seite über Agent Reach oder Scrapling
im Scratch-Ordner, nie im Repo
leere Datei heißt nicht geholt, nicht nichts gefunden
das Hauptmodell plant auf der Datei
liest nur Dateien, recherchiert nicht
Der Prüfbefehl ist bewusst schlicht: test -s datei. Eine leere Datei bedeutet, dass die Quelle nicht geholt wurde. Ohne diese Prüfung plant ein Modell auf einer leeren Datei und meldet hinterher, es habe nichts gefunden.
Auf beiden Rechnern ist die Version fest auf v1.5.0, Scrapling läuft in v0.4.15 als MCP-Server. Den Zustand prüfe ich mit agent-reach doctor, einmal lokal und einmal per SSH auf dem Server.
drei fragen, eine antwort
- 01Liegt der Inhalt auf einer Plattform wie YouTube, in einem Feed oder auf GitHub?
ja: Agent Reachnein: weiter zur nächsten Frage
- 02Geht es um eine einzelne Seite, die normale Abrufe blockiert?
ja: Scrapling (StealthyFetcher)nein: weiter zur nächsten Frage
- 03Brauchst du Suchergebnisse oder strukturierte Datensätze?
ja: Firecrawlnein: ein einfacher Abruf reicht
Acht Prompts, die ich wirklich nutze
Ab hier redest du normal mit Claude Code. Jeder Prompt nennt die Plattform, das gewünschte Ergebnis und eine Grenze, an der Claude aufhören soll. Ohne Plattform greift das Modell gern zur allgemeinen Websuche und liefert eine Zusammenfassung über den Thread statt den Thread.
acht prompts zum kopieren
Nenne die Plattform, das Ergebnis und die Grenze.
Hol das Transkript von [LINK] mit Agent Reach und speichere es als Datei im Scratch-Ordner. Fasse danach zusammen: die These in zwei Sätzen, die fünf konkretesten Aussagen mit Zeitstempel und jede genannte Zahl mit ihrer Quelle. Was nicht im Transkript steht, lässt du weg.Lies diese Feeds: [URLS]. Zeig mir nur Einträge der letzten 24 Stunden, die eines dieser Stichworte treffen: [STICHWORTE]. Pro Treffer: Titel, ein Satz Relevanz für mein Geschäft, Link. Keine Treffer heißt: schreib „keine Treffer“ und nenne die Zahl der gelesenen Einträge.Recherchiere [THEMA] mit der Exa-Suche über Agent Reach, mindestens acht Quellen. Trenne Herstellerangaben von unabhängigen Quellen. Gib mir eine Tabelle: Aussage, Quelle, Datum, wie belastbar. Am Ende drei offene Fragen, die die Quellen nicht beantworten.Analysiere [REPO-URL] mit gh: Was macht das Projekt tatsächlich, welche Abhängigkeiten zieht es, wie oft erscheinen Releases, welche Issues sind am häufigsten offen? Prüf den Installer auf sudo, curl-Pipes und globale npm-Installationen. Schluss: einsetzen, mit Auflagen einsetzen oder lassen.Die Seite [URL] blockiert normale Abrufe. Hol sie mit dem Scrapling-MCP über stealthy_fetch, nur den Bereich [CSS-SELEKTOR], als Markdown. Wenn eine Anmeldung nötig wäre, brich ab und sag es mir, statt es zu versuchen.Schreib ein kurzes Python-Skript mit Scrapling: StealthyFetcher holt [URL], liest Produktname und Preis per CSS mit auto_save=True und schreibt eine Zeile mit Datum in preise.csv. Beim nächsten Lauf mit adaptive=True, damit ein Layout-Wechsel das Skript nicht bricht. Kein Login, höchstens ein Abruf pro Stunde.Briefing zu [THEMA] auf einer Seite. Nutze Exa-Suche, YouTube-Transkripte und öffentliche GitHub-Repos über Agent Reach, für einzelne geschützte Seiten Scrapling. Gliederung: Konsens, Streitpunkte, die drei meistgenannten Werkzeuge, Widersprüche zwischen den Quellen. Jede Aussage mit Quelle und Plattform.Bevor du planst: Hol alle Quellen für diese Aufgabe mit Agent Reach oder Scrapling und leg sie als Dateien im Scratch-Ordner ab. Prüf jede Datei mit test -s. Leere Datei heißt nicht geholt, nicht „nichts gefunden“. Erst danach schreibst du den Plan, und der executor arbeitet nur mit diesen Dateien.Ersetze die eckigen Klammern. Jeder Prompt sagt, wo Claude suchen soll und wann es aufhören soll. Das ist der Unterschied zwischen einem echten Thread und der Zusammenfassung einer Zusammenfassung.
Was du dir damit ins Haus holst
Agent Reach bündelt fremde Kommandozeilenwerkzeuge und MCP-Server. Du vertraust damit einer ganzen Kette von Projekten. Darum lohnt sich der Blick in den Installer und der Probelauf mit --dry-run vor jeder Änderung am System.
Cookie-Zugriffe auf Plattformen bleiben eine Grauzone der Nutzungsbedingungen. Ein Testaccount ist die Mindestmaßnahme, ein Hauptkonto gehört nie hinein. Die Sternezahl misst Aufmerksamkeit. Wie viele Menschen ein Werkzeug täglich einsetzen, verrät sie nicht. Und TikTok fehlt in der offiziellen Kanaltabelle, auch wenn es in manchen Videos anders klingt.
„Keine API-Gebühren“ heißt kostenlos, nicht dauerhaft. Bilibili hat im Juni 2026 einen Weg geschlossen, X und Reddit ändern ihre Sperren regelmäßig. Für Recherche ist das in Ordnung. Ein Kundenprozess, der jeden Morgen laufen muss, braucht eine offizielle Schnittstelle.
Wie ich Werkzeuge wie diese in einen festen Ablauf mit Prüfung und zweitem Modell einbaue, beschreibt der Beitrag Claude Code und Codex orchestrieren.
Häufige Fragen
Was ist Agent Reach?
Ein Open-Source-Projekt unter MIT-Lizenz. Es wählt pro Plattform ein funktionierendes freies Werkzeug aus, installiert es und prüft mit agent-reach doctor, ob der Kanal noch läuft. Fällt ein Weg aus, schaltet es auf den nächsten um.
Wofür brauche ich Scrapling, wenn ich Agent Reach habe?
Agent Reach arbeitet plattformweise. Scrapling holt einzelne Webseiten, auch hinter Cloudflare Turnstile, und findet Elemente nach einem Layout-Wechsel wieder. Über seinen MCP-Server ruft Claude Code es direkt auf.
Kostet Agent Reach etwas?
Es fallen keine API-Gebühren an. Die Wege funktionieren aber nur, solange die Plattformen sie offen lassen. Für Geschäftsprozesse, die nicht ausfallen dürfen, ist das keine Grundlage.
Sollte ich Login-Kanäle wie Reddit oder Instagram freischalten?
Nur mit einem eigenen Testaccount. Das Projekt rät selbst davon ab, Hauptkonten zu verwenden, weil Plattformen automatisierte Zugriffe erkennen und Konten sperren können.
Funktioniert Agent Reach auch auf einem Server?
Ja. Auf meinem Server liefen nach der Installation sieben von dreizehn Kanälen ohne Login, darunter YouTube-Untertitel, RSS, Exa-Suche und GitHub. Login-Kanäle gehören nicht auf einen Server.
Quellen und Stand
Stand: 7. Oktober 2026. Versionen, Kanäle und Installationsschritte können sich ändern.
- Agent Reach auf GitHub, README, Installationsanleitung und Release v1.5.0, gelesen am 7. Oktober 2026.
- Scrapling auf GitHub, README und Release v0.4.15, gelesen am 7. Oktober 2026.
- Scrapling-Dokumentation: MCP-Server, gelesen am 7. Oktober 2026.
- Alan Langhammer (@alan.buildz): Anleitung „Claude bekommt Augen fürs ganze Internet“, September 2026. Anstoß für diesen Beitrag, Text und Prompts hier sind eigene Fassungen.
Bildhinweis: Beide Bilder sind KI-generiert, erstellt für diesen Beitrag. Zahlen zu Sternen und Kanälen stammen aus GitHub und aus agent-reach doctor auf meinem Mac und meinem Server am 7. Oktober 2026.


