注目★★★★★GitHub Trending
Crawl4AI v0.9.2、LLM向けWeb抽出を修正強化
30秒で把握
- 1Crawl4AI v0.9.2がDispatcher・Docker・GPUビルドの不具合を修正
- 2ストリーミング終了時のタスク漏れとPlaywright周辺の問題を解消
- 3v0.9.0でDocker API認証を既定化しv0.8.7で重大脆弱性を修正
要約
Crawl4AIは、WebページをLLM向けのMarkdownへ変換するオープンソースのクローラー兼スクレーパー v0.9.2を公開した。MemoryAdaptiveDispatcherのストリーミング終了時に発生していたタスク・ページリーク、Docker Playgroundの設定エラー、Monitor WebSocketのJWT認証エラー、Playwrightのheadless-shellパッケージ、GPU対応Dockerビルドを修正した。新機能や破壊的変更はない。直近のv0.9.0ではDocker APIサーバーを認証有効・loopback bindのsecure-by-defaultへ変更し、v0.8.7ではRCE、SSRF、認証バイパスなどの重大な脆弱性を修正した。
あなたへの影響
Crawl4AIをPythonやDockerで利用する日本の開発チームは、v0.9.2へ更新してストリーミング処理やGPUビルドの不具合を確認するとよい。
推奨:LLM向けMarkdown生成、CSS抽出、LLMによる構造化抽出を備え、APIサーバーではJWT認証とloopback bindが既定になっている。