Asayomu Tech
注目★★★★★GitHub Trending

Crawl4AI v0.9.2、LLM向けWeb抽出を修正強化

30秒で把握

  • 1Crawl4AI v0.9.2がDispatcher・Docker・GPUビルドの不具合を修正
  • 2ストリーミング終了時のタスク漏れとPlaywright周辺の問題を解消
  • 3v0.9.0でDocker API認証を既定化しv0.8.7で重大脆弱性を修正

要約

Crawl4AIは、WebページをLLM向けのMarkdownへ変換するオープンソースのクローラー兼スクレーパー v0.9.2を公開した。MemoryAdaptiveDispatcherのストリーミング終了時に発生していたタスク・ページリーク、Docker Playgroundの設定エラー、Monitor WebSocketのJWT認証エラー、Playwrightのheadless-shellパッケージ、GPU対応Dockerビルドを修正した。新機能や破壊的変更はない。直近のv0.9.0ではDocker APIサーバーを認証有効・loopback bindのsecure-by-defaultへ変更し、v0.8.7ではRCE、SSRF、認証バイパスなどの重大な脆弱性を修正した。

あなたへの影響

Crawl4AIをPythonやDockerで利用する日本の開発チームは、v0.9.2へ更新してストリーミング処理やGPUビルドの不具合を確認するとよい。

推奨:LLM向けMarkdown生成、CSS抽出、LLMによる構造化抽出を備え、APIサーバーではJWT認証とloopback bindが既定になっている。

詳細を読む → 元記事へ※ 本文は元記事をご確認ください (asayomu は要約のみ提供)

関連する記事

※ 外部記事の権利は原著作者に帰属します。著作権削除要請は copyright@asayomu.jp までご連絡ください(受領確認 24h・実処理 72h 以内)。