Cloudflare、OSS決定モデル「Clef」とRL微調整基盤を公開
원제: Clef: Open-source decision models, and new RL fine-tuning platform
왜 중요한가
エッジネットワーク上でのRL駆動型政策判断モデルのOSS化は、AIとネットワークセキュリティの融合を加速させる可能性がある。
Cloudflareは2025年、強化学習(RL)ファインチューニング基盤と併せて、オープンソースの意思決定モデル群「Clef」を公開した。Workers AI上で動作し、セキュリティ・トラフィック制御などのポリシー判断を自動化する用途を主なターゲットとして設計されている。
CloudflareはBirthday Weekの発表として、オープンソースの意思決定モデル群「Clef」とそれを支えるRL(強化学習)ファインチューニング基盤を公開した。
Clefは、Webトラフィックの許可・拒否・チャレンジといったリアルタイムのポリシー決定を、大規模言語モデルよりも軽量かつ高速に処理することを目的として開発された。Cloudflareが自社ネットワークで蓄積した膨大なトラフィックデータを基に学習されており、Bot管理やWAFルール適用などの判断タスクに最適化されている点が特徴だ。
新設のRLファインチューニング基盤は、ユーザーが独自の判断ポリシーを持つカスタムモデルをCloudflareのWorkers AI環境上で訓練・デプロイできる仕組みを提供する。モデルの重みとコードはオープンソースとして公開されており、外部の研究者や開発者も利用・改良できる。
Cloudflareはこの取り組みを「AIによるネットワーク制御の民主化」と位置づけており、従来は同社エンジニアだけが活用できていた内部モデルを広く開放する方針を示した。具体的なパラメータ数や推論レイテンシの数値は公式ブログ上で段階的に開示される見通しだ。