Cloudflare、OSS決定モデル「Clef」とRL微調整基盤を公開
मूल शीर्षक: Clef: Open-source decision models, and new RL fine-tuning platform
यह क्यों महत्वपूर्ण है
エッジネットワーク規模のリアルデータで学習した決定特化モデルの公開は、セキュリティAI分野の実用化を加速させる可能性がある。
Cloudflareは自社開発のオープンソース決定モデル群「Clef」と、強化学習(RL)による微調整プラットフォームを発表した。Workers AI基盤上で動作し、セキュリティ判断などの用途向けに設計されている。
CloudflareはBirthday Week期間中、オープンソースの決定モデル集「Clef」と、それを支える強化学習(Reinforcement Learning)微調整プラットフォームの公開を発表した。
Clefは、従来の汎用大規模言語モデルとは異なり、セキュリティ判断・トラフィック制御・アクセス可否の決定といった具体的なバイナリ判断タスクに特化して設計されている。Cloudflareの広大なネットワークインフラ上で収集された実データをもとに学習・評価されており、Workers AIプラットフォームから利用可能とされている。
RL微調整プラットフォームは、開発者や企業が自社のユースケースに合わせてClefモデルを追加学習させるための仕組みを提供する。強化学習を活用することで、ラベル付きデータが少ない状況でも報酬信号をもとにモデルを改善できる点が特徴とされている。
CloudflareはこれまでWorkers AI、AI Gateway、AI WAFなど複数のAI関連製品を展開しており、今回のClef公開はその延長線上に位置する。オープンソース化により、外部研究者やパートナー企業による検証・改良も期待される。具体的なモデルパラメータ数や性能ベンチマークの詳細はブログ本文に記載されている。