Cloudflare、OSS決定モデル「Clef」とRL微調整基盤を公開

Judul asli: Clef: Open-source decision models, and new RL fine-tuning platform

Mengapa Ini Penting

エッジでのAI自律判断を低レイテンシで実現する試みは、ネットワークセキュリティ自動化の方向性を示す。

CloudflareはオープンソースAI決定モデル「Clef」と強化学習(RL)ファインチューニング基盤を発表。Workers AIと統合し、エッジでの自律的判断処理を支援する。

Cloudflareは自社ブログにて、オープンソースの決定モデル群「Clef」と、強化学習(Reinforcement Learning)ベースのファインチューニング基盤を公開した。Clefはエッジ環境での意思決定タスク向けに設計されており、Workers AIプラットフォームと連携して動作する。

従来の大規模言語モデルとは異なり、Clefは「判断」に特化した軽量モデルとして位置づけられている。RL(強化学習)を用いたファインチューニング基盤により、開発者は独自のフィードバックデータでモデルを調整し、セキュリティポリシーの適用やトラフィック制御など実用的なシナリオに活用できる。

Cloudflareはモデルの重みとトレーニングコードをオープンソースとして公開しており、コミュニティによる検証と改良を歓迎する姿勢を示した。具体的なモデルサイズやベンチマーク数値は公式ブログ内で詳細が記載されているが、エッジ推論の低レイテンシ要件を満たす設計が強調されている。

Sumber

blog.cloudflare.com — Baca artikel asli →