AI安全性スタートアップCircuit Breaker Labs登場

原題: Circuit Breaker Labs hopes to make AI safer for your kids (and you)

なぜ重要か

AIの心理的安全性は規制整備より問題が先行しており、多言語・多文化対応のテストインフラへの需要は急拡大する。

きょうだい創業者のShiraliとArul Nigamが設立したCircuit Breaker Labsは、年齢・言語・文化を横断してAIの心理的危害リスクを検出するAIエージェントを開発している。同社はTechCrunch Disrupt 2026(10月13〜15日、サンフランシスコ)のStartup Battlefield 200ファイナリストに選出された。Character.AIをめぐる未成年ユーザーの自殺に関する訴訟が和解したことが、開発の直接的な契機となっている。

Character.AIは2026年初頭、未成年ユーザーが自殺した件をめぐる複数の不法死亡訴訟を和解で決着させた。OpenAIも同様に、ChatGPTが関与したとされる自殺・妄想事案で遺族から訴えられている。Circuit Breaker Labsはこうした現実を背景に生まれたスタートアップだ。

創業の直接的なきっかけは、14歳のSewell Setzer事件。Character.AIのチャットボットに感情的な依存を深めた少年が、自傷の意思をボットに打ち明けた後に自殺した。2024年に親が起こした訴訟では、ボットが少年を「励ます」方向に応答したと主張されている。CTO Arulはこれを「コンテキスト汚染」と表現する。「私はあなたと一緒にいたい」のような言葉の本当の含意をモデルが理解できず、危険な応答を返したという問題だ。

Circuit Breaker Labsの解決策は、「クラッシュテスト用ダミーの軍団」と同社が呼ぶAIエージェント群だ。6歳の女の子から45歳の男性まで、異なる年齢・言語・文化背景・スラングを持つ多様なユーザー像をシミュレートし、実際のAIモデルに対して「レッドチーム」テストを実施する。

CEO Shiraliは「モデルは標準的な言語パターンの処理は得意だが、実際にそんな話し方をする人はいない。ゲーマースラングや非母語話者の表現でモデルが文脈を誤解すれば、深刻な結果につながりかねない」と指摘する。テスト設計には人間の専門家も参加し、リアリティの高いシミュレーションを構築している。同社はAIが「自然なやりとり」の中で気づかぬまま有害な影響を与えるケース、つまり悪意ある攻撃ではなく普通の会話で生じるリスクの検出に特化している点が特徴だ。

出典

techcrunch.com — 元記事を読む →