2026-09-18
AnthropicのClaudeが「次世代Claude」を共同開発 自己改良AIの安全性は大丈夫か
米AI研究企業Anthropic(アンソロピック)は9月17日、自社の大規模言語モデル「Claude(クロード)」が、次世代モデルの開発プロセスに本格的に参加していると発表しました。既存モデルを使ってコード生成や実験設計、評価などを自動化し、より高性能な後継モデルの開発を加速する狙いです。
同社によると、Claudeは研究者の指示のもとで、学習データの前処理や新しいアーキテクチャ案の比較検討、ベンチマーク結果の解析などを支援しており、人間のエンジニアと「協働する開発者」として位置づけられています。一方で、AIが自分自身を高度化していく「自己改良(self‑improvement)」は暴走リスクへの懸念も強く、Anthropicのダリオ・アモディCEOらは、フロンティアモデル(最先端AI)開発の減速や透明性向上を公に提唱してきました。
Anthropicは、モデルの能力向上ペースを外部から測れる新たな指標案も同日公表し、政府や研究者による監視を受け入れる姿勢を示しています。自己改良に近いプロセスを取り入れつつ、どこまで人間の制御と安全対策を保てるかが、今後の国際的なAIガバナンス議論の焦点になりそうです。
元記事: Anthropic says its model Claude is helping to build the next version of itself