日本語版
最新ニュース
世界

📜 25 日目: 憲法上の AI — 間違ったモデルを正しく教える 🤖 |投稿者: サムリディ | 2025 年 10 月

昨日のことだったら AIを安全に保つ、今日のこと AIを道徳的にする。しかし、罪悪感、プライド、共感を感じない機械にどうやって倫理を教えればよいのでしょうか?あなたはそれを与えます 憲法 — それが従うことができる書かれた道徳的羅針盤。📍 好奇心のための短期集中コース GenAI の 25 日目Enterを押すかクリックして画像をフルサイズで表示します🧠 問題: 人間のフィードバックはスケールしない最新の LLM のほとんどは、以下を使用して調整されていました。 RLHF — 人間のフィードバックからの強化学習。これは強力ですが、遅く、高価で、一貫性がありません。何千人もの人間によるラベル付け担当者が回答を評価しているところを想像してください。👍「対応が良かったです。」👎「対応が悪い。」これを何十億ものトークンに掛け合わせると、問題がわかるでしょう。 人間は、すべてのアウトプットを永久に面倒を見ることはできません。そこでアントロピック氏は大胆な質問をしました。人間が AI の行動を評価する代わりに、書かれた一連の原則に基づいて、AI 自身が判断できるように訓練したらどうなるでしょうか?それが基礎です 憲法AI。 #日目 #憲法上の #間違ったモデルを正しく教える #投稿者 #サムリディ #年 #月

📜 25 日目: 憲法上の AI — 間違ったモデルを正しく教える 🤖 |投稿者: サムリディ | 2025 年 10 月

1761503639
2025-10-26 18:31:00

昨日のことだったら AIを安全に保つ、今日のこと AIを道徳的にする

しかし、罪悪感、プライド、共感を感じない機械にどうやって倫理を教えればよいのでしょうか?あなたはそれを与えます 憲法 — それが従うことができる書かれた道徳的羅針盤。

📍 好奇心のための短期集中コース GenAI の 25 日目

Enterを押すかクリックして画像をフルサイズで表示します

🧠 問題: 人間のフィードバックはスケールしない

最新の LLM のほとんどは、以下を使用して調整されていました。 RLHF人間のフィードバックからの強化学習
これは強力ですが、遅く、高価で、一貫性がありません。

何千人もの人間によるラベル付け担当者が回答を評価しているところを想像してください。
👍「対応が良かったです。」
👎「対応が悪い。」
これを何十億ものトークンに掛け合わせると、問題がわかるでしょう。
人間は、すべてのアウトプットを永久に面倒を見ることはできません。

そこでアントロピック氏は大胆な質問をしました。

人間が AI の行動を評価する代わりに、書かれた一連の原則に基づいて、AI 自身が判断できるように訓練したらどうなるでしょうか?

それが基礎です 憲法AI

#日目 #憲法上の #間違ったモデルを正しく教える #投稿者 #サムリディ #年 #月

執筆者について: nipponese

Nipponese News編集部は、国内外のニュースを日本語で分かりやすくお届けします。