スレッド概要
「DeepSeek-R1の「推論」失敗:RLHFスクリプトが論理を上書き?医療バイオマーカーで問題」についてのスレッドです。ユーザーが医療バイオマーカー(精神医学 vs 糖尿病)について質問したところ、モデルが論理的な推論を無視して、RLHFスクリプトに従った回答を返したという内容です。 いわゆる「推論の失敗」で、モデルが安全策や事前の学習バイアスに上書きされてしまった例です。 17件の返信で意見交換されています。
- このトピックには17件の返信、5人の参加者があり、最後ににより3年前に更新されました。
17件の返信を表示中(うち親返信8件)
17件の返信を表示中(うち親返信8件)