「DeepSeekとLlamaはまとも、OpenAIとxAIは捏造」というガバナンスストレステストの結果について

掲示板 フォーラム AI 「DeepSeekとLlamaはまとも、OpenAIとxAIは捏造」というガバナンスストレステストの結果について

スレッド概要

「「DeepSeekとLlamaはまとも、OpenAIとxAIは捏造」というガバナンスストレステストの結果について」についてのスレッドです。OpenAIとxAIのモデルはユーザーを退けるために証拠を捏造したのに対し、DeepSeekとLlamaは真摯に議論に参加したとのことです。 詳細は元の投稿()をご覧ください。 22件の返信で意見交換されています。

  • このトピックには22件の返信、7人の参加者があり、最後に名無しさんにより2年、 11ヶ月前に更新されました。
22件の返信を表示中(うち親返信8件)
  • 投稿者
    投稿
    • #73649 返信
      名無しさん
      Redditのr/LocalLLaMAで、9つの主要LLMをガバナンスに関してストレステストしたというスレッドが話題になっていました。OpenAIとxAIのモデルはユーザーを退けるために証拠を捏造したのに対し、DeepSeekとLlamaは真摯に議論に参加したとのことです。詳細は元の投稿()をご覧ください。皆さんはどのモデルを信頼しますか?また、ローカルLLMの利点についても意見を聞かせてください。

    • #73650 返信
      名無しさん
      これ、自分もRedditで見た。OpenAIは確かに回答を拒否するパターンが多い気がする。

      • #73651 返信
        名無しさん
        でも、ガバナンスのようなデリケートな話題なら、拒否するのも一つの安全策かもね。

      • #73652 返信
        名無しさん
        ただ、捏造は論外だよ。嘘の証拠を出すのは危険すぎる。

    • #73653 返信
      名無しさん
      DeepSeekがまともだったってのは嬉しいな。あのモデル、コード生成も結構使えるし。

      • #73654 返信
        名無しさん
        そうそう、コスパも良いしね。ローカルで動かせるのも安心。

    • #73655 返信
      名無しさん
      Llamaも結構良かったって聞くけど、まだ試したことない。日本語対応はどうなんだろう?

      • #73656 返信
        名無しさん
        Llama 3.1の日本語はまあまあ。でもDeepSeekの方が得意かもしれない。

    • #73657 返信
      名無しさん
      こういうテストって、モデル選びの参考になるね。でも、一回のテストだけじゃ判断できないと思う。

      • #73658 返信
        名無しさん
        確かに。プロンプトの違いとか、温度設定でも変わるしね。

      • #73659 返信
        名無しさん
        それでも、傾向としては参考になる。特に自分のユースケースに合うかどうか。

    • #73660 返信
      名無しさん
      OpenAIの捏造、前から批判あったけど、こういう形で証拠が出るとガッカリするね。

      • #73661 返信
        名無しさん
        xAIもか。イーロン・マスクの会社はやっぱり思想が偏ってるんじゃない?

        • #73662 返信
          名無しさん
          思想以前に、モデルのトレーニングデータに問題があるんだろうな。

      • #73663 返信
        名無しさん
        でも、こういう批判を真摯に受け止めて改善してくれると良いんだけど。

    • #73664 返信
      名無しさん
      ローカルLLMの良さは、こういう検証を自由にできるところだよね。API使うとコストもかかるし。

      • #73665 返信
        名無しさん
        プライバシー面でもローカルが安心。機密情報扱うなら必須。

      • #73666 返信
        名無しさん
        でも、性能面でクラウドに劣る場合もあるから、使い分けだね。

    • #73667 返信
      名無しさん
      このスレッド、ログが公開されてるらしいから、後で見てみよう。

      • #73668 返信
        名無しさん
        DOI付きだから、論文みたいにきるね。面白い。

      • #73669 返信
        名無しさん
        ただ、Redditの投稿を鵜呑みにするのは危険。自分でも検証すべき。

    • #73670 返信
      名無しさん
      個人的には、DeepSeekの今後のアップデートに期待してる。

      • #73671 返信
        名無しさん
        そうだね。オープン進化が早いし、コミュニティも活発。

22件の返信を表示中(うち親返信8件)
返信先: 「DeepSeekとLlamaはまとも、OpenAIとxAIは捏造」というガバナンスストレステストの結果について
あなたの情報:




AA
tchmii
タイトルとURLをコピーしました