DeepSeek R1 0528とQwen3 8Bの不安定さについて語ろう

掲示板 フォーラム AI DeepSeek R1 0528とQwen3 8Bの不安定さについて語ろう

スレッド概要

「DeepSeek R1 0528とQwen3 8Bの不安定さについて語ろう」についてのスレッドです。コメントでは、ハルシネーションが多い、コード生成が信頼できない、ベンチマークと実用性の乖離など様々な意見が交わされています。 皆さんはどう思いますか? 16件の返信で意見交換されています。

  • このトピックには16件の返信、5人の参加者があり、最後に名無しさんにより2年、 10ヶ月前に更新されました。
16件の返信を表示中(うち親返信11件)
  • 投稿者
    投稿
    • #80286 返信
      名無しさん
      Redditのr/LocalLLaMAで、DeepSeek R1 0528とQwen3 8Bの組み合わせが非常に不安定だという投稿がありました。コメントでは、ハルシネーションが多い、コード生成が信頼できない、ベンチマークと実用性の乖離など様々な意見が交わされています。皆さんはどう思いますか?

    • #80287 返信
      名無しさん
      確かに不安定だよね。特に長文のコード生成でエラーが多い。

      • #80289 返信
        名無しさん
        それな。自分も同じ経験。短いプロンプトだと問題ないのに。

      • #80297 返信
        名無しさん
        コード生成ならCodeGemmaのが安心。

    • #80288 返信
      名無しさん
      自分は逆に安定してるけど。Qwenベースのモデルは相性次第?

      • #80300 返信
        名無しさん
        自分も安定してる。量子化の違いかも。

    • #80290 返信
      名無しさん
      具体的にどんなタスクで不安定?

      • #80292 返信
        名無しさん
        数学の推論問題でよく間違える。DeepSeek特有の過学習かも。

    • #80291 返信
      名無しさん
      ベンチマークでは良いスコアなのにね。実際使うと別物。

    • #80293 返信
      名無しさん
      温度設定を下げるとマシになるよ。

      • #80294 返信
        名無しさん
        試してみるわ。ありがとう。

    • #80295 返信
      名無しさん
      Llama 3.1 8Bの方が安定してる印象。

    • #80296 返信
      名無しさん
      Qwen2.5 7Bの方がいいかも。

    • #80298 返信
      名無しさん
      ローカルLLMはまだ発展途上。誤差の範囲。

    • #80299 返信
      名無しさん
      わかるわかる。でも面白いから使ってしまう。

    • #80301 返信
      名無しさん
      ところでDeepSeekの新バージョン出るらしいね。

    • #80302 返信
      名無しさん
      とりあえず様子見かな。

16件の返信を表示中(うち親返信11件)
返信先: DeepSeek R1 0528とQwen3 8Bの不安定さについて語ろうで#80293に返信
あなたの情報:




AA
tchmii
タイトルとURLをコピーしました