スレッド概要
「DeepSeekに推論能力を付与したら、Alibabaが『OK』と返した話」についてのスレッドです。詳細はッドをご参照ください。 26件の返信で意見交換されています。
- このトピックには26件の返信、8人の参加者があり、最後に名無しさんにより2年、 11ヶ月前に更新されました。
26件の返信を表示中(うち親返信10件)
-
投稿者投稿
-
-
名無しさんRedditのr/LocalLLaMAで、DeepSeekモデルに推論能力などを追加して性能を向上させたという投稿があり、Alibabaがそれに対して「OK」とだけ返したという話題です。詳細はッドをご参照ください。
-
名無しさんこれ、本当に推論能力が向上したのか?それとも単なるベンチマークのオーバーフィットかな。
-
名無しさんベンチマークだけなら何とでも言えるからね。実タスクでの検証が必要だろう。
-
-
名無しさんAlibabaが「OK」ってだけって、もっと話し合うとかないのかよ。
-
名無しさん向こうにとっては取るに足らないってことかもね。
-
名無しさんでもDeepSeek自体かなり良いモデルだから、改良の余地があるなら試してみたい。
-
-
-
名無しさんライセンス的に大丈夫なの?派生モデル作るには制限あったはず。
-
名無しさんDeepSeekはMITライセンスだから自由に改変できるよ。
-
名無しさんそれならAlibabaがOKしたのも納得。競合他社が勝手にやる分には構わないってことか。
-
-
-
名無しさん実際にコードとか公開されてるの?気になる。
-
名無しさんはリンクあったけど、今は削除されてるっぽい。
-
名無しさんじゃあ再現性がないじゃん。話半分に聞いておくわ。
-
-
-
名無しさん推論能力って具体的に何を追加したんだろう。CoTとか?
-
名無しさんおそらくReasoning系のプロンプトかファインチューニングだと思う。
-
名無しさんそれならわざわざ外部に報告するほどのこと?
-
名無しさん宣伝目的かもしれないね。
-
-
-
-
名無しさんローカルLLM界隈ではこういう相互改良の話はよくあるけど、Alibabaが反応したのは珍しい。
-
名無しさん企業としても自社モデルが改良されるのは悪い気はしないだろう。
-
-
名無しさんコスト面ではDeepSeekは優秀だから、推論力が上がればさらに使いやすくなるな。
-
名無しさんでもコード生成とかではまだClaudeやGPTに劣るって声もあるよ。
-
名無しさんそこを改善したって話なら期待したい。
-
-
-
名無しさんプライバシー重視の自分にはローカルで動くDeepSeekはありがたい。
-
名無しさん同感。クラウド依存は怖いからね。
-
-
名無しさんベンチマークの数字だけ見てる限りだと差はほとんどない気がする。
-
名無しさん実際使ってみないと分からない部分は大きい。
-
-
名無しさん次のバージョンで公式に取り込まれるかもね。
-
名無しさんそれならOSSコミュニティとしては理想的だ。
-
-
-
投稿者投稿
26件の返信を表示中(うち親返信10件)
関連するAIトピック
- DeepSeek V3でコード監査エージェント作ったってのスレ。AST解析+ハイブリッド検索でシニア級らしい。20件の返信最終更新 2023年8月3日 16:32
- DeepSeek V4とBaiduのKunlunxinチップに関するの投稿を見つけた18件の返信最終更新 2023年7月21日 15:17
- Qwenが32B/235Bベースモデルを非公開に、DeepSeekへの蒸留対策か?15件の返信最終更新 2023年10月16日 19:20
- DeepSeek-R1-Qwen3-8bのトークナイザーをQwen3 30b A3bにコピーできる?17件の返信最終更新 2023年10月16日 17:34
- DeepSeek-R1-0528-Qwen3-8BのOpenVINO量子化バージョンが公開されたらしい19件の返信最終更新 2023年10月16日 15:53