[請益] 為什麼Gemini2.0的討論度比DeepSeek低這麼多?
國立成功大學
最近一週冒出很多對LLM有興趣的人,以及大量的LLM專家。
數學、科學、MMLU效果評比各有優勢,Gemini 2.0 Flash Thinking的Context長度更長,也就是有機會跑更長的長篇文件,也可以和Gemini 2.0討論長長一大串的code要怎麼修改。
多模態的部分Gemini整合得更好,像是在應用程式介面直接貼youtube影片網址Gemini可以直接解讀影片。
柵欄的部分是都有,Gemini要求政治正確,DeepSeek也會迴避某些議題。
多數人的需求只要在應用程式介面當免費仔開對話框問問題對答即可,如果是企業要開發服務想進一步串接API玩玩的話Gemini的token費 input、output都更便宜,而且DeepSeek-R1 CoT如果想特別多的話不知道會不會算入output的費用。
模型開發成本的部分可能是DeepSeek的亮點!? 新聞說是500~600萬美金據說這個數字是用訓練開始Run下去到結束的GPU租用時間計算出來的。
不過這樣會難以比較,因為Google是直接買了很多實體GPU來給工程師玩,Gemini是其中一個項目。
DeepSeek還有一個特點是開源,但DeepSeek 685B的模型一般人的設備想跑也跑不了,多數企業的需求只要串接API解決,擔心個資洩漏常見的解法是買Azure OpenAI套餐。
除非是真的一定需要在local端跑,又可以自己維護系統,又有硬體可以跑起來685B模型的企業才有影響。
所以為什麼Gemini2.0的討論度比DeepSeek低這麼多?
先不看FB、PTT,光是在dcard 閒聊版、科技業版、股票版、時事版都一堆DeepSeek的文章,但Gemini2.0卻少之又少
難道是DeepSeek還多了一個功能是可以當作青鳥和小草互相攻擊政敵的工具嗎



