為什麼去年過年有一堆DeepSeek的文章?

國立成功大學
記得去年有一段時間打開Dcard一堆DeepSeek的文章,還出圈到各個板。
下午好奇查了 那段時間DeepSeek有什麼重要發布,但Janus-Pro版上幾乎沒被討論。
2023 DeepSeek 公司成立
2023/11/2: 發布 DeepSeek-Coder,開源
2024/1 : 發布DeepSeek V1,開源,號稱性能對標 LLaMA 2
2024/5/6: 發布 DeepSeek-V2,使用 DeepSeek-MoE架構,號稱性能對標GPT-4 Turbo
2024/6/17: 發布 DeepSeek-Coder-V2,開源
2024/9/5: 發布 DeepSeek-V2.5,對話和寫code模型合併
2024/11/20: 發布 DeepSeek-R1-Lite,強化學習,推理模型
2024/12/26: 發布 DeepSeek-V3,號稱性能對標 GPT-4o,訓練成本557萬
2025/1/20: 發布 DeepSeek-R1,強化學習,推理模型
2025/1/27: 發布 Janus-Pro,多模態生成與推理模型
2025/4/30: 發布 DeepSeek-Prover-V2,數學證明題很厲害
2025/10/20: 發布 DeepSeek-OCR,視覺語言模型,光學上下文壓縮
2026/01/27: 發布DeepSeek-OCR 2,開源,模仿人類閱讀邏輯,顯著提升文檔解析能力
如果看性能不錯的開源模型2024/6/17就已經開源了
如果說當時在吵的訓練成本低那麼是2024/12/26那個DeepSeek-V3的事
如果是去年過年前2025/1/27發布的Janus-Pro在板上反而沒什麼討論,關鍵字什麼都搜不到
如果是技術重大突破那麼2025/10/20的DeepSeek-OCR泛用性最高
列完後無法理解為什麼DeepSeek的討論95%以上都集中在去年過年那幾天?


