為什麼去年過年有一堆DeepSeek的文章?

記得去年有一段時間打開Dcard一堆DeepSeek的文章,還出圈到各個板。 下午好奇查了 那段時間DeepSeek有什麼重要發布,但Janus-Pro版上幾乎沒被討論。 2023 DeepSeek 公司成立 2023/11/2: 發布 DeepSeek-Coder,開源 2024/1 : 發布DeepSeek V1,開源,號稱性能對標 LLaMA 2 2024/5/6: 發布 DeepSeek-V2,使用 DeepSeek-MoE架構,號稱性能對標GPT-4 Turbo 2024/6/17: 發布 DeepSeek-Coder-V2,開源 2024/9/5: 發布 DeepSeek-V2.5,對話和寫code模型合併 2024/11/20: 發布 DeepSeek-R1-Lite,強化學習,推理模型 2024/12/26: 發布 DeepSeek-V3,號稱性能對標 GPT-4o,訓練成本557萬 2025/1/20: 發布 DeepSeek-R1,強化學習,推理模型 2025/1/27: 發布 Janus-Pro,多模態生成與推理模型 2025/4/30: 發布 DeepSeek-Prover-V2,數學證明題很厲害 2025/10/20: 發布 DeepSeek-OCR,視覺語言模型,光學上下文壓縮 2026/01/27: 發布DeepSeek-OCR 2,開源,模仿人類閱讀邏輯,顯著提升文檔解析能力 如果看性能不錯的開源模型2024/6/17就已經開源了 如果說當時在吵的訓練成本低那麼是2024/12/26那個DeepSeek-V3的事 如果是去年過年前2025/1/27發布的Janus-Pro在板上反而沒什麼討論,關鍵字什麼都搜不到 如果是技術重大突破那麼2025/10/20的DeepSeek-OCR泛用性最高 列完後無法理解為什麼DeepSeek的討論95%以上都集中在去年過年那幾天?
愛心
跪
驚訝
15
24
全部留言