Udemy
    •  
    •  
    •  
    •  
    •  
    •  
    •  
    •  
Turn what you know into an opportunity and reach millions around the world.
Learn More
Your cart is empty.
Keep shopping
(Ken Cen出品)Generative AI第18部 如何訓練DeepSeek大語言模型
Rating: 5.0 out of 5(6 ratings)
133 students

(Ken Cen出品)Generative AI第18部 如何訓練DeepSeek大語言模型

關於DeepSeek,RoPE,MoE,MLA,MHA,Transformer,Attention,Positional Embedding,SoftMax,Logits
Created byKen Cen
Last updated 10/2025
Chinese (Traditional)
Chinese (Traditional) [Auto],

What you'll learn

  • DeepSeek的發展與技術特點
  • 如何使用 Python 編寫MLA & RoPE
  • 如何用Python編寫MLA的各層和結構
  • 如何用Python編寫混合專家架構
  • 如何實現訓練和編寫DeepSeekModel

Course content

4 sections18 lectures7h 14m total length
  • 加入Udemy 全球最大的中文 AI 課程2:16
  • 課程工具準備2:41

    學員將為課程做好工具準備

  • 如何安裝和使用包管理器18:47

    學員將學會如何安裝和使用包管理器

  • Windows安裝使用Poetry的方法1:24

    學員將學會Windows安裝使用Poetry的方法

Requirements

  • 一台電腦

Description

掌握AI未來:用Python代碼拆解DeepSeek-R1,開啓低成本大模型訓練之旅——從理論到實踐,手把手教你成為下一代AI開發者

DeepSeek-R1:一場全球AI競賽的顛覆性突破

2025年初,中國AI企業DeepSeek憑借開源模型DeepSeek-R1震撼全球,其性能與OpenAI的頂級推理模型o1旗鼓相當,但成本僅為後者的1/40!這一突破不僅讓亞馬遜、微軟等科技巨頭爭相接入,更引發美國政界與科技界的雙重震動


課程包括內容:


  1. DeepSeek的發展與技術特點(DeepSeek V1, DeepSeek V2, DeepSeek V3, DeepSeek R1-Zero, DeepSeek R1, )

  2. 神經網絡Neural Networks的組成和原理

  3. 前饋神經網絡的原理&數據加載(輸入層,隱藏層, Softmax,Logits,激活函數,輸出層)

  4. 如何用Python訓練前饋神經網絡(tensor, epoch)

  5. 什麼是Transformer & Attention & MHA & GQA & MQA(Transformer, Attention, Positional Embedding)

  6. 什麼是MLA & RoPE & MoE

  7. 用Python編寫MLA的各層和結構

  8. 如何添加RotaryEmbedding到MLA

  9. 如何用Python編寫混合專家架構

  10. 如何實現訓練和編寫DeepSeekModel

  11. 如何實現 Transformer(Encoder, Decoder)

Who this course is for:

  • 對資料科學感興趣的Python 開發人員
  • 對 Deepseek 感興趣的學員