Shelly Sheynin 的深度學習書籍是一本免費、開放存取的 PDF,託管於 GitHub,從核心原理到現代電腦視覺技術,逐步引導讀者深入學習。它從基礎開始——資料預處理、權重初始化、激活與損失函數、最佳化與正則化——然後進入卷積神經網路及驅動當今視覺系統的建構模組。
後續章節涵蓋廣泛的應用主題,包括物體偵測、語意分割、超解析度、風格轉換和影像修補,接著是更進階的內容,涵蓋生成模型、去噪、自監督學習、Vision Transformers、光學字元辨識(OCR)和多模態學習。
適合對象
這份資源最適合已經具備機器學習基礎知識的學習者,他們想要一份單一且組織良好的參考資料,能將基礎的深度學習理論與實用、最先進的電腦視覺架構連結起來。它很適合當作課程的補充閱讀,或作為工程師和學生深化神經網路理解的自學參考。
由於它以單一 PDF 形式在 GitHub 上發布,因此易於下載和離線閱讀,是個人深度學習書庫中方便的補充資料。