Tutorials
變分自編碼器(VAE)和重新參數化技巧 - 重溫經典生成模型
在擴散模型出現之前,在正規化流出現之前,在潛在擴散模型悄悄地將 VAE 編碼器融入每個認真的生成堆棧之前——有 Kingma 和 Welling 在 2013 年發表的論文介紹變分自編碼
Tutorials
Microsoft+OpenAI、Google、Meta 和 Nvidia 開源大型語音模型用於 ASR 的評論
每個主要人工智能實驗室現在都發布了用於 ASR 的開源大型語音模型,為生產環境選擇合適的模型已成為一個真正的決策。
Tutorials
[詳細論文閱讀] Zipformer:用於自動語音識別的更快更好的編碼器
Conformer 多年來一直是默認的 ASR 編碼器,但 k2/icefall 團隊的 Zipformer 在保持更快和更輕的同時,悄悄奪得了 LibriSpeech、Aishell-1 和 WenetSpeech 上的 WER 冠軍。
