Archive: 2022 May

News
[Long Review] Axial Attention in Multidimensional Transformers
Tutorials

[์žฅ๋ฌธ ๋ฆฌ๋ทฐ] Axial Attention in Multidimensional Transformers

์ด๋ฏธ์ง€ ๋˜๋Š” ๋น„๋””์˜ค์— ๋Œ€ํ•œ ์™„์ „ํ•œ self-attention์€ ๋น„์šฉ์ด ๊ณผ๋„ํ•ฉ๋‹ˆ๋‹ค. ์ด์ฐจ ์ฆ๊ฐ€ ์—†์ด Transformer์˜ ํ‘œํ˜„๋ ฅ์„ ์œ ์ง€ํ•˜๋ ค๋ฉด?

5์›” 28, 2022ยท 1 min read
[Short Review] Axial Attention in Multidimensional Transformers
Tutorials

[๋‹จ๋ฌธ ๋ฆฌ๋ทฐ] Axial Attention in Multidimensional Transformers

Axial attention์€ Transformer๋ฅผ ๊ณ ์ฐจ์› ๋ฐ์ดํ„ฐ์— ๋Œ€ํ•ด ๋‹ค๋ฃจ๊ธฐ ์‰ฝ๊ฒŒ ์œ ์ง€ํ•˜๋Š” ์šฐ์•„ํ•œ ์•„์ด๋””์–ด ์ค‘ ํ•˜๋‚˜์ž…๋‹ˆ๋‹ค: ํ•œ ๋ฒˆ์— ๋ชจ๋“  ํ”ฝ์…€์ด๋‚˜ ๋ชจ๋“  ์‹œ๊ฐ„-์ฃผํŒŒ์ˆ˜ ๋นˆ์— ์ฃผ๋ชฉํ•˜๋Š” ๋Œ€์‹ , ํ•œ ๋ฒˆ์— ํ•œ ์ถ•์„ ๋”ฐ๋ผ ์ฃผ๋ชฉํ•ฉ๋‹ˆ๋‹ค.

5์›” 28, 2022ยท 1 min read
[Long Review] Transfer Learning from Speaker Verification to Multispeaker Text-To-Speech Synthesis
Tutorials

[๋กฑ ๋ฆฌ๋ทฐ] Speaker Verification์—์„œ Multispeaker Text-To-Speech Synthesis๋กœ์˜ Transfer Learning

์ด ๋…ผ๋ฌธ์€ ์ œ๋กœ์ƒท ์Œ์„ฑ ํด๋กœ๋‹์„ ์‹ค์šฉ์ ์œผ๋กœ ๋งŒ๋“  ์—ฐ๊ตฌ์ž…๋‹ˆ๋‹ค: ์ˆ˜์ฒœ ๊ฐœ์˜ ๋…ธ์ด์ฆˆ๊ฐ€ ๋งŽ๊ณ  ์ „์‚ฌ๋ณธ์ด ์—†๋Š” ์Œ์„ฑ์œผ๋กœ ํŒ๋ณ„์  ๊ฒ€์ฆ ์ž‘์—…์—์„œ speaker encoder๋ฅผ ํ•™์Šตํ•œ ํ›„, ๊ทธ ์ž„๋ฒ ๋”ฉ์„ Tacotron 2๋กœ

5์›” 21, 2022ยท 1 min read
[Short Review] Transfer Learning from Speaker Verification to Multispeaker Text-To-Speech Synthesis
Tutorials

[์ˆ ๋ฆฌ๋ทฐ] Speaker Verification์—์„œ Multispeaker Text-To-Speech Synthesis๋กœ์˜ Transfer Learning

ํ˜„๋Œ€ ์ œ๋กœ์ƒท ์Œ์„ฑ ํด๋กœ๋‹ ๋ฌผ๊ฒฐ์„ ์‹œ์ž‘ํ•œ Google ๋…ผ๋ฌธ์€ ์•„๋ฆ„๋‹ต๊ฒŒ ๊น”๋”ํ•œ ์•„ํ‚คํ…์ฒ˜๋ฅผ ๊ฐ€์ง€๊ณ  ์žˆ์Šต๋‹ˆ๋‹ค: verification์— ํ•™์Šต๋œ speaker encoder, ํ…์ŠคํŠธ์™€ speaker ์ž„๋ฒ ๋”ฉ์„

5์›” 21, 2022ยท 1 min read
[Short Review] Wav2Seq: Pre-training Speech-to-Text Encoder-Decoder Models Using Pseudo Languages
Tutorials

[์ˆ ๋ฆฌ๋ทฐ] Wav2Seq: Pseudo Languages๋ฅผ ์‚ฌ์šฉํ•œ Speech-to-Text Encoder-Decoder Models์˜ Pre-training

wav2vec 2.0 ๊ฐ™์€ Self-supervised pretraining์€ ํ›Œ๋ฅญํ•œ speech encoder๋ฅผ ์ œ๊ณตํ–ˆ์Šต๋‹ˆ๋‹ค, ํ•˜์ง€๋งŒ ์ „์ฒด encoder-decoder ASR ์‹œ์Šคํ…œ์„ ์›ํ•˜๋ฉด, decoder๋Š” ์—ฌ์ „ํžˆ ์ฒ˜์Œ๋ถ€ํ„ฐ ์‹œ์ž‘ํ–ˆ์Šต๋‹ˆ๋‹ค.

5์›” 14, 2022ยท 1 min read
[Long Review] Towards Zero-Label Language Learning
Tutorials

[๊ธด ๋ฆฌ๋ทฐ] Towards Zero-Label Language Learning

์ธ๊ฐ„์ด ๋ ˆ์ด๋ธ”์„ ์ง€์ •ํ•œ ๋‹จ ํ•˜๋‚˜์˜ ์˜ˆ์ œ ์—†์ด ์ž‘์—…๋ณ„ NLP ๋ชจ๋ธ์„ ํ•™์Šต์‹œํ‚ฌ ์ˆ˜ ์žˆ๋‹ค๋ฉด ์–ด๋–จ๊นŒ์š”? "Towards Zero-Label Language Learning"์€ ์ด ์งˆ๋ฌธ์„ ๊ฐ•ํ•˜๊ฒŒ ์ œ๊ธฐํ•ฉ๋‹ˆ๋‹ค.

5์›” 7, 2022ยท 1 min read
[Short Review] Towards Zero-Label Language Learning
Tutorials

[์งง์€ ๋ฆฌ๋ทฐ] Towards Zero-Label Language Learning

์ˆ˜๊ฐœ์›”์„ ๋“ค์—ฌ ์ฃผ์„์„ ์ง€์ •ํ•œ ๋ ˆ์ด๋ธ”๋œ ๋ฐ์ดํ„ฐ๊ฐ€ ์ •๋ง๋กœ ํ•„์š”ํ•˜์ง€ ์•Š๋‹ค๋ฉด ์–ด๋–จ๊นŒ์š”?

5์›” 7, 2022ยท 1 min read