Blog

Blog
A Review of GPT-4's Technical Report (GPT-4 in a Nutshell)
Video Tutorials

GPT-4์˜ ๊ธฐ์ˆ  ๋ณด๊ณ ์„œ ๋ฆฌ๋ทฐ (ํ•œ๋ˆˆ์— ๋ณด๋Š” GPT-4)

GPT-4์˜ ๊ธฐ์ˆ  ๋ณด๊ณ ์„œ๋Š” ์•„ํ‚คํ…์ฒ˜ ์„ธ๋ถ€์‚ฌํ•ญ์ด ๋ถ€์กฑํ•˜๊ณ  ๋Šฅ๋ ฅ ์ฃผ์žฅ์ด ๋งŽ๊ธฐ๋กœ ์•…๋ช…๋†’์œผ๋ฉฐ, ์ด๋Š” ๋ช…ํ™•ํ•œ ๋ฆฌ๋ทฐ๋ฅผ ๊ทธ ์œ„์— ๊ตฌ์ถ•ํ•˜๋Š” ๋ชจ๋“  ์‚ฌ๋žŒ์„ ์œ„ํ•ด ํ•„์ˆ˜ ์ฝ๊ธฐ๋กœ ๋งŒ๋“ญ๋‹ˆ๋‹ค.

3์›” 25, 2023ยท 1 min read
[Olewave's Review] AudioLM: a Language Modeling Approach to Audio Generation
Video Tutorials

[Olewave์˜ ๋ฆฌ๋ทฐ] AudioLM: ์˜ค๋””์˜ค ์ƒ์„ฑ์„ ์œ„ํ•œ ์–ธ์–ด ๋ชจ๋ธ๋ง ์ ‘๊ทผ

AudioLM์€ ๋งŽ์€ ์‚ฌ๋žŒ๋“ค์—๊ฒŒ ์˜ค๋””์˜ค ์ƒ์„ฑ์ด ์‹ ํ˜ธ ์ฒ˜๋ฆฌ๋ณด๋‹ค๋Š” ์–ธ์–ด ๋ชจ๋ธ๋ง์ฒ˜๋Ÿผ ๋ณด์—ฌ์•ผ ํ•œ๋‹ค๊ณ  ํ™•์‹ ์‹œํ‚จ ๋…ผ๋ฌธ์ž…๋‹ˆ๋‹ค.

3์›” 11, 2023ยท 1 min read
In-depth review of OpenAI's GPT-3 : Language Models are Few-Shot Learners (Part 3/3: Results&Rest)
Video Tutorials

OpenAI์˜ GPT-3์— ๋Œ€ํ•œ ์‹ฌ์ธต ๋ฆฌ๋ทฐ : ์–ธ์–ด ๋ชจ๋ธ์€ ์†Œ์ˆ˜ ์ƒท ํ•™์Šต์ž์ž…๋‹ˆ๋‹ค (ํŒŒํŠธ 3/3: ๊ฒฐ๊ณผ ๋ฐ ๋‚˜๋จธ์ง€)

์ด 3๋ถ€์ž‘ GPT-3 ์‹ฌ์ธต ๋ถ„์„์˜ ์ตœ์ข… ํšŒ์ฐจ๋Š” ๊ฒฐ๊ณผ์— ๋„๋‹ฌํ•ฉ๋‹ˆ๋‹ค: 1,750์–ต ๊ฐœ์˜ ํŒŒ๋ผ๋ฏธํ„ฐ๋ฅผ ๋ฒค์น˜๋งˆํฌ ์Šค์œ„ํŠธ์— ํˆฌ์ž…ํ•˜๊ณ  ๋ฏธ์„ธ ์กฐ์ •์„ ์™„์ „ํžˆ ๊ฑด๋„ˆ๋›ธ ๋•Œ ์‹ค์ œ๋กœ ์–ด๋–ค ์ผ์ด ๋ฐœ์ƒํ•˜๋Š”์ง€์— ๋Œ€ํ•ด.

3์›” 8, 2023ยท 1 min read
[10 mins] Explain Why OpenAI's Whisper API Isn't As Good As ChatGPT
Video Tutorials

[10๋ถ„] OpenAI์˜ Whisper API๊ฐ€ ChatGPT๋งŒํผ ์ข‹์ง€ ์•Š์€ ์ด์œ  ์„ค๋ช…

Whisper๋Š” ํฐ ์„ฑ๊ณต์„ ๊ฑฐ๋‘์—ˆ์ง€๋งŒ, GPT-3์ด NLP๋ฅผ ์žฌํŽธํ–ˆ๋˜ ๋ฐฉ์‹์œผ๋กœ ASR์„ ์žฌํŽธํ•˜์ง€๋Š” ๋ชปํ–ˆ์Šต๋‹ˆ๋‹ค. ์ด 10๋ถ„์งœ๋ฆฌ ๋ฆฌ๋ทฐ๋Š” ๊ทธ ์ด์œ ๊ฐ€ ๋…ผ๋ฌธ ์ž์ฒด์— ๋‚ด์žฌ๋˜์–ด ์žˆ๋‹ค๊ณ  ์ฃผ์žฅํ•ฉ๋‹ˆ๋‹ค.

3์›” 4, 2023ยท 1 min read
In-depth review of OpenAI's GPT-3 : Language Models are Few-Shot Learners (Part 2/3: Results)
Video Tutorials

OpenAI์˜ GPT-3์— ๋Œ€ํ•œ ์‹ฌ์ธต ๊ฒ€ํ† : ์–ธ์–ด ๋ชจ๋ธ์€ Few-Shot ํ•™์Šต์ž์ž…๋‹ˆ๋‹ค (ํŒŒํŠธ 2/3: ๊ฒฐ๊ณผ)

์ด GPT-3 ์‹ฌ์ธต ๋ถ„์„์˜ 2๋ถ€๋Š” ์„ค์ •์„ ๋„˜์–ด ์‹ค์ œ๋กœ ์‚ฌ๋žŒ๋“ค์ด NLP๋ฅผ ์žฌ์ƒ๊ฐํ•˜๊ฒŒ ํ•œ ๊ฒฐ๊ณผ๋กœ ์ด๋™ํ•ฉ๋‹ˆ๋‹ค.

2์›” 25, 2023ยท 1 min read
WSJ Made a Mistake in Translating China's Foreign Minister's Speech; What has the Diplomat Said?
Video Tutorials

WSJ๊ฐ€ ์ค‘๊ตญ ์™ธ๊ต๋ถ€์žฅ์˜ ์—ฐ์„ค ๋ฒˆ์—ญ์—์„œ ์‹ค์ˆ˜๋ฅผ ์ €์งˆ๋ €์Šต๋‹ˆ๋‹ค. ์™ธ๊ต๊ด€์€ ๋ฌด์—‡์„ ๋งํ–ˆ์„๊นŒ์š”?

๊ธฐ๊ณ„ ๋ฒˆ์—ญ๊ณผ ์ธ๊ฐ„ ๋ฒˆ์—ญ ์˜ค๋ฅ˜๋Š” ์›”์ŠคํŠธ๋ฆฌํŠธ ์ €๋„์˜ ์ฒซ ํŽ˜์ด์ง€์— ๋‚˜ํƒ€๋‚˜๊ณ  ์ง€์ •ํ•™์  ์„œ์‚ฌ๋ฅผ ์žฌํŽธํ•  ๋•Œ ์–ธ์–ด ์• ํ˜ธ๊ฐ€์˜ ํ˜ธ๊ธฐ์‹ฌ ์ด์ƒ์ž…๋‹ˆ๋‹ค.

2์›” 22, 2023ยท 1 min read
In-depth review of OpenAI's GPT-3 : Language Models are Few-Shot Learners (Part 1/3: Intro&Approach)
Video Tutorials

OpenAI์˜ GPT-3์— ๋Œ€ํ•œ ์‹ฌ์ธต ๊ฒ€ํ† : ์–ธ์–ด ๋ชจ๋ธ์€ Few-Shot ํ•™์Šต์ž์ž…๋‹ˆ๋‹ค (ํŒŒํŠธ 1/3: ์†Œ๊ฐœ & ์ ‘๊ทผ)

์ด ์„ธ ๋ถ€๋ถ„ GPT-3 ๊ฒ€ํ† ์˜ ์ฒซ ๋ฒˆ์งธ ๋ถ€๋ถ„์€ ๊ทœ๋ชจ๋ฅผ ์—ฐ๊ตฌ ๋ฒ ํŒ…์—์„œ ์—…๊ณ„ ๋ณต์Œ์œผ๋กœ ๋ฐ”๊พผ ๋…ผ๋ฌธ์„ ์„ค์ •ํ•ฉ๋‹ˆ๋‹ค.

2์›” 11, 2023ยท 1 min read
In-depth Review of VALL-E: Neural Codec Language Models are Zero-Shot Text to Speech Synthesizers
Video Tutorials

VALL-E์˜ ์‹ฌ์ธต ๋ฆฌ๋ทฐ: ์‹ ๊ฒฝ ์ฝ”๋ฑ ์–ธ์–ด ๋ชจ๋ธ์ด ์˜์ƒท ํ…์ŠคํŠธ ์Œ์„ฑ ํ•ฉ์„ฑ๊ธฐ

3์ดˆ ์ฐธ๊ณ  ํด๋ฆฝ์œผ๋กœ๋ถ€ํ„ฐ์˜ ์˜์ƒท TTS๋Š” VALL-E๊ฐ€ ์ถœ์‹œ๋  ๋•Œ๊นŒ์ง€ ๋ถˆ๊ฐ€๋Šฅํ•ด ๋ณด์˜€์ง€๋งŒ, ์ด ์‹ฌ์ธต ๋ฆฌ๋ทฐ๋Š” Microsoft๊ฐ€ ์ •ํ™•ํžˆ ์–ด๋–ป๊ฒŒ ์ด๋ฅผ ๋‹ฌ์„ฑํ–ˆ๋Š”์ง€๋ฅผ ์ƒ์„ธํžˆ ์„ค๋ช…ํ•ฉ๋‹ˆ๋‹ค.

2์›” 4, 2023ยท 1 min read
Understand Microsoft's VALL-E in 3 Minutes (SOTA Zero-shot TTS)
Video Tutorials

3๋ถ„ ์•ˆ์— Microsoft์˜ VALL-E ์ดํ•ดํ•˜๊ธฐ (์ตœ๊ณ  ์„ฑ๋Šฅ ์˜์ƒท TTS)

VALL-E๋Š” TTS๊ฐ€ ์‹ ํ˜ธ ํšŒ๊ท€์ฒ˜๋Ÿผ ๋ณด์ด๊ธฐ๋ฅผ ๋ฉˆ์ถ”๊ณ  ์–ธ์–ด ๋ชจ๋ธ๋ง์ฒ˜๋Ÿผ ๋ณด์ด๊ธฐ ์‹œ์ž‘ํ•œ ์ˆœ๊ฐ„์ด๋ฉฐ, ์ด ๋น ๋ฅธ ์„ค๋ช…์€ ๋‹น์‹ ์„ ์‹ ์†ํ•˜๊ฒŒ ์ดํ•ดํ•˜๋„๋ก ๋„์™€์ค๋‹ˆ๋‹ค.

2์›” 4, 2023ยท 1 min read
ChatGPT/ChatGPT Plus/InstructGPT:Training language models to follow instructions with human feedback
Video Tutorials

ChatGPT/ChatGPT Plus/InstructGPT: ์ธ๊ฐ„ ํ”ผ๋“œ๋ฐฑ์œผ๋กœ ์ง€์‹œ๋ฅผ ๋”ฐ๋ฅด๋„๋ก ์–ธ์–ด ๋ชจ๋ธ ํ›ˆ๋ จ

ChatGPT ์ œํ’ˆ ๋’ค์—๋Š” InstructGPT ๋…ผ๋ฌธ์ด ์žˆ์œผ๋ฉฐ, ์ด ์ƒ์„ธ ๋ฆฌ๋ทฐ๋Š” ์›์‹œ GPT-3์„ ์‚ฌ๋žŒ๋“ค์ด ์‹ค์ œ๋กœ ๋Œ€ํ™”ํ•˜๊ณ  ์‹ถ์–ด ํ•˜๋Š” ๊ฒƒ์œผ๋กœ ๋ณ€ํ™˜ํ•œ ํŒŒ์ดํ”„๋ผ์ธ์„ ์ž์„ธํžˆ ๋ถ„์„ํ•ฉ๋‹ˆ๋‹ค.

1์›” 28, 2023ยท 1 min read
Explain how ChatGPT/ChatGPT Plus works in 3 minutes
Video Tutorials

3๋ถ„ ์•ˆ์— ChatGPT/ChatGPT Plus๊ฐ€ ์–ด๋–ป๊ฒŒ ์ž‘๋™ํ•˜๋Š”์ง€ ์„ค๋ช…

ChatGPT๋Š” ์™ธ๋ถ€์—์„œ๋Š” ๋งˆ๋ฒ•์ฒ˜๋Ÿผ ๋ณด์ด์ง€๋งŒ, ์–ด๋””๋ฅผ ๋ด์•ผ ํ•˜๋Š”์ง€ ์•Œ๋ฉด ๋ ˆ์‹œํ”ผ๋Š” ์ž˜ ๋ฌธ์„œํ™”๋˜์–ด ์žˆ์œผ๋ฉฐ, ์ด 3๋ถ„ ์„ค๋ช…์€ ํ•ต์‹ฌ ์•„์ด๋””์–ด๋ฅผ ์š”์•ฝํ•ฉ๋‹ˆ๋‹ค.

1์›” 28, 2023ยท 1 min read
[Olewave's Review] CLIP (3/3): Learning Transferable Visual Models From Natural Language Supervision
Video Tutorials

[Olewave's Review] CLIP (3/3): ์ž์—ฐ์–ด ๊ฐ๋…์œผ๋กœ๋ถ€ํ„ฐ์˜ ์ „์ด ๊ฐ€๋Šฅํ•œ ์‹œ๊ฐ ๋ชจ๋ธ ํ•™์Šต

์ด CLIP ๊ฒ€ํ† ์˜ ๋งˆ์ง€๋ง‰ ๋ถ€๋ถ„์€ ๊ฒฐ๊ณผ ์„น์…˜์— ๋„๋‹ฌํ•˜๋ฉฐ, ์—ฌ๊ธฐ์„œ OpenAI์˜ ๋Œ€์กฐ์  ์ด๋ฏธ์ง€-ํ…์ŠคํŠธ ๋ชจ๋ธ์ด ํฅ๋ฏธ๋กœ์šด ์•„์ด๋””์–ด์—์„œ ์ „์ฒด ๋ฉ€ํ‹ฐ๋ชจ๋‹ฌ ์Šคํƒ์˜ ๊ธฐ์ดˆ ๊ณ„์ธต ๊ธฐ๋ณธ ์š”์†Œ๋กœ ์ „ํ™˜๋˜์—ˆ์Šต๋‹ˆ๋‹ค.

1์›” 14, 2023ยท 1 min read
[Olewave's Review] CLIP (2/3): Learning Transferable Visual Models From Natural Language Supervision
Video Tutorials

[Olewave's Review] CLIP (2/3): ์ž์—ฐ์–ด ๊ฐ๋…์œผ๋กœ๋ถ€ํ„ฐ์˜ ์ „์ด ๊ฐ€๋Šฅํ•œ ์‹œ๊ฐ ๋ชจ๋ธ ํ•™์Šต

OpenAI์˜ CLIP์€ ๊ณ ์ • ๋ ˆ์ด๋ธ” ์„ธํŠธ๋ฅผ ๋ฒ„๋ฆฌ๊ณ  ๋Œ€์‹  ์ธํ„ฐ๋„ท์—์„œ ์ˆ˜์ง‘ํ•œ 4์–ต ๊ฐœ์˜ (์ด๋ฏธ์ง€, ํ…์ŠคํŠธ) ์Œ์œผ๋กœ ํ›ˆ๋ จํ•จ์œผ๋กœ์จ ์ปดํ“จํ„ฐ ๋น„์ „์˜ ์Šคํฌ๋ฆฝํŠธ๋ฅผ ๋’ค์ง‘์—ˆ์Šต๋‹ˆ๋‹ค.

1์›” 1, 2023ยท 1 min read
[Olewave's Review] CLIP (1/3): Learning Transferable Visual Models From Natural Language Supervision
Video Tutorials

[Olewave's Review] CLIP (1/3): ์ž์—ฐ์–ด ๊ฐ๋…์œผ๋กœ๋ถ€ํ„ฐ์˜ ์ „์ด ๊ฐ€๋Šฅํ•œ ์‹œ๊ฐ ๋ชจ๋ธ ํ•™์Šต

BLIP, LLaVA, ๋˜๋Š” ๊ฐ€์น˜ ์žˆ๋Š” ์Œ์„ฑ-LLM์ด ์žˆ๊ธฐ ์ „์— CLIP์ด ์žˆ์—ˆ์œผ๋ฉฐ, ์ด๊ฒƒ์ด ์ด์•ผ๊ธฐ๊ฐ€ ์‹œ์ž‘๋˜๋Š” ๊ณณ์ž…๋‹ˆ๋‹ค.

12์›” 17, 2022ยท 1 min read
[Olewave's Review] Token-level Sequence Labeling for SLU using Compositional E2E Models
Video Tutorials

[Olewave's Review] ํ•ฉ์„ฑ E2E ๋ชจ๋ธ์„ ์‚ฌ์šฉํ•œ SLU์˜ ํ† ํฐ ์ˆ˜์ค€ ์‹œํ€€์Šค ๋ ˆ์ด๋ธ”๋ง

End-to-end SLU๊ฐ€ ์ฃผ๋ชฉ๋ฐ›๊ณ  ์žˆ์ง€๋งŒ, ์‹œํ€€์Šค ๋ ˆ์ด๋ธ”๋ง์„ ์‹œํ€€์Šค ์˜ˆ์ธก์œผ๋กœ ์ทจ๊ธ‰ํ•˜๋ฉด ์ˆ˜์‹ญ ๋…„์— ๊ฑธ์นœ ์ž˜ ์ดํ•ด๋œ ํ† ํฐ ์ˆ˜์ค€ ํƒœ๊น… ๋ฉ”์ปค๋‹ˆ์ฆ˜์ด ์กฐ์šฉํžˆ ๋ฒ„๋ ค์ง‘๋‹ˆ๋‹ค.

12์›” 3, 2022ยท 1 min read
[Olewave's Review] Branchformer: Parallel MLP-Attention Architectures, and E-Branchformer
Video Tutorials

[Olewave์˜ ๋ฆฌ๋ทฐ] Branchformer: Parallel MLP-Attention Architectures, and E-Branchformer

Conformer๋Š” ์ˆ˜๋…„๊ฐ„ ์ตœ๊ณ ์˜ ASR ์ธ์ฝ”๋”์˜€์ง€๋งŒ, Branchformer์™€ ๊ทธ ํ›„์†์ž‘์ธ E-Branchformer๋Š” ์ˆœ์ฐจ์  conv-plus-attention์ด ์œ ์ผํ•œ ๊ฒฝ๋กœ๊ฐ€ ์•„๋‹ˆ๋ผ๋Š” ์„ค๋“๋ ฅ ์žˆ๋Š” ์ฃผ์žฅ์„ ์ œ์‹œํ•ฉ๋‹ˆ๋‹ค.

11์›” 19, 2022ยท 1 min read
Non Collision Mispronunciation Addition (NCMA) for Accented ASR
Video Tutorials

Non Collision Mispronunciation Addition (NCMA) for ์‚ฌํˆฌ๋ฆฌ ASR

์‚ฌํˆฌ๋ฆฌ์™€ ๋น„์›์–ด๋ฏผ ์Œ์„ฑ์€ ๋ฐœ์Œ ์‚ฌ์ „์„ ํŒŒ๊ดดํ•˜์—ฌ ์Œ์„ฑ ๋ชจ๋ธ ์ •๋ ฌ์„ ์กฐ์šฉํžˆ ์˜ค์—ผ์‹œํ‚ค๋Š”๋ฐ, ์ด Interspeech 2021 ์ž‘์—…์€ ๊ธฐ๋งŒ์ ์œผ๋กœ ๋‹จ์ˆœํ•œ ์งˆ๋ฌธ์„ ๋˜์ง‘๋‹ˆ๋‹ค: ์šฐ๋ฆฌ๊ฐ€ ํƒ์ง€๋œ ์˜ค๋ฐœ์Œ์„ ๋‹จ์ˆœํžˆ ์‚ฌ์ „์— ์ถ”๊ฐ€ํ•˜๋ฉด

11์›” 3, 2022ยท 1 min read
[Olewave's Review] OpenAI's Whisper ASR: Robust Speech Recognition via Large-Scale Weak Supervision
Video Tutorials

[Olewave์˜ ๋ฆฌ๋ทฐ] OpenAI์˜ Whisper ASR: ๋Œ€๊ทœ๋ชจ ์•ฝํ•œ ์ง€๋„๋ฅผ ํ†ตํ•œ ๊ฐ•๊ฑดํ•œ ์Œ์„ฑ ์ธ์‹

OpenAI๊ฐ€ Whisper๋ฅผ ์ถœ์‹œํ–ˆ์„ ๋•Œ, ASR ์ปค๋ฎค๋‹ˆํ‹ฐ๋Š” 68๋งŒ ์‹œ๊ฐ„์˜ ๋‹ค๊ตญ์–ด, ๋‹ค์ค‘ ์ž‘์—…, ์›น ํฌ๋กค๋ง ์˜ค๋””์˜ค๋กœ ํ›ˆ๋ จ๋˜์–ด ์‚ฌํˆฌ๋ฆฌ, ๋ฐฐ๊ฒฝ ์†Œ์Œ, ๊ธฐ์ˆ  ์šฉ์–ด ์ „๋ฐ˜์— ๊ฑธ์ณ

10์›” 31, 2022ยท 1 min read
One-Edit-Distance FSA/Network-based (OEDN) in Mispronunciation Detection and Accented ASR
Video Tutorials

One-Edit-Distance FSA/Network-based (OEDN)๋ฅผ ์ด์šฉํ•œ ์˜ค๋ฐœ์Œ ํƒ์ง€ ๋ฐ ์‚ฌํˆฌ๋ฆฌ ASR

๋น„์›์–ด๋ฏผ ์Œ์„ฑ ๋ชจ๋ธ๋ง์€ ๋‹ญ๊ณผ ๊ณ„๋ž€ ๋ฌธ์ œ๋ฅผ ๊ฐ€์ง€๊ณ  ์žˆ์Šต๋‹ˆ๋‹ค: ๋‚˜์œ ์Œ์„ฑ ์ •๋ ฌ์€ ๋‚˜์œ ๋ชจ๋ธ์„ ๋งŒ๋“ค๊ณ , ๋‚˜์œ ๋ชจ๋ธ์€ ๋‚˜์œ ์ •๋ ฌ์„ ๋งŒ๋“ญ๋‹ˆ๋‹ค.

9์›” 24, 2022ยท 1 min read
Olewave's most detailed illustration of RNN-T: Sequence Transduction with Recurrent Neural Networks
Video Tutorials

Olewave์˜ RNN-T ์„ค๋ช… ์ค‘ ๊ฐ€์žฅ ์ƒ์„ธํ•จ: Sequence Transduction with Recurrent Neural Networks

Alex Graves์˜ RNN-T ๋…ผ๋ฌธ์€ ์˜ค๋Š˜๋‚  ์ถœ์‹œ๋˜๋Š” ๊ฑฐ์˜ ๋ชจ๋“  ์ŠคํŠธ๋ฆฌ๋ฐ ASR ์‹œ์Šคํ…œ์˜ ์กฐ์šฉํ•œ ์กฐ์ƒ์ด๋ฉฐ, Google์˜ ์˜จ๋””๋ฐ”์ด์Šค ์ธ์‹๊ธฐ์—์„œ๋ถ€ํ„ฐ NeMo, ESPnet ๋“ฑ์˜ ์ˆ˜๋งŽ์€ ์˜คํ”ˆ์†Œ์Šค ํŠธ๋žœ์Šค๋“€์„œ ์Šคํƒ์— ์ด๋ฅด๊ธฐ๊นŒ์ง€์ž…๋‹ˆ๋‹ค.

9์›” 3, 2022ยท 1 min read
Google fired Blake Lemoine for saying AI bot is sentient? Does LaMDA or ChatGPT think like human?
Video Tutorials

Google์ด AI ๋ด‡์ด ์„ผํ‹ฐ์–ธํŠธ๋ผ๊ณ  ๋งํ•œ Blake Lemoine์„ ํ•ด๊ณ ํ–ˆ๋‚˜? LaMDA๋‚˜ ChatGPT๊ฐ€ ์ธ๊ฐ„์ฒ˜๋Ÿผ ์ƒ๊ฐํ• ๊นŒ?

Google์ด LaMDA๊ฐ€ ์„ผํ‹ฐ์–ธํŠธ๊ฐ€ ๋˜์—ˆ๋‹ค๋Š” ์ฃผ์žฅ์„ ๊ณต๊ฐœํ•œ Blake Lemoine์„ ํ•ด๊ณ ํ–ˆ์„ ๋•Œ, ๊ทธ ์ด์•ผ๊ธฐ๋Š” ๋ฐ”์ด๋Ÿด์ด ๋˜์—ˆ์ง€๋งŒ, ๊ทผ๋ณธ์ ์ธ ์งˆ๋ฌธ์ด ๋‚จ์•˜์Šต๋‹ˆ๋‹ค: LaMDA์™€ ChatGPT์™€ ๊ฐ™์€ ๋Œ€๊ทœ๋ชจ ์–ธ์–ด ๋ชจ๋ธ์ด ์‹ค์ œ๋กœ ์ƒ๊ฐ์„

8์›” 5, 2022ยท 1 min read
[Olewave's Long Review] Efficient Training of Neural Transducer for Speech Recognition
Video Tutorials

[Olewave์˜ ๋กฑ ๋ฆฌ๋ทฐ] ์Œ์„ฑ ์ธ์‹์„ ์œ„ํ•œ ์‹ ๊ฒฝ ํŠธ๋žœ์Šค๋“€์„œ์˜ ํšจ์œจ์ ์ธ ํ›ˆ๋ จ

์‹ ๊ฒฝ ํŠธ๋žœ์Šค๋“€์„œ๋Š” ์ŠคํŠธ๋ฆฌ๋ฐ ASR์˜ ์ฃผ๋ ฅ์ด์ง€๋งŒ, ํšจ์œจ์ ์œผ๋กœ ํ›ˆ๋ จํ•˜๋Š” ๊ฒƒ์€ ์œ ๋ช…ํ•˜๊ฒŒ ๊ณ ํ†ต์Šค๋Ÿฝ์Šต๋‹ˆ๋‹ค: RNN-T ์†์‹ค์€ ์‹œํ€€์Šค ๊ธธ์ด์—์„œ 3์ œ๊ณฑ ๋ฉ”๋ชจ๋ฆฌ๋ฅผ ๊ฐ€์ง€๋ฉฐ, ์ •๋ ฌ ๊ฒฉ์ž๋Š” ๊ธด ๋ฐœํ™”์—์„œ ํญ๋ฐœํ•˜๊ณ , ๋‹จ์ผ-

7์›” 23, 2022ยท 1 min read
Boris Johnsonโ€™s Rise and Fall - an analysis of the mics
Video Tutorials

Boris Johnson์˜ ํฅ๋ง - ๋งˆ์ดํฌ์˜ ๋ถ„์„

์ •์น˜ ๋‰ด์Šค๋Š” ๋ณดํ†ต ์Œ์„ฑ AI ์—”์ง€๋‹ˆ์–ด๊ฐ€ ๊ธˆ์š”์ผ ์˜คํ›„์— ํ์— ์˜ฌ๋ ค๋†“๋Š” ๊ฒƒ์ด ์•„๋‹ˆ์ง€๋งŒ, Boris Johnson์˜ ์‚ฌ์ž„ ๋ฐœํ‘œ๋Š” ์ผ๋ จ์˜ ์Šค์บ”๋“ค์— ๋Œ€ํ•œ ์ •๋‹น์˜ ๋ฐ˜๋ž€์œผ๋กœ ๋งˆ์ดํฌ ๋ฑ…ํฌ ์•ž์—์„œ ์ „๋‹ฌ๋˜์—ˆ์Šต๋‹ˆ๋‹ค

7์›” 9, 2022ยท 1 min read
[Olewave's Long Review] Xception: Deep Learning with Depthwise Separable Convolutions
Video Tutorials

[Olewave์˜ ์žฅํŽธ ๋ฆฌ๋ทฐ] Xception: ๊นŠ์ด๋ณ„ ๋ถ„๋ฆฌํ˜• ์ปจ๋ณผ๋ฃจ์…˜์„ ์ด์šฉํ•œ ๋”ฅ๋Ÿฌ๋‹

Xception์€ Inception ๊ฐ€์„ค์„ ๋…ผ๋ฆฌ์  ๊ทน๋‹จ๊นŒ์ง€ ๋ฐ€์–ด๋ถ™์ด๊ณ  ์ฑ„๋„ ๊ฐ„ ๋ฐ ๊ณต๊ฐ„์  ์ƒ๊ด€๊ด€๊ณ„๋ฅผ ์™„์ „ํžˆ ๋ถ„๋ฆฌ๋œ ์—ฐ์‚ฐ์œผ๋กœ ๋ฐ€์–ด๋ถ™์˜€์œผ๋ฉฐ, ์ด๋กœ ์ธํ•ด ์ธ๊ธฐ๋ฅผ ์–ป์€ ๊นŠ์ด๋ณ„ ๋ถ„๋ฆฌํ˜• ์ปจ๋ณผ๋ฃจ์…˜์€ ์ด์ œ ๋ชจ๋“  ๊ณณ์— ๋‚˜ํƒ€๋‚œ๋‹ค

7์›” 9, 2022ยท 1 min read
[Olewave's Short Review] Xception: Deep Learning with Depthwise Separable Convolutions
Video Tutorials

[Olewave์˜ ๋‹จํŽธ ๋ฆฌ๋ทฐ] Xception: ๊นŠ์ด๋ณ„ ๋ถ„๋ฆฌํ˜• ์ปจ๋ณผ๋ฃจ์…˜์„ ์ด์šฉํ•œ ๋”ฅ๋Ÿฌ๋‹

Xception์˜ ํ•ต์‹ฌ ์•„์ด๋””์–ด๋งŒ ์›ํ•˜๊ณ  ์žฅํŽธ ๋ฆฌ๋ทฐ์˜ ๊นŠ์€ ๋‚ด์šฉ์€ ์›ํ•˜์ง€ ์•Š๋Š”๋‹ค๋ฉด, ์ด ๋‹จํŽธ ๋ฆฌ๋ทฐ๊ฐ€ ๊ฐ„๋‹จํ•œ ๋ฒ„์ „์ž…๋‹ˆ๋‹ค.

7์›” 9, 2022ยท 1 min read
Phased Array Radar on China's Aircraft Carrier Fujian 003 and Its Connection with Speech Beamforming
Video Tutorials

์ค‘๊ตญ์˜ ํ•ญ๊ณต๋ชจํ•จ Fujian 003์˜ ์œ„์ƒ๋ฐฐ์—ด ๋ ˆ์ด๋”์™€ ์Œ์„ฑ ๋น”ํฌ๋ฐ์˜ ์—ฐ๊ฒฐ

์ค‘๊ตญ์˜ ์ตœ์‹  ํ•ญ๊ณต๋ชจํ•จ Fujian 003์— ํƒ‘์žฌ๋œ ์œ„์ƒ๋ฐฐ์—ด ๋ ˆ์ด๋”์™€ ์Šค๋งˆํŠธ ์Šคํ”ผ์ปค๊ฐ€ ์‹œ๋„๋Ÿฌ์šด ๋ฐฉ์—์„œ ๋‹น์‹ ์˜ ๋ง์„ ๋“ค์„ ์ˆ˜ ์žˆ๊ฒŒ ํ•˜๋Š” ๋งˆ์ดํฌ ์–ด๋ ˆ์ด๋Š” ์‹ค์ œ๋กœ ๊ฐ™์€ ๊ธฐ๋ณธ ์ˆ˜ํ•™์„ ๊ณต์œ ํ•ฉ๋‹ˆ๋‹ค.

6์›” 25, 2022ยท 1 min read
How Does the All-New Dictation in iOS 16 Work? Reveal Apple's Secret Sauce by a Speech Researcher!
Video Tutorials

iOS 16์˜ ์ƒˆ๋กœ์šด ๋ฐ›์•„์“ฐ๊ธฐ ๊ธฐ๋Šฅ์€ ์–ด๋–ป๊ฒŒ ์ž‘๋™ํ• ๊นŒ์š”? Apple์˜ ๋น„๊ฒฐ์„ ์Œ์„ฑ ์—ฐ๊ตฌ์›์ด ๋ฐํ˜€์ค๋‹ˆ๋‹ค!

Apple์˜ iOS 16 ๋ฐ›์•„์“ฐ๊ธฐ๋Š” ์™„์ „ํžˆ ๊ธฐ๊ธฐ์—์„œ ์‹คํ–‰๋˜๋ฉฐ, ์ด ๋‹จ์ผ ์„ค๊ณ„ ์„ ํƒ์€ ์ง€์—ฐ ์‹œ๊ฐ„, ๊ฐœ์ธ์ •๋ณด ๋ณดํ˜ธ, ๊ทธ๋ฆฌ๊ณ  ํœด๋Œ€ํฐ์—์„œ ์‹คํ–‰ ๊ฐ€๋Šฅํ•œ ASR ์•„ํ‚คํ…์ฒ˜์˜ ์ข…๋ฅ˜์— ๋Œ€ํ•œ ์—ฐ์‡„์  ์˜ํ–ฅ์„ ๋ฏธ์นฉ๋‹ˆ๋‹ค.

6์›” 18, 2022ยท 1 min read
[Long Review] Conformer: Convolution-augmented Transformer for Speech Recognition
Video Tutorials

[์žฅ๋ฌธ ๋ฆฌ๋ทฐ] Conformer: ์Œ์„ฑ ์ธ์‹์„ ์œ„ํ•œ Convolution-augmented Transformer

Conformer๋Š” end-to-end ASR์„ ์กฐ์šฉํžˆ ์žฅ์•…ํ•œ ๋ชจ๋ธ์ด๋ฉฐ, ๋ชจ๋“  Transformer ๋ธ”๋ก์— convolution ๋ชจ๋“ˆ์„ ์ถ”๊ฐ€ํ•˜๋Š” ๊ทธ ๋ฐฉ์‹์€ ๋‹จ์ˆœํ•˜์ง€๋งŒ ๋†€๋ž๊ฒŒ๋„ ์ž˜ ์ž‘๋™ํ•˜๋Š” ์•„์ด๋””์–ด ์ค‘ ํ•˜๋‚˜์ž…๋‹ˆ๋‹ค.

6์›” 11, 2022ยท 1 min read
[Short Review] Conformer: Convolution-augmented Transformer for Speech Recognition
Video Tutorials

[๋‹จ๋ฌธ ๋ฆฌ๋ทฐ] Conformer: ์Œ์„ฑ ์ธ์‹์„ ์œ„ํ•œ Convolution-augmented Transformer

Conformer๋Š” ๊ฑฐ์˜ ๋‹จ์ˆœํ•œ ์ž‘์—…์„ ํ†ตํ•ด ASR ์„ธ๊ณ„๋ฅผ ํœฉ์“ธ์—ˆ์Šต๋‹ˆ๋‹ค: ๊ฐ Transformer ๋ธ”๋ก์— convolution ๋ชจ๋“ˆ์„ ๋ถ™์—ฌ ๋ชจ๋ธ์ด ์ „์—ญ ์ปจํ…์ŠคํŠธ์™€ ๋กœ์ปฌ ์Œํ–ฅ ์„ธ๋ถ€ ์ •๋ณด๋ฅผ ํ•œ ๋ฒˆ์— ํฌ์ฐฉํ•  ์ˆ˜ ์žˆ๋„๋ก ํ–ˆ์Šต๋‹ˆ๋‹ค.

6์›” 11, 2022ยท 1 min read