생성 오디오 입문: 샘플링·나이퀴스트 정리부터 U-Net 음질 복원과 트랜스포머 작곡까지
버클리 CS 198-126 생성 오디오 강의 정리. 연속된 소리를 숫자로 바꾸는 표본화와 나이퀴스트 정리, U-Net으로 저음질 음원을 복원하는 구조, 트랜스포머가 다음 음을 예측하도록 음악을 토큰화하는 방식을 차례로 다룬다.
핵심 내용 읽기 →AI TOPIC
오디오 AI 관련 핵심 뉴스와 활용 인사이트 2편을 최신순으로 모았습니다.

버클리 CS 198-126 생성 오디오 강의 정리. 연속된 소리를 숫자로 바꾸는 표본화와 나이퀴스트 정리, U-Net으로 저음질 음원을 복원하는 구조, 트랜스포머가 다음 음을 예측하도록 음악을 토큰화하는 방식을 차례로 다룬다.
핵심 내용 읽기 →
언어 모델이 사진과 영상, 소리를 이해하게 된 과정을 비전 트랜스포머와 CLIP, 플라밍고와 Q-Former, 오디오 모델까지 따라가며 모달리티마다 반복되는 세 단계 설계로 정리했다.
핵심 내용 읽기 →