AI 영상 생성 평가: 캐릭터AI가 'AI 슬롭'을 걸러내는 소형 VLM 평가 모델 개발기
AI 영상 생성은 사실상 공짜가 됐지만 대부분은 품질이 낮다. 캐릭터AI의 마오르 브릴이 프레임 단위 지표를 넘어 '이야기·물리·오디오 싱크'까지 평가하는 소형 VLM 방식을 소개한다.
핵심 내용 읽기 →AI TOPIC
AI 영상 생성 관련 핵심 뉴스와 활용 인사이트 10편을 최신순으로 모았습니다.

AI 영상 생성은 사실상 공짜가 됐지만 대부분은 품질이 낮다. 캐릭터AI의 마오르 브릴이 프레임 단위 지표를 넘어 '이야기·물리·오디오 싱크'까지 평가하는 소형 VLM 방식을 소개한다.
핵심 내용 읽기 →
API 키나 구독 없이 내 PC에서 무료로 AI 영상을 만드는 방법을 ComfyUI 설치부터 텍스트-투-비디오, 이미지-투-비디오까지 단계별로 안내한다.
핵심 내용 읽기 →
복잡한 노드 편집 없이 문장 몇 줄로 단편 드라마와 광고 영상을 만드는 멀티 에이전트 플랫폼을 시연하며, 채팅 기반 AI 영상 제작의 가능성과 한계를 짚었다.
핵심 내용 읽기 →
WaN 2.2와 LTX 2.3 영상 생성 모델을 FP16부터 2비트까지 단계별로 낮춰 비교한 실험. FP8이 같은 비트의 Q8보다 품질이 떨어지고 오디오가 영상보다 먼저 무너지며, 비트 수보다 형식이 중요하다는 결론을 정리했습니다.
핵심 내용 읽기 →
내 컴퓨터에서 무료·비공개로 돌리는 로컬 AI 영상(Wan·LTX)을 최상위 클라우드 모델과 같은 프롬프트로 비교했다. 현실성 격차는 뚜렷했지만 로컬은 통제력에서 앞섰고, 다음 경쟁은 로컬 대 클라우드가 아니라 모델 대 워크플로로 옮겨간다.
핵심 내용 읽기 →
실사감의 소라2, 오디오까지 만드는 구글 베오, 일관성의 런웨이, 아바타의 신세시아까지. 최신 AI 영상 생성 도구들의 강점과 한계를 용도별로 비교했다.
핵심 내용 읽기 →
구글 Veo 3, 소라 같은 AI 영상 생성기는 어떻게 진짜 같은 영상을 만들까. 노이즈를 더하고 빼는 확산 모델, 잠재 공간 압축, 시공간 패치와 어텐션까지 작동 원리를 쉽게 풀었다.
핵심 내용 읽기 →
발표자는 가상의 쿠키 브랜드 광고를 제미나이 옴니로 5분 만에 만들었다. 일관된 이미지 5장 생성, 애니메이션화, 재프롬프트 편집의 3단계와 에이전시 약 1,400달러 대비 비용·시간 차이를 정리했다.
핵심 내용 읽기 →
AI 영상 툴 Higgsfield의 MCP를 'Hermes' 에이전트에 연결해 자연어로 바이럴 프리셋 영상을 만드는 과정을 시연한다. 인증·스킬 설치, 실패 후 자가 개선, 약 8달러의 비용과 Soul ID 활용법까지 정리했다.
핵심 내용 읽기 →
Gemini에 들어온 영상 생성 모델 Omni를 물리 시뮬레이션, 캐릭터 일관성, 대화형 장면 편집 측면에서 직접 테스트했다. Nano Banana 2 연계와 Seedance 2 비교, 그리고 10초 제한 등 현실적 한계까지 정리한다.
핵심 내용 읽기 →