셔터스톡 AI 데이터 라이선싱 전략: 모델 학습용을 넘어 추론용 콘텐츠 공급으로 확장하다
셔터스톡 데이터 라이선싱 총괄이 스톡 사진 회사가 어떻게 AI 모델 학습·추론용 데이터 공급자로 바뀌었는지, 창작자 보상 문제와 합성 데이터의 한계, 에이전트 시대의 과제를 팟캐스트 인터뷰에서 설명했다.
핵심 내용 읽기 →AI TOPIC
학습데이터 관련 핵심 뉴스와 활용 인사이트 5편을 최신순으로 모았습니다.

셔터스톡 데이터 라이선싱 총괄이 스톡 사진 회사가 어떻게 AI 모델 학습·추론용 데이터 공급자로 바뀌었는지, 창작자 보상 문제와 합성 데이터의 한계, 에이전트 시대의 과제를 팟캐스트 인터뷰에서 설명했다.
핵심 내용 읽기 →
웹·수학·코드 학습 데이터를 어떤 비율로 섞느냐가 모델 성능을 좌우한다. OLMo 3 개발 과정에서 정리된 데이터 믹싱 설계 선택지와, 개발 도중 데이터가 바뀔 때 재계산 비용을 줄이는 방법을 함께 살펴본다.
핵심 내용 읽기 →
AI 엔지니어 콘퍼런스 강연에서 데이터 시장 분석가가 밝힌 구조를 정리했다. 결과물이 아닌 '과정 데이터'가 핵심이며, 검증 가능성의 세 축이 어떤 분야가 먼저 AI에 뚫릴지 예측한다는 설명과 함께 업계 벤치마크를 믿기 어려운 이유도 짚는다.
핵심 내용 읽기 →
거대 언어 모델(LLM)이 어떻게 작동하고 어떤 데이터로 학습되는지, 트랜스포머 구조부터 사전학습·파인튜닝, 토큰 규모, 데이터 수집·정제 절차까지 한 번에 정리했다.
핵심 내용 읽기 →
머신러닝을 처음 접할 때 헷갈리는 핵심 용어를 22분 분량으로 정리한 영상 요약. AI와 ML의 차이부터 모델·모델 학습·학습 데이터와 테스트 데이터까지 예시로 짚는다.
핵심 내용 읽기 →