Amazon, AI 모델 학습 위해 희귀 도서 훼손
TechCrunch는 Amazon이 희귀 도서를 LLM 학습 자료로 활용하고 있다고 보도했다.
왜 중요한가
이번 보도는 AI 개발사들이 공개 인터넷을 넘어서는 데이터를 찾는 과정에서 희소한 비웹 텍스트 자료에 대한 수요가 계속되고 있음을 보여준다. 동시에 기업들이 모델 학습을 위해 문화적으로 가치 있는 자료를 어떻게 확보하고 보존하는지에 대한 의문도 제기한다.
핵심 포인트
- 1.Amazon이 AI 학습에 희귀 도서를 사용하고 있는 것으로 알려졌다.
- 2.희귀 도서는 온라인에서 이미 흔한 텍스트가 아닌 자료를 제공할 수 있다.
- 3.이 관행은 데이터 출처와 보존에 관한 우려를 낳고 있다.
TechCrunch는 Amazon이 AI 모델을 학습시키기 위해 희귀 도서를 훼손하고 있다고 보도했다. 보도에 따르면 많은 모델이 이미 온라인에 공개된 자료로 학습된 만큼, 희귀 도서는 LLM 학습에 가치 있는 자료로 평가된다.
⚡ 오늘 바로 활용
물리적 자료나 희귀 자료를 사용하는 AI 학습 데이터 파이프라인은 출처, 권리, 보존 관행을 점검해야 한다.
출처 및 원본 보도
이 브리핑은 아래 매체의 보도를 요약하고 링크합니다.
이 브리핑이 유용했나요? 다음 소식을 메일로 받아보세요.
관련: 비즈니스
비즈니스
VentureBeat, 초대 Lead Analyst로 Rob Strechay 선임
VentureBeat가 엔터프라이즈 AI 의사결정자를 겨냥해 VentureBeat Research를 확대하고 있다.
VentureBeat AI·1h ago
비즈니스
Nvidia와 금융사들, 5,000억 달러 규모 컴퓨트 계획 추진
Nvidia가 주요 금융사들과 함께 GPU 컴퓨트를 투자 가능한 자산군으로 만들기 위해 협력하고 있다.
The Verge AI·3h ago
비즈니스
OpenAI, 유럽 전역으로 ChatGPT Ads 확대
OpenAI에 따르면 ChatGPT Ads가 유럽 31개 시장으로 확대된다.
OpenAI·17h ago