snow · 2026.9.4 00:05 · 조회 0
아부다비 AI 연구소 IFM, 학습 데이터·코드까지 공개한 완전 오픈소스 모델 6종 발표
아랍에미리트 아부다비에 본거지를 둔 AI 연구기관 IFM(Institute of Foundation Models)이 2026년 9월 3일(현지시간, 목요일) 모델 가중치는 물론 학습 데이터와 학습에 사용된 코드까지 모두 공개하는 완전한 오픈소스 방식으로 AI 모델 6종을 발표했다. 로이터 통신은 이번 발표가 최근 빅테크들이 모델 가중치만 공개하고 학습 데이터는 비공개로 유지하는 '오픈 웨이트' 관행과 대비되는 행보라고 전했다.
배경
아부다비를 비롯한 UAE는 최근 몇 년간 국가 차원에서 AI 산업 육성에 대규모 투자를 이어왔으며, Falcon 시리즈 등 오픈소스 대형언어모델(LLM)을 선도해온 지역으로 꼽힌다. 이번 발표 주체인 IFM은 이 지역 오픈소스 AI 생태계의 연장선에서, 단순히 모델 가중치만 배포하는 '오픈 웨이트' 수준을 넘어 학습 데이터셋과 학습 파이프라인 코드까지 전면 공개하는 '완전 오픈소스' 전략을 택했다.
업계에서는 메타의 라마(Llama)나 미스트랄(Mistral) 등 주요 오픈소스 모델들이 가중치는 공개하되 학습 데이터의 구성이나 출처는 비공개로 유지해온 것과 비교해, 이번 IFM의 행보가 AI 모델 개발 과정의 투명성을 한 단계 끌어올린 사례로 평가된다.
영향
학습 데이터와 코드까지 공개되면 연구자와 스타트업은 모델을 처음부터 재현하거나 특정 목적에 맞게 변형하는 것이 훨씬 수월해진다. 이는 오픈소스 AI 생태계 전반의 연구 재현성과 검증 가능성을 높이는 동시에, 중동 지역이 글로벌 AI 경쟁에서 독자적인 위치를 확보하려는 신호로도 해석된다.
반면 학습 데이터 전면 공개는 저작권·데이터 출처 관련 논란에 노출될 가능성도 있어, 향후 데이터 구성에 대한 검증과 논의가 뒤따를 것으로 보인다.
향후 전망
IFM이 추가로 어떤 모델을 오픈소스로 공개할지, 그리고 글로벌 오픈소스 진영(허깅페이스 등 커뮤니티)과의 협업이 어떤 방식으로 확대될지가 주목된다. 완전 오픈소스 모델이 상업용 오픈 웨이트 모델과 어떻게 경쟁하고 공존할지도 관심사다.
자주 묻는 질문
Q. IFM이 이번에 공개한 모델은 몇 개인가? 로이터 보도에 따르면 IFM은 2026년 9월 3일 총 6종의 AI 모델을 학습 데이터와 코드까지 포함해 공개했다.
Q. '완전 오픈소스'와 '오픈 웨이트'는 어떻게 다른가? 오픈 웨이트는 모델의 학습된 가중치 파일만 공개하는 방식인 반면, 완전 오픈소스는 학습 데이터셋과 학습에 사용된 코드까지 함께 공개해 누구나 모델 개발 과정을 검증하고 재현할 수 있게 한다.
Q. 이번 발표가 왜 주목받나? 메타, 미스트랄 등 대다수 오픈소스 모델 개발사가 학습 데이터 구성을 공개하지 않는 것과 달리, IFM은 데이터까지 투명하게 공개함으로써 AI 개발의 투명성 논쟁에 새로운 기준을 제시했다는 평가를 받는다.
댓글
아직 댓글이 없습니다.
댓글을 작성하려면 로그인이 필요합니다.