2026년 2차 독자 AI 파운데이션 모델 프로젝트 공동활용 데이터 지원사업 공고
📋 한눈에 보기
AI 파운데이션 모델 개발을 위한 고품질 데이터 지원 사업이에요.
자격증, STEM 강의 데이터를 보유한 기업/기관이 대상이고요.
데이터 권원 확보와 정제/가공 능력이 중요하답니다.
📌 기본 정보
| 항목 | 내용 |
|---|---|
| 분야 | 기술 |
| 주관기관 | 과학기술정보통신부 |
| 수행기관 | 한국데이터산업진흥원 |
| 신청기간 | 2026년 8월 12일 ~ 2026년 9월 2일 |
| 문의처 | 한국데이터산업진흥원 AI데이터지원팀 02-3708-5442 |
🎯 이런 기업이 신청하세요
이 사업은 AI 학습용 데이터를 보유하고 있거나, 확보해서 제공할 수 있는 기관이나 기업들을 찾고 있어요. 특히, 자격증 강의나 STEM(과학, 기술, 공학, 수학) 분야의 강의 데이터를 가지고 있다면 더욱 주목해야 할 사업이죠.
예를 들어, 온라인 교육 플랫폼을 운영하면서 다양한 자격증 강의 콘텐츠를 보유하고 있거나, 과학/기술 분야의 전문 교육 자료를 많이 축적해둔 교육 기관이 있을 수 있어요. 또한, 데이터를 수집하고 가공하는 전문 기술을 가진 데이터 전문 기업도 좋은 대상이 될 수 있답니다. 중요한 건, 제공하는 데이터에 대한 적법한 권리(저작권, 소유권)를 가지고 있어야 하고요. 데이터를 AI 학습에 맞게 정제하고, 필요하면 가명처리하거나 표준화할 수 있는 능력이 있어야 신청하기 유리해요. 혼자서 다 하기 어렵다면 여러 기업이 힘을 합쳐 컨소시엄 형태로도 참여할 수 있으니 참고해 보세요.
💰 지원 내용 상세
이번 지원사업은 국민 누구나 AI를 활용하고 그 혜택을 누릴 수 있는 AI 생태계를 만들기 위한 중요한 단계예요. 고품질의 다양한 데이터를 확보해서 글로벌 수준의 독자적인 AI 파운데이션 모델을 만드는 데 기여하는 것이 목표입니다.
구체적으로는 AI 학습용 데이터를 다른 AI 수요기관(예를 들어, AI 모델 개발팀)이 공동으로 활용할 수 있도록 제공하는 역할을 하는 기관이나 기업을 지원하는 내용이에요. 데이터 제공 주체로서 AI 학습에 필요한 데이터를 적법하게 확보하고, 유통할 수 있는 능력을 갖춰야 합니다. 또한, 데이터를 요구에 맞춰 정제, 가명처리, 가공, 표준화하는 등의 기술적 역량도 중요하게 보고 있어요.
지원 데이터 분야는 크게 두 가지로 나뉘는데요. 국가기술, 국가공인, 국가전문자격 등 다양한 '자격증 강의' 데이터와 과학, 기술, 공학, 수학 등의 'STEM 강의' 데이터가 해당됩니다. 일반적으로 데이터 제공에 따른 비용이나 인프라 구축 등에 대한 지원이 이루어질 수 있답니다.
📝 신청 꿀팁
- 데이터 권원 명확화: 제공하려는 데이터에 대한 저작권이나 소유권 등 적법한 권원을 확실하게 증명하는 것이 중요합니다. 계약서나 관련 증빙 자료를 꼼꼼히 준비해 주세요.
- 데이터 정제 및 가공 능력 어필: 단순히 데이터를 가지고 있는 것을 넘어, AI 학습에 적합하도록 데이터를 정제하고 가공, 표준화할 수 있는 기술력과 경험을 구체적으로 보여주는 것이 좋아요. 관련 프로젝트 경험이 있다면 꼭 포함해 보세요.
- 데이터 활용 계획 제시: 제공할 데이터가 독자 AI 파운데이션 모델 개발에 어떻게 기여할 수 있을지, 어떤 시너지를 낼 수 있을지에 대한 구체적인 활용 계획을 제시하면 높은 평가를 받을 수 있습니다.
- 컨소시엄 구성 시 시너지 강조: 여러 기업이나 기관이 컨소시엄을 구성할 경우, 각 참여 주체의 역할과 기여도를 명확히 하고, 협력을 통해 얻을 수 있는 시너지 효과를 상세히 설명하는 것이 좋습니다.
📂 준비서류 체크리스트
- 사업신청서 (사업계획서 포함)
- 법인등기부등본 (개인사업자의 경우 사업자등록증)
- 재무제표 (최근 3개년)
- 국세 및 지방세 완납증명서
- 데이터 권원 증빙 서류 (저작권 등록증, 소유권 증빙, 데이터 확보 계약서 등)
- 참여인력 이력사항 (컨소시엄의 경우 각 참여사별)
- 데이터 정제 및 가공 관련 기술 역량 증빙 자료 (관련 특허, 인증서, 수행 실적 등)
- 기타 사업계획서에 명시된 필수 제출 서류
❓ 자주 묻는 질문
Q1: '공동활용 데이터'는 정확히 무엇을 의미하나요?
A1: 공동활용 데이터는 AI 파운데이션 모델 개발을 위해 여러 AI 개발팀이나 연구기관에서 함께 사용할 수 있도록 개방된 데이터를 말해요. 데이터를 제공하는 기관은 이 데이터가 폭넓게 활용될 수 있도록 지원하는 역할을 하게 됩니다.
Q2: 저희가 가진 데이터가 아직 완벽하게 정제되지 않았는데 신청할 수 있나요?
A2: 네, 가능합니다. 중요한 것은 데이터를 정제하고 가명처리, 가공, 표준화할 수 있는 역량을 가지고 있는가 하는 점이에요. 신청 시 보유한 데이터의 현황과 함께 데이터를 AI 학습에 적합하게 만들 수 있는 계획과 기술력을 구체적으로 제시해야 합니다.
Q3: 데이터 제공에 대한 금전적인 보상이나 지원금도 있나요?
A3: 이번 사업은 AI 생태계 구축을 위해 고품질 데이터를 확보하고 그 제공을 지원하는 사업이에요. 일반적으로 데이터 확보, 구축, 정제, 가공 및 유통 과정에서 발생하는 비용이나 인프라 구축 등에 대한 지원이 포함될 수 있답니다. 자세한 내용은 공고문을 통해 확인하는 것이 가장 정확해요.
🔗 신청하기
자세한 내용과 신청은 원문 공고에서 확인하세요.
지원받자에서 이 공고에 대한 무료 자격 진단과 AI 신청서 초안을 받아보세요.