소버린 AI 개발을 위한 데이터 전략 2가지 소버린 AI 없이 버틴 기업,
미래에 어떤 대가를 치를까? |
|
|
지금 여러분의 AI는 어떤가요?
- 소버린 AI인가요?
- 또는 해외의 인프라를 활용하고 계신가요?
후자의 경우 하나씩 개발해야 하는 공수가 덜 들어가니 효율적일 수도 있습니다.
그러나 장기적으로 보면 후회로 남을 선택이 될 지 모릅니다.
1) 국가·기업의 전략, R&D, 고객 정보가 해외 서버를 통해 유출될 수 있습니다.
- 경쟁력을 쌓기 위해 개발한 AI인데, 오히려 AI로 인해 경쟁력을 빼앗기는 것이죠.
2) 데이터의 출처, 이전 경로 등을 명확히 증명하기 어렵습니다.
- 유럽은 이미 GDPR과 EU AI Act로 데이터 주권을 법제화했습니다.
- 한국도 인공지능 기본법을 통해 유사한 방향으로 움직이고 있어요.
- 규제를 준수하기 위해, 데이터의 출처, 데이터의 이전 경로 등을 명확히 밝혀야 하는 것인데요.
- 해외 기반 모델의 경우 이 경로를 직접 통제하기 어렵습니다.
이제 한국 기업들에게 필요한 것은 ‘소버린 AI’.
클라우드, AI 모델, 데이터 등 다방면의 노력이 있어야 비로소 소버린 AI가 완성되는데요.
👉 데이터 인프라 전문가로서, 페블러스는 데이터에 초점을 맞추어서 설명을 드리겠습니다. |
|
|
한국이 소버린 AI로 자리잡기 위한 데이터 전략 2가지 |
|
|
1. 한국 환경에 알맞은 데이터를 생성해야 합니다.
페블러스의 고객 사례 중, 소버린 데이터가 중요했던 사례를 소개해드리려 합니다.
농촌에서 고라니와 같은 야생동물 탐지 AI를 개발하기 위해, 그에 관한 데이터가 필요했습니다.
합성데이터를 생성할 때, 해외 기반의 생성형 AI를 사용한다면?
- 전 세계 고라니의 90%가 한국에 서식하기 때문에, 해외 AI의 학습 데이터에 고라니가 거의 없습니다.
- AI에게 고라니 이미지 생성을 요청해도, 사슴 이미지가 생성되는 것이죠!
그렇다면 국내에서 촬영한 고라니 사진을 모은다면?
- 농촌 야생동물 탐지 AI를 개발할 때는 그마저도 충분하지 않습니다.
- 한국만의 도로, 농촌 환경, 계절별 변화, 야간 조명 조건, 가드레일 같은 시설물까지 학습해야 해요.
- 그래야 실제 한국 농촌에서 제대로 작동하는 AI가 개발됩니다.
페블러스 데이터클리닉에서는 결국 위 조건을 모두 반영한 이미지 합성데이터를 생성했습니다!
|
|
|
여기서 고라니는 하나의 작은 사례일 뿐입니다.
- 국방 장비 운용 환경
- 한국의 도로 인프라
- 국내 제조 공정
- 한국 고유의 법률·행정 체계까지...
해외 데이터로는 절대 채울 수 없는 영역이 무수히 많습니다.
👉 오직 한국 환경에 알맞은 소버린 데이터여야 한국만의 소버린 AI를 개발할 수 있어요. |
|
|
2. 데이터 파이프라인까지 독자적이어야 합니다.
데이터는 살아있고, 지속적으로 변화합니다.
👉 즉 한두 번 개선해서 끝나는 게 아니라, 지속적으로 관리할 데이터 인프라가 필요해요!
그런데 한 가지 중요한 질문이 있습니다.
데이터 인프라 자체가 법적으로 보호받지 못한다면 어떨까요?
🔸 경쟁사가 동일한 방식을 그대로 따라 하여 데이터를 생성할 수 있습니다. 🔸 심지어 인프라 자체를 특허로 먼저 선점해버릴 수도 있습니다.
그 결과, 이런 현상이 나타납니다.
🔸 힘들게 개선한 데이터의 차별성이 사라집니다.
🔸 결국 AI 성능에서도 격차를 만들기 어려워집니다.
👉 결론적으로, 보호받지 못한 데이터 개선 기술은 ‘지속적인 경쟁력’을 만들지 못합니다.
그래서 페블러스는 데이터가 움직이는 모든 경로를 특허로 보호했습니다.
데이터클리닉은 세 단계로 작동합니다.
각 단계마다 특허의 내용을 일부 확인해볼까요?
1) 데이터 품질 진단
- 임베딩 벡터 공간에서 특정 조건을 만족하는 벡터를 자동으로 식별 및 캡쳐하여 스냅샷 정보를 생성해요.
- ISO/IEC 5259 국제 표준에 부합하는 유사성, 대표성, 다양성 등의 지표를 정량적으로 산출합니다.
- 해당 지표에 따라 시각화 인터페이스를 제공하여, 중복·편향·희소 영역을 시각적으로 진단하기 편리해집니다.
2) 데이터 품질 개선
- 사용자 쿼리 기반으로 데이터 탐색과 합성데이터 생성을 동시에 수행하여, 목적에 맞는 데이터만 효율적으로 생성해요.
- 생성된 합성데이터에 대해 품질을 세밀하게 평가하고, 속성을 조정하는 인터페이스를 제공해요.
3) 데이터 이력 추적 및 거버넌스
- 데이터 거래 이력과 기여도를 블록체인에 기록해요.
- GDPR·EU AI Act·한국 AI 기본법 등 각종 규제가 요구하는 데이터의 이력을 투명하게 증명해요.
실제 특허 정보, 소버린 AI에 대해 더 자세한 내용을 알고 싶다면? |
|
|
페블러스의 독자적인 기술과 특허 기반 파이프라인,
여러분의 AI가 소버린 AI로 나아갈 수 있도록 데이터의 품질부터 주권까지 완성해드립니다.
더이상 데이터 고민은 하지 마세요. AI 개발에 편히 집중하세요.
협업 및 파트너십을 논의하고 싶다면 아래 3단계를 확인해주세요.
1️⃣ 데이터클리닉 홈페이지에서 '문의하기' 버튼을 눌러주세요.
2️⃣ 데이터에 관한 고민을 말씀해주세요.
3️⃣ 영업일 기준 2~3일 내로 페블러스 내부의 데이터 과학자님이 직접 상담을 도와드리겠습니다.
|
|
|
본 내용은 페블러스의 기획 하에 AI를 보조적으로 활용하여 작성되었으며, 페블러스의 엄밀한 감수를 거쳐 출간되었습니다. |
|
|
🚀 AI 기반 데이터 혁신, 지금 페블러스와 함께 하세요! |
|
|
페블러스는 AI와 데이터 분석을 통해 다양한 산업의 문제를 해결하고,
더 나은 의사결정을 지원합니다.
📌 페블러스에 대해 더 알고 싶거나, 협업 및 파트너십을 논의하고 싶다면
언제든지 연락 주세요!
페블러스 드림 |
|
|
|