전체기사 최신뉴스 GAM
KYD 디데이
전국 대전·세종·충남

속보

더보기

"AI 수천억짜리 장난감 안 되려면 데이터 품질 챙겨야"

기사입력 :

최종수정 :

※ 본문 글자 크기 조정

  • 더 작게
  • 작게
  • 보통
  • 크게
  • 더 크게

※ 번역할 언어 선택

박지환 씽크포비엘 대표 "비전문가 목소리 커…현실적 대안 필요"
호랑이 큰 고양이 인식하는 실수 예방 위해 '데이터 밸런스' 중요

[서울=뉴스핌] 김수진 기자 = 인공지능(AI) 시장이 매년 큰 폭으로 성장하고 있다. 정보통신산업진흥원에 따르면 AI 시장규모는 2022년 1132억 달러에 이르고 관련 시장도 3조 9230억 달러에 달할 것으로 내다봤다.

동시에 AI를 학습하는 데이터 산업도 크게 성장할 것으로 보인다. 실제로 올해 AI 학습용 데이터 활용건수는 전년도 대비 6250배 성장한 것으로 나타났다.

관련 사업에 신청한 기업 수도 전년도 2075건에서 올해 6164건으로 3배 가까이 증가했다.

정부는 관련 예산을 올해보다 15% 증가한 1230억원을 투입하고 지원 분야도 늘릴 계획이다. 1000억원 이상의 정부 지원금이 들어가는 '뉴딜' 정책이다.

하지만 일각에서는 데이터 양을 늘리는 데에만 집중하지 말고 품질도 높여야 한다는 목소리가 커지고 있다.

산업현장에서 쓸 수 있는 AI를 실현하기 위해서는 질 높은 데이터를 잘 구축해야 하기 때문이다.

AI 학습용 데이터 품질에 대한 기준은 아직 전무한 상황이다. 많은 전문가들은 데이터 댐 사업이 활발한 지금이 데이터 품질 확보의 적기라고 보고 있다.

다음은 인공지능 기반 소프트웨어 공학 기업인 (주)씽크포비엘 박지환 대표와의 일문일답.

[서울=뉴스핌] 김수진 기자 = 박지환 씽크포비엘 대표가 정부 데이터댐 사업이 성공하기 위해 데이터 품질 확보에 나서야 한다고 밝혔다. 사진은 지난 23일 씽크포비엘 사무실에서 본지와 인터뷰 중인 모습. 2020.12.31 nn0416@newspim.com

-'데이터는 양'이라는 인식이 여전한데.

▲ 올해 사업 발표 후 강남 판교 일대 관련 회사들 중 여기에 발 한번 담가보지 않은 곳이 없을 정도로 엄청난 수가 데이터댐 사업에 뛰어들었다.

정부 재원 수천억 원이 풀리니 당연한 결과다. 하지만 프로젝트 대부분이 데이터 구축, 즉 양 불리기에 급급했던 것 같다.

하지만 생각해보라. 더하기 문제만 수만 개를 풀었다고 해서 우리가 그 사람을 수학을 잘한다고 하지 않듯 AI 학습용 데이터도 다양성을 확보해야 하는 것이 당연하다.

하지만 아직도 시장에서 데이터는 '양'으로만 그 가치를 평가한다. 그 인식 그대로 정부 사업에 반영된 것이다.

품질 논의도 이러한 배경에서 나온 것이 아닐까 싶다. 내년부터 중장기 사업도 진행되는 만큼 늦었지만 이제라도 품질 논의를 해야 할 시점이다.

중요한 것은 요구되는 데이터 품질이 무엇이냐는 거다. 데이터의 오타 유무를 의미하는 것인지, 양을 의미하는지, 다양성 수준을 의미하는지, 포맷의 일관성이나 정확성을 의미하는 지 등을 아주 명확히 해야 한다.

그것을 전제로 현장에서 필요한 신뢰성을 갖춰야 하는데 이를 위해 데이터의 '다양성' 수준이 매우 중요하다. 다양성은 AI가 현장에서의 상황을 이해하고 해석할 능력을 키워주기 때문이다.

데이터 댐의 궁극적 목적은 바로 이것을 확보하는 일이다. 결국 '현장에서 써먹을 수 있는 지능이 나오느냐, 아니면 실험실에서 구경할 장난감을 만드느냐'의 차이다.

이러한 다양성 수준을 평가하는 공인 기준이 없다는 것이 큰 문제다. AI 분야는 기술이나 제도가 성숙돼 있지 못한 상황이다. 미국 등 선진국도 마찬가지다. 따라서 지금이 데이터 다양성에 대한 품질을 확인하는 기준이 필요한 시점이다.

데이터를 바라보는 산업에서의 혼란은 적용 기준이 없기 때문이라고 생각한다. 또한 기준이 사용될 수 있는 실용적인 측정 기술이 부재하다. 이를 시급히 해결하지 못한다면 정부 기대치보다 낮은 결과가 나올 가능성도 있다.

얼마 전 '아마존' 구직자 평가 AI가 성차별하는 모습을 보여 폐기되지 않았나. 업계에 만연한 성차별 편견이 반영된 기존 데이터를 학습했기 때문이다. 이렇듯 AI 신뢰성은 이제 먼 미래 일이 아니라 당장 내가 겪을 수 있는 현실이 됐다.

헬스케어나 에너지 산업 적용 AI의 신뢰성은 생명과 관계되는 만큼 검증 시스템, 즉 가이드라인 확보는 필수다. AI 기술에 맞는 윤리기준을 다방면으로 생각해 만들어야 한다.

현장에서 바라는 정부 정책은.

▲ 다행히 지난 가을 정부가 조만간 관련 대안을 만들겠다고 발표했는데 현장 목소리에 부디 귀기울여주길 바란다. 지식은 없는데 힘을 가진 비전문가들이 정책에 관여해 현실성 떨어지는 대안을 만드는 일이 앞으로는 없었으면 한다.

데이터 댐 사업은 상당히 전문적인 분야고 일반인이 이해하기 쉽지 않다. 따라서 정책 결정 시 비전문가의 영역과 전문가 영역을 명확히 나눠야 한다고 생각한다. 

감리 부문의 현실화 등 현장의 애로도 반영해줬으면 한다. 일례로 감리로 온 분이 데이터와 빅데이터의 차이도 이해 못하거나 보고서를 회사 측에 대신 써달라고 했었다고 전해 들었다. 이런데 어찌 데이터 댐 사업이 좋은 결과를 얻겠는가. 정부는 이러한 업계 목소리를 열심히 들어야 한다.

데이터 댐 사업의 일자리 창출 효과에 대한 논의도 놓쳐선 안 된다고 생각한다. 당초 사회적 약자를 위해 만들어진 정책인 만큼 그들이 앞으로도 꾸준히 일을 하면서 능률과 경쟁력을 갖출 수 있도록 보완해야 한다.

현재 데이터 구축 사업은 단순반복에 그쳐 저임금근로자로 남을 수밖에 없는 구조다. 우리 회사에서는 단순반복 작업자가 아닌 '데이터 밸런서'로써 고효율적인 업무 능력을 갖출 수 있도록 교육하고 있다.

-데이터 밸런스를 강조하는데.

▲ 예를 들어 이미지 데이터 중 고양이 화상만을 뽑아내는 AI를 개발한다고 하자. 이때 AI는 이미지 데이터의 색조, 명암, 선명도 등 자체 특성뿐만 아니라 해상도, 촬영 시간대, 주변 환경 등 외부 요소까지 고려해 파악해야 한다.

여기에 더해 표범이나 자칼 등 고양이와 혼동할 수 있는 동물 데이터도 AI를 훈련시켜야 현장에서 호랑이를 큰 고양이로 인식하는 실수를 막는다. 이렇듯 AI가 실 산업현장에서 필요한 기능을 안정적으로 수행할 수 있도록 데이터를 설계하고 적용하는 기준 설정은 매우 중요하다. 그것이 '데이터 밸런스'라는 기술이다.

이 기술을 통해 데이터 댐에 모인 데이터가 실제로 특정 현장에서 유용한지 오작동 가능성은 없는지를 검증한다. 현재 한국정보통신기술협회(TTA)의 단체표준으로 지정돼 있다.

-앞으로 산업 전망은.

▲ AI의 경쟁력은 신뢰성이 생명이다. AI가 얼마나 똑똑한지 보다, 얼마나 안전하고 어디까지 믿을 수 있는지가 더 중요해질거다. 그러한 신뢰성을 갖추기 위해서는 AI 데이터를 평가하고 검증하는 기술을 갖춰야 한다고 생각한다.

아직 AI 성능이나 신뢰성을 평가하는 기술이 부재하고 그에 대한 기준도 사실상 거의 없다. 아직은 혼란한 상황이지만 또 다르게 말해 한국이 관련 시장을 선도할 수 있다는 의미기도 하다.

우리 회사의 데이터밸런스 뿐만 아니라 국내 다른 기업들이 더 많은 다양한 방법을 시도하며 선의의 경쟁을 펼친다면 관련 시장도 더욱 발전하지 않을까 싶다. 공공의 영역에서도 이에 많은 관심과 지원이 있기를 바란다.

nn0416@newspim.com

[뉴스핌 베스트 기사]

사진
연말 공항은 설렘으로 가득하다 [서울=뉴스핌] 신수용 기자 = #. 스타트업 입사 4년 차인 30대 직장인 A씨는 연말에 아껴둔 휴가를 소진하기로 결심했다. 그동안 여러 프로젝트로 쓰지 못한 연차를 모두 사용하기로 했다. 회사에서도 연차 소진 권고가 내려지면서 징검다리 연휴를 눈치 보지 않고 사용할 수 있는 분위기가 조성됐다. 이에 A씨는 크리스마스 이브인 23일, 24일과 26일 연차를 내고 22일 저녁 일본에 도착해 여정을 시작하는 6박 7일 여행을 다녀오기로 마음먹었다. [서울=뉴스핌] 신수용 기자 = 24일 비행기 출발을 기다리는 이들로 설렘이 가득차 있던 김포공항에는 크리스마스 이브를 맞이해 화요일인 26일 징검다리 연휴에 연차를 낸 이들과, 고국으로 돌아가는 외국인 관광객 등이 공항에 자리했다. 2025.12.24 aaa22@newspim.com 24일 크리스마스를 앞둔 김포공항은 여행객으로 북적였다. 크리스마스 다음날인 26일 금요일 하루를 연차로 내면 최소 3박 4일의 휴가를 즐길 수 있어서다. 내년 1월 1일 신정까지 연차를 내면 최장 11일을 휴가로 사용할 수 있다. 커다란 캐리어를 양손에 쥐고 있는 하루토(가명·23) 씨는 이날 고국인 일본으로 돌아간다. 그는 "한국 여행을 마치고 가족들과 크리스마스와 연말을 함께 보내기 위해 고국인 일본에 가기로 했다"고 설명했다. 이날 출국장에는 외국인들이 화장품 등 다양한 선물을 가득 담은 박스와 커다란 캐리어를 밀며 분주히 오갔다. 출국장에 위치한 체크인 줄에는 커다란 기내용 캐리어를 쥔 사람들로 줄들이 가로세로 빽빽히 차 있었다. 이른 아침 시간에 출발하느라 챙기지 못한 끼니를 벤치에 앉아 간단히 빵과 커피로 때우는 이들도 간간히 보였다. 안양에서 왔다는 30대 커플은 "4박 5일 일정으로 대만으로 갈 예정"이라며 "직장인이라 업무 때문에 더 휴가를 내지 못해 아쉽다. 뒤에 휴가를 더 붙였다면 유럽에 가고싶었다"고 아쉬워했다. 이어 "업무가 쌓여있어도 연차를 아예 날릴 수는 없고 (회사에서도) 소진하라는 분위기여서 다행이었다"라며 "대만에서 맛있는 음식을 많이 먹어보고 싶다"며 기대감을 감추지 못했다. [서울=뉴스핌] 신수용 기자 = 24일 김포공항 출국장 한 켠에 쌓여 있는 캐리어와 수화물들. 2025.12.24 aaa22@newspim.com 이날 공항에서 만난 40대 여성은 서울 서초구 양재에서 공항으로 왔다. 그는 "중국 상하이에서 근무하는 남편을 만나러 간다"며 "중국에서 2주 정도 같이 연말을 보낼 것"이라고 말했다. 해외에서 보내는 장기 휴가가 가능한 이유는 크리스마스인 25일, 내년 신정인 1월 1일이 각각 목요일이기 때문이다. 금요일인 26일(금요일), 29일부터 31일까지, 내년 1월 2일(금요일) 등 총 5일의 연차를 사용하면 최장 11일의 휴가를 즐길 수 있다. 가족끼리 휴가일을 맞춰 같이 해외 휴가를 가는 경우도 있었다. 장승훈(28·건국대 컴퓨터공학과) 씨는 "참여하고 있는 개발자 관련 프로그램에 양해를 구하고 나를 포함해 총 6명이 중국 상하이로 어머니 생일과 가족 기념일을 겸해 가족 여행을 간다"며 "아버지나 삼촌 등 다른 분들도 휴가를 낼 수 있었던 것 같은데 중국을 가본 적이 없어 기대가 된다"고 말했다. 이날 출국하는 여행객들의 목적지는 일본과 중국이 대부분이었다. 고환율과 엔저의 영향으로 여행 경비 부담이 비교적 덜한 일본이나 중국이 인기 관광지로 꼽혔다. 여행 전문 기업 노랑풍선에 따르면 올해 12월 25일부터 내년 1월 4일까지 노랑풍선을 통해 해외 패키지여행을 예약한 고객 수는 전년 동기간 대비 약 10% 증가한 것으로 나타났다. 특히 이중 일본이 30%로 가장 높았고, 중국(20%)이 그 뒤를 이었다. 베트남과 필리핀은 각각 16%, 7%를 차지했다. 노랑풍선 관계자는 "한한령 완화와 단체 비자 발급 확대, 주요 노선의 항공편 증편 등 여행 여건이 개선되면서 중국 여행객이 늘었다"며 "긴 연휴로 장거리 여행을 가는 이들이 생기며 유럽은 8% 수준을 늘었다"고 설명했다. aaa22@newspim.com 2025-12-24 14:41
사진
이마트판 다이소, '와우샵' 초저가 승부 [서울=뉴스핌] 조민교 기자 = 이마트가 5000원 이하 초저가 생활용품 편집숍 '와우샵(WOW SHOP)'을 앞세워 다시 한 번 초저가 시장 공략에 나섰다. 사실상 다이소가 독점해온 시장을 정조준한 행보다. 24일 업계에 따르면 이마트는 최근 이마트 매장 내 편집존 형태의 '와우샵'을 시범 운영 중이다. 지난 17일 왕십리점에 약 20평 규모로 도입한 데 이어 연말까지 은평점(19일), 자양점(24일), 수성점(31일) 등 총 4개 점포로 확대한다. 와우샵 은평점 전경. [사진=이마트 제공] 와우샵은 전 상품을 1000원·2000원·3000원·4000원·5000원 균일가로 판매하는 것이 핵심이다. 초저가 생활용품 1340여 개 중 64%를 2000원 이하, 86%를 3000원 이하로 구성해 가격 경쟁력을 전면에 내세웠다.  이마트는 앞서 2018년 '삐에로쇼핑'을 통해 유사한 초저가 실험에 나섰지만 2년 만에 사업을 철수한 바 있다. 삐에로쇼핑은 '오프프라이스+초저가'를 콘셉트로 1000원대 상품부터 브랜드 이월 상품까지 혼합 진열하고 미로형 동선과 자극적인 매장 연출로 주목받았다. 그러나 시간이 지날수록 매장 정체성이 불분명하다는 지적이 잇따랐다. 상시 저가 매장인지 할인 전문점인지 소비자 인식이 흐릿했고 대형마트와 분리된 독립 매장 구조로 집객과 회전율을 안정적으로 확보하지 못한 점이 한계로 작용했다. 업계에서는 와우샵이 삐에로쇼핑과는 다른 출발선에 서 있다는 평가가 나온다. 와우샵은 이마트 매장 내 편집존으로 운영돼 기존 고객 트래픽을 자연스럽게 흡수할 수 있고 전 상품을 1000원~5000원 균일가로 단순화해 가격 메시지도 명확하다. 무엇보다 이마트 해외 직소싱과 품질 관리 역량을 앞세워 '싼 가격이지만 믿을 수 있는 상품'이라는 인식을 강화하려는 전략이 눈에 띈다. 다이소 김포 장기점 매장 전경. [사진=다이소] 이 같은 평가의 배경에는 초저가 시장에서 이미 검증된 '성공 공식'이 존재한다는 점도 작용한다. 대표적인 사례가 다이소다. 다이소는 균일가, 생활필수품 중심, 언제 방문해도 저렴한 가격이라는 단순한 포지션을 수십 년간 흔들림 없이 유지해왔다. 복잡한 기획이나 과도한 연출 대신 소비자가 기대하는 가격과 품목을 정확히 충족시켰고 전국 단위 점포망을 통해 일상 동선 속 구매를 자연스럽게 만들었다.  와우샵의 성패를 가를 관건은 결국 '지속성'이다. 일회성 화제에 그치지 않고 상시 초저가에 대한 신뢰를 쌓을 수 있을지가 핵심이다. 업계에서는 이마트가 대형마트라는 기존 경쟁력 위에 초저가 포맷을 결합했다는 점에서 과거 삐에로쇼핑과는 구조적으로 다르다고 본다. 와우샵이 단기 실험을 넘어 이마트 매장의 고정 코너로 안착할 경우 초저가 시장의 판도에도 변화가 생길 수 있다는 분석이다. 한편 이마트는 올해 들어 와우샵 외에도 4950원 화장품 '글로우:업 바이 비욘드', 880원부터 4980원까지 가격을 고정한 '5K프라이스', 노브랜드 확대 등 초저가 실험을 잇달아 선보이고 있다. 이는 과거 정용진 신세계그룹 회장이 "소비자가 체감하지 못하는 10원, 100원 차이는 의미가 없으며, 상식 이하 가격으로 팔아야 한다"고 강조해온 가격 철학의 연장선으로 해석된다. 중간 가격대는 사라지고 '초저가와 프리미엄만 살아남는다'는 그의 판단이 최근 이마트의 전방위 초저가 전략으로 다시 구현되고 있다는 평가다. mkyo@newspim.com 2025-12-24 15:21
기사 번역
결과물 출력을 준비하고 있어요.
종목 추적기

S&P 500 기업 중 기사 내용이 영향을 줄 종목 추적

결과물 출력을 준비하고 있어요.

긍정 영향 종목

  • Lockheed Martin Corp. Industrials
    우크라이나 안보 지원 강화 기대감으로 방산 수요 증가 직접적. 미·러 긴장 완화 불확실성 속에서도 방위산업 매출 안정성 강화 예상됨.

부정 영향 종목

  • Caterpillar Inc. Industrials
    우크라이나 전쟁 장기화 시 건설 및 중장비 수요 불확실성 직접적. 글로벌 인프라 투자 지연으로 매출 성장 둔화 가능성 있음.
이 내용에 포함된 데이터와 의견은 뉴스핌 AI가 분석한 결과입니다. 정보 제공 목적으로만 작성되었으며, 특정 종목 매매를 권유하지 않습니다. 투자 판단 및 결과에 대한 책임은 투자자 본인에게 있습니다. 주식 투자는 원금 손실 가능성이 있으므로, 투자 전 충분한 조사와 전문가 상담을 권장합니다.
안다쇼핑
Top으로 이동