
“인공지능(AI) 경쟁력을 갖추려면 세 가지가 필요합니다. 쓸 만한 데이터가 있어야 하고, 품질이 좋아야 하고, 무엇보다 제대로 활용할 수 있어야 합니다. 국가데이터처는 앞으로 데이터의 '활용'에 초점을 맞춰야 합니다.”
안형준 국가데이터처장은 인공지능(AI) 시대 국가데이터처의 역할을 '대한민국 데이터 최고책임자(CDO)'로 규정했다. 과거 국가통계를 생산·공표하는 데 그쳤다면 이제는 정부와 민간에 흩어진 데이터를 연결하고 AI가 활용할 수 있는 '지식 자산'으로 바꿔야 한다는 것이다.
핵심은 '모두의 AI를 위한 데이터 지능 기반(MODI)' 구축이다. 안 처장은 MODI를 'AI를 위한 데이터베이스(DB) 관리 표준 체계'로 정의했다. 데이터를 단순히 모으는 것이 아니라 카탈로그화·지식화하고 품질을 관리해 AI가 정확하게 활용할 수 있도록 만드는 것이 목표다.
안 처장은 “우리나라에는 범용 AI를 뒷받침할 데이터를 제대로 축적·관리하는 곳이 사실상 없다”며 “우리만의 데이터를 AI가 쓸 수 있는 형태로 구축해야 한다”고 강조했다. MODI를 시작으로 각 부처의 데이터를 연결해 '국가 DB'로 확장한다는 구상이다.
과제는 부처 간 데이터 칸막이를 허무는 것이다. 국가데이터처는 범정부 데이터 총괄·조정 역할을 맡고 있지만 이를 뒷받침할 법적 권한은 부족하다. 안 처장은 국가데이터기본법 제정을 통해 데이터 연계·활용의 제도적 기반을 마련하고 주거·금융, 복지, 안전 등 국민 체감 분야부터 활용을 확대하겠다고 밝혔다.
대담=조정형 정치정책부장
-AI 시대에 국가데이터처가 맡아야 할 역할은 무엇이라고 보나.
▲AI가 성공하려면 결국 데이터가 중요하다. 단순히 데이터가 많다고 되는 것은 아니다. 필요한 데이터를 제대로 확보하고 정확하게 관리하는 것이 중요하다.
사람들이 MODI를 국가데이터처가 만드는 'AI 표준 체계'라고 오해하기도 한다. 정확히 말하면 AI 표준 체계가 아니라 'AI를 위한 DB 관리 표준 체계'다.
데이터를 단순히 한곳에 모으겠다는 것이 아니다. 데이터 카탈로그를 만들고 하나하나를 지식화해야 한다. 중복이 없어야 하고 정확한 데이터가 들어와야 하며 실제로 제대로 활용되는지도 관리해야 한다.
그런 원칙 아래 활용성이 높은 DB를 만들고 각 부처로 확산한 뒤 서로 연결하면 궁극적으로 국가 전체의 DB가 될 수 있다고 생각한다.
-기존 공공데이터포털이나 국가공유데이터플랫폼과 MODI는 어떻게 다른가.
▲기존 플랫폼이 데이터의 개방과 공유를 지원했다면 MODI는 각 부처 업무 과정에서 쌓인 데이터까지 포함해 AI가 이해하고 활용할 수 있는 '지식'으로 만드는 데 초점을 둔다.
모든 원 데이터를 한곳으로 가져오는 방식도 아니다. 데이터는 해당 데이터를 가장 잘 아는 각 부처가 직접 관리하면서 정확성과 최신성을 유지한다. 필요할 때 권한과 보안 수준에 맞춰 안전하게 연결해 활용하는 방식이다.
-AI가 국가통계를 제대로 읽지 못하는 문제도 있다.
▲기존에는 AI가 국가통계포털(KOSIS)에 제대로 접근하기 어려웠다. 생성형 AI는 기본적으로 언어모델이다. 텍스트를 다루는 데 강하지만 숫자나 통계는 정확하게 읽지 못하는 경우가 있다. 통계를 물어보면 틀린 답을 하거나 직접 데이터처에서 찾아보라는 식의 답변을 하기도 했다.
지난 7월부터는 모델컨텍스트프로토콜(MCP)을 적용해 AI가 통계를 보다 쉽고 정확하게 찾도록 했다. 앞으로 메타데이터 체계도 구축한다.
메타데이터보다 한 단계 더 나아가면 온톨로지가 있다. 데이터와 데이터 사이의 관계를 일종의 '지도'처럼 만들어주는 것이다. AI가 그 논리적 관계를 따라가며 데이터를 읽으면 보다 정확한 답을 찾을 수 있고 환각도 줄일 수 있다.

-데이터처가 되면서 국민이 체감할 수 있는 가장 큰 변화는 무엇인가.
▲과거 통계청의 주된 역할은 통계를 조사하거나 행정자료를 활용해 통계를 만들고 이를 공표·서비스하는 것이었다.
AI 시대에는 다양한 텍스트까지 모두 데이터가 된다. 통계 역시 수많은 데이터 가운데 하나다. 그래서 업무 범위가 훨씬 넓어진다. 통계뿐 아니라 다양한 데이터를 AI가 제대로 활용하도록 만드는 것이 중요해졌다.
또 데이터는 많아 보이지만 정작 중요한 데이터는 각 기관 안에 숨어 있다. 개인정보 문제도 있고 각 기관이 데이터를 자신의 자산이라고 생각해 내놓지 않는 경우도 있다. 이런 데이터를 안전하게 연계해 새로운 의미를 찾아내는 것이 앞으로 데이터처가 해야 할 일이다.
-실제로 데이터를 연결해 새로운 가치를 만든 사례가 있나.
▲연금통계가 대표적이다. 11개 연금 데이터를 연결하니 전체 연금 구조를 볼 수 있게 됐다. 누가 연금을 받고 얼마나 받는지 등을 종합적으로 분석할 수 있다.
생활인구도 마찬가지다. 인구감소지역의 경우 우리가 가진 등록부에 카드 데이터와 통신 데이터를 연결해 실제 생활인구를 파악한다. 국가데이터처 데이터에 민간 데이터와 다른 부처 데이터를 연결하면서 기존에는 보이지 않았던 새로운 의미를 찾아내는 것이다.
-국가데이터처로 승격 이후, 아쉬운 부분은 무엇인가.
▲지난해 10월 국가데이터처로 승격되면서 직제상 데이터 총괄·조정 기능은 부여받았다. 하지만 직제만 가지고 일을 할 수는 없다. 실제로 총괄·조정하려면 법적인 근거가 있어야 한다.
그래서 국가데이터기본법 제정을 추진하고 있다. 지난 5월 국회에 제출됐고 상임위에도 상정됐다. 부처 간 데이터를 총괄·조정하려면 거버넌스가 필요하다. 국가데이터위원회를 만들어 이를 통해 조정하려고 한다.
또 중요한 것이 데이터 품질과 활용이다. 데이터를 제대로 활용하려면 서로 연계해야 하는데 개별 법률 때문에 막혀 있는 부분이 많다. 국가데이터기본법을 통해 데이터를 보다 쉽게 연계하고 활용할 수 있는 법적 기반을 마련하려 한다.
-각자 데이터 공유를 꺼려하는 문제도 있다고 본다.
▲맞다. 2015년 빅데이터가 부상할 때부터 데이터 간 연계를 준비했다. 그때부터 등록부를 만들고 부처 협조를 받아 데이터를 연계했는데 국세청 데이터를 연결하는 것도 굉장히 어려웠다. 결국 국세청 자료를 활용하게 됐고 복지부의 협조도 받게 되면서 연금통계를 만들었다. 시간이 지나면서 하나씩 진전돼 왔다.
국가데이터기본법은 이 속도를 높이기 위한 것이다. 국가 차원에서 활용 가치가 높고 연계가 필요한 데이터를 국가데이터위원회를 통해 '국가데이터'로 지정하고 해당 데이터는 특례를 통해 보다 쉽게 연계할 수 있도록 하려 한다.
-국가데이터기본법이 통과되면 국가데이터위원회의 위상도 상당히 커질 것 같다.
▲각 부처가 가진 데이터를 서로 연계해야 한다는 필요성을 조정하고, 이를 위해 특례를 적용할 수 있는 권한도 필요하다. 실제 일을 해나가면서 위원회의 위상도 커질 것으로 기대한다.
법이 만들어지면 국가 차원에서 활용 가치가 높은 데이터를 지정하고 품질을 관리할 수 있다. 국가데이터 이용센터를 통해 보안이 보장된 환경에서 데이터를 분석·활용하는 기반도 만들 수 있다.
-법 통과 이후 가장 해보고 싶은 데이터 결합은 무엇인가.
▲의료 데이터를 많이 연계해 활용해보고 싶다. 의료 데이터와 우리가 가진 등록부, 경제·사회 통계를 연계하면 세계적으로도 의미 있는 결과가 나올 수 있다고 생각한다.
다만 데이터 보유기관이 적극적으로 데이터를 내놓을 유인이 크지 않다는 게 현실적인 문제다. 지난 10년간 데이터 연계 업무를 하면서 느낀 점이다. 데이터가 중요하다는 사실은 모두 알지만 실제 활용은 아직 가보지 않은 길이다.
-국민이나 기업은 국가데이터처를 어떻게 활용하면 좋을까.
▲자신이 가진 데이터를 국가데이터처의 데이터와 연결해 활용했으면 한다. 생활인구를 만들 때도 연구기관이 자신들의 데이터를 가져와 연계하고 통신사 역시 자체 데이터를 가져와 활용한다.
실제로 데이터를 쓰다 보면 '품질을 더 높여달라'거나 '이런 데이터가 추가로 필요하다'는 요구도 생긴다. 이런 피드백을 적극적으로 줬으면 한다. 데이터는 결국 활용해야 가치가 생긴다.
-해외에서 국가데이터처가 벤치마킹할 만한 모델이 있나.
▲찾아봤지만 마땅한 사례가 없다. 미국은 AI와 데이터 분야에서 정부보다 빅테크가 주도한다. 일본에는 디지털청이 있지만 우리가 하려는 역할과는 다르다. 리투아니아는 통계기관이 국가데이터기관 역할을 한다는 점에서 우리와 일부 유사하다.
결국 우리가 모델을 만들어야 한다. 통계는 데이터의 핵심이고 우리는 오랫동안 통계를 다뤄오면서 데이터에 대한 전문성을 쌓았다.
AI와 데이터 경쟁력을 갖추려면 세 가지가 필요하다고 생각한다. 첫째 쓸 만한 데이터, 둘째 좋은 품질, 셋째 제대로 된 활용이다. 국가데이터처는 특히 '활용'에 초점을 맞춰야 한다. 활용하다 보면 어떤 데이터의 품질을 높여야 하는지도 자연스럽게 알 수 있다.
-궁극적으로 어떤 국가 데이터 기반을 만들고 싶은가.
▲AI가 중요하다고 이야기하지만 정작 데이터에 대해서는 잘 모르는 사람이 많다. 우리가 쓰는 챗GPT나 제미나이도 결국 미국 빅테크의 AI다. 우리나라에는 범용 AI를 뒷받침할 데이터를 체계적으로 구축하고 관리하는 곳이 부족하다.
앞으로는 범용 AI뿐 아니라 기관별로 특화된 버티컬 AI가 많아질 것이기 때문에 데이터 관리 기술이 더욱 중요해질 것이다. MODI가 그 역할을 하려는 것이다.
구글은 빅데이터 시대부터 엄청난 양의 데이터를 축적했다. 반면 우리는 출발이 늦은 만큼 오히려 중복을 줄이고 잘 관리된 데이터로 효율적인 DB를 만들 수 있다고 생각한다.
각 기관으로 확산하는 데 약 3년 정도를 생각하고 있지만 3년도 너무 늦을 수 있다. 내년 말이면 큰 틀은 만들어져야 한다. MODI라는 하나의 제대로 된 기준을 만들어 놓으면 이후 분야별 확산은 훨씬 빨라질 것이다.

○안형준 국가데이터처장은…
고려대 경제학과를 졸업하고 행정고시 40회로 공직에 입문해 통계청 경제통계국장, 통계데이터허브국장, 통계정책국장, 통계청 차장 등 주요 보직을 거치며 경제통계와 데이터 정책 분야에서 전문성을 쌓았다. 2025년 통계청장에 취임했으며, 2025년 10월 통계청이 국가데이터처로 승격·출범하면서 초대 국가데이터처장을 맡았다. 국가 통계·데이터 정책을 총괄하며 범정부 데이터 연계·활용과 인공지능(AI) 친화적 데이터 기반 구축을 추진하고 있다.
손지혜 기자 jh@etnews.com











