엔씨소프트, 한국어 특화 비전언어모델 및 멀티모달 벤치마크 5종 공개

엔씨소프트, 중소형 오픈소스 VLM 모델 공개…"동급 모델 중 한국어 최고 성능"
한국어 AI 언어모델 연구 및 발전을 위해 '한국어 멀티모달 벤치마크' 5종 제안
"VLM 멀티모달 적용 범위 확대, 콘텐츠 제작 지원 기능 강화 통해 성능 높일 것"

【 청년일보 】 엔씨소프트(이하 엔씨(NC))가 뛰어난 한국어 성능을 자랑하는 중소형 오픈소스 VLM(Vision Language Model) 모델 'VARCO-VISION'과 한국어 멀티모달 벤치마크 5종을 4일 공개했다.

VLM은 자연어와 이미지를 함께 활용해 입력 값을 넣을 수 있는 언어모델이다. 최근 모달리티 확장 연구에 관심이 높아지며 VLM이 주목을 받고 있다. 현재 오픈소스로 공개된 대부분의 VLM은 영어와 중국어 기반이며 한국어 지원 모델은 소수에 불과해 국내 기업들은 GPT 혹은 클로드(Claude) 같은 빅테크 기업의 API에 의존하고 있다.

엔씨(NC)가 공개한 오픈소스 VLM 모델 VARCO-VISION은 한글, 영어 프롬프트와 함께 이미지 입력 값을 이해할 수 있는 중소형 모델이다. LLM과 유사한 수준의 언어 능력을 보유하고 있어 애플리케이션에서 LLM과 VLM 두개의 모델을 운용하지 않고 VARCO-VISION 단일 모델 만으로 이미지-텍스트 작업과 텍스트 전용 작업을 모두 처리할 수 있을 전망이다.

특히 VARCO-VISION은 한국어 부문에서 동종 크기 모델 중 1위 성능을 보인다. ▲OCR ▲그라운딩 ▲레퍼링 등 이미지를 인식하고 추론하는 비전 태스크에서도 뛰어난 결과값을 제공한다. VARCO-VISION을 활용하면 AI 서비스 개발 기업은 ▲이미지 인식 및 질의응답 ▲이미지 설명 ▲글자인식(OCR) ▲사물 위치 검출(그라운딩) 기능을 활용한 각종 멀티모달 AI 서비스를 개발할 수 있다.

콘텐츠 제작 기업은 이미지 상세 설명을 자동 생성해 콘텐츠 제작 시간을 아끼거나, 이미지 내 텍스트 인식을 통해 보다 많은 자료를 빠르게 수집하는 등 기획 업무에 도움을 받을 수 있다. 멀티모달 AI모델은 엔씨(NC)가 개발 중인 '바르코 스튜디오(VARCO Studio)'에도 적용될 예정이다.

엔씨(NC)는 이날 한국어 AI 모델 연구 발전에 기여하기 위한 벤치마크 5종도 공개했다. 일반적으로 언어모델의 성능을 평가하기 위해서는 수행능력 판별의 기준점이 되는 벤치마크가 필요하다. 반면 한국어의 경우 멀티모달 벤치마크가 거의 없어 올바른 성능 평가가 어려운 상황이었다.

엔씨(NC)는 영미권에서 대표적으로 사용되고 있는 객관식 벤치마크 3종(MMBench, SEED-Bench, MMStar)과 주관식 벤치마크 1종(LLava-in-the-wild)을 기반으로 새로운 한국어 벤치마크 4종을 구축했다. 더불어 한국어 문서, 표, 차트에 대한 이해능력을 검증할 수 있는 'K-DTCBench' 벤치마크 1종을 새롭게 더했다.

이연수 NC Research 본부장은 "엔씨소프트가 VARCO-VISION과 한국어 벤치마크 5종 공개를 통해 멀티모달 AI 분야에서 선도적인 위치를 확보하고 있다는 점을 증명했다"며 "앞으로 VLM의 접목 분야를 오디오, 비디오까지 확대하고 콘텐츠 제작 지원 기능을 강화하는 등 다양한 산업에서 활용할 수 있도록 성능을 끌어 올릴 것"이라고 밝혔다.

【 청년일보=조성현 기자 】

[청년발언대] 실재하는 지능, 피지컬 AI(Physical AI)의 연착륙을 위한 시스템 설계 전략

【 청년일보 】 "모니터를 넘어 물리적 세계로 진입한 AI" 인공지능(AI)은 오랫동안 '화면 속 존재'였다. GPT 계열 언어 모델이 텍스트를 생성하고, 추천 알고리즘이 클릭률을 높이는 방식으로 AI는 디지털 레이어에 머물러 왔다. 이러한 스크린 AI는 한 가지 근본적 한계를 안고 있다. 결과에 책임지지 않는다는 점이다. 모델이 오작동해도 서버를 재부팅하면 그만이다. 그러나 AI가 모니터 밖으로 나오는 순간 규칙이 달라진다. 피지컬 AI(Physical AI)란 AI 알고리즘이 로봇, 센서, 액추에이터와 결합해 물리적 환경을 직접 인지하고 제어하는 시스템이다. 협동 로봇이 작업자 옆에서 부품을 조립하고, 자율주행 지게차가 물류 창고를 누비는 세계에서 AI의 오판단은 단순한 버그가 아니라 충돌과 부상으로 이어진다. 이 지점에서 산업공학의 역할이 부각된다. 뛰어난 AI 모델을 만드는 것은 컴퓨터 과학자의 영역이지만, 그 AI가 현실 세계에서 안정적으로 작동하도록 설계하는 것은 시스템 아키텍트(System Architect)로서의 산업공학적 사고를 요구한다. 이 글은 피지컬 AI의 연착륙을 위한 세 가지 핵심 설계 전략(신뢰성 공학, 실시간 공정 제어, 인간공학

[청년발언대] 최적화는 항상 정의로운가?

【 청년일보 】 우리는 '최적'이라는 단어를 들으면 본능적으로 그것이 옳다고 믿는다. 더 빠르고, 더 싸고, 더 효율적인 선택. 최적화는 언제나 합리적이며, 따라서 정의롭다고 여겨진다. 하지만 과연 그럴까? 최적화는 언제나 어떤 기준을 설정한 뒤 이루어진다. 비용을 최소화할 것인가, 시간을 단축할 것인가, 이윤을 극대화할 것인가. 문제는 그 기준이 이미 하나의 가치판단이라는 점이다. 예를 들어 기업이 생산 비용을 최소화하도록 시스템을 설계한다면, 그 결과는 인건비 절감, 자동화 확대, 혹은 인력 감축으로 이어질 수 있다. 숫자상으로는 '최적'일지 모르지만, 그 결정이 노동자에게도 정의로운 선택이라고 말할 수 있을까? 플랫폼 알고리즘 역시 마찬가지다. 사용자 체류 시간을 최대화하는 것이 목표라면, 자극적인 콘텐츠가 더 많이 노출되는 구조가 만들어진다. 이 또한 시스템 관점에서는 최적이지만, 사회 전체의 건강이라는 관점에서는 반드시 그렇다고 말하기 어렵다. 최적화는 답이 아니라 방향이다. 우리가 무엇을 최적화할 것인지 정하는 순간, 이미 우리는 하나의 가치를 선택하고 있는 셈이다. 효율을 최우선으로 둘 것인가, 공정성을 고려할 것인가, 안전과 인간의 존엄을 포함

[청년발언대] 웨이퍼 위의 건설 현장

【 청년일보 】 반도체는 완성된 부품을 조립해 만들기 보다는 바닥 위에 구조물을 올리는 시공에 가깝다. 기초를 다지고, 벽을 세우고, 배관과 전기 배선을 넣은 뒤, 검사와 마감까지 거쳐야 비로소 집이 되는 것처럼 실리콘 웨이퍼라는 바탕 위에서 회로는 한 번에 만들어지지 않는다. 현장에서 수십 번의 공정이 겹겹이 이어지며, 매 공정마다 정밀도가 유지되어야 칩이 완성된다. 공사는 먼저 바닥 상태부터 잡는다. 실리콘을 얇게 잘라 표면을 거울처럼 매끈하게 만든 판인 웨이퍼 위에 쌓이는 구조들은 이 바닥의 균일함에 큰 영향을 받는다. 하지만 나노미터 단위로 회로를 올리는 작업에서는 먼지 한 알이 현장의 자갈처럼 작지 않다. 그래서 반도체 제조는 깨끗함이 곧 품질인 공간에서 시작된다. 바탕이 준비되면, 이제는 벽과 길을 동시에 설계한다. 전기가 흐를 길을 만들기 위해서는, 전기가 새어 나오지 않도록 막아주는 절연층이 필요하다. 웨이퍼 위에 얇은 막을 형성하는 과정은 건설로 치면 방수층이나 단열재를 까는 일과 비슷하다고 볼 수 있다. 눈에 띄지 않지만, 나중에 성능을 좌우하는 필수 공정이다. 그 다음은 현장에서의 핵심인 도면을 바닥에 옮기는 작업이다. 반도체에서는 빛을

[청년발언대] AI 고도화 시대, 품질과 신뢰성의 가치

【 청년일보 】 AI 기술이 산업 전반에 빠르게 스며들고 있다. 특히 초정밀 공정과 자동화 시스템을 기반으로 하는 첨단 제조 산업은 그 변화의 중심에 있다. 미세한 오차와 공정 변동이 막대한 손실로 이어질 수 있는 환경에서, 품질과 신뢰성은 단순한 관리 지표가 아니라 산업 경쟁력을 좌우하는 핵심 요소이다. 과거 품질관리가 결함을 줄이고 수율(Yield)을 높이는 데 집중했다면, 오늘날은 데이터와 AI가 공정을 실시간으로 분석하고 이상을 탐지·예측하는 단계로 전환되고 있다. 여기서 'AI가 내린 판단을 우리는 얼마나 신뢰할 수 있는가'라는 주목해야 할 포인트가 생긴다. 이러한 점은 AI 고도화 시대 속 품질과 신뢰성의 가치를 다시 한 번 돌아보게 만든다. ◆ 수율과 공정 안정성, 전통적 품질관리의 본질 첨단 제조 산업에서 품질은 곧 수율과 직결된다. 생산 공정에서 얼마나 많은 양품을 안정적으로 확보할 수 있는지는 기업의 수익성과 직결되며, 이를 위해 통계적 공정관리(SPC)와 Six Sigma 기법이 폭넓게 활용되어 왔다. 공정 변동을 최소화하고, 불량의 원인을 정밀하게 분석하며, 동일한 조건을 반복적으로 재현하는 것이 전통적 품질관리의 핵심이었다. 신뢰성 또

[청년발언대] 정돈된 체계가 만드는 의료 정의, 혼란의 이원화를 넘어 안전으로

【 청년일보 】 의료의 4원칙 중 가장 오해 받는 개념은 정의이다. 도덕적 옳음이 아닌, '한정된 의료 자원을 효율적이고 공정하게 분배하자'라는 시스템의 문제를 다루고 있기 때문이다. 의료 체계의 도입은 보건의 향상을 이끌었다. 국민보건서비스 법(영국, 1946)을 제정하며 의료를 사회적 책임으로 규정했고, 플렉스너 리포트(미국, 1910)를 통해 의학 교육이 과학적 원리와 연구 프로토콜을 따르도록 개혁했다. 한국은 어떨까? 혁신적인 의료 보험 제도를 도입했으나, 모호한 이원화 체계는 자원의 효율적 운용, 즉 정의를 저해하는 요소가 되었다. 한국은 의료법 제2조에 따라 현대 의학과 한방을 별개의 영역으로 법제화하고 있다. 그러나 실제 현장에서는 그 경계가 모호하다. 한방은 국제 기준에서 보충·대체 의학으로 분류되며, '한약(생약)제제 등의 품목 허가·신고에 관한 규정' 제24조에 따르면, '동의보감'을 비롯한 한약서에 실린 품목이면 안전성, 유효성 심사가 제외된다. 현대 의학은 히포크라테스 선서를 하지만 4체액설을 적용하지 않는다. 과거의 지식을 의심하고 증명한다. 3상 임상시험 등 엄격한 근거 중심 의학을 기초로 한다. 현대 의학은 세계 어디에서나 환자의