
< 왼쪽부터 전기및전자공학부 최소영 석사과정, 황성현 박사과정, 황의종 교수(오른쪽위) >
보통 그림과 글자가 함께 있을 때 사람의 시선이 그림에 먼저 가는 것처럼, 여러 감각을 동시에 활용하는 ‘멀티모달 인공지능’도 특정 데이터에 더 크게 의존하는 경향이 있다. 우리 대학 연구진은 이러한 상황에서도 그림과 글자를 모두 고르게 인식하여 훨씬 더 정확한 예측을 가능케 하는 멀티모달 인공지능 학습 기술을 개발했다.
우리 대학은 전기및전자공학부 황의종 교수 연구팀이 다양한 데이터 유형을 한 번에 처리해야 하는 멀티모달 인공지능이 모든 데이터를 고르게 활용할 수 있도록 돕는 새로운 학습 데이터 증강 기술을 개발했다고 14일 밝혔다.
멀티모달 인공지능은 텍스트, 영상 등 여러 데이터를 동시에 활용해 판단하고 있다. 하지만 인공지능은 여러 정보를 받아들일 때, 한쪽 데이터에 치우쳐 판단하는 경향을 보여 예측 성능이 떨어지는 문제가 있었다.
연구팀은 이 문제를 해결하기 위해, 일부러 서로 어울리지 않는 데이터를 섞어서 학습에 사용했다. 그러면 인공지능은 어떤 경우에도 한쪽 데이터에만 의존하지 않고, 글과 그림, 소리 등 모든 데이터를 균형 있게 활용하는 방법을 배우게 된다.
또, 품질이 낮은 데이터는 보완하고, 어려운 데이터는 더 강조해서 훈련하는 방식까지 더해 다양한 상황에서도 안정적으로 성능을 높일 수 있음을 보여줬다. 이 방법은 특별한 모델 구조에 묶이지 않고, 어떤 종류의 데이터에도 쉽게 적용할 수 있어 확장성과 실용성이 크다는 점에서 의미가 있다.

< 데이터 중심 멀티모달 AI 학습 프레임워크 적용시 모델 예측 변화예시 >
황의종 교수는 “AI 성능을 높이려면 모델 구조(알고리즘)만 바꾸는 것보다, 어떤 데이터를 어떻게 학습에 쓰느냐가 훨씬 중요하다”며 “이번 연구는 멀티모달 인공지능이 특정 데이터(예: 영상, 텍스트)에 치우치지 않고 균형 있게 정보를 활용할 수 있도록 데이터 자체를 설계하고 가공하는 접근법이 효과적일 수 있음을 보여줬다”고 말했다.
이번 연구에는 전기및전자공학부 황성현 박사과정, 최소영 석사과정이 공동 제1저자로 참여했으며, 황의종 교수가 교신저자로 참여했다. 연구 결과는 오는 12월 미국 샌디에이고와 멕시코 멕시코시티에서 열리는 AI 분야 최고 권위 국제학술대회 NeurIPS(Conference on Neural Information Processing Systems)에서 발표될 예정이다.
※ 논문명: MIDAS: Misalignment-based Data Augmentation Strategy for Imbalanced Multimodal Learning, 논문 원본: https://arxiv.org/pdf/2509.25831
한편, 이번 연구는 정보통신기획평가원(IITP)의 지원을 받은 ‘강건하고 공정하며 확장 가능한 데이터 중심의 연속 학습’ 과제 (RS-2022-II220157)와 ‘뇌질환 진단 및 치료용 비침습 근적외선 기반 AI 기술’ 과제 (RS-2024-00444862)의 지원을 받아 수행됐다.
우리 대학은 KAIST와 국가AI연구거점이 공동으로 제프 딘(Jeff Dean) 디스커버리 루프(Discovery Loop) 공동 창업자 겸 CEO를 초청해 13일 서울 AI 허브에서 특별강연을 개최했다고 18일 밝혔다. 제프 딘은 1999년 구글 초기 멤버로 합류해 27년간 검색 인프라의 근간인 맵리듀스(MapReduce)와 빅테이블(Bigtable), AI 시대의 핵심 기반인 텐서플로우(TensorFlow)와 TPU 개발을 이끌었고, 구글 브레인을 공동 설립한 뒤 수석과학자로서 제미나이(Gemini) 개발을 총괄해 '구글의 전설'로 불리는 인물이다. 그는 최근 산제이 게마왓(Sanjay Ghemawat), 쿽 레(Quoc Le), 오리올 비냘스(Oriol Vinyals)와 함께 디스커버리 루프를 창업했다. 가설 수립부터 실험 실행과 결과 분석에 이르는 연구의 반복 과정을 AI로 자동화해, 과학·공학 발견의 속도 자체를 끌어올리겠다는 구상이다. 우리 대학은 이
2026-08-18우리 대학은 삼성중공업(대표이사 최성안)과 13일 대전 본원 학술문화관 존해너홀에서 ‘SHI-KAIST 차세대선박연구센터(AMRC, Advanced Maritime Research Center)’ 개소식을 개최했다고 밝혔다. 이번 연구센터 출범은 1995년부터 32년째 이어지고 있는 양 기관 산학협력의 결실이다. 우리 대학과 삼성중공업은 지난 30여 년간 축적한 공동연구 경험과 신뢰를 바탕으로 기존 산학협력 체계를 미래 조선해양 핵심기술 개발을 위한 공동연구 거점으로 확대한다. 양 기관은 연구센터를 중심으로 AI·로보틱스·친환경 기술 등 산업 현장의 수요와 연계한 미래 핵심기술을 공동 개발하고, 연구성과의 산업적 활용과 전문인재 양성을 함께 추진할 계획이다. 배충식 KAIST 총장은 “앞으로는 실제 산업 현장을 혁신하는 Physical AI가 제조 경쟁력을 좌우하는 시대가 될 것”이라며, “조선해
2026-08-13우리 대학은 오는 8월 18일(화) 오전 9시 30분부터 오후 6시까지 대전 본원 정근모콘퍼런스홀(E9)에서 ‘AI 시대 외로움 글로벌 컨퍼런스: AI 기반 외로움 측정 지표 AI-LOVI 출범(Global Conference on Loneliness in the Age of AI: Launching the AI Loneliness Vital Index)’을 개최한다고 12일 밝혔다. 이번 컨퍼런스에는 OECD와 WHO를 비롯해 영국·일본·태국·독일 등 국내외 정책·연구 전문가들이 참여해 AI 시대에 심화되는 외로움과 사회적 고립 문제를 과학적으로 측정하고 대응하기 위한 국제협력 방안을 논의한다. 우리 대학은 인공지능(AI), 음성·텍스트 분석, 바이오센싱, 웨어러블 기술 등 교내 연구 역량을 결집한 차세대 외로움 측정 체계 ‘AI 기반 외로움 측정 지표(AI-LOVI, AI Lon
2026-08-12선거철마다 반복되는 온라인 갈등 뒤에 조직적인 여론 개입이 숨어 있다면 어떨까. 우리 대학 연구진이 20년간 축적된 1억 1,000만 건의 뉴스 댓글을 AI로 분석해, 외국 연계 영향력 활동으로 의심되는 흔적과 그 판단 근거까지 찾아내는 기술을 개발했다. 우리 대학은 문화기술대학원 이원재 교수, 전산학부 차미영 교수(독일 막스플랑크 연구소 단장 겸임), 오혜연 교수 공동연구팀이 막스플랑크 연구소 토르스텐 홀츠 교수와 국제 공동연구를 통해 온라인 뉴스 댓글에서 외국 연계 영향력 활동으로 의심되는 패턴을 자동으로 탐지하고, 그 판단 근거까지 제시하는 ‘설명 가능한 AI 기술’을 개발했다고 12일 밝혔다. 특정 세력이 댓글이나 게시물을 조직적으로 확산해 사람들의 인식이나 여론에 영향을 미치려는 활동을 ‘온라인 영향력 공작’이라고 한다. 기존 AI 탐지 기술은 특정 계정을 의심 계정으로 분류하더라도 “왜 이 계정을 의심하는가&
2026-08-12AI 반도체도 이제‘눈치'를 본다. 기존 AI 반도체는 입력 신호에 반응하는 속도와 정보를 기억하는 시간이 한 번 정해지면 바꿀 수 없는‘고정된 반응 특성'을 가졌지만, 이제는 데이터의 변화 속도에 맞춰 스스로 반응하는 시대가 열렸다. 우리 대학 연구진은 이 기술로 시간에 따라 변하는 데이터의 예측 오류를 기존보다 최대 40배 줄였다. 자율주행차와 로봇, 웨어러블 기기의 실시간 AI 성능을 높일 핵심 원천기술로 기대된다. 우리 대학은 전기및전자공학부·반도체공학대학원 최신현 석좌교수 연구팀이 입력되는 데이터의 변화 속도에 따라 반응 특성을 자유롭게 바꿀 수 있는 새로운 AI 반도체 소자‘프로그래머블 동적 멤트랜지스터(Programmable Dynamic Memtransistor, PDM)'와 이를 집적한 어레이를 개발했다고 7일 밝혔다. 멤트랜지스터(Memtransistor)는 정보를 저장하는 메모리(Memory)와 계산을 수행하
2026-08-07