JIINSI
논문 브리핑

AI, 추상 개념을 ‘불’처럼 구체적인 단서로 이해한다: ‘환유적 회로’ 발견

한경모글 · 한경모
인공지능 모델이 다양한 시각 이미지에서 추상적인 의미를 추론하는 과정을 도식화한 모습.
인공지능 모델이 다양한 시각 이미지에서 추상적인 의미를 추론하는 과정을 도식화한 모습.
인공지능(AI)이 사람처럼 ‘분노’나 ‘사랑’ 같은 추상적인 개념을 어떻게 이해하고 판단할 수 있을까요? 직접적인 시각적 단서가 없는 상황에서 AI가 추상적인 감정을 인식하는 방식은 늘 미스터리였습니다. 최근 한 연구팀이 이러한 의문에 답할 ‘환유적 회로(Metonymic Circuits)’라는 새로운 메커니즘을 제시해 AI 연구계의 이목을 집중시키고 있습니다. 이 연구는 AI, 특히 비전 트랜스포머(Vision Transformers)가 추상적인 개념을 이해하는 방식을 구체적인 '앵커 개념'을 통해 설명합니다. 이는 AI의 내부 작동 방식을 이해하고, 더 나아가 투명하고 신뢰할 수 있는 인공지능을 개발하는 데 중요한 전환점이 될 수 있습니다. 해당 연구는 비전 트랜스포머가 훈련 데이터에 추상 개념(예: 분노)에 대한 직접적인 시각적 증거가 제한적일 때, 어떻게 해당 개념을 인식하는지 탐구합니다. 연구팀은 AI가 추상적인 예측을 할 때, 시각적 신호를 추상적인 의미론적 연결고리로 이어주는 구체적이고 해석 가능한 '앵커 개념(concrete anchor concepts)'(예: 불)을 활용한다는 '환유적 접지(metonymic grounding)' 가설을 세웠습니다. 쉽게 말해, AI는 '분노'를 직접적으로 보지 못하더라도, '불'이나 '붉은색'과 같이 분노와 연관된 구체적인 시각적 단서를 통해 분노를 '느끼는' 것처럼 작동한다는 설명입니다. 이 가설을 검증하기 위해 연구팀은 CLIP과 DINO 비전 인코더(vision encoders)에 트랜스코더(Transcoders)라는 기법을 적용했습니다. 이를 통해 AI 모델 내부에서 중간 단계의 특징(intermediate features)들을 추출하고, 이 특징들이 어떤 구체적인 개념들과 연결되는지를 파악했습니다. 이렇게 추적된 '회로'가 실제로 추상 개념 예측에 어떻게 기여하는지를 분석한 결과, AI가 우리 생각보다 훨씬 더 복잡하고 흥미로운 방식으로 세상을 이해하고 있음을 밝혀냈습니다. 이는 AI의 '블랙박스' 같던 내부 작동 방식을 한 꺼풀 벗겨낸 중요한 진전으로 평가됩니다. 이 연구 결과는 인공지능의 해석 가능성(Explainable AI, XAI) 분야에 큰 영향을 미칠 것으로 보입니다. AI가 왜 특정 결정을 내렸는지 설명하기 어려웠던 기존의 한계를 극복하고, 더욱 신뢰할 수 있는 AI 시스템을 구축하는 데 기여할 수 있습니다. 예를 들어, 자율주행차가 보이지 않는 위험을 예측하거나 의료 AI가 복잡한 질병을 진단할 때, 단순히 결과만 제시하는 것이 아니라 어떤 구체적인 단서를 바탕으로 그런 판단을 내렸는지 설명할 수 있게 되는 것입니다. 물론, 아직 초기 단계의 연구이며, 모든 AI 모델에 적용되거나 사람의 추상적 사고와 완전히 동일하다고 볼 수는 없습니다. 하지만 AI가 추상적 개념을 이해하는 근원적인 메커니즘을 밝혔다는 점에서 큰 의미가 있습니다. 이 연구의 핵심 기여와 특징은 다음과 같이 정리할 수 있습니다.
  • 추상 개념 이해 메커니즘 제시: AI가 직접적인 시각적 증거 없이 '환유적 접지'를 통해 추상 개념을 이해한다는 가설을 제시했습니다.
  • '앵커 개념'의 역할 규명: '불'과 같은 구체적인 시각적 단서가 '분노' 같은 추상 개념을 연결하는 핵심적인 '앵커' 역할을 한다는 것을 밝혀냈습니다.
  • 내부 작동 방식 해석: 트랜스코더를 활용하여 비전 트랜스포머의 중간 특징을 분석, AI의 '추론 회로'를 가시화했습니다.
  • AI 투명성 증진: AI가 왜 특정 결론에 도달했는지 설명할 수 있는 해석 가능성(XAI) 연구에 새로운 길을 열었습니다.
업계 전문가들은 그동안 AI가 추상적인 개념을 이해하는 방식이 명확하지 않아 '환각(hallucination)'이나 예측 불가능한 오류를 일으키는 원인 중 하나로 지적해왔습니다. 이 연구는 AI의 '인지' 과정을 한 단계 더 깊이 이해하는 데 중요한 발판을 마련하며, 궁극적으로 더 안전하고 신뢰할 수 있는 인공지능 시스템 개발에 필수적인 지식이 될 것입니다. 앞으로 이러한 통찰이 실제 AI 모델 개발에 어떻게 적용되어 인공지능의 한계를 넘어설 수 있을지 기대됩니다.
인사이트

AI가 추상 개념을 이해하는 방식에 대한 근본적인 메커니즘을 밝혀내, AI의 내부 작동 투명성을 높이고 더욱 신뢰할 수 있는 인공지능 시스템 개발에 기여할 중대한 연구입니다.

자주 묻는 질문

AI가 '분노' 같은 추상적인 감정을 진짜로 이해할 수 있나요?
이 연구는 AI가 추상 개념을 '이해하는 것처럼 작동하는' 방식을 밝힌 것입니다. 사람처럼 자율적으로 감정을 느끼거나 의미를 부여하는 수준은 아니지만, 구체적인 시각적 단서(앵커 개념)를 통해 간접적으로 추상 개념과 연결시키는 메커니즘을 발견했습니다.
이 '환유적 회로' 연구가 왜 중요한가요?
AI의 의사결정 과정을 더 투명하게 만들고, AI의 '블랙박스' 문제를 해결하는 데 기여합니다. AI가 어떤 이유로 특정 판단을 내렸는지 설명할 수 있게 되어, 편향된 학습 데이터로 인한 오류를 줄이고 AI 시스템의 신뢰도를 높이는 데 도움이 됩니다.
이 기술을 모든 AI 모델에 적용할 수 있나요?
이 연구는 비전 트랜스포머(Vision Transformer) 기반 모델에 초점을 맞췄습니다. 하지만 '환유적 접지'와 유사한 메커니즘이 다른 종류의 AI 모델에서도 발견될 가능성이 있어, 향후 연구를 통해 확장 적용될 여지는 충분합니다.
공유XTelegram

이 기사 어땠어요?

피드백을 남겨주시면 더 나은 맞춤 추천을 만듭니다.

이런 뉴스를 매일 받아보세요

매일 아침 7시, 그날의 정리를 이메일과 Telegram으로 받아보세요.