본문으로 건너뛰기
Linkbricks Horizon-AI
기술

SKYNET HYBRID MODAL AI

하이브리드 모달 AI란?

멀티모달 AI는 인간의 여러 감각을 모방해 서로 다른 유형의 데이터를 동시에 처리하고 이해하는 인공지능 기술입니다. 반면 크로스모달 AI는 텍스트, 이미지, 오디오처럼 서로 다른 데이터 모달리티 사이의 상호작용과 변환을 가능하게 하는 기술입니다. '멀티모달 AI + 크로스모달 AI = 하이브리드 모달 AI'는 두 기술의 강점을 결합해 한층 진화한 인공지능 시스템을 구상하는 개념입니다.

0808자세히 보기
01

멀티모달 AI(Multimodal AI)

멀티모달 AI는 인간의 다양한 감각(예: 시각, 청각, 촉각)을 모방하여 서로 다른 유형의 데이터를 동시에 처리하고 이해하는 인공지능 기술을 말합니다. 여기서 '모달(modal)'은 데이터의 형태나 유형을 의미하며, 멀티모달 AI는 텍스트, 이미지, 오디오, 비디오 등 여러 모달리티를 통합적으로 분석하여 종합적인 응답이나 분석 결과를 제공하는 능력을 갖추고 있습니다.

02

크로스모달 AI(Crossmodal AI)

크로스모달 AI는 텍스트, 이미지, 오디오 등 서로 다른 데이터 모달리티 간의 상호작용과 변환을 가능하게 하는 인공지능 기술을 말합니다. 멀티모달 AI와 유사하지만, 크로스모달 AI는 하나의 모달리티에서 다른 모달리티로 정보를 변환하거나 이들을 매끄럽게 연결하는 데 초점을 둡니다.

03

멀티모달 AI + 크로스모달 AI = 하이브리드 모달 AI

'멀티모달 AI + 크로스모달 AI = 하이브리드 모달 AI'는 두 기술의 강점을 결합하여 보다 진화한 인공지능 시스템을 구상하는 개념입니다.

04

통합적 이해 + 변환 가능성

여러 모달리티를 동시에 처리(멀티모달)하면서도 모달 간의 변환(크로스모달)을 유기적으로 수행합니다.

  • 예: 텍스트로 이미지를 생성하고, 생성된 이미지와 텍스트를 결합하여 새로운 맥락의 분석 결과를 도출.
05

다양한 상호작용

서로 다른 모달리티 간의 상호작용과 정보의 통합적 학습을 실현합니다.

  • 예: 이미지 캡션 생성 + 텍스트를 기반으로 추가 이미지 생성.
06

고급 응용

멀티모달의 데이터 융합 능력과 크로스모달의 변환 능력을 결합하여 복잡한 작업을 처리합니다.

  • 예: 의학 분야에서 의료 영상을 분석(이미지 모달), 해당 결과를 설명(텍스트 모달), 그리고 음성으로 의사에게 제공(음성 모달).
07

하이브리드 모달 AI의 잠재적 응용

  • 교육 — 학생 질문(텍스트)을 기반으로 학습 자료 생성(이미지/비디오) 후 음성으로 설명.
  • 의료 — 의료 데이터를 여러 모달로 분석하고 변환(예: X-ray → 설명 → 음성 리포트).
  • 엔터테인먼트 — 스토리(텍스트)를 기반으로 비디오(영상)와 음향 효과를 통합적으로 생성.
  • 자율주행 — 시각(카메라) + 음성(센서 데이터 경고) + 맥락적 결정을 실시간으로 통합 처리.
08

하이브리드 모달 AI의 강점: Linkbricks Horizon-AI Cross & Multi Modal AI Technology

  • 텍스트(Text) — 다양한 파라미터 규모의 텍스트 기반 크로스모달 LLM.
  • 음성(Voice) — 동기, 비동기 및 실시간 음성 LLM.
  • 이미지(Image) — text-to-image, image-to-text, image-to-image를 위한 저비용 LLM.
  • 음악(Music) — 음악 생성, music-to-music, text-to-music을 위한 빠르고 경제적인 LLM.
  • 비디오(Video) — 비디오 생성, text-to-video, video-to-text를 위한 저비용 LLM.
  • 피지컬(Physical) — LLM과 결합해 범용 로보틱스/Embodied AI/Physical AI를 위해 설계된 Genesis 및 Omniverse Physics 플랫폼.

기술 갤러리

2장