마지막 업데이트:
**지아후이 유(Jiahui Yu)**는 멀티모달 모델, 컴퓨터 비전, 생성형 AI 및 추론 모델 분야의 연구로 잘 알려진 인공지능 연구자이자 기업가입니다. 그는 이전에 Meta Superintelligence Labs 내에서 TBD Lab을 공동 설립했으며, OpenAI에서 인식(perception) 연구를 이끌었고, Google DeepMind에서 Google의 Gemini 프로젝트 멀티모달 부문을 공동 총괄했습니다. 2026년 8월, 유 박사는 새로운 회사를 설립하기 위해 Meta를 떠난다고 발표했습니다. [7] [8]
유 박사는 중국과학기술대학교(USTC)에서 컴퓨터 과학 학사 학위를 받았습니다. 이후 일리노이 대학교 어바나-샴페인(UIUC)에서 박사 학위를 마쳤으며, 그의 연구는 딥러닝, 컴퓨터 비전 및 효율적인 신경망에 집중되었습니다. [1]
유 박사는 2015년 5월부터 12월까지 마이크로소프트 아시아 연구소(Microsoft Research Asia)에서 인턴으로 연구 경력을 시작하여 대규모 딥러닝 훈련 시스템을 연구했습니다. 2016년 초에는 Megvii Research에 연구 인턴으로 합류하여 객체 탐지에 집중하고 UnitBox에 기여했습니다. 2016년 6월부터 2018년 5월 사이에는 Jump Trading에서 연구 컨설턴트로 근무하며 금융 데이터와 관련된 모델을 개발했습니다. [1] [6]
2017년 5월부터 12월까지는 Adobe Research에서 인턴십을 수행하며 생성적 적대 신경망(GAN)과 이미지 인페인팅(inpainting) 작업을 진행했습니다. 이 시기의 프로젝트로는 DeepFill과 이후의 이미지 완성 연구가 포함됩니다. 2018년 1월부터 8월까지는 Snap Research에서 Slimmable Networks를 포함한 효율적인 딥러닝 모델을 연구했습니다. 이후 바이두 리서치(Baidu Research), 엔비디아 리서치(Nvidia Research), 구글 브레인(Google Brain)에서 인턴으로 근무하며 AutoML, 효율적인 신경망, 생성 모델 등의 분야를 연구했습니다. [1] [6]
유 박사는 2020년 2월 연구 과학자로 Google에 합류했습니다. 그의 연구에는 자동 음성 인식, 멀티모달 표현 학습, 컴퓨터 비전 및 생성 모델이 포함되었습니다. 이후 그는 선임 연구 과학자가 되었으며 이어서 Google DeepMind에서 근무했습니다. [1] [6]
Google DeepMind에서 유 박사는 Google의 멀티모달 AI 모델 제품군인 Gemini의 멀티모달 기둥(pillar)을 공동 총괄했습니다. 그는 또한 멀티모달 이해 및 생성 연구를 수행했으며, 대규모 멀티모달 파운데이션 모델로의 Google 전환과 관련된 연구에 기여했습니다.
유 박사는 2023년에 Google DeepMind를 떠났습니다. [1]
2023년 10월, 유 박사는 OpenAI에 합류하여 인식(Perception) 팀을 이끌었습니다. 그의 연구는 AI 모델이 텍스트와 함께 이미지와 같은 정보를 처리하고 추론할 수 있도록 하는 멀티모달 기능에 집중되었습니다. [1] [6]
유 박사의 개인 웹사이트에 따르면, 그는 여러 OpenAI 모델 출시에 기여했습니다. 그는 GPT-4o의 데이터, 인코더, 사전 훈련(pre-training) 및 사후 훈련(post-training) 작업을 수행했으며, 이후 GPT-4o의 이미지 생성 기능에 대한 사전 훈련 데이터 기여자 및 사후 훈련 자문가로 활동했습니다. 유 박사는 OpenAI의 'Thinking with Images' 작업의 프로젝트 리더였으며, o3의 멀티모달 사후 훈련 리드, 그리고 사전 훈련부터 사후 훈련까지 o4-mini의 직접 책임자(DRI)를 맡았습니다. [1]
유 박사는 2025년 OpenAI를 떠나 Meta의 새로 형성된 초지능(superintelligence) 조직에 합류했습니다. [2] [3]
유 박사는 Meta가 OpenAI, Google DeepMind, Anthropic 등의 조직에서 연구원을 영입하던 2025년에 Meta의 초지능 이니셔티브에 합류했습니다. Meta는 고급 파운데이션 모델을 개발하고 초지능을 추구하기 위한 광범위한 노력의 일환으로 2025년 6월 Meta Superintelligence Labs(MSL)를 공식 조직했습니다. [2] [3]
Meta에서 유 박사는 Meta Superintelligence Labs 내의 모델 개발 팀인 TBD Lab을 공동 설립하고 멀티모달 작업을 이끌었습니다. [1] [8] [9]
재임 기간 동안 유 박사의 멀티모달 팀은 Muse Spark, Voice Mode, Muse Image 및 Muse Video를 연구했습니다. 유 박사는 Muse Spark 1.0, 1.1, 1.2와 Muse Image 및 Muse Video의 멀티모달 팟(pod) 리드였다고 자신을 소개합니다. [1]
Muse Spark는 2026년 Meta의 차세대 AI 모델의 일부로 도입되었습니다. 이후 해당 팀의 릴리스 및 프로젝트는 음성, 이미지 생성, 비디오 생성, 코딩, 에이전트 작업 및 멀티모달 기능으로 확장되었습니다. [8] [9]
유 박사는 Meta CEO 마크 저커버그(Mark Zuckerberg) 및 Meta 최고 AI 책임자 알렉산드르 왕(Alexandr Wang)과 함께 TBD Lab을 구축한 것이 회사에서의 시간 중 중요한 부분이었다고 설명했습니다. 그는 합류한 지 약 14개월 만인 2026년 8월에 Meta를 떠났습니다. [8] [9] [7]
2026년 8월, 유 박사는 새로운 회사를 시작하기 위해 Meta를 떠난다고 발표했습니다. [7] [8] [9] [10] [11]
이러한 움직임을 발표하면서 유 박사는 시간이 지남에 따라 인류의 미래에 중대한 영향을 미칠 수 있지만 상대적으로 덜 탐구된 문제에 점점 더 관심을 갖게 되었다고 말했습니다. 그는 이 문제가 자신의 주요 초점이 되었으며 작업이 진행됨에 따라 더 많은 정보를 공개할 것이라고 밝혔습니다. [7] [8] [9]
2026년 8월 현재, 유 박사는 새 회사의 이름, 구체적인 연구 또는 제품 초점, 다른 공동 창립자나 팀원, 또는 자금 조달 방식에 대해 공개적으로 밝히지 않았습니다. 그의 개인 웹사이트에는 현재 그의 상태가 단순히 "새로운 회사를 시작함(starting a new company)"으로 기재되어 있습니다. [1] [8] [9]
새 회사는 유 박사가 Meta에서 근무하는 동안 공동 설립한 TBD Lab과는 별개입니다. TBD Lab은 유 박사가 퇴사 후 발표한 벤처의 이름이 아니라 Meta에서의 이전 작업의 일부로 남아 있습니다. [1] [8]
유 박사는 자신의 주요 작업 중 다수의 주요 멀티모달 및 파운데이션 모델 프로젝트를 나열하고 있습니다:
유 박사의 초기 연구에는 컴퓨터 비전, 신경망 효율성, 이미지 생성, 이미지 인페인팅, 멀티모달 표현 학습 및 자동 음성 인식 분야의 작업도 포함됩니다. [1]
유 박사는 공개 인터뷰와 기술 프레젠테이션에서 자신의 연구에 대해 논의해 왔습니다. Google의 'Meet a Google Researcher' 에피소드에서 유 박사와 연구원 용휘 우(Yonghui Wu)는 자기회귀 텍스트-이미지 모델인 Parti에 대해 논의했습니다. 이 논의에서는 이미지 생성을 시퀀스 모델링 문제로 표현하는 Parti의 접근 방식, 텍스트-이미지 모델의 확장, 멀티모달 연구, 그리고 점점 더 유능해지는 생성 시스템의 개발에 대해 다루었습니다. [4]
August 17, 2026. 01:37 UTC
편집 요약:
Updated wiki: removed Perception/OpenAI and Gemini Multimodal/DeepMind line; added ..; tags -> Developer; category -> People in crypto; added 5 refs
