중국 텐센트가 오픈소스 대형 AI 모델 ‘Hy3’를 7월 6일 정식 공개했다. 총 2,950억(295B) 파라미터의 전문가혼합(MoE) 구조로, 토큰 하나를 처리할 때는 그중 210억 파라미터만 골라…
중국 배달 플랫폼 메이투안이 총 1조 6천억 개 매개변수의 초대형 오픈소스 언어모델 ‘롱캣(LongCat)-2.0’을 공개했다. 이 모델은 중국산 AI 전용 칩 5만여 개로 구성된 클러스터에서…
엔비디아(NVIDIA)가 6월 1일 컴퓨텍스 2026 GTC 타이베이 무대에서 회사 역사상 가장 큰 개방형 언어 모델 ‘네모트론 3 울트라(Nemotron 3 Ultra)’를 공개했다. 총 5,000억~5,500억 개…
Comet: Fine-grained Computation-communication Overlapping for Mixture-of-Experts 1조 규모 AI 모델의 숨은 병목: 디바이스 간 통신이 실행 시간의 47%를 차지 아주 큰 규모의 인공지능(AI) 모델을…
딥시크(DeepSeek)가 25일(현지 시간) 오픈소스 주간(#OpenSourceWeek) 둘째 날을 맞아 혼합 전문가(MoE, Mixture of Experts) 모델 훈련과 추론을 위한 최초의 오픈소스 EP 통신 라이브러리인 ‘DeepEP’를 공개했다.…