Search

MoE

텐센트, 오픈소스 'Hy3' 공개…GLM-5.2 절반 크기로 코딩 빼고 앞섰다

텐센트, 오픈소스 ‘Hy3’ 공개…GLM-5.2 절반 크기로 코딩 빼고 앞섰다

7월 8, 2026

중국 텐센트가 오픈소스 대형 AI 모델 ‘Hy3’를 7월 6일 정식 공개했다. 총 2,950억(295B) 파라미터의 전문가혼합(MoE) 구조로, 토큰 하나를 처리할 때는 그중 210억 파라미터만 골라…

메이투안, 1.6조 매개변수 오픈소스 '롱캣-2.0' 공개…엔비디아 없이 학습

‘중국 배민’ 메이투안, 1.6조 매개변수 오픈소스 ‘롱캣-2.0’ 공개…중국 칩셋만으로 학습

7월 2, 2026

중국 배달 플랫폼 메이투안이 총 1조 6천억 개 매개변수의 초대형 오픈소스 언어모델 ‘롱캣(LongCat)-2.0’을 공개했다. 이 모델은 중국산 AI 전용 칩 5만여 개로 구성된 클러스터에서…

엔비디아, 5,000억 개 파라미터 개방형 모델 '네모트론 3 울트라' 공개…에이전트 추론 5배·운영 비용 30% 절감

엔비디아, 5,000억 개 파라미터 개방형 모델 ‘네모트론 3 울트라’ 공개…에이전트 추론 5배 상승·운영 비용 30% 절감

6월 2, 2026

엔비디아(NVIDIA)가 6월 1일 컴퓨텍스 2026 GTC 타이베이 무대에서 회사 역사상 가장 큰 개방형 언어 모델 ‘네모트론 3 울트라(Nemotron 3 Ultra)’를 공개했다. 총 5,000억~5,500억 개…

Comet: Fine-grained Computation-communication Overlapping for Mixture-of-Experts

바이트댄스, 트릴리언급 모델을 47% 빠르게 만드는 ‘코멧’ 기술 공개

3월 18, 2025

Comet: Fine-grained Computation-communication Overlapping for Mixture-of-Experts 1조 규모 AI 모델의 숨은 병목: 디바이스 간 통신이 실행 시간의 47%를 차지 아주 큰 규모의 인공지능(AI) 모델을…

딥시크, 대규모 AI 모델 훈련을 위한 오픈소스 통신 라이브러리 'DeepEP' 출시

딥시크, 대규모 AI 모델 훈련을 위한 오픈소스 통신 라이브러리 ‘DeepEP’ 출시

2월 26, 2025

딥시크(DeepSeek)가 25일(현지 시간) 오픈소스 주간(#OpenSourceWeek) 둘째 날을 맞아 혼합 전문가(MoE, Mixture of Experts) 모델 훈련과 추론을 위한 최초의 오픈소스 EP 통신 라이브러리인 ‘DeepEP’를 공개했다.…