매니코어소프트, 400kW In-rack CDU·딥가젯 액체냉각 서버 공개 | AI EXPO KOREA 2026
2026년 5월 6일~8일, 서울 코엑스에서 열린 제9회 국제인공지능대전(AI EXPO KOREA 2026) 현장 정리
AI 토큰 한 개가 데이터센터를 통과하는 길
엔터를 누른 뒤 첫 토큰이 화면에 나타나기까지, 시간과 돈과 전기는 어디에 쓰일까
H200 8장에 안 들어간다: 2.8조 파라미터 오픈 모델 Kimi K3
문샷AI가 7월 16일 공개한 오픈웨이트 프론티어 모델. 가중치는 27일 풀리고 권장 배포 사양은 가속기 64장 이상이다.
같은 칩인데 10% 느렸다: RTX Pro 6000 SE vs RTX 5090 실측기
RTX Pro 6000 Server Edition은 FP32 행렬곱 실측에서 RTX 5090보다 약 10% 느렸습니다(76.8 vs 87.2 TFLOPS). 원인은 최대 클럭 2430MHz와 한 단 낮은 메모리 클럭입니다. FP16 딥러닝 연산에서는 SE가 이론대로 앞섭니다.