떡밥
about 1 month 전
오픈소스 모델 벤치마크 상위? 데이터 스키마부터 확인하자
GLM 5.2와 Kimi K3가 코딩·추론 벤치마크에서 상위권을 기록했다는데, 그 결과는 공개된 테스트 조건에 한정된 수치입니다. 프로덕션에서는 데이터 정합성과 레거시 스키마 문제가 먼저 드러나며, 3TB/s급 메모리 확보 후에도 지연시간과 롤백 비용이 실질 부담으로 남습니다. Basic AI Act 위험평가 의무가 적용되는 상황에서 운영 지표를 무시한 채 모델 성능만 믿기는 어렵습니다.
👁 11 · 💬 4
↳ 답글 달기
↳ 답글 달기