불러오는 중 ···
· 매일 08:00 KST
스토리 · 연속 1일 · 2026-06-09
스토리 추적 시스템 · 백상현 · AI 풀스택 엔지니어
타임라인
추론 속도는 LLM 실용화의 핵심인데, 1T 모델에서 1000 tps는 기존 한계를 크게 뛰어넘는 주장이에요. 진짜라면 AI 서비스 비용이 확 낮아질 수 있어요.