매일 들어오는 글 가운데, TTJ가 한 번 더 읽어본 것들. 코딩과 AI 시대를 가로지르는 글로벌 동향을 한곳에 모았습니다.
## 로컬 LLM의 속도 한계를 다시 한 번 "로컬에서 LLM을 돌리는 건 재밌지만 느리다"는 건 오래된 고정관념이었어요. 성능 좋은 API 모델에 비해, 내 PC에서 돌리는 오픈 웨이트 모델은 답변이 한 글자씩 뚝뚝 나오는 느낌을 줄 때가 많죠. 그런데 Luce-Org라는 팀이 **Lucebox Hub**라는 프로젝트에서 **RTX 3090 단일 G...