매일 들어오는 글 가운데, TTJ가 한 번 더 읽어본 것들. 코딩과 AI 시대를 가로지르는 글로벌 동향을 한곳에 모았습니다.

요즘 프론티어 모델 비교는 대부분 벤치마크 점수표로 이뤄지잖아요. 그런데 한 개발자가 조금 다른 방식의 실험을 공유했어요. Anthropic의 Fable 5와 OpenAI의 GPT-5.6 Sol에게 NP-하드 문제를 던져놓고, 목표 지향 기능인 /goal을 켰을 때와 껐을 때 결과가 어떻게 달라지는지 관찰한 건데요. 정답이 정해진 시험문제가 아니라 '끝...