codex 2

GPT-5.6 Sol vs Fable 5, 실제 코딩은 달랐다

모델 비교표만 보면 답이 금방 나올 것 같습니다. GPT-5.6 Sol은 코딩 에이전트 점수와 속도, 가격에서 앞섭니다. Claude Fable 5는 다른 코딩 시험과 지식 노동 평가에서 다시 뒤집습니다. 숫자를 한 줄씩 고르면 어느 쪽이든 우승시킬 수 있습니다. 그런데 출시 후 일주일 동안 올라온 사용기는 점수표보다 훨씬 거칠었습니다. 한 사용자는 Sol에게 Fable이 만든 코드를 검토시켰다가 5만 줄 가운데 약 4만7천 줄이 지워지고 다시 작성됐다고 했습니다. 다른 비교에서는 같은 2D 게임을 3D로 바꾸라고 했더니 Sol은 게임의 분위기와 규칙까지 크게 바꿨고, Fable은 원래 구조를 더 충실히 지켰습니다.둘의 차이는 누가 더 똑똑하냐보다, 일을 어디까지 바꾸려 드느냐에서 먼저 드러났습니다. O..

AI 2026.07.10

AI 에이전트 비교 전에 먼저 정해야 하는 선

AI 에이전트 비교 글은 계속 인기입니다. Manus, Genspark, Claude Code, Codex, Antigravity 같은 이름이 계속 오갑니다. 어떤 건 브라우저를 조작하고, 어떤 건 코드를 고치고, 어떤 건 리서치와 문서화를 해줍니다. 비교표를 보면 다 써봐야 할 것 같습니다.그런데 나는 비교표를 보기 전에 먼저 정해야 할 선이 있다고 봅니다. 내 업무에서 AI가 어디까지 움직여도 되는가입니다. 이 선이 없으면 기능이 많은 도구일수록 위험해집니다.선부터 정하자AI 에이전트는 똑똑한 도구이기 전에 행동하는 도구입니다. 그래서 기능보다 권한 경계가 먼저입니다.AI 에이전트는 기능표보다 경계선이 먼저다. 어디까지 맡길지 정하지 않으면 비교 자체가 흔들린다.자율성이 클수록 멈춤 장치가 중요하다좋..

AI 2026.06.17