이미지로 공유된 모델 순위표에서 GPT-6 Astra, Claude Fable 5.1, Claude Opus 5 등의 점수가 화제가 됐다. 높은 벤치마크 수치에 놀라는 반응이 있었지만, 실무 격차는 작업 완주율·수정 반복 안정성·실제 문제 해결 능력으로 판단해야 한다는 의견이 우세했다. AI가 고도화돼도 가치·책임·생계 문제는 인간이 계속 다뤄야 한다는 앞선 철학 논의로 연결됐다.
- 순위표의 수치가 실제 업무 성능을 그대로 뜻하지는 않는다는 지적이 나왔다.
- 실무에서는 작업을 끝까지 완료하는 능력과 반복 수정의 안정성이 중요하다고 했다.
- 벤치마크 경쟁이 업계의 점수 경쟁으로 보인다는 반응이 있었다.
- AI 가속과 별개로 방향 설정, 책임, 생계 문제는 인간 의제로 남는다는 결론이 나왔다.