Claude가 간단한 수정도 장황하게 설명
Reddit에서는 두 줄짜리 버그 수정에도 Claude가 5개 문단짜리 답변을 내놓아 시스템 프롬프트와 지침 파일을 바꿔도 통제하기 어렵다는 불만이 나왔다. 긱뉴스에서도 Claude Code가 코드는 잘 작성하지만 설명을 장황하고 과장된 말투로 한다는 지적이 공유됐다.
Cursor 사용량과 초과 청구가 불안정
한 사용자는 1799달러 초과 사용액을 부담하지 않겠다는 안내를 받은 뒤 지출 한도를 올리자 같은 사용량이 다시 청구됐다고 말했다. 다른 사용자들은 한 시간도 안 돼 월간 사용량 대부분 또는 수천만 토큰을 소진했다고 호소했다.
사용량 표시와 청구 로직이 예측 가능하지 않으면 고가 요금제의 핵심 가치인 비용 통제가 무너진다. 특히 에이전트 작업에서는 짧은 시간에 사용량이 폭증할 수 있어 사전 차단과 실시간 경고가 중요하다.
Cursor 요금제와 모델 설정이 혼란스러움
사용자들은 20달러와 60달러 플랜의 사용량이 빠르게 소진돼 200달러 플랜을 선택해야 하는지 묻고 있다. SuperGrok Heavy가 유지되는 동안 Ultra가 포함된다는 안내가 6개월로 바뀌었다는 사례와, 기본 모델을 Composer 2.5로 설정해도 새 창에서 Grok이 다시 선택된다는 문제도 나왔다.
요금제 혜택과 모델 기본값이 일관되게 전달·적용되지 않으면 구매 판단과 작업 재현성이 모두 흔들린다. 사용자는 단순히 더 많은 한도보다 포함 범위와 설정 우선순위를 명확히 알고 싶어 한다.
에이전트의 민감정보 취급을 믿기 어려움
Hacker News에서는 ChatGPT에 털어놓은 비밀이 법정에서 문제가 된 사례와, Claude가 작성한 내용을 사용자가 제대로 설명하지 못하는 상황이 함께 논의됐다. 민감한 데이터를 보호하면서도 도구 호출을 중단하지 않는 에이전트 설계 방법에 대한 관심도 나타났다.
사용자는 모델의 답변 정확도뿐 아니라 입력 데이터의 경계와 결과물의 책임 소재를 걱정하고 있다. 에이전트가 외부 도구와 연결될수록 비밀정보 분류, 기록 범위, 실행 권한을 사용자가 직접 통제할 수 있어야 한다.
모델별 코딩 품질 편차가 큼
Reddit에서는 Opus 4.6을 최고의 모델로 기억한다는 호평과 함께, Cursor의 Composer 2.5가 기본적인 SCSS 문제를 해결하지 못하고 엉뚱한 응답을 했다는 사례가 나왔다. Hacker News에서는 Claude와 Codex가 같은 앱을 다시 작성했을 때 아키텍처 차이를 비교하는 경험이 공유됐다.
모델 성능은 평균 점수보다 작업 유형과 시점에 따른 편차가 실사용 체감에 더 큰 영향을 준다. 사용자는 모델 이름만 보고 선택하기보다 특정 코드베이스와 문제 유형에서의 안정성을 비교하고 있다.
AI 코딩 세션을 다시 찾기 어려움
긱뉴스에서는 Claude Code 세션이 프로젝트별로 쌓이면 이름을 바꿔도 과거 맥락을 찾거나 이어가기 어렵다는 불편이 제기됐다. Hacker News에서는 파일 기반 장기 메모리를 에이전트가 설치해 사용하는 방식이 소개됐다.
에이전트 사용이 일회성 질의에서 장기 프로젝트 작업으로 이동하면서 대화 기록만으로는 맥락 관리가 부족해지고 있다. 세션 검색, 프로젝트별 기억, 재사용 가능한 작업 맥락이 핵심 생산성 기능으로 부상했다.
AI 특유의 문체가 개발 문서에 확산
Hacker News에서는 ChatGPT가 사용자의 글쓰기 방식 자체를 바꾸고 있다는 논의가 나왔다. 긱뉴스에서는 GitHub 풀 리퀘스트 분석에서 특정 AI 특유의 어휘와 문체를 가진 글이 크게 늘었다는 결과가 공유됐다.
AI가 만든 결과물을 구별하기 어려워지는 문제를 넘어, 사람의 표현과 팀의 커뮤니케이션 규칙까지 비슷하게 만들 수 있다는 우려다. 코드 리뷰와 문서 품질을 평가할 때 내용뿐 아니라 출처와 작성 맥락을 확인해야 하는 부담이 커진다.
코드 생성 능력과 별개로 출력 길이와 말투를 제어하지 못하면 반복 사용성이 크게 떨어진다. 사용자는 더 나은 추론보다 먼저 짧고 직접적인 응답을 안정적으로 얻을 방법을 요구하고 있다.