
8월 11일에는 Grok Bot, 12일에는 Grok 4.6이 연달아 나왔습니다. 모델과 에이전트를 하루 간격으로 공개한 셈입니다. 두 발표를 같이 봐야 하는 이유가 있습니다. 하나는 오래 생각하고 검증하는 엔진이고, 다른 하나는 브라우저와 앱 안에서 실제 일을 이어 가는 작업 공간입니다.
관심을 끄는 숫자는 많습니다. 하지만 공급사가 제시한 벤치마크와 요금표만으로 업무 자동화가 완성되지는 않습니다. 공식 발표, 모델 문서, 제품 FAQ, 미국 증권거래위원회 공시를 대조해 보니 이번 출시의 핵심은 ‘더 강한 모델’보다 모델·실행 환경·운영 통제를 한 묶음으로 내놓았다는 것에 가깝습니다.
하루 간격으로 나온 두 제품은 역할이 다릅니다
Grok 4.6은 xAI가 장시간 에이전트 작업과 대화형·시각 작업에 초점을 맞췄다고 설명하는 모델입니다. Grok Bot은 사용자가 맡긴 일을 클라우드 컴퓨터에서 계속 수행하고, 필요한 순간에 승인이나 판단을 요청하는 상시형 에이전트입니다. 이름은 ‘봇’이지만 단순 채팅창보다 원격 업무 보조자에 가깝습니다.

출처: xAI, Introducing Grok Bot. 2026-08-24 확인.
xAI는 Grok Bot이 도구와 앱에 로그인해 사람이 하듯 화면을 사용하고, 결과가 나올 때까지 계속 작업한다고 설명합니다. 공식 사례는 영업 조사, 마케팅 정리, 운영 업무, 버그 수정까지 넓습니다. 다만 “끝까지 일한다”는 표현을 무제한 자율성으로 읽으면 곤란합니다. 결제, 외부 발송, 삭제, 권한 변경처럼 되돌리기 어렵거나 책임이 따르는 행동은 사람 승인 지점을 남겨야 합니다.
공개 범위는 출시 뒤 넓어졌습니다. 8월 21일 기준 SuperGrok Plus·Heavy, Cursor Pro+·Ultra, Cursor Teams Standard·Premium에 Grok Bot이 포함됩니다. 공식 FAQ는 macOS·Windows와 iOS 18을 지원 환경으로 적고, Linux·Android·iPad는 초기 출시에서 지원하지 않는다고 안내합니다. 기업용 제공은 별도로 확대 중입니다.
Grok 4.6의 강점은 점수보다 긴 작업 궤적에 있습니다
xAI가 공개한 표에서 Grok 4.6 High는 Artificial Analysis Intelligence Index 61점, CursorBench v3.2 69.9%, DeepSWE v1.1 65.9%, FrontierCode Extended 61.3%를 기록했습니다. 같은 표에서 일부 항목은 GPT-5.6 Sol이나 Fable 5 Max가 앞섭니다. “모든 평가에서 1위”가 아니라 여러 장기 에이전트 평가에서 최상위권에 들어간 모델이라는 표현이 정확합니다.

출처: xAI, Introducing Grok 4.6. 굵은 값은 항목별 최고점이며 경쟁 모델 값도 xAI가 공개한 비교표입니다. 2026-08-24 확인.
이 수치는 xAI의 공급사 자체 평가입니다. 실제 도입에서는 팀의 저장소, 브라우저 절차, 문서 형식, 실패 복구 조건을 넣은 표본으로 다시 봐야 합니다. 특히 장시간 작업은 첫 답변의 인상보다 중간 오류를 발견하고 다시 시도하는 능력, 완료 전에 결과를 검증하는 습관, 비용이 새지 않는지가 중요합니다.
독립 평가 기관 Artificial Analysis의 모델 페이지도 지능 지수 61점을 제시하지만, API 측정 출력 속도는 초당 65.8토큰, 첫 답변 토큰까지 걸린 시간은 41.87초로 표시합니다. 높은 지능 점수와 빠른 대화 경험은 같은 지표가 아니라는 뜻입니다. 순위와 지연 시간은 바뀔 수 있으므로 이 수치는 2026년 8월 24일 기준 스냅샷으로 봐야 합니다.
공식 모델 문서에는 50만 토큰 컨텍스트, 텍스트·이미지 입력, 함수 호출, 구조화 출력, 추론 지원이 표시돼 있습니다. 기본 가격은 100만 토큰당 입력 2달러, 캐시 입력 0.50달러, 출력 6달러입니다. 20만 토큰을 넘는 긴 컨텍스트에는 별도 고구간 가격이 적용되므로 “500k를 지원한다”와 “항상 같은 단가로 500k를 쓴다”는 다른 이야기입니다.

출처: xAI 모델 문서, Grok 4.6. 2026-08-24 확인.
출시 당시 Grok 4.6은 Cursor, Grok Build, xAI API, OpenRouter, Vercel, Cloudflare에서 제공됐고 첫 주에는 Cursor와 Grok Build의 포함 사용량이 두 배였습니다. 이는 현재 상시 가격이 아니라 출시 주간 조건입니다.
Grok Bot의 핵심 경계는 ‘봇별’이 아니라 ‘사용자별’입니다
첨부 내용에서 가장 중요한 수정 지점이 있습니다. Grok Bot마다 클라우드 컴퓨터가 하나씩 따로 생기는 구조가 아닙니다. 공식 FAQ에는 한 사용자의 모든 Grok Bot이 하나의 지속형 클라우드 컴퓨터를 공유한다고 적혀 있습니다. 파일, 브라우저, 로그인도 그 컴퓨터 안에서 공유되고 격리는 봇 단위가 아니라 사용자 단위입니다.
이 차이는 보안 설계를 바꿉니다. 리서치 봇에 로그인한 계정과 운영 봇이 사용하는 브라우저 상태가 같은 사용자 경계 안에 놓입니다. 봇 이름을 나눈 것만으로 권한이 분리됐다고 가정하면 안 됩니다. 민감 업무 승인, 사용자 단위 격리, 사용량·접근 한도를 운영 규칙으로 잡아야 합니다.
xAI 문서는 승인 경계를 설명하며 Auto Review는 해당 집행 기능을 사용할 수 있는 환경에 적용된다고 밝힙니다. Cursor는 암호화, Privacy Mode, 기업용 관리와 네트워크 통제를 별도로 안내합니다. 이는 사용할 수 있는 통제 장치이지 특정 환경의 안전을 보장하는 인증서가 아닙니다. 어떤 행동이 자동 승인되고 어떤 행동이 사람에게 돌아오는지, 실패했을 때 파일과 외부 시스템을 원상 복구할 수 있는지는 조직이 따로 시험해야 합니다.
접근 비용도 모델 API와 다릅니다. 현재 접근 페이지는 여러 Cursor·SuperGrok·Teams 등급을 함께 제공하며 출시 뒤 대상과 가격 구성이 이미 바뀌었습니다. 고정된 가격 두 개만 적으면 오히려 잘못된 비교가 됩니다. 공식 가격표를 다시 확인하고, 주간 포함량과 추가 토큰 비용까지 합쳐 완료 업무 한 건당 실제 비용을 기록해야 합니다.
이번 출시는 모델보다 ‘연결된 업무 스택’의 경쟁입니다
좋은 모델만으로는 반복 업무를 끝낼 수 없습니다. 모델이 판단해도 코드를 고칠 저장소, 화면을 조작할 브라우저, 메시지를 확인할 인박스, 실행을 멈출 승인 장치가 없으면 결과물은 답변에 머뭅니다. Grok 4.6과 Grok Bot을 붙여서 발표한 의미는 추론 엔진과 실행 장소를 한 제품 흐름으로 연결했다는 데 있습니다.
Cursor와 SpaceX의 관계는 8월 14일 달라졌습니다. SpaceX는 2026년 6월 16일 Cursor 운영사 Anysphere와 약 600억 달러의 기업가치를 전제로 합병 계약을 맺었습니다. 이후 SEC 공시에 따르면 합병은 8월 14일 효력이 발생했고, Cursor는 SpaceX의 완전자회사로 존속합니다. 6월 공시의 ‘종결 대기’ 상태는 더 이상 현재 사실이 아닙니다.
후발 주자가 따라잡은 이유를 합병 하나로 설명하는 것도 성급합니다. 지금 확인되는 것은 xAI 모델, Cursor·Grok Build 같은 작업 화면, Grok Bot의 지속형 컴퓨터, SpaceX의 컴퓨팅·자본 배경이 한 방향으로 묶이고 있다는 점입니다. 이것이 실제 우위가 되는지는 다른 질문입니다. 업무 완료율과 총비용, 권한 사고, 사람이 다시 손보는 시간을 함께 측정해야 합니다.
도입 전에는 4주짜리 업무 표본으로 검증하는 편이 낫습니다
첫 주부터 메일함과 결제 계정 전체를 연결할 이유는 없습니다. 완료 조건이 분명하고 되돌릴 수 있는 업무 20~30개를 고른 뒤 모델 적합성과 봇 적합성을 따로 측정하는 편이 안전합니다. 긴 코딩·리서치 작업은 Grok 4.6의 재검증 능력을 보고, 반복 브라우저 절차는 Grok Bot의 지속성과 승인 흐름을 봅니다.
운영표에는 적어도 완료율, 사람이 고친 시간, 승인 요청 횟수, 실패 후 복구 시간, 완료당 토큰 비용을 넣습니다. 여기에 공유 로그인 범위와 외부 발송·삭제 기록을 남깁니다. 결과 품질이 오르더라도 자격증명과 비용 통제가 흐려지면 범위를 넓히지 않는 것이 맞습니다.
제가 도입 순서를 정한다면 1주 차에는 읽기 전용 조사와 문서 초안, 2주 차에는 샌드박스 브라우저 작업, 3주 차에는 승인 후 실행, 4주 차에만 제한된 반복 업무를 맡기겠습니다. 이때 사람의 확인 시간이 실제로 줄고 완료율이 유지되는지 봅니다. ‘에이전트가 오래 일했다’보다 ‘사람이 덜 개입하고도 안전하게 끝냈다’가 더 나은 성공 기준입니다.
Grok 4.6과 Grok Bot은 모델 단품 경쟁이 업무 시스템 경쟁으로 이동하고 있다는 신호입니다. 다만 출시 직후의 순위 경쟁이나 ‘Top 3’ 같은 예측보다 먼저 확인할 것은 단순합니다. 강한 모델, 실행할 컴퓨터, 멈출 수 있는 통제가 함께 작동하는가. 그 세 가지가 맞아야 상시형 에이전트가 채팅창을 넘어 실제 업무 도구가 됩니다.
참고한 자료
보도 내용, 공식 문서, 정책 배경, 제품 정보처럼 시간이 지나면 바뀔 수 있는 내용을 확인할 때 본 자료입니다.
- Introducing Grok 4.6xAI확인한 내용: 출시일; 벤치마크; 배포 채널; 출시 주간 사용량 혜택확인일: 2026-08-24
- Grok 4.6 independent model evaluationArtificial Analysis확인한 내용: 독립 지능 지수; 출력 속도; 첫 답변 지연 시간확인일: 2026-08-24
- Grok 4.6 model documentationxAI확인한 내용: 컨텍스트 길이; 입출력 가격; 지원 기능확인일: 2026-08-24
- Introducing Grok BotxAI확인한 내용: 출시일; 제품 동작 방식; 베타 접근 범위확인일: 2026-08-24
- Grok Bot product and FAQxAI확인한 내용: 클라우드 컴퓨터 경계; 요금제; 지원 운영체제; 보안·승인 기능확인일: 2026-08-24
- Grok Bot is now included with more plansxAI확인한 내용: 8월 21일 접근 확대; 대상 구독 등급; 기업용 배포확인일: 2026-08-24
- Grok Bot frequently asked questionsxAI확인한 내용: 지원 플랫폼; 공유 컴퓨터 경계; 현재 과금 안내확인일: 2026-08-24
- Grok Bot approvals, security, and privacyxAI확인한 내용: 승인 경계; 조건부 Auto Review 제공; 공유 컴퓨터 보안 지침확인일: 2026-08-24
- Cursor securityCursor확인한 내용: 암호화와 개인정보 통제; 기업용 관리; 네트워크 보안 지침확인일: 2026-08-24
- SpaceX and Anysphere merger agreement filingU.S. Securities and Exchange Commission확인한 내용: 6월 16일 합병 계약; 600억 달러 기업가치; 당시 종결 전 상태확인일: 2026-08-24
- SpaceX completion of Anysphere merger filingU.S. Securities and Exchange Commission확인한 내용: 8월 14일 합병 완료; 완전자회사 편입; 600억 달러 기업가치확인일: 2026-08-24



