검색

휴대폰에서 제어하는 Claude Code, GLM-5.3이 GPT-5.6 Sol과 Claude Fable 5를 앞서고, Perplexity가 Brain 메모리를 상세히 설명

인공지능으로 생성된 기사
휴대폰에서 제어하는 Claude Code, GLM-5.3이 GPT-5.6 Sol과 Claude Fable 5를 앞서고, Perplexity가 Brain 메모리를 상세히 설명

ai-powered-markdown-translator

gpt-5.4-mini로 fr에서 ko로 번역된 기사.

GitHub에서 프로젝트 보기 ↗

8월 22일, Anthropic은 전화기에서 세션을 시작할 수 있는 Claude Code Remote Control을 공개하고, Google은 원격으로 에이전트를 제어할 수 있는 동등한 기능을 Antigravity에 추가한다. 모델 측면에서는 Together AI의 두 비교 테스트가 오픈 모델 GLM-5.3이 DeepSWE 벤치마크에서 GPT-5.6 Sol과 Claude Fable 5와 동등하거나 더 우수한 성능을 내며, 비용은 그 일부에 불과하다고 보여준다. 또한 Perplexity는 Git으로 버전 관리되는 에이전트 메모리인 Brain의 아키텍처를 설명하고, NotebookLM은 Google Search의 IA 모드에 통합된 채 모든 사용자에게 제공되기 시작한다. 그 밖에도 Replit은 에이전트 모드를 다시 정비하고, Runway는 모델 라이선스 오퍼를 공개하며, OpenAI는 API 비용 통제와 Codex 보안 제품군을 강화하고, Grok Bot은 접근 범위를 넓힌다.


Claude Code Remote Control: 전화기에서 세션 시작 가능 및 안정성 강화

8월 22일 — Anthropic은 X에 Remote Control의 여러 안정성 수정 사항을 자세히 설명하는 스레드를 게시했다. 이 기능은 원격 컴퓨터에서 Claude Code가 실행되는 동안 전화기에서 세션을 조작할 수 있게 해준다. 전화기와 머신 간 상태 동기화는 이제 Claude Code가 종료된 뒤에도 유령 세션이 남아 표시되지 않으며, 네트워크 끊김(Wi‑Fi 전환, 덮개 닫힘)은 자동 재연결을 유발하고, 대형 세션 열기도 iOS에서 훨씬 빨라졌다. 세 가지 슬래시 명령은 모바일 전용 동작을 얻었다(/clear, /compact, /diff). 제품의 새 기능으로는 전화기에서 직접 세션을 시작할 수 있게 된 점이 있다 — claude remote-control를 실행 중인 모든 머신이 Code 탭에서 장치 카드로 표시되며, 이를 선택해 원격으로 세션을 시작할 수 있다.

Your phone now stays in sync with what’s running on your machine. Resuming a session on your laptop keeps the phone on the live session instead of archiving it. When Claude Code exits, your phone shows it offline within seconds instead of leaving a stale session hanging around.

🇰🇷 이제 당신의 전화기는 머신에서 실행 중인 내용과 동기화 상태를 유지합니다. 노트북에서 세션을 이어가면 전화기는 그 세션을 보관하지 않고 활성 세션에 붙어 있습니다. Claude Code가 종료되면, 전화기는 오래된 세션을 그대로 남겨두지 않고 몇 초 안에 오프라인으로 표시합니다.@ClaudeDevs X에서

🔗 X 전체 스레드 🔗 Remote Control 문서


Replit: Conversations, Agent 모드 이름 변경(Power/Max), 그리고 Routines와 Memories 베타

8월 22일 — Replit이 주간 요약 This Week in Replit을 공개하며 세 가지 새로운 기능을 소개했다. Conversations는 아이디어를 실현하기 전에 대화형 연구와 발상 단계로 앱 구상을 시작할 수 있게 해주며, 이후 구축 단계로 넘어가도 이전에 쌓인 맥락을 잃지 않는다 — 이 단계가 다른 IA 도우미에서 시작될 때 흔히 발생하던 문제를 해결한다. Agent 모드의 이름도 바뀐다: 기존 Economy 모드는 Power로, 기존 Power 모드는 Max로 변경되며, 두 모드의 비용은 동일하다. 마지막으로 Routines와 Memories가 베타로 제공된다. Routines는 대화에서 시작된 작업을 예약 실행하고 그 결과를 자동으로 돌려주며, 지속 메모리 시스템을 기반으로 한다. 이 발표들은 Replit의 Friday Showcase에서 생중계로 소개되었다.

🔗 발표 스레드


Together AI, DeepSWE에서 GLM-5.3과 GPT-5.6 Sol 및 Claude Fable 5를 비교

8월 21일 — Together AI는 같은 날 독립적인 두 비교 결과를 공개하며, Zhipu/Z.ai의 최신 오픈 모델 GLM-5.3을 소프트웨어 엔지니어링 벤치마크인 DeepSWE(113개 과제, 구성당 4회 시도, 최대 노력, 총 904회 실행)에서 두 폐쇄형 기준 모델과 맞붙였다. GPT-5.6 Sol과의 비교에서 GLM-5.3은 첫 시도에서는 뒤처지지만 두 번째 시도에서 따라잡고, 네 번째 시도에서는 더 앞선다. 비용은 훨씬 낮다. Claude Fable 5와의 비교에서는 초기 격차가 거의 없으며, 여러 차례 시도할수록 GLM-5.3 쪽으로 뚜렷하게 벌어진다 — Claude Fable 5는 이 비교에서 가장 비싼 구성으로 드러난다. 테스트 실패 시에만 Sol로 승격하는 GLM-5.3 → Sol 캐스케이드는 과제당 6.61달러로 성공률 85.9%를 달성했으며, 이는 완벽한 오라클 라우터(83.8%)보다 더 좋은 결과다.

테스트한 비교첫 시도 점수4회 시도 후 점수실행당 비용
GLM-5.3 vs GPT-5.6 Sol69.0 % vs 72.7 %87.6 % vs 85.8 %3.99 $ vs 8.37 $ (2.1배 저렴)
GLM-5.3 vs Claude Fable 569.0 % vs 69.7 %87.6 % vs 84.1 %3.99 $ vs 21.63 $ (5.4배 저렴)

Don’t pick one. Run GLM-5.3 first, escalate to GPT-5.6 Sol when the tests fail. That cascade solves 85.9% of DeepSWE tasks at $6.61 each. Sol alone solves 72.7% at $8.37. Thirteen points better, 21% cheaper.

🇰🇷 모델 하나만 고르지 마세요. 먼저 GLM-5.3을 실행하고, 테스트가 실패할 때 GPT-5.6 Sol로 승격하세요. 이 캐스케이드는 DeepSWE 과제의 85.9%를 과제당 6.61달러에 해결합니다. Sol만으로는 72.7%를 8.37달러에 해결합니다. 13포인트 더 높고, 21% 더 저렴합니다.Together AI, 공식 블로그

🔗 GLM-5.3 vs Claude Fable 5 비교


NotebookLM이 모든 사용자에게 제공되며 Google Search의 IA 모드에 통합됨

8월 21일 — Gemini Notebook으로 이름이 바뀐 NotebookLM의 X 계정은, 단계적 배포 이후 새로 개편된 “Notebook” 경험이 이제 웹에서 모든 사용자가 이용할 수 있다고 발표했다(모바일 버전은 추후 제공 예정). 또 하나의 구조적 변화는 노트북이 이제 Google Search의 IA 모드에서 직접 접근 가능하다는 점으로, 문서 요약 도구가 Google의 मुख्य 검색 엔진과 더 가까워졌다. 발표에는 Chat 측면의 두 가지 수정도 포함된다: 수식의 더 나은 렌더링과 복사/붙여넣기, 그리고 오른쪽에서 왼쪽으로 쓰는 언어(아랍어, 히브리어)에서 숫자를 거꾸로 표시하던 버그 수정. 추가 소식도 앞으로 몇 주 안에 예고되었다.

🔗 X 발표


OpenAI, Usage and Spend 대시보드에 API 키별 지출 추적 추가

8월 21일 — OpenAI가 개발자 플랫폼의 Usage and Spend 대시보드에 API 키별 세분화를 추가했다. 지금까지는 조직 또는 프로젝트 수준으로만 집계되던 지출 추적이 이제 개별 API 키 각각의 기여도를 분리해 보여주므로, 어떤 애플리케이션이나 작업 흐름이 청구서에서 가장 큰 비중을 차지하는지 정확히 파악할 수 있다. 이 기능은 조직 또는 프로젝트 수준에서 설정 가능한 지출 한도와 함께 제공되며, 상한에 도달하면 트래픽을 자동으로 차단하는 엄격한 한도 설정도 가능하다. 이러한 제어는 API Platform 인터페이스와 Admin API에서 사용할 수 있어, 프로그래매틱한 작업 흐름에 통합할 수 있다. OpenAI는 이 업데이트를 같은 날 발표한 GPT-5.6 Sol의 가격 인하를 보완하는 조치로 소개한다.

🔗 X 발표


Codex Security: 사이버 방어를 위한 실전 가이드와 오픈 소스 CLI (Daybreak)

8월 21일 — OpenAI가 Daybreak 생태계를 설명하는 가이드를 공개했다. 이 플랫폼은 ChatGPT의 초기 분류부터 검증된 수정안 생성까지 IA가 보조하는 사이버 방어용이다. 개발자에게 가장 직접적인 포인트는 Codex Security CLI로, npm 패키지로 공개된 오픈 소스 도구(@openai/codex-security)이며 로컬 저장소를 스캔하는 데 사용할 수 있고(npx @openai/codex-security scan .), SARIF 형식 내보내기와 함께 CI/CD(GitHub Actions, GitLab CI/CD)에 통합할 수 있다. 특히 눈에 띄는 새 기능은 bulk-scan으로, CSV 인벤토리에서 시작해 저장소 전체 포트폴리오를 감사하며, 중단 후 재개와 구성 가능한 동시성 파라미터를 지원한다. OpenAI는 또한 두 가지 접근 수준을 구분한다: 승인된 방어자를 위한 Daybreak Blue(취약점 분류, 수정 검증)와, 더 제한된 승인 용도에만 허용되는 Daybreak Red(고급 취약점 연구, red teaming)이다. Codex Security cloud는 이미 3천만 건이 넘는 커밋과 3만 개가 넘는 코드베이스를 분석했다.

🔗 전체 가이드


Grok Bot, 더 많은 요금제로 접근을 확대하고 시험 사용은 무료화

8월 21일 — 베타 출시 10일 만에 Grok Bot이 더 넓은 요금제 범위로 접근을 확대했다: SuperGrok Plus, SuperGrok Heavy, 그리고 Cursor 요금제(Pro+, Ultra, 모든 Teams 플랜)가 포함된다. 이 요금제 외 사용자는 이제 제한된 사용량의 무료 체험을 이용할 수 있다. 이러한 자율 IA 에이전트는 브라우저와 터미널 접근이 가능한 자체 클라우드 환경을 갖추고 있어, 영업 발굴, 전체 웹사이트 제작(도메인 구매와 배포 포함), 메일함 분류, 고객 지원, 회의 메모 작성 같은 작업을 수행한다. 한 그룹 안에서 여러 Bot을 동시에 실행할 수 있으며, “routine” 모드는 사용자가 어떤 작업을 처음 한 번 수행하는 모습을 관찰해 Bot이 그 작업을 배우도록 해준다. 더 대규모 배포를 위한 기업용 대기자 명단도 열려 있다.

🔗 X 발표


Runway, 기업 전략과 모델 라이선스 오퍼를 상세히 공개

8월 21일 — Runway의 새 최고상업책임자 Sean Holcombe가 회사의 기업 전략을 자세히 설명하는 글을 공개했다. 연간 매출은 두 배 이상 증가했고, 순 유지율은 300%를 넘었으며, 국제 확장도 두드러진다(유럽은 기업 기반의 20% 이상, 일본은 아시아 최대 시장이 되었다). 가장 구조적인 발표는 모델 라이선스 오퍼의 개시다. API 사용량 기반 과금형 접근 대신, 일부 기업 고객은 폐쇄형 모델 가중치와 자체 환경에 직접 호스팅하고 미세 조정할 수 있는 독자적 학습/추론 프레임워크를 받을 수 있다. Runway는 네 가지 유형의 고객을 겨냥한다: 자체 창작 IP를 보유한 기업, 이미 연산 자원을 갖춘 플랫폼, 강한 규제 제약을 받는 조직, 그리고 매우 큰 물량을 처리하는 사업자다.

🔗 전체 글


Perplexity가 Computer의 에이전트 메모리 시스템 Brain을 자세히 설명

8월 19일 — Perplexity가 로컬 에이전트인 Computer의 지속 메모리 시스템 Brain의 동작 방식을 자세히 설명했다. 일반적인 벡터 데이터베이스 대신 Brain은 Git으로 버전 관리되는 지식 위키 형태로 메모리를 구성하며, 샌드박스 파일 시스템 안에 세 계층으로 나뉜다: knowledge/(위키), notes/(추출된 요약본), sessions/(원시 전사본). 전용 “Memory Agent”는 시작할 때마다 전체 트리를 복사하는 대신 필요할 때 관련 파일만 불러오며, “Dream”이라는 백그라운드 에이전트는 공개 전 검증과 함께 네 단계로 위키를 오프라인에서 유지 관리한다.

평가된 지표Brain 없음Brain 있음
정확도(내부 벤치마크, 640개 질문)0.6000.661
증거 회수율(내부 벤치마크)0.5730.625
실제 환경 정확도(최근 30일)기준값+9.3포인트

🔗 기술 문서


한 줄 소식

  • Devin(Cognition) — GPT-5.6 Sol 추가 20% 할인 — OpenAI가 GPT-5.6 Sol 가격에 20% 인하를 추가하여 3개월간 적용한다. 이는 8월 18일부터 이미 시행 중인 70% 할인에 더해지는 것으로, Devin Desktop과 CLI의 누적 할인은 이제 2026년 10월 3일까지 76%에 이른다. 🔗 발표
  • Google Antigravity 2.9.1 — 에이전트를 원격으로 제어하는 Remote Control — 어떤 브라우저에서든 로컬 에이전트 세션을 시작하고 모니터링할 수 있는 새 기능으로, 성능 향상과 오류 후 복구 개선이 포함된다. 🔗 변경 기록
  • Copilot Max용 자동 모델 선택 30% 할인 — Copilot Max 구독자를 위한 자동 모델 선택(Claude, GPT 또는 Microsoft AI)에 대한 프로모션으로, 2026년 9월 30일까지 유효하다. 🔗 발표 · 🔗 종료일
  • GitHub Universe 2026 — 티켓 판매 재개 — 제품 발표 없이, 짧은 영상 하나로 GitHub Universe 2026 컨퍼런스의 마케팅 재개가 이뤄졌다. 🔗 영상
  • Midjourney — 사이트 alpha에 대한 대규모 변경 기록 — alpha.midjourney.com에서 2주간 진행된 UX 수정: 프로젝트 폴더, Upscale/Zoom/Vary 복귀, 설정 지속성, 성능 수정. 🔗 변경 기록
  • MiniMax, SambaNova에서 M3 모델 출시를 암시 — SambaNova의 수수께끼 같은 발표에 대한 응답으로, MiniMax가 곧 M3 모델이 나올 것임을 암시했지만 사양이나 출시일은 공개하지 않았다. 🔗 트윗
  • Grok 4.6, Google Enterprise Agent Platform에서 사용 가능 — 이 모델은 Model Garden(구 Vertex AI)에 합류하며, 500,000 토큰의 컨텍스트 창과 입력/출력 천만 토큰당 2 $ / 6 $의 요금이 적용된다. 🔗 발표
  • Cohere, superwhisper를 통해 음성 받아쓰기에 로컬 모드 활성화 — “Go Local” 모드는 Cohere Transcribe와 superwhisper의 오픈 모델 S1-mini(6억 파라미터)를 결합하며, 전적으로 기기 내에서 전사한다. 🔗 발표

의미하는 바

서로 무관한 두 개의 독립적인 발표가 오늘 하나의 같은 흐름으로 수렴하고 있다. 바로 AI 에이전트의 제어를 실제로 실행되는 머신으로부터 분리하는 것이다. Anthropic에서는 Claude Code Remote Control을 통해 이제 휴대폰에서 직접 세션을 시작할 수 있고, 기기 간 자동 재연결과 상태 동기화도 지원한다. Google에서는 Antigravity가 자체적인 “Remote Control” 기능을 도입해, 어떤 브라우저에서든 로컬 에이전트 세션을 제어하고 모니터링할 수 있게 했다. 두 경우 모두 연산과 실행은 여전히 작업용 컴퓨터에 고정되어 있고, 이동하는 것은 제어 창이다. 이러한 분리는 이제 흔한 사용 방식에 부응한다. 즉, 개발 머신에서 긴 작업을 시작한 뒤, 진행 상황을 다른 기기에서 확인하고 제어를 다시 이어받되, 실행 중인 작업은 한 번도 중단하지 않는 방식이다.

오늘 눈에 띄는 두 번째 흐름은 모델 경제성에 관한 것이다. Together AI의 두 비교 자료는 Zhipu/Z.ai의 오픈 모델인 GLM-5.3이 같은 소프트웨어 엔지니어링 벤치마크에서 GPT-5.6 Sol과 Claude Fable 5와 동등하거나 그 이상을 기록하면서도 비용은 2~5배 낮다는 점을 보여준다. 이는 고립된 사례가 아니다. 같은 주에 xAI는 Grok 4.6을 위한 클라우드 통합을 계속 늘려가고 있고(GitHub Copilot과 Amazon Bedrock에 이어 Google Enterprise Agent Platform까지), OpenAI는 Devin 사용자에게 GPT-5.6 Sol에 대해 누적 76% 할인을 제공하며, Replit은 자사 에이전트 모드도 확장하고 있다. 경쟁은 더 이상 모델의 순수한 성능만으로 결정되지 않고, 비용 대비 효율성과 멀티플랫폼 가용성에서 벌어지고 있다. 그리고 이 영역에서는 오픈 모델이 모델 간 캐스케이드 전략과 결합될 때, 폐쇄형 모델에 맞서는 중요한 상업적 무기가 되고 있다.

조금 덜 눈에 띄는 세 번째 흐름도 오늘 하루를 관통한다. 바로 지속형 메모리가 AI 에이전트의 핵심 인프라 구성 요소가 되고 있다는 점이다. Perplexity는 Brain의 아키텍처를 상세히 설명하며, Computer 에이전트의 메모리를 일반적인 벡터 데이터베이스에 쌓아두는 대신 Git으로 버전 관리되는 지식 위키로 구조화한다고 밝히고, 이를 통해 정확성과 증거 회수율에서 측정 가능한 향상을 보였다고 한다. 같은 시각, Google은 재구성된 NotebookLM의 Notebook 경험에 대한 접근 범위를 넓히고 이를 Google Search의 AI 모드에 직접 통합하면서, 문서 요약 도구를 주요 검색 엔진과 한층 더 가깝게 만들고 있다. 두 경우 모두 가치의 원천은 더 이상 기반 모델 자체에만 있지 않다. 과거 기록과 축적된 지식을 어떻게 조직하고, 다시 찾아내고, 세션 간 재사용하느냐에 있다.

마지막 관점은 기업의 기술 및 보안 팀을 위한 도구의 성숙도와 관련된다. OpenAI는 API 키별 지출 추적과 엄격한 제한 설정 기능을 대시보드에 추가하는 동시에, Codex Security에 대한 상세 가이드를 공개했고, 전체 저장소 포트폴리오를 감사할 수 있는 오픈소스 CLI도 함께 제공했다. 같은 날 같은 팀이 발표한 이 두 소식은, 대규모로 AI 에이전트를 배포하는 조직이 공유하는 우려에 대한 일관된 응답을 보여준다. 즉, 이러한 도구가 약속하는 속도는 유지하면서도 비용과 보안 표면에 대한 세밀한 통제는 놓치지 않겠다는 것이다.


출처