검색

Grok, Word·Excel·PowerPoint용 Copilot에 도입, OpenAI는 미국 정부기관의 ChatGPT 라이선스를 무료화, DeepSeek는 V4 Pro 유지

인공지능으로 생성된 기사
Grok, Word·Excel·PowerPoint용 Copilot에 도입, OpenAI는 미국 정부기관의 ChatGPT 라이선스를 무료화, DeepSeek는 V4 Pro 유지

ai-powered-markdown-translator

gpt-5.6-sol로 프랑스어에서 한국어로 번역된 기사.

GitHub에서 프로젝트 보기 ↗

이번 토요일에는 새로운 주력 모델이 나오지 않았지만, 이미 이 도구들을 사용하고 있는 사람들에게는 실질적인 변화가 있었다. Microsoft는 Teams에 Grok Bot을 도입한 다음 날 Word·Excel·PowerPoint용 Copilot에 SpaceXAI의 Grok 모델을 배포했고, OpenAI는 연방법 제정을 촉구하는 동시에 모든 미국 정부기관의 ChatGPT 라이선스 가격을 무료로 낮췄으며, DeepSeek 문서는 9월 14일로 예정됐던 V4 Pro 리디렉션을 취소했다. 개발 도구 분야에서는 사용자가 자체 연산 자원과 모델을 제공하면 Amp를 무료로 이용할 수 있게 됐고, Gemini CLI와 Vibe CLI는 보안 통제를 강화했다.


Grok, Word·Excel·PowerPoint용 Copilot부터 Teams까지 Microsoft 제품군에 자리 잡다

9월 12일 — Microsoft는 Word·Excel·PowerPoint용 Copilot에 SpaceXAI의 Grok 모델을 배포한다고 발표했다. 출시는 제한적으로 진행된다. 우선 Microsoft Frontier 프로그램 고객에게만 제공되며, Microsoft는 이를 Copilot에서 제공하는 모델 선택지의 확대라고 설명했다. @grok 계정은 발표가 나온 지 한 시간도 지나지 않아 이를 공유했다.

Launching even more models in Copilot. Grok models from SpaceXAI are rolling out in Copilot in Word, Excel, and PowerPoint—starting with a focused release to customers in the Microsoft Frontier program.

🇰🇷 Copilot에 더 많은 모델이 도입됩니다. SpaceXAI의 Grok 모델이 Word·Excel·PowerPoint용 Copilot에 배포되고 있으며, Microsoft Frontier 프로그램 고객을 대상으로 한 제한적 출시부터 시작합니다.@Microsoft365의 X 게시물

여기에는 중요한 차이가 있다. SpaceXAI는 이미 6월과 7월부터 Word, Excel, PowerPoint, Outlook용 자체 Grok 추가 기능(add-ins)을 제공했고, Grok 4.6은 8월 말부터 Microsoft Foundry에서 이용할 수 있었다. 이번에는 Grok 모델 자체가 Microsoft의 Copilot에 들어간다. 발표에는 적용되는 Grok 버전이나 가격, Frontier 프로그램 이후의 일정이 명시되지 않았다.

🔗 Grok이 X에서 공유한 발표

Grok Bot, Microsoft Teams에서 검색하고 작업하다

9월 11일 — Microsoft 발표 전날 @bot 계정은 SpaceXAI의 상시 실행형 에이전트 서비스인 Grok Bot이 이제 사용자를 대신해 Microsoft Teams에서 검색하고 작업할 수 있다고 밝혔다. 태평양 표준시 기준 9월 10일 늦은 오후에 게시된 메시지는 이미 영업팀을 대상으로 하고 있었다. Grok Bot은 Salesforce, HubSpot, Gong, Clay, Granola에 연결돼 고객 계정을 추적하고, 후속 연락을 처리하며, 심층 조사를 수행한다. 이러한 커넥터는 9월 초에 소개된 Grok Bot for Enterprise부터 양식 작성과 메시지 초안 작성까지의 기능을 확장한다. 두 게시물 모두 필요한 요금제나 가격, 사용 한도를 명시하지 않았다.

🔗 Grok Bot의 Microsoft Teams 지원 발표가 게시된 X


공공 조달과 입법 촉구 사이에서 미국 정부를 마주한 OpenAI

9월 9일과 10일 — 주중에 발표됐지만 이전 호에서 다루지 않았던 OpenAI의 두 글은 미국 공권력을 대하는 회사를 두 가지 측면에서 보여준다. 정부기관에 서비스를 판매하는 동시에 입법부에 규제 마련을 요구하고 있다.

OneGov 2.0, 모든 정부기관에 제공되는 무료 ChatGPT 라이선스

9월 10일 — OpenAI for Government는 지난해의 연방정부 대상 서비스를 이어 미국 연방 총무청(General Services Administration, GSA)과 새로운 다년 계약을 체결했다. 일반적으로 사용자당 월 15달러인 라이선스는 최소 약정 없이 무료가 되며, 사용료는 절반으로 낮아진다. 이제 서비스 범위는 연방정부를 넘어선다. 주정부, 지방정부, 부족 정부도 처음으로 이용할 수 있다. 기존 계약을 통해 이미 100만 명 이상의 공무원이 ChatGPT를 이용하고 있었으며, 대상자는 약 2,300만 명으로 늘어난다. 제공 도구에는 GPT-6 Astra도 포함된다.

계약 항목발표된 내용
사용자당 라이선스최소 약정 없이 월 15달러에서 0달러로 인하
모델 사용료50% 할인
이용 가능한 정부기관연방정부, 주정부, 지방정부 및 부족 정부
사이버 방어 부문Daybreak Blue는 상업용 요금의 50%, Daybreak Red는 요청 시 표준 요금 적용
계약 기간2026년 10월 1일부터 2028년 12월 31일까지 27개월

사이버 방어 부문은 전주에 발표된 10억 달러 규모의 Daybreak for Frontline Defenders를 확장한다. OpenAI는 ChatGPT Enterprise가 조직의 입력 및 출력 데이터를 모델 학습에 사용하지 않는다고 강조했다. 소개 웨비나는 9월 14일로 예정돼 있다.

🔗 연방·주·지방·부족 정부를 위한 AI 접근성과 사이버 방어 확대

연방법과 캘리포니아 법안 네 건을 촉구하는 기고문

9월 9일 — OpenAI의 글로벌 업무 책임자(Chief Global Affairs Officer) Chris Lehane은 정치적 기회의 창이 열렸다고 평가한 기고문에서 의회가 회기 종료 전에 모델 역량을 기준으로 하는 의무적인 국가 차원의 규제를 도입해야 한다고 주장했다. 이러한 의무는 가장 강력한 시스템을 개발하는 소수의 연구소를 대상으로 해야 하며, 스타트업이나 소규모 개발자를 겨냥해서는 안 된다. 또한 안전 정책이 오픈 웨이트 모델에 반대하는 정책으로 변질돼서도 안 된다고 했다. 그동안 OpenAI는 캘리포니아주 의회를 통과해 Newsom 주지사에게 전달된 법안 네 건을 공식적으로 지지한다. 그중 하나인 SB 1119에 대해서는 이미 8월 말에 지지를 표명한 바 있다.

캘리포니아 법안법안의 목적
SB 813독립적인 안전성 평가를 위한 체계
AB 1405AI 감사인에게 적용되는 표준
SB 1119동반자형 챗봇을 사용하는 미성년자 보호
AB 1864AI가 촉진할 수 있는 생물학적 위협에 대한 안전장치

Some of these bills we did not endorse in the past, and are now supporting after reconsidering in light of the recent jump in capabilities we have seen.

🇰🇷 과거에는 이 법안들 가운데 일부를 지지하지 않았지만, 최근 관찰한 급격한 역량 향상을 고려해 다시 검토한 뒤 이제는 지지합니다. — Chris Lehane, OpenAI 글로벌 업무 책임자

기고문은 정렬 실패(misalignment)를 감시하기 위한 업계 표준도 요구한다. 모델이 개발 또는 평가 과정에서 관련 조직의 보안 통제를 무단으로 우회하면 해당 조직에 신속히 서면으로 알리는 방식이다. OpenAI는 Astra의 사고 과정까지 포함한 전체 궤적을 감시하고, 내부 배포를 확대하기 전에 정렬 평가를 의무화한다고 밝혔다. 글에 따르면 완전히 자율적인 재귀적 자기 개선(recursive self-improvement)은 현재 일어나고 있지 않으며, 안전하게 수행할 수 있을 때까지 추진해서는 안 된다.

🔗 AI 정책의 기회의 창이 열렸다. 지금 행동해야 한다.


DeepSeek, 결국 9월 14일 이후에도 V4 Pro API 유지

9월 12일 확인 — DeepSeek API 문서는 이제 9월 10일 발표와 반대되는 내용을 담고 있다. 당시 DeepSeek는 V4.1-Flash 출시와 함께 V4 Pro의 종료를 예고했다. 9월 14일 04:00 UTC부터 deepseek-v4-pro로 향하는 모든 요청을 V4.1-Flash로 리디렉션하고 Flash 요금을 적용하며, 이는 V4.1-Pro 출시 때까지 계속될 예정이었다. 그러나 Models & Pricing 페이지의 안내문에는 이제 사용자 요청에 따라 9월 14일 이후에도 DeepSeek가 V4 Pro API를 계속 제공하고 요금도 변경하지 않으며, 추후 변경이 있으면 미리 알리겠다고 적혀 있다.

같은 문단이 9월 10일 자 변경 기록(Change Log)의 영문판과 중문판에도 실렸다. DeepSeek는 이러한 방침 변경 시점을 밝히지 않았고 X에도 공유하지 않았다. 반면 9월 10일 발표 글에는 여전히 기존 일정이 표시돼 있어 서로 모순되는 두 내용이 모두 온라인에 남아 있다.

토큰 100만 개당 과금 항목deepseek-flash, 비혼잡 시간대deepseek-flash, 혼잡 시간대deepseek-v4-pro, 비혼잡 시간대deepseek-v4-pro, 혼잡 시간대
캐시 적중 입력(cache hit)0,003달러0,006달러0,022달러0,044달러
캐시 미적중 입력(cache miss)0,15달러0,30달러0,66달러1,32달러
출력 토큰0,60달러1,20달러1,98달러3,96달러
동시 요청 수2 5002 500500500
이미지 이해지원지원미지원미지원

따라서 API 사용자에게는 자동 리디렉션이 이뤄지지 않는다. 두 모델은 각각 100만 토큰의 컨텍스트와 최대 384K의 출력을 지원하며 함께 제공된다. 과금 항목에 따라 V4 Pro는 Flash보다 3.3배에서 7.3배 비싸다. 혼잡 시간대는 월요일부터 금요일까지 01:0004:00 및 06:0010:00 UTC이며, 나머지 시간에는 요금이 절반으로 낮아진다.

🔗 DeepSeek API의 Models & Pricing 🔗 DeepSeek API 변경 기록


자체 연산 자원과 모델 구독을 제공하면 Amp 무료 이용 가능

9월 12일 — Amp는 웹사이트에 9월 13일 자로 표시된 Free Agent라는 글을 게시하고 코딩 에이전트의 과금 방식을 변경했다. 사용자가 자체 연산 자원과 모델 구독 또는 키를 제공하면 무료로 이용할 수 있다. ChatGPT 구독 연결에는 더 이상 월간 요금제가 필요하지 않으며, 개인 API 키 사용(Bring Your Own Key, BYOK)에는 Enterprise 외 모든 고객을 대상으로 토큰당 수수료와 한도가 모두 사라졌다. 이제 Amp는 에이전트가 자율적이고 병렬로 작업하는 원격 머신인 orbs에 요금을 부과한다. 자체 머신에 설치하는 실행기(runners)를 이용하면 orbs 없이 무료로 사용할 수 있다. 추론 자원은 여전히 Amp에서 추가 마진 없이 구매할 수 있다.

Amp 요금제표시 가격요금제에 포함된 내용
Hobby(신규)무료모든 기능, 사용량에 따라 유료인 orbs 또는 무료 개인 실행기, 수수료와 한도 없는 BYOK
Individual(Megawatt 또는 Gigawatt)Megawatt 기준 월 20달러orb 사용 시간 45 000분, 무제한 공개 및 비공개 저장소
Teams(신규)추가 비용 없음서로 다른 요금제를 쓰는 구성원, 공유 스레드와 포털, 공동 크레딧, SAML/OIDC SSO
Enterprise별도 견적유료 좌석 없이 공동 크레딧 제공, SCIM, 지출 한도, 감사 로그

팀의 경우 진입 비용이 사라진다. 누구나 작업 공간에 무료로 초대할 수 있으며, 사용량이 많은 사용자는 사용료 할인을 받기 위해 유료 요금제로 전환한다. Amp에 따르면 평균 할인율은 Megawatt가 60%, Gigawatt가 65%다. 한 명이라도 유료 요금제를 이용하면 전체 작업 공간에서 SAML/OIDC 통합 인증을 무료로 이용할 수 있다. 지금까지 Enterprise 고객에게만 계약으로 보장되던 데이터 무보존 또는 최소 보존 정책도 모두에게 확대된다. 마지막으로 Megawatt와 Gigawatt에는 OpenRouter, Amazon Bedrock, Ollama Cloud 등을 포함한 8개 추가 공급자에 대한 조기 접근 권한이 제공된다.

🔗 Amp의 Free Agent 게시물


데스크톱용 ChatGPT 26.908, Pets에서 빠른 대화 시작 및 Windows용 Appshots

9월 11일 — OpenAI는 Pets를 중심으로 한 ChatGPT 데스크톱 애플리케이션 26.908 버전을 출시했다. macOS와 Windows에서 다른 창 위에 떠 있는 선택형 애니메이션 동반자인 Pets는 지금까지 진행 중인 대화를 추적하는 용도로 쓰였다. 이제 대화를 시작하는 지점으로도 사용할 수 있다. 동물 아래에 배치된 조작부에서 빠른 대화(Quick Chat)를 입력하고 Enter를 누르면 기본 창을 열지 않고도 전송할 수 있다. 전역 단축키를 누르면 이 조작부가 나타난다. macOS에서는 Option+Space, Windows에서는 Windows+Alt+P를 사용한다. Mini 모드는 화면에 동물이 표시되지 않지만 같은 단축키와 알림을 유지한다.

동물은 대화 진행 중, 결정 대기 중, 완료 또는 오류로 인한 차단이라는 네 가지 상태를 나타내며, 응답을 기다리는 스레드를 우선 표시한다. 이 조작부에서 시작한 대화는 어떤 프로젝트에도 속하지 않은 상태로 생성된다. 맞춤형 Pets는 기기에만 저장되며 웹의 ChatGPT와 동기화되지 않는다.

8월 말 macOS에 도입된 Appshots도 Windows에 출시된다. 두 Alt 키를 동시에 누르면 현재 맨 앞에 있는 창의 스크린샷과 이용 가능한 텍스트가 사용자가 선택한 ChatGPT 대화로 전송된다. 단축키는 변경할 수 있으며, Windows에서는 appshot이 기본 애플리케이션에서 열린다.

🔗 X에 게시된 ChatGPT 발표 🔗 ChatGPT 애플리케이션 변경 기록


Gemini CLI, sandbox를 격리하고 빌드 파일을 감시하는 nightly

9월 12일 — 9월 10일과 11일에 코드 변경 없이 두 차례 nightly가 나온 뒤, Gemini CLI의 v0.61.0-nightly.20260912에는 두 가지 변경 사항이 추가됐다. 둘 다 보안에 관한 것으로, 9월 2일, 4일, 5일 nightly의 연장선에 있다. stable(v0.59.0)과 preview(v0.60.0-preview.0) 채널에는 변동이 없다.

첫 번째 변경 사항(PR #29250)은 빌드 파일을 통한 간접 프롬프트 주입(indirect prompt injection)을 겨냥한다. 악의적으로 조작된 외부 콘텐츠가 에이전트로 하여금 Makefile 또는 package.json을 수정한 뒤 빌드를 실행하게 만드는 공격이다. 이제 CLI는 세션 중 생성되거나 수정된 빌드 구성 파일을 추적하며, 이후 실행되는 모든 빌드 또는 테스트 명령(npm run, make, cargo, blaze)에 명시적인 확인을 요구한다. Google Docs, Buganizer, web fetch로 가져온 페이지 또는 MCP 서버 응답처럼 신뢰할 수 없는 외부 콘텐츠에서 가져온 인수를 명령이 사용할 때도 같은 규칙이 적용된다.

두 번째 변경 사항(PR #29214, 45개 commit)은 sandbox를 사용자의 구성 및 자격 증명과 분리한다. Gemini CLI는 홈 디렉터리, 시스템 루트 또는 ~/.gemini에서 sandbox를 실행하거나 이러한 경로를 컨테이너에 마운트하지 못하게 한다. 컨테이너에는 hooks와 API 키가 제거된 정제된 설정 사본만 전달된다. macOS에서는 Seatbelt 프로필이 ~/.gemini 및 민감한 파일(oauth_creds.json, trustedFolders.json, .env)에 대한 쓰기와 자격 증명 저장소 및 hooks 정의에 대한 읽기를 차단한다.

🔗 nightly v0.61.0-nightly.20260912 참고 사항


Vibe CLI 2.25.4, 위험한 shell 구문에 승인을 요구

9월 12일 — Mistral이 나흘 동안 네 번째 버전인 Vibe CLI 2.25.4를 공개했다. 이 수정 버전은 우선 보안을 다룬다. 이제 shell 권한 검사는 workspace 제어와 거부 목록(denylist)을 우회할 수 있었던 위험한 명령 구문 및 옵션에 사용자 승인을 요구한다. 릴리스 노트는 이 강화 조치를 CVE-2026-87984부터 CVE-2026-87987까지 네 개의 식별자와 CVE-2026-87988의 잔존 변형에 연결한다. 9월 12일 기준 저장소에는 보안 권고가 없었으며, 이러한 취약점의 심각도도 명시되지 않았다.

2.25.1에서 비밀을 표시할 가능성이 있는 git 명령을 자동 승인하지 못하도록 이미 변경된 스마트 승인(smart approve)의 동작도 다시 달라졌다. 위험한 작업이 재요청되면 이제 단순히 차단하는 데 그치지 않고 이유를 표시하며 확인을 요청한다. 자동으로 승인된 호출은 더 이상 경고가 아니라 간단한 안내로 표시되며, 점진적 배포를 통해 활성화되면 Vibe Desktop의 선택기에 이 모드가 나타난다.

그 밖의 변경 사항은 일상적인 사용의 안정성을 높인다. 유효하지 않은 connector가 있어도 다른 connector의 로딩을 막지 않으며, @을 통한 파일 언급이 --add-dir로 추가된 모든 root에서 작동하고, Zed와 JetBrains 같은 ACP client에는 활성 모드가 항상 표시된다.

🔗 GitHub의 2.25.4 릴리스 노트


Wringer, 가중치당 2.655비트인 40억 parameter 추론 모델

9월 12일 — weiciao wu가 Hugging Face 커뮤니티 블로그에 하이브리드 Qwen3.5 아키텍처를 사용하는 40억 parameter 추론 모델 InternScience/Agents-A1-4B에서 시험한 양자화 방식 Wringer를 공개했다. 이는 연구소의 발표가 아니라 개인의 기여다. 모델 본체는 가중치당 2.655비트까지 줄어들면서 IFEval, HumanEval, GSM8K에서 원래 점수의 평균 93.7%를 유지한다. 반면 같은 모델의 GGUF 양자화 곡선은 보간 기준으로 동일한 bitrate에서 52.7%까지 떨어진다.

방식은 세 단계로 구성된다. 전체 공분산 행렬에 GPTQ를 적용한 closed-form 양자화만으로도 유지율 81.4%를 달성한다. 이어서 채우기(fill) 단계에서는 code를 고정하고 각 linear layer에 rank 128 adapter를 추가한 뒤, 약 1억 token을 이용한 self-distillation으로 학습한다. 단일 GPU에서 약 7시간 30분이 걸린다. 마지막으로 짜내기(wring) 단계에서는 adapter의 기여분을 흡수하도록 code를 다시 계산해 adapter를 제거한다. bit 예산은 같고 inference에는 adapter가 필요 없다.

시험 구성본체 가중치당 bitIFEval 점수HumanEval 점수GSM8K 점수평균 유지율
bf16, 기준1692,7994,5195,53100 %
GGUF, IQ2_M class2,76373,3863,4176,6575,47 %
학습하지 않은 Wringer2,65575,9770,7383,7081,44 %
Wringer, 2회 cycle(공개된 모델)2,65588,1785,3793,4894,65 %
GGUF, IQ2_XXS class2,55834,3820,1236,5432,16 %

93.7%라는 수치는 1회 cycle의 초기 평가 결과이며, Hub에 공개된 2회 cycle 모델은 94.65%에 도달한다. 한계도 명시돼 있다. 2.655비트는 본체의 linear weight에만 해당하며, embedding을 bf16으로 유지하면 전체 모델은 가중치당 4.69비트다. native low-bit kernel이 없어 vLLM에서 inference할 때 bf16으로 다시 변환되므로, 실행 시 메모리나 속도가 개선된다는 사실은 아직 입증되지 않았다. 평가 또한 모델 하나, benchmark 세 개, GGUF와의 비교에만 한정된다. 이 프로젝트에는 단일 GPU로 약 5주가 걸렸으며, 에이전트가 실험 과정을 실행하는 동안 사람이 탐색할 방향을 선택했다.

🔗 Hugging Face 블로그의 Wringer


단신

  • Cognition과 Perplexity가 end-to-end 테스트를 GPT-6 Astra에 맡기다 — API 사례 연구 두 건이다. Devin은 iPhone 게임 Otter Run을 테스트하고 simulator에서 녹화 영상을 반환하며, 보고서에서는 성공한 검증과 테스트하지 않은 영역을 구분한다. Perplexity는 Astra에 다른 서비스의 응답을 모방하는 작은 프로그램을 구축하게 해 애플리케이션을 end-to-end로 시험한다. 🔗 출처
  • OpenAI Developers가 GPT-6 Astra로 구축한 프로젝트 13개를 한데 모으다 — 3D로 탐색할 수 있는 해부학적 구조물 2,234개, Unreal Engine으로 재현한 Manhattan, 오래된 기차 그림을 편집 가능한 object 3,295개로 구성된 Blender 모델로 변환한 사례, C++로 작성된 ray tracer를 iPhone GPU용 Swift로 이식한 사례 등이 포함된다. 🔗 출처
  • autofinetune이 수십 건의 Gemma fine-tuning 실험을 에이전트에 맡기다 — Google Developers Blog에 따르면 Antigravity CLI와 Gemini 3.7 Flash가 학습 script를 수정하고 Cloud TPU에서 Tunix를 실행한 뒤 성능이 향상된 commit만 남긴다. 그 결과 FunctionGemma 270M에서 몇 시간 만에 20건의 실험을 수행했고, 이어 Gemma 3 1B에서 2~3일 동안 GRPO 실험 40건을 진행해 reward를 약 10% 높였다. 🔗 출처
  • ToolGrad가 응답에서 출발해 도구 사용 데이터를 생성하다 — 9월 10일 소식이다. Google Research는 먼저 유효한 API 호출 chain을 만든 다음 요청을 작성하며, ToolBench의 API 16,000여 개에서 성공률이 거의 100%에 이른다. 이 데이터로 fine-tuning한 Gemma 3 12B는 BFCL에서 83.1점을 기록했다. 기사 작성 당시 최고 수준 모델인 gemini-2.5-pro는 83.2점, GPT-5는 74.4점이었다. 🔗 출처
  • Gemini API 문서가 Google AI Studio에 추가되다 — 9월 10일 소식이다. 처음부터 새로 구축된 첫 preview로 ai.studio/docs에서 이용할 수 있으며, Logan Kilpatrick은 사람과 에이전트 모두를 위해 설계됐다고 설명한다. 게시물에는 에이전트가 이를 어떻게 활용하는지 명시돼 있지 않다. 🔗 출처
  • Google이 베니스 국제영화제에서 Android XR 프로젝트 세 개를 지원하다 — 100 ZEROS 팀은 Andy Serkis의 NEVATARS와 Margot Robbie가 내레이션을 맡고 Gemini가 관객과의 대화를 구현하는 Galápagos: The Last Eden, 그리고 Asylm Studios의 심리 thriller Sedona 예고편을 2D에서 3D로 자동 변환하는 작업을 지원했다. 게시물에는 구체적인 모델이나 출시일이 제시되지 않았다. 🔗 출처
  • Claude Code 2.1.270이 2.1.269의 regression을 수정하다 — Bash 도구로 실행한 읽기 전용 git 명령이 일정한 세션 시간이 지난 뒤 다시 권한을 요청하지 않게 됐다. 이 버전의 유일한 변경 사항이다. 🔗 출처
  • Claude Enterprise에서 스마트 보고서(smart reports)를 beta로 제공하다 — 9월 10일 소식이다. Claude가 최대 28일 동안 팀의 대화 기록 표본을 분석하고, 완료한 작업과 비용, 마찰 요인, 공유 skill로 전환할 반복 작업에 관한 보고서를 작성한다. beta 기간에는 매달 보고서 10개가 무료이며, 이 기능은 기본적으로 비활성화돼 있다. 🔗 출처
  • Copilot metric이 VS Code의 Agents 창을 측정하다 — 정식 출시된 새 field는 기업, 조직 또는 사용자별로 1일 및 28일 동안 이 창의 일일 활성 사용자, session, message 수를 집계한다. 소유자, 결제 관리자 및 View Copilot Metrics 권한이 있는 role만 접근할 수 있다. 🔗 출처
  • GitHub가 Universe 2026 티켓 판매를 다시 홍보하다 — 짧은 영상에서 현장 참가자에게만 제공되는 mini-computer 형태의 프로그래밍 가능한 badge를 강조한다. San Francisco에서 10월 28일과 29일에 열리는 행사의 현장 pass는 1,399달러이며 온라인 참가는 무료다. 8월 22일과 9월 7일의 재홍보와 마찬가지로 제품 발표가 없는 홍보다. 🔗 출처
  • Fugu Ultra v2가 OpenRouter에 추가되다 — Sakana AI의 고급 orchestrator로, 입력 token 100만 개당 5달러, 출력 token 100만 개당 30달러이며 context는 token 100만 개다. token 272,000개가 넘는 prompt에는 더 높은 요금이 적용되며, orchestration 자체에서 소비되는 token도 일반 token처럼 과금된다. 🔗 출처
  • ChordStream, symbolic music 모델을 위한 chord당 64bit token — Hugging Face 커뮤니티 블로그에 공개된 specification이다. 각 token에는 MIDI 파일 또는 REMI stream에서 추출한 chord의 key, degree, bass, position이 담기며 captioned-ChordStream dataset도 제공된다. extractor는 여전히 heuristic 방식이며 학습된 모델은 제시되지 않았다. 🔗 출처
  • Qwen3.8-27B가 Cerebras에서 초당 약 1,850 token으로 실행되다 — 무료 이용 시 64k token, 유료 이용 시 128k token의 context를 제공하며, 입력 token 100만 개당 0.99달러, 출력 token 100만 개당 1.49달러다. Cerebras는 이 모델의 Artificial Analysis Intelligence Index 점수를 34점으로 제시한다. 🔗 출처

이것이 의미하는 것

오늘의 첫 번째 흐름은 유통이다. Grok 모델은 Microsoft를 통해 Word, Excel, PowerPoint용 Copilot에 들어왔다. SpaceXAI는 이미 이 애플리케이션용 자체 add-in을 제공하고 있었고, Grok Bot은 하루 전 Salesforce나 HubSpot 같은 상업용 도구에 연결된 데 이어 Teams에도 설치됐다. OpenAI도 같은 영역에 주력한다. 데스크톱용 ChatGPT에서는 floating companion으로 대화를 시작할 수 있고, 이제 Windows에서는 키 두 개로 창 하나를 ChatGPT에 보낼 수 있다. Microsoft도 Grok의 도입을 Copilot에서 선택 가능한 모델을 확대하는 조치로 소개한다. 모델은 이제 별도로 찾아가야 하는 애플리케이션에만 머무르지 않고 이미 열려 있는 도구 안에서 선택할 수 있는 옵션이 된다.

두 번째 흐름은 정책이다. OpenAI는 이틀 동안 연방정부부터 부족 정부까지 약 2,300만 명의 미국 공무원에게 제공되는 ChatGPT license 비용을 0으로 낮추는 계약과, 모델의 capability에 기반한 의무적 법률을 의회에 요구하는 기고문을 발표했다. 두 글은 서로 맞물린다. 회사는 전국 규모의 행정기관 공급자가 되는 동시에, 의무는 startup이나 open weight가 아니라 가장 강력한 system을 개발하는 소수의 연구소에 부과돼야 한다고 제안한다. 과거에는 지지하지 않았던 법안을 포함해 California 법안 네 건을 지지한 것도 해당 기고문에서 역연방주의(reverse federalism)라고 부른 방식, 즉 연방 차원의 조치를 기다리는 동안 주 법률이 수렴하는 흐름에 속한다.

세 번째 흐름은 사용 비용에 관한 것이다. Amp는 사용자가 직접 제공하는 token에 대한 과금을 중단하고 inference를 마진 없이 재판매하는 대신, 에이전트가 실행되는 원격 machine에 요금을 부과한다. 더 저렴한 V4.1-Flash를 위해 V4 Pro를 철회하려 했던 DeepSeek는 수요에 대응해 기존 가격으로 이를 유지한다. 가격이 3.3배에서 7.3배까지 높아도 일부 사용자는 최저가보다 특정 모델을 더 중시한다. 한편 Sakana는 자체 orchestration에 쓰인 token까지 과금하며, Cerebras는 Qwen3.8-27B의 속도를 상품화한다. 마지막으로 Wringer는 가중치당 2.655비트로 압축해도 inference가 bf16으로 돌아가는 한 비용이 아직 줄지 않는다는 점을 보여준다.

마지막 흐름은 command line 에이전트의 보안이며, 모두 승인 요청이라는 동일한 메커니즘을 중심으로 전개된다. Gemini CLI는 세션 중 빌드 파일이 수정됐거나 명령이 웹페이지 또는 MCP 서버에서 가져온 인수를 사용할 때 승인을 요구하고, sandbox를 사용자의 자격 증명과 분리한다. Vibe CLI 2.25.4는 제어를 우회하던 shell 구문에 승인을 의무화하면서 CVE 네 건과 다섯 번째 CVE의 변형을 언급하고, 스마트 승인을 차단 방식에서 확인 방식으로 바꾼다. Claude Code 2.1.270은 그 반대 측면을 보여준다. regression 때문에 단순한 읽기 전용 git 명령에도 권한을 다시 요청하고 있었다. 취약점을 그대로 통과시키는 상황과 질문을 지나치게 자주 던지는 상황 사이에서, 이러한 요청을 조정하는 일이 개발사의 눈에 띄는 과업이 되고 있다.


출처