ai-powered-markdown-translatorgpt-5.4-mini로 fr에서 ko로 번역된 기사.
2026년 8월 8일, Anthropic은 Claude Managed Agents에 세션 예산, 계산 지역 선택, skills 자동 로드, 그리고 세션 중에 확인할 수 있는 더 강력한 조언자 모델을 추가해 기능을 확장했다. 같은 날 Firebird는 아르메니아에 CIS 지역 최대 AI factory를 개소하며 2027년 말까지 7만 개 이상의 GPU를 목표로 한다고 밝혔고, GitHub는 Copilot에서 Kimi K3의 복귀와 정확한 요금을 확인하는 한편 code review의 Lite와 Balanced 수준을 일반 제공으로 전환하고 주간 요약도 공개했다. 여기에 X Premium 구독을 Grok에 연결하는 Warp Agent CLI, Replit의 대규모 에이전트 사용에 대한 내부 보고, 두 개 순위표에서 경쟁력을 입증한 Meta Muse Spark 1.2, 그리고 Hugging Face, Together AI, 생성형 미디어 쪽의 브리핑 십여 건이 더해졌다.
Claude Developer Platform : Managed Agents를 위한 네 가지 업데이트
8월 8일 — Anthropic은 Claude Developer Platform의 Claude Managed Agents에 네 가지 개선 사항을 제공했다. 이제 세션마다 예산을 설정해 지출을 제어할 수 있으며, 한도에 도달한 세션은 budget_reached 이벤트와 함께 일시 중지되고 예산을 올리면 다시 이어갈 수 있다. model.inference_geo 매개변수는 us(1.1배 과금, 미국 지역 보장) 또는 global(표준 요금, 가용한 용량이 있는 곳에서 추론)을 허용한다. Managed Agents는 연결된 저장소의 .claude/skills/에 이미 있는 skills도 추가 설정 없이 자동으로 로드한다. 마지막으로, Managed Agent는 이제 세션 중에 두 번째 의견을 받을 수 있는 더 강력한 “조언자”(advisor) 모델을 사용할 수 있으며, 로스터 설정은 한 줄이면 충분하다.
| 업데이트 | 세부 내용 |
|---|---|
| 세션 예산 | 한도에서 자동 일시 중지, budget_reached 이벤트 |
| 계산 지역 | us(1.1배) 또는 global(표준 요금) |
| skills 로딩 | 연결된 저장소에서 자동 |
| 조언자 모델 | 세션 중 두 번째 의견, 설정 1줄 |
코드 도구 : Warp는 X Premium을 연결하고, Replit은 내부 에이전트 실태를 공개
Warp Agent CLI가 X Premium 구독 연결을 위한 /connect-grok을 추가
8월 7일 — Warp는 8월 4일 출시한 Warp Agent CLI에 /connect-grok 명령을 추가해 기존 X Premium 구독을 연결하고 별도의 API 키를 설정하지 않고 Grok을 사용할 수 있게 했다. 이는 도구가 이미 제공하던 “bring your own key” 모델의 확장이다. 같은 날 Warp는 여러 기능을 함께 보여주는 시연 영상을 공개했는데, 멀티 에이전트 오케스트레이션, 추론 구문 강조가 있는 plan 모드, 음성 모드(/voice), shell 모드가 포함됐다.
Run /connect-grok in the Warp Agent CLI to use your X Premium subscription with Warp!
🇰🇷 Warp Agent CLI에서 /connect-grok을 실행해 Warp와 함께 X Premium 구독을 사용하세요! — @warpdotdev X에서
Replit, 에이전트를 사용해 코드 산출량을 거의 세 배로 늘린 내부 운영 방식을 공개
8월 7일 — Replit은 자체 에이전트를 내부에서 6개월간 사용한 결과를 담은 내부 보고서를 공개했다. 생성된 코드의 양은 거의 세 배로 늘었고, 리뷰 시간과 회귀율, 장애 건수는 안정적으로 유지됐으며 품질은 향상됐다. 팀은 이것이 단일 AI가 아니라 여러 기능에 걸쳐 분산된 에이전트 시스템이라고 강조한다. 여기에는 장애 조사, pull request 리뷰, 지원 triage, 데이터 분석, 영업 계정 조사 등이 포함된다. 또 하나의 눈에 띄는 점은 내부에서 사용하던 유료 SaaS 도구를 Replit에서 완전히 개발한 애플리케이션으로 대체했고, 그 결과 원래 제품보다 더 낫다고 평가했다는 것이다. Replit은 이러한 변화를 “autopilot된 회사”의 시작이라고 표현했다.
Over the last 6 months, Replit nearly tripled its code output. Quality held. Nothing broke. We started becoming a self-driving company.
🇰🇷 지난 6개월 동안 Replit은 생성된 코드의 양을 거의 세 배로 늘렸습니다. 품질은 유지됐습니다. 아무것도 망가지지 않았습니다. 우리는 autopilot된 회사가 되었습니다. — @Replit X에서
Meta Muse Spark 1.2가 두 개 순위표에서 경쟁력을 입증
8월 6일 — 서로 다른 두 순위표가 Meta Muse Spark 1.2의 돌파를 확인했다. 범용 순위표인 Vals Index에서 이 모델은 테스트당 0.69달러로 상위 5위에 진입했으며, 이는 Kimi보다 약 3배 저렴하고 Opus, Fable 또는 GPT-5.6 Sol보다 10배 이상 저렴한 수준이다. 게임 개발 특화 순위표에서는 Muse Spark 1.2가 GPT-5.6-Sol과 동률을 이루며 공동 3위를 차지했다. Meta 팀의 한 엔지니어는 올해 초만 해도 이런 순위표에서 자사가 이런 위치에 오르는 것은 불가능하다고 여겼다고 말한다. 이 두 신호는 8월 초 이미 다뤘던 국제 과학 올림피아드 금메달과 Artificial Analysis 벤치마크에 더해져, Muse Spark 계열의 경쟁력이 계속 높아지고 있으며 비용 면에서 특히 큰 이점을 보인다는 점을 확인해 준다.
| 순위표 | Muse Spark 1.2의 위치 | 기준 |
|---|---|---|
| Vals Index | 상위 5위 | 0.69 $/test, Kimi보다 3배 저렴 |
| 비디오 게임(특화) | 공동 3위 | GPT-5.6-Sol과 동률 |
Muse Spark 1.2 just cracked the top 5 on the Vals Index, at just $0.69 per test. This is 3x cheaper than Kimi and 10x or more cheaper than Fable, Opus, and 5.6 Sol.
🇰🇷 Muse Spark 1.2가 방금 Vals Index 상위 5위에 진입했습니다. 테스트당 고작 0.69달러입니다. 이는 Kimi보다 3배 저렴하고 Fable, Opus, 5.6 Sol보다 10배 이상 저렴합니다. — @ValsAI X에서
GitHub Copilot : Kimi K3, 주간 신규 기능, 그리고 code review
Copilot의 Kimi K3 : 배포 일시 중지 후 재개, 요금 확인
8월 6-7일 — GitHub는 GitHub Actions에 영향을 주는 장애를 해결하는 동안 8월 6일 Copilot에서 Kimi K3 배포를 일시 중지했으며, 동시에 모델의 예정된 요금도 미리 안내했다. 다음 날인 8월 7일 GitHub는 배포 재개를 발표했다. Kimi K3는 usage-based billing의 일환으로 공급자(provider) 목록 요금(provider list pricing)으로 청구되며, 회사는 전체 모델 및 요청 세부사항은 요금 문서를 참고하라고 안내했다. 이 조치는 전날 발표된 Copilot에서의 Kimi K3 일반 제공을 보완하는 것으로, 정확한 요금 정보와 배포를 잠시 중단시켰던 기술적 장애의 세부사항을 추가한다.
| 토큰 유형 | 가격 |
|---|---|
| 입력 | 3 $ / million |
| 출력 | 15 $ / million |
| 캐시 입력 | 0.30 $ / million |
🔗 배포 재개 트윗
8월 3일 주간 신규 기능 : 앱, CLI, VS Code
8월 7일 — GitHub Copilot의 주간 요약은 desktop app, CLI, VS Code 1.132를 다룬다. desktop app에서는 이제 요청마다 사용된 모델과 소모된 크레딧, 캐시 사용 내역이 표시되며, 공유 세션에 참여하거나 /side을 통해 병렬 탐색을 열 수 있다. CLI는 사이드바에서 여러 세션을 동시에 관리할 수 있게 하고(n은 생성, x는 탐색 단축키), 격리된 작업 공간을 위한 실험용 /worktree 명령과 Git 의존 없이 이전 상태로 복원하는 /rewind 명령을 추가했다. VS Code 1.132에서는 다국어 받아쓰기가 말한 언어를 자동 감지하며, /btw 명령으로 현재 대화를 중단하지 않고 후속 질문을 할 수 있다.
| 표면 | 핵심 신규 기능 |
|---|---|
| Desktop app | 요청별 모델과 크레딧 표시, /side 명령 |
| CLI | 다중 세션, /worktree, Git 없이 /rewind |
| VS Code 1.132 | 다국어 받아쓰기, /btw 명령 |
Copilot code review : Lite와 Balanced가 일반 제공으로 전환
8월 7일 — GitHub는 Copilot code review의 두 가지 노력 수준을 일반 제공으로 전환하며, 기존 Low와 Medium 명칭을 대체했다. Lite 수준은 문서, 사소한 수정 같은 단순 변경을 대상으로 하며, 집중된 피드백을 제공한다. Balanced 수준은 복잡한 로직, 보안 측면에서 민감한 코드, 서비스 간(cross-service) 변경에 적합하며, 강화된 추론 모델을 활용한 더 심층적인 분석을 제공한다. 선택은 저장소나 조직의 기본값을 바꾸지 않고 개별 리뷰마다 이뤄지지만, 관리자는 조직 설정에서 모든 저장소에 적용되는 기본 수준을 지정할 수 있다. 선택된 수준은 이제 pull request의 타임라인과 요약 댓글에 표시된다. 두 수준은 Copilot Pro, Pro+, Max, Business, Enterprise에 포함된다.
| 수준 | 대상 | 포함된 요금제 |
|---|---|---|
| Lite | 단순 변경, 문서, 사소한 수정 | Pro, Pro+, Max, Business, Enterprise |
| Balanced | 복잡한 로직, 보안, cross-service | Pro, Pro+, Max, Business, Enterprise |
🔗 Copilot code review 노력 수준이 일반 제공으로 전환
Firebird, 아르메니아에 CIS 지역 최대 AI factory를 개소
8월 8일 — CIS(독립국가연합) 지역에서 활동하는 신흥 AI cloud인 Firebird가 아르메니아 Hrazdan에서 이 지역 최대 AI factory로 소개되는 시설을 개소했다. 이 인프라는 NVIDIA의 가속 컴퓨팅 플랫폼과 Dell Technologies PowerEdge 서버를 기반으로 하며, NVIDIA DSX 플랫폼은 에너지 효율을 통해 같은 면적에서 GPU를 40% 더 많이 배치할 수 있다고 주장한다. 이번 구축은 2027년 말까지 7만 개 이상의 GPU(Blackwell과 Rubin 혼합)를 배치하고, 300메가와트 용량을 목표로 하며, 6개월이 조금 넘는 기간에 가동을 시작한다. Perplexity는 초기 고객으로 언급된다. Firebird는 아르메니아와 카자흐스탄을 첫 이정표로 하는 20억 와트 규모의 지역 로드맵도 발표했다.
| 항목 | 세부 사항 |
|---|---|
| 배치된 GPU | 2027년 말까지 70,000개 이상(Blackwell + Rubin) |
| 목표 용량 | 300 MW |
| 파트너 | NVIDIA, CoreWeave, Dell Technologies, Schneider Electric, Vertiv |
| 초기 고객 | Perplexity |
🔗 Firebird가 아르메니아에 CIS 지역 최대 AI Factory를 개소
브리핑
- Replit, 프로젝트를 워크스페이스 간에 이동할 수 있게 함 — 같은 team 또는 enterprise 계정의 workspace 간 전송이 가능하며, 프로젝트 목록의 드롭다운 메뉴에서 실행할 수 있다. 🔗 출처
- 새로운 DNA foundation 모델이 Hugging Face에 공개됨 — DNA 서열을 읽고 생성할 수 있는 모델이 데모 공간과 함께 제공된다. 모델 이름과 조직은 공개되지 않았다. 🔗 출처
- NVIDIA, NeMo Gym의 대화형 tool-use 자산을 공개 — 에이전트가 도구를 사용하는 대화형 모델을 학습하기 위한 참고용 policy/tool 쌍과 프롬프트 이력이 Hugging Face에 올라왔다. 🔗 출처
- Hugging Face, ICML 2026 논문을 재현하는 AI 에이전트 연구를 소개 — AI 에이전트가 과학 논문을 자동으로 재현하는 내용의 스레드로, 방법론이나 성공률의 세부사항은 없다. 🔗 출처
- Hugging Face Storage Buckets가 Vast AI에 통합됨 — Vast AI에서 임대한 GPU 인스턴스가 이제 수동 전송 없이 Hugging Face bucket을 직접 읽고 쓸 수 있다. 🔗 출처
- 제3자 공급업체가 DeepSeek V4 Flash와 Kimi K3에서 가장 빠른 추론을 주장 — 합성 테스트가 아니라 실제 production 트래픽을 근거로 한 주장으로, 신중하게 볼 필요가 있다. 🔗 출처
- Together AI가 문서에 Learn 섹션을 추가 — 첫 토큰까지의 시간(TTFT), context window, sampling, fine-tuning, quantization, 배포 트레이드오프를 설명하는 교육용 콘텐츠다. 🔗 출처
- FLUX 3가 Together AI에서 production 사용 가능 — Black Forest Labs의 멀티모달 모델(동기화된 비디오와 오디오, 최대 20초 클립)이 Together AI의 관리형 serverless inference를 통해 제공된다. 🔗 출처
- Roomote가 Together AI를 추론 공급자로 선택 — 이제 에이전트 도구가 workflow 단계별로 코드, 계획, 비전, 리뷰에 서로 다른 오픈 모델을 할당할 수 있다. 🔗 출처
- Copilot impact dashboard에 투자수익 섹션 추가 — 새 섹션은 개발자당 Copilot의 월 비용과 생성된 pull request 수를 비교하며, 대화형 급여 선택기가 포함된다. 🔗 출처
- 이제 기업이 타사 GitHub Apps를 설치할 수 있음 — enterprise 계정 소유자는 공개 외부 GitHub Apps를 설치할 수 있으며, enterprise 계정에 대한 접근은 제한되고 민감한 권한은 더 좁게 제한된다. 🔗 출처
- MiniMax H3, DesignArena 세 개 부문에서 1위 — 이 open weights 모델은 DesignArena Frontier 순위에서 Multi-Image to Video, Image to Video, Video Editing 부문 1위를 주장한다. 🔗 출처
- Kimi K3 — 다운로드 수와 활성 사용자 급증(SensorTower) — Kimi 앱 다운로드 수는 거의 다섯 배로 늘었고, 일간 활성 사용자는 Kimi K3 출시 이후 약 40% 급증했다. 🔗 출처
의미하는 바
에이전틱 인프라는 주요 공급업체들 사이에서 표준화되고 있다. Anthropic은 Managed Agents에 Claude Code가 이미 단독으로 제공하던 것들 — 예산, 리전 선택, skill 로딩 — 을 더하고, 세션 도중에 조회할 수 있는 조언자 모델로 혁신한다. GitHub은 거버넌스 측면에서 같은 논리를 이어간다. Copilot code review는 Lite와 Balanced를 조직 단위 설정으로 일반화하고, CLI는 세션을 일회성 흐름이 아니라 복원 가능한 상태로 다루는 되돌릴 수 있는 명령들(/rewind)을 추가한다. 한편 Warp는 전용 API 키를 강요하지 않으면서도 X Premium 구독을 통해 Grok 등 제3자 모델 접근을 확장한다. 공통점은 분명하다. 에이전틱 도구들이 클라우드 인프라의 전통적인 습관 — 예산, 리전, 권한, 되돌리기 — 을 그대로 받아들이고 있다는 점이다.
비용 대비 성능은 여전히 원시적인 순위보다 도입 선택을 더 강하게 좌우한다. Meta Muse Spark 1.2는 테스트당 0.69 $로 Vals Index 상위 5위권에 진입했으며, 비슷한 포지션의 Kimi보다 3배 저렴하다. 반면 Kimi K3는 SensorTower 기준 다운로드 수가 거의 5배 늘어난 것으로 보이며, GitHub Copilot에서는 정확한 사용량 기반 요금(백만 토큰당 3 $ / 15 $)을 확인시켰다. 이 두 신호를 함께 보면, 사용자 견인력과 요청당 비용이 기준 순위에서의 위치만큼이나 중요한 시장이 형성되고 있음을 알 수 있다.
물리 인프라의 배포는 전통적인 지역 밖에서도 계속 가속되고 있다. Firebird는 CIS 지역 최대 규모의 AI factory를 구축하기 위해 아르메니아를 택했으며, 2027년 말까지 7만 개 이상의 GPU와 20억 와트 규모의 지역 로드맵을 목표로 한다. 초기 고객으로 언급된 Perplexity는 모델 공급업체들이 미국이나 중국 허브에만 의존하기보다 계산 자원의 지리적 다양성을 적극적으로 추구하는 흐름을 보여준다.
마지막으로, 위성 도구 생태계는 몇몇 오픈 추론 공급업체를 중심으로 굳어지고 있다. Together AI는 일주일 사이 여러 통합을 연달아 내놓았다 — FLUX 3의 프로덕션 적용, 에이전틱 고객으로서의 Roomote, 추론 개념 전용 교육 섹션 — 반면 Hugging Face는 Vast AI 통합을 통해 저장소 플랫폼으로서의 역할과 모델 배포 플랫폼으로서의 역할을 함께 확장하고 있다. 화려한 발표보다는 짧은 소식들로 이뤄진 이러한 흐름이, 오늘날 더 눈에 띄는 사용 사례들이 의존하는 배관을 조용히 구축하고 있다.
출처
- @ClaudeDevs 공지 — Managed Agents
- @warpdotdev 공지 — /connect-grok
- @Replit 공지 — 에이전트 내부 현황
- @ValsAI 공지 — Muse Spark 1.2
- @github 트윗 — Kimi K3 재조명
- GitHub 변경 로그 — 8월 3일 주간 새 기능
- GitHub 변경 로그 — Copilot code review effort levels
- NVIDIA — Firebird AI factory 아르메니아
- @Replit 공지 — 프로젝트 이동
- @EmmaScharfmann 공지 — ADN foundation 모델
- @HuggingPapers 공지 — NeMo Gym
- @huggingface 공지 — ICML 2026 에이전트
- @vast_ai 공지 — Storage Buckets
- @amiruci 공지 — 빠른 추론
- @togethercompute 공지 — Learn 섹션
- @togethercompute 공지 — FLUX 3
- @togethercompute 공지 — Roomote
- GitHub 변경 로그 — Copilot impact dashboard ROI
- GitHub 변경 로그 — 타사 GitHub Apps
- @MiniMax_AI 공지 — DesignArena
- @a16z 공지 — Kimi K3 SensorTower