ai-powered-markdown-translatorgpt-5.4-mini를 사용해 fr에서 ko로 번역된 기사.
7월 17일은 에이전트 코딩 도구의 비즈니스 모델 변화로 기억될 만한 날이었다. Amp가 첫 월간 구독을 출시하며 기존의 전면 사용량 과금 방식에서 벗어났고, Claude Code는 WebSearch와 서브에이전트를 위한 폭주 방지 안전장치를 갖춘 새 버전을 내놓았다. 한편 Perplexity, Gemini, Grok은 기업용 자율 에이전트 플랫폼을 강화했다. 미디어 생성 분야는 HeyGen, ElevenLabs, Runway에서 여전히 활발했고, 오픈 연구 분야에서는 현재 모델의 한계를 되짚는 두 편의 논문이 공개됐다.
Amp가 첫 월간 구독을 출시하다: Megawatt와 Gigawatt
7월 17일 — Amp(Sourcegraph / Amp Frontier Corporation)가 베타로 첫 월간 구독을 출시했다. 이는 지금까지 순수하게 사용량 기반 과금(API 원가 기준)으로만 동작하던 제품에 대한 전략적 전환이며, 구독형 경쟁사보다 더 비싸게 느껴지게 만들던 모델에서 벗어나는 변화이기도 하다. Amp는 발표 글에서 스스로를 지금까지는 « 에이전트 코딩 도구계의 Apple 또는 Porsche »였다고 설명한다.
| 평가된 요금제 | 월간 가격 | 포함된 orb 시간 | 포함된 에이전트 사용량 | 사용 가능한 모드 |
|---|---|---|---|---|
| Megawatt | $20 | 750시간(작은 orbs) | $20 | low, medium |
| Gigawatt | $200 | 1,000시간(큰 orbs) | $200 | low, medium, high, ultra |
Megawatt에는 자신의 ChatGPT 구독을 연결해 GPT-5.6에 접근하거나, X Premium+/SuperGrok 구독을 연결할 수 있는 기능도 포함된다. 출시 프로모션으로는 7월 19일 일요일 이전에 구독을 시작한 모든 사용자에게 첫 달 동안 포함 사용량(orbs 및 agents)을 두 배로 제공한다. 구독을 원하지 않는 사용자는 여전히 사용량 기반 과금을 이용할 수 있으며, 포함 한도를 넘기면 ChatGPT 구독을 연결하거나 유료 크레딧을 추가해야 한다.
Amp는 이 전환의 이유로 양질의 토큰 비용이 전반적으로 낮아진 점(예시로 새 « low » 모드의 GLM-5.2를 언급)과, 에이전트 작업이 로컬 워크스테이션보다 원격 머신(« orbs »)으로 이동하고 있다는 점을 든다. 회사는 사용자들이 « 자신의 단일 로컬 개발 환경을 종료하길 » 원한다고 밝힌다.
“Introducing Amp Subscriptions. $20 or $200 gets you on the agentic frontier with us.”
🇰🇷 Amp 구독 소개. 20달러 또는 200달러로 우리와 함께 에이전트 프런티어에 접근할 수 있습니다. — X의 @sqs
Claude Code와 Amp: 새로운 에이전트 기능
Claude Code CLI v2.1.212: 폭주 방지 안전장치
7월 16일 — Anthropic이 Claude Code 2.1.212 버전을 공개했다(파리 시간 21:20에 npm에 배포). 가장 눈에 띄는 변경은 /fork 관련으로, 이제 이 명령은 대화 내용을 백그라운드의 새 세션으로 복사하며(claude agents에서 확인 가능), 세션에서 실행된 기존 서브에이전트는 /subtask로 이름이 바뀐다. 두 가지 폭주 방지 장치도 추가됐다. 하나는 WebSearch 도구 호출에 대한 세션별 제한(기본 200회, CLAUDE_CODE_MAX_WEB_SEARCHES_PER_SESSION로 조정 가능)이고, 다른 하나는 실행 가능한 서브에이전트 수의 상한(기본 200개, CLAUDE_CODE_MAX_SUBAGENTS_PER_SESSION)이다. 2분을 넘기는 MCP 도구 호출은 이제 자동으로 백그라운드로 전환된다.
보안 관련 수정도 두 가지 있다. 플랜 모드에서는 권한 요청 없이 파일을 수정하는 Bash 명령(touch, rm)을 더 이상 실행할 수 없으며, .claude/worktrees에 커밋된 symlink를 따라 worktree를 생성할 때 저장소 밖에 파일을 쓸 수 없게 됐다.
Amp: 이제 에이전트가 다른 에이전트를 spawn할 수 있다
7월 17일 — Amp가 « From Agent to Agent »를 출시했다. 이제 Amp 에이전트는 다른 에이전트를 만들어낼 수 있으며(spawn), orb(원격 머신), 로컬 머신 또는 그 밖의 어떤 머신에서도 서로 메시지와 파일을 주고받을 수 있다.
Amp가 제시한 사용 사례는 다음과 같다. 사용자가 본래 작업을 계속하는 동안 orb에서 에이전트를 실행해 부차적인 버그를 처리하기, 여러 스레드를 병렬로 돌리기(예: 서로 다른 네 가지 화면 크기에서 흐름을 테스트하기 위해 low 모드의 4개 스레드), 중단된 이전 스레드에서 유용한 파일을 회수하기, 다른 머신으로 작업을 넘기기, 또는 에이전트에게 API 변경 사항을 문서화하게 하여 프로젝트 간 작업을 조정하기 등이다. 이 기능은 « Agents in Orbs »(6월 30일)와 « Custom Agents »(6월 19일)를 확장한 것이지만, 스레드와 머신을 가로지르는 에이전트 간 통신을 처음으로 도입했다. 공동 창업자 Thorsten Ball은 공식 출시 몇 시간 전 X에서 이 기능을 예고한 바 있다.
자율 에이전트: 기업 자동화와 생산성
Manus (James)와 Ascendea: 90배 생산성 사례 연구
7월 17일 — Manus가 Ascendea를 조명한 사례 연구를 공개했다. Ascendea는 Warwick 대학교 Science Park에 기반을 둔 영국 에이전시로, 소규모 기업을 위한 CRM, 에이전트, 자동화를 개발한다. CTO Rob Arnold는 자신의 Manus 인스턴스에 « James »라는 이름을 붙이고, 이를 회사의 AI 비서실장으로 삼았다. 이 구조는 세 층으로 이뤄져 있다. 복잡한 작업은 Manus가 맡고, 일상적인 인간 인터페이스는 Slack 대화형 에이전트(Victor, Victoria, Ava)가 담당하며, 반복 작업은 전용 서버에서 실행되는 여섯 개의 로컬 에이전트가 처리한다.
가장 주목받은 사용 사례는 하루 만에 303개의 표준 운영 절차(SOP)를 생성한 일이다. 이는 수작업 방식으로 두 사람이 처리했다면 약 14주가 걸렸을 것으로 추정되는 작업이다. Ascendea는 현재 인간 직원 10명만으로 운영되며, 112개의 활성 고객을 상대하고, Manus를 통해 조정되는 28~33개의 IA 워크플로를 운영한다.
Perplexity가 Projects를 출시하다, Computer의 Spaces 진화판
7월 17일 — Perplexity가 자사 에이전트 환경인 Perplexity Computer 안에서 Spaces의 후속작인 Projects를 발표했다. Projects는 파일, 애플리케이션, 대화 스레드를 하나의 지속 세션에 모으며, 새로운 작업은 이전 세션의 전체 컨텍스트를 포함한 상태로 시작된다.
이 기능은 기업 팀을 대상으로 한다. Drive, Notion, Linear, Salesforce, Snowflake, Slack/Microsoft Teams 같은 도구와 연결되며(400개 이상의 커넥터가 발표됨), 각 사용자의 데이터, 메모리, 접근 권한은 분리된다. Projects는 Computer의 자기 학습형 메모리 시스템인 Brain 위에서 동작하며, Skills와 통합되고, 연결된 소스와 답변의 추적 가능성을 나열하는 « trust panel »을 제공한다. 기존 Spaces는 자동으로 마이그레이션되며, 오늘부터 모든 Computer 사용자에게 제공된다. 눈에 띄는 점은 공식 페이지의 게시일이 7월 22일로 표시되어 있지만, 실제로는 이미 17일부터 온라인이며 공개 접근이 가능하다는 것이다.
Grok의 Automations
7월 16일 — xAI가 Grok에 Automations를 출시했다. 작업을 한 번만 설명해두면, 일정에 따라(한 번, 매일, 평일, 매주, 매월 또는 매년) 자동으로 실행되거나, 정의된 필터에 맞는 이메일 도착을 계기로 실행되도록 할 수 있다. 각 실행은 Grok와의 완전한 대화를 열며, 실행 기록에서 확인할 수 있고, 이메일, 앱 알림, 둘 다, 또는 아무 것도 받지 않도록 설정할 수 있다.
Automations는 grok.com과 Grok 모바일 앱(iOS, Android)에서 사용할 수 있다. 일정 기반 자동화는 모든 사용자에게 제공되며, 이메일 트리거는 SuperGrok 구독자만 사용할 수 있다.
Google / Gemini: 기업용 에이전트 플랫폼
Conductor가 휴대 가능한 플러그인이 되다, Antigravity CLI 및 Claude 호환
7월 16일 — 작년에 Gemini CLI용으로 출시된 사양 기반 개발(Spec-Driven Development) 확장인 Conductor가 이제 Conductor Plugin이 된다. 이는 skills, 규칙, MCP 서버, hooks를 하나의 패키지에 담는 형식이다. 지금까지는 Gemini CLI에만 묶여 있었지만, 이제 Antigravity CLI와 Claude에서도 사용할 수 있다.
이제 에이전트는 자연스럽게 대화하면서 컨텍스트, 사양(spec.md), 계획(plan.md)을 생성하고 발전시킨다. 이들은 지속적인 Markdown 산출물로 유지되며 버전 관리된다. Google은 기존 명령과의 하위 호환성을 유지하며, TerminalBench의 가장 복잡한 작업 하위 집합에서 더 높은 성공률을 보인다고 밝혔다. Antigravity CLI의 경우 설치는 agy plugins install https://github.com/gemini-cli-extensions/conductor를 통해 이뤄진다.
🔗 공식 발표
Gemini Enterprise Agent Platform이 Parallel Web Systems와 협력하다
7월 16일 — Google Cloud가 Parallel Web Systems(트위터 전 CEO Parag Agrawal가 설립)와의 파트너십을 발표했다. 목표는 자사 검색 인프라를 Gemini Enterprise Agent Platform의 새로운 웹 grounding 제공자로 네이티브 통합하는 것이다. 이를 통해 에이전트가 최신이며 검증 가능한 웹 결과와 정확한 인용을 기반으로, 자동화된 KYC 점검이나 제품 카탈로그 보강 같은 작업을 수행하도록 하려는 것이다.
이 기능은 Gemini API를 통해 제공되며, Agent Studio에서 선택할 수 있고, Google Cloud Marketplace를 통해 사용량 기반으로 과금된다. 민감한 워크로드를 위한 데이터 무보존 옵션도 제공된다. 일반적인 웹 검색과 달리, 이 통합은 내부 데이터베이스를 강화하기 위해 데이터를 추출하고 영구적으로 캐시하는 것을 허용하며, 결과를 다른 LLM이 후처리할 수도 있다. Parag Agrawal에 따르면, AI 에이전트는 곧 인간보다 훨씬 더 많이 웹을 사용할 것이므로, 그 동작 방식에 맞춘 검색 인프라가 필요하다.
🔗 공식 발표
미디어 생성
HeyGen — Batch APIs를 프로덕션에 배포
7월 17일 — HeyGen이 Batch APIs를 공개했다. 이를 통해 한 번의 요청으로 최대 100개의 비디오, 번역, 립싱크(lipsyncs), 또는 업로드를 제출할 수 있으며, 배치 처리가 끝난 뒤에는 하나의 웹훅 알림만 받으면 된다. 이 기능은 대규모 프로덕션 사용 사례—에이전시, 마케팅 팀—를 겨냥하며, 이전에는 같은 양의 콘텐츠를 처리하기 위해 수백 번의 개별 API 호출을 관리해야 했다.
HeyGen — HyperFrames에 통합 미디어 라이브러리 추가
7월 17일 — HeyGen이 코드로 비디오를 만드는 도구(write HTML, render video)인 HyperFrames에 통합 미디어 라이브러리를 추가했다. 이 라이브러리는 10,000개 이상의 오디오 트랙, 75,000개의 이미지, 효과음, 로고를 모으며, HeyGen 계정만 있으면 무료로 이용할 수 있고, 자체 생성형 모델에도 접근할 수 있다. 사용한 자산은 로컬에 저장되어 새 프로젝트를 시작할 때마다 다시 검색할 필요가 없다.
🔗 X의 발표
ElevenLabs — Sir Michael Caine의 AI 음성으로 들려주는 『오디세이아』
7월 17일 — ElevenLabs가 배우 Sir Michael Caine의 완전 라이선스 AI 음성으로 낭독한 호메로스의 『오디세이아』 전체판을 ElevenReader 앱에서 무료로 제공한다. 이는 공식적으로 라이선스된 AI 음성을 통해 프리미엄 오디오 콘텐츠를 제공하려는 ElevenLabs 전략의 연장선상에 있는, 완전 허가를 받은 유명인 음성 파트너십의 또 다른 사례다.
🔗 X의 발표
Runway Agent 2.0, 독립 벤치마크 Physion-Arc 1.0에서 1위
7월 16~17일 — Runway는 7월 16일 제3자 평가기관 Physion Labs가 공개한 독립 벤치마크 Physion-Arc 1.0의 결과를 강조했다. 이 벤치마크는 6개의 AI 비디오 에이전트에 16개 지표로 평가되는 30개의 영화적 프롬프트를 적용했다. Runway Agent(6월 말 출시된 2.0 버전)는 평가된 세 축인 서사적 일관성, 영화적 언어, 제작 품질에서 모두 선두를 차지했다.
Runway는 또한 Agent 뒤에 있는 철학을 설명하는 기술 글도 게시했다. 핵심은 채팅보다 비주얼 중심의 인터페이스, 각 기반 모델의 강점과 약점에 대한 지식을 인코딩한 시스템, 그리고 그 능력들을 워크플로로 결합하는 « skills » 계층이다. 앞으로 논의된 방향은 세션 간 컨텍스트 메모리, 일괄 생성, Agent 내부에서 직접 작업 예약 기능이다.
🔗 X의 발표
연구 및 오픈 모델
Sakana AI — « Diffusing Blame » 연구: RL에 적용한 Dale의 원리
7월 17일 — Sakana AI가 « Diffusing Blame »을 공개했다. 이 연구는 신경망이 경쟁적으로 학습하면서도 Dale의 원리를 엄격히 따를 수 있는지 탐구한다. Dale의 원리란 생물학적 제약으로, 하나의 뉴런은 이웃 뉴런에 대해 흥분성 또는 억제성 중 하나만 가질 수 있고 둘 다일 수는 없다는 뜻이다. 이 논문은 #ALIFE2026에서 채택되었으며 arXiv에서 확인할 수 있다.
같은 스레드의 두 번째 게시물에서 팀은 이 생물학적 제약을 따르는 오류 확산 메커니즘을 통합한 강화학습 알고리즘 PPO(Proximal Policy Optimization)의 변형인 ED-PPO를 소개했다. 이 방식은 제어 작업에서 입증됐다. 이 작업은 제품 발표보다 생물학에서 영감을 받은 아키텍처에 초점을 둔 Sakana AI의 연구 방향을 보여준다.
🔗 X의 발표
PerceptionBench: 어떤 모델도 정확도 60%를 넘지 못하다(Kimi / Moonshot AI)
7월 16일 — Kimi 팀이 PerceptionBench를 공개했다. 이는 대형 멀티모달 모델의 시각적 지각 능력을 10개의 원자적 능력으로 분리한 벤치마크다. 시각적 관계, 개수 세기, 속성, 깊이와 3D, 위치 지정, 비교, 정밀 인식, 맥락 통합, OCR, 환각이 그 범주에 해당한다. 이 범주들은 기존 40개 이상의 벤치마크에서 발생한 실제 모델 실패를 분석해 도출됐다. 데이터셋은 3,000개의 검증된 질문으로 구성되며, 각 질문은 추론이나 외부 지식 없이 단순 관찰만으로 답할 수 있다.
“No model we evaluate clears 60% accuracy, and models with nearly identical overall scores can exhibit very different perceptual strengths and weaknesses.”
🇰🇷 평가된 어떤 모델도 정확도 60%를 넘지 못했으며, 전체 점수가 거의 같은 모델들도 지각 능력에서는 매우 다른 강점과 약점을 보일 수 있다. — Kimi Team, PerceptionBench
이 벤치마크는 같은 날 공개된 Kimi K3 기술 문서에서도 내부 멀티모달 평가 도구로 인용된다.
간추린 소식
- Built with Claude: Life Sciences 해커톤 종료 — Gladstone Institutes 및 Cerebral Valley와 공동 주최했으며, 임상시험 매칭인 Trialign, 소아암 DNA 분석을 다루는 NCypher, 견고한 단백질 설계를 하는 Extremolith, 연구용 코드 재구성 에이전트 Lazarus를 수상작으로 선정했다. 🔗 출처
- Boris Cherny — 기업 내 AI 도입 — Claude Code의 창시자는 팀의 AI 도입에서 자신이 관찰하는 네 가지 단계를 설명하며, 이는 제품 발표라기보다 편집 콘텐츠에 가깝다. 🔗 출처
- Hugging Face — NVIDIA의 NeMo AutoModel이 Diffusers를 지원 — 이미 Transformers를 지원하던 NVIDIA의 오픈소스 fine-tuning 라이브러리가 이제 Hugging Face의 이미지 생성 라이브러리인 Diffusers도 지원한다. 🔗 출처
- Antigravity 2.3.1 — 잘못된 구성 버그를 수정하는 패치로, Google의 에이전틱 IDE가 시작되지 못하게 하던 문제를 고쳤으며 새 기능은 없다. 🔗 출처
- GitHub Mobile: PR 댓글에 Fix with Copilot 버튼 추가 — 웹에는 이미 있던 이 버튼이 이제 pull request의 मुख्य 보기와 각 리뷰 댓글에서 iOS와 Android 모두로 접근 가능하다. 🔗 출처
- NVIDIA Nemotron 3 Embed 8B — LMEB에서도 1위 — RTEB에 이어 이 임베딩 모델은 긴 대화 기억을 평가하는 LMEB 리더보드에서도 1위를 차지했으며, 관련 1B 모델은 2위를 기록했다. 🔗 출처
- HeyGen HyperFrames — 12/30일차: 동적 자막 — HyperFrames 카탈로그에서 바로 사용할 수 있는 컴포넌트로 제공되는, 단어 단위로 정확히 동기화된 애니메이션 자막이다. 🔗 출처
- Kling AI — 서울 NextGen Awards 시상식 정리 — 시각적 스토리텔링에 Kling AI를 활용한 크리에이터들을 시상한 행사에 대한 회고로, 단편 The Well로 Jo Ryeongmi가 포함됐다. 🔗 출처
- Runway — R/GA 사례 연구: AI 아바타 «Forever Founder» — R/GA는 50주년을 기념해 Runway Characters API로 창립자의 실시간 AI 아바타를 만들었고, 20번의 대화에서 145개의 질문에 기술적 문제 없이 답했다. 🔗 출처
- ZCode: 브라우저 및 컴퓨터 사용 준비 중 — Z.ai는 ZCode 개발 환경을 위해 향후 browser use와 computer use 기능을 예고했지만, 세부사항이나 일정은 밝히지 않았다. 🔗 출처
- A scorecard for the AI age (OpenAI) — CFO Sarah Friar가 기업에서의 AI 투자수익을 측정하는 방법(«Useful Intelligence per Dollar»)에 대해 쓴 글로, ChatGPT Work를 예시로 들었으며 새 제품 발표는 없다. 🔗 출처
의미하는 바
Amp의 구독 전환은 Claude Code의 새로운 안전장치(WebSearch 제한과 서브에이전트 제한), 그리고 Amp 에이전트가 다른 에이전트를 만들어낼 수 있는 능력과 맞물려, 에이전틱 코딩 도구들이 같은 방향으로 이동하고 있음을 보여준다. 즉, 사용량 기반 과금으로 무제한 성장하던 초기 단계를 지나 이제는 경제성과 거버넌스를 구조화하는 단계에 들어섰다는 뜻이다. 예측 가능한 구독료를 부과하면서 한 세션이 생성할 수 있는 서브에이전트 수를 제한하는 것은 출발점은 달라도 같은 문제를 해결한다. 에이전트가 다른 에이전트를 연쇄적으로 호출하는 컴퓨팅 환경을 에디터와 사용자 모두에게 지속 가능하게 만드는 것이다.
Perplexity Projects, Gemini Enterprise와 Parallel Web Systems의 결합, 그리고 Grok의 Automations는 기업용으로 같은 패턴에 수렴한다. 바로 지속되는 맥락, 기존 업무 도구와의 연결, 그리고 일정이나 트리거에 따른 자율 실행이다. Manus를 통해 인간 직원 10명이 생산 환경에서 28~33개의 AI 워크플로를 운영하는 Ascendea 사례는, 이 논리가 소규모 조직에서 어디까지 갈 수 있는지를 보여준다. 이는 극단적인 사례이지만, 훨씬 더 큰 조직들이 곧 마주하게 될 질문을 미리 보여준다.
미디어 생성 측면에서는 HeyGen이 Batch APIs와 HyperFrames에 통합된 미디어 라이브러리로 생산 인프라를 확장하고 있고, ElevenLabs는 완전히 라이선스된 유명인 음성 파트너십에 집중하며, Runway는 독립적인 제3자 벤치마크로 설계 선택을 검증받고 있다. 업계는 이제 데모 중심의 논리에서 생산 인프라의 논리로 이동하고 있으며, 규모·라이선스·외부 평가는 그 자체로 판매 포인트가 되고 있다.
마지막으로, 오픈 연구는 여전히 기반이 개선 가능함을 상기시킨다. Sakana AI의 «Diffusing Blame»은 신경망 학습을 위한 전례 없는 생물학적 제약을 탐구하고, Kimi의 PerceptionBench는 현재의 어떤 멀티모달 모델도 기초 시각 인식 과제에서 60% 정확도를 넘지 못한다는 사실을 보여준다. 이 대비는 오늘의 제품 발표 뒤편에서, 모델의 지각 및 구조적 능력에는 여전히 기능 경쟁만으로는 자동으로 메워지지 않는 사각지대가 남아 있음을 일깨운다.
출처
- Amp 구독, 마침내
- @sqs on X — Amp 구독
- CHANGELOG Claude Code — v2.1.212
- Amp — 에이전트에서 에이전트로
- @thorstenball on X — From Agent to Agent 예고
- Manus — Ascendea 사례 연구
- Perplexity — Projects 출시
- xAI — Grok의 Automations
- Google Developers Blog — Conductor Plugin
- Google Developers Blog — Gemini Enterprise Agent Platform 및 Parallel Web Systems
- @HeyGen on X — Batch APIs
- HeyGen — Batch APIs 문서
- @HeyGen on X — HyperFrames 미디어 라이브러리
- @ElevenLabs on X — Michael Caine이 내레이션한 오디세이
- @runwayml on X — Physion-Arc 1.0
- Runway — Runway Agent 구축 접근 방식 내부
- @SakanaAILabs on X — Diffusing Blame
- arXiv의 Diffusing Blame
- Kimi — PerceptionBench
- @claudeai on X — Life Sciences 해커톤 종료
- @bcherny on X — 기업 내 AI 도입
- @NVIDIAAI on X — NeMo AutoModel 및 Diffusers
- Antigravity — 변경 기록
- GitHub Changelog — GitHub Mobile의 Fix with Copilot
- @NVIDIAAI on X — LMEB의 Nemotron 3 Embed 8B
- @HeyGen on X — HyperFrames 12/30일차
- @Kling_ai on X — 서울 NextGen Awards
- Runway — R/GA 사례 연구
- @zcode_ai on X — ZCode browser/computer use
- OpenAI — AI 시대를 위한 점수표