ai-powered-markdown-translatorgpt-5.4-mini로 fr에서 ko로 번역된 기사.
2026년 7월 22일은 기업용 AI 도구와 에이전트가 주도한다. Cursor는 Cursor Router를 출시해 품질 저하 없이 비용을 60% 줄이는 모델 라우터를 선보였고, OpenAI는 에이전트 플랫폼 Presence와 조지아의 3.2기가와트 규모 Project Camellia 데이터 센터를 연달아 공개했으며, Alibaba는 Qwen-Image-3.0을 소개했고 Synthesia는 전문 교육용 Roleplay Sessions를 출시했다. 이 다섯 가지 주요 발표를 중심으로 미국 에너지부의 Genesis Mission(Google, OpenAI, Arcee AI)부터 Anthropic, GitHub Copilot, NVIDIA, Cohere의 새 소식까지 약 서른 가지의 주목할 만한 업데이트가 이어진다.
Cursor가 Cursor Router를 출시하다, 60% 더 저렴한 지능형 모델 라우팅
7월 22일 — Cursor는 Cursor Router를 출시했다. 이는 Auto 모드에 통합된 모델 라우터로, 각 요청을 분석해 모든 요청을 기계적으로 최전선 모델(frontier)로 보내는 대신 작업에 가장 적합한 모델을 자동으로 선택한다. 이 기능은 오늘부터 Teams 및 Enterprise 요금제에서 모든 접점(desktop, web, iOS, CLI, SDK)에서 사용할 수 있다.
| 최적화 모드 | 목표 | 과금 |
|---|---|---|
| Intelligence | 일관된 최전선 품질 | 실제로 사용된 모델 요금 |
| Balance | 최전선에 가까운 품질, 일상 사용 | 실제로 사용된 모델 요금 |
| Cost | 적절한 품질, 토큰 최적화 | 실제로 사용된 모델 요금 |
관리 측면에서 Teams 및 Enterprise 팀은 세밀한 제어를 이용할 수 있다. 팀별로 Router를 켜거나 끌 수 있고, 접근 가능한 모드를 제한하며, 기본 모드를 지정하고, 일부 하위 모델을 허용하거나 차단하고, 실제로 라우팅된 모델 이름을 표시할지 여부를 선택할 수 있다(기본값은 숨김). 유연 적용 또는 엄격 적용 옵션을 통해 조직 내 Auto 모드 사용을 표준화할 수 있다.
In early access, customers observed no drop-off in quality with a lower cost per commit vs. routing all requests to Opus 4.8.
🇰🇷 조기 액세스에서 고객들은 품질 저하를 전혀 관찰하지 않았고, 모든 요청을 Opus 4.8로 라우팅했을 때보다 커밋당 비용은 더 낮았다. — @cursor_ai X에서
OpenAI Presence, 기업용 음성 및 텍스트 에이전트 플랫폼
7월 22일 — OpenAI는 기업이 단순한 기술 데모를 넘어 신뢰할 수 있는 음성 및 텍스트 에이전트를 실제 환경에 배포할 수 있도록 설계된 AI 에이전트 플랫폼 Presence를 출시한다. Presence는 모델의 추론과 정책, 안전장치, 인간 에스컬레이션 규칙을 결합한다.
각 배포는 청구, 보험 청구, 내부 IT 요청처럼 하나의 구체적인 업무에서 시작한다. 에이전트는 필요한 지식과 시스템 접근 권한만 부여받고, 고객 기업은 에이전트가 할 수 있는 일, 인간 검토가 필요한 시점, 그리고 사람이 개입해야 하는 시점을 정의한다. 프로덕션에 배포된 뒤에는 실제 세션과 에스컬레이션 사례를 통해 시스템의 빈틈이 드러나며, Codex가 업데이트를 제안하면 팀이 이를 테스트하고 검증해 에이전트가 사용자 행동 변화에 맞춰 적응할 수 있다.
오늘부터 Presence는 고객 지원, 아웃바운드 영업, 고위험 내부 업무 흐름을 위한 실시간 음성 및 텍스트 경험을 지원한다. 이 제품은 제한된 일반 공개 프로그램을 통해 자격을 갖춘 기업 고객에게 제공되며, OpenAI 팀의 직접 지원 이후에는 선별된 시스템 통합업체가 지속적인 후속 지원을 맡는다.
Project Camellia, 조지아에 세워지는 3.2기가와트 규모의 OpenAI 데이터 센터
7월 22일 — OpenAI는 조지아주 Effingham 카운티에 추진하는 장기 AI 인프라 프로젝트 Project Camellia의 세부 내용을 공개했다. 회사는 Georgia Power와 2028년부터 2032년 사이 단계적으로 공급될 3.2기가와트 전력 계약을 체결했다.
전력 측면에서 OpenAI는 주민 요금에 전가되지 않도록 인프라 및 서비스 비용 전액을 부담하기로 했으며, 이 부지는 주거 고객에게 영향이 가기 전에 수요 급증 시 선제적으로 소비를 줄이도록 설계됐다. 물 사용 측면에서는 닫힌 회로가 물을 지속적으로 취수하고 방류하는 대신 재순환시켜, 동급 사무용 건물과 비슷한 수준의 연속적 소비를 유지한다.
경제적으로는 OpenAI가 프로젝트 수명 동안 지역사회 편익 8천만 달러(학교, 공공안전, 보건, 주거, 참전용사, 소상공인)를 약속했으며, 향후 지방 및 주 정부 세수로 수억 달러가 기대된다고 밝혔다. 회사는 또한 조지아의 대학, 커뮤니티 칼리지, 기술학교에 재학 중인 자격 있는 학생들에게 최대 7,100만 달러의 Codex 크레딧을 제공할 예정이며, 각 학생은 ChatGPT 계정을 통해 100달러의 크레딧을 받는다.
Qwen-Image-3.0, Alibaba의 이미지 생성 모델 3세대
7월 22일 — Alibaba는 이미지 생성 모델의 3세대인 Qwen-Image-3.0을 출시했다. 팀은 이를 1.0의 정밀함과 2.0의 다양성/완성도에 이어, 한마디로 “Real”(“实”)이라고 요약했다.
| 차원 | 실제로 바뀌는 점 |
|---|---|
| 풍부한 콘텐츠 | 최대 4.5k 토큰 프롬프트; 한 번의 패스로 복잡한 레이아웃 생성(신문, 스토리보드, 시험 문제, 3×3 인포그래픽 그리드, 중첩된 인터페이스) |
| 사실적인 디테일 | 10px까지 읽히는 텍스트, 완전한 LaTeX 페이지, 준사실적 질감(모공, 머리카락 가닥, 피부) |
| 깊은 지식 | 12개 언어로의 네이티브 렌더링, 100개 이상의 예술 스타일, 사실적인 인터페이스(web, games, streams), 실시간 웹 검색 |
Alibaba가 강조한 한 예시는 이러한 “수평 확장”을 보여준다. 단 3.7k 토큰으로 모델은 터널 안전, 공간 기하, 중국 고전 텍스트의 문체 분석, 투사체 운동, 기생충학, 의학 진단, Sylow 정리, 은행 통제, DNA 구조까지 서로 매우 다른 9개 분야를 아우르는 3×3 인포그래픽을 생성하며, 각 칸마다 정확한 텍스트와 시각 요소를 담는다. Alibaba는 이 모델을 단순히 “보기 좋은” 도구가 아니라 디자인, 콘텐츠 제작, 교육, 전자상거래를 위한 생산성 도구로 포지셔닝한다. 지금 바로 Qwen Chat에서 사용할 수 있다.
🔗 X에서 발표
Synthesia, 전문 교육용 Roleplay Sessions 출시
7월 22일 — Synthesia는 AI 기반 전문 교육 플랫폼 “Sessions”의 첫 구성 요소인 Roleplay Sessions를 출시한다. 핵심은 실시간으로 반응하고 밀어붙이는 아바타와의 라이브 훈련 대화로, 점수 시스템으로 사용자를 코칭하고 팀 단위로 역량 향상을 측정한다. 공개된 목표는 영업, 관리자 역할, 고객 서비스, 그리고 직원이 어려운 대화를 연습해야 하는 모든 상황이다.
| 지표 | 수치 |
|---|---|
| 2027년까지 핵심 역량이 크게 흔들릴 비율( Synthesia 출처) | 44%의 직원 |
| 격차를 메울 역량이 부족하다고 답한 고용주 | 63% |
| 평균 역량 향상 폭(세계적 대형 채용 회사) | 약 30% |
| 자발적으로 다시 훈련에 참여하는 영업사원(Fortune 10 기업) | 약 70% |
Roleplay Sessions는 원래 흩어져 있던 네 단계를 하나의 플랫폼으로 묶고자 한다. 즉, 알리기, 연습하기, 코칭하기, 측정하기다. 이 기능은 이미 Fortune 100 기업의 90%가 사용하는 Synthesia의 비디오 기반을 활용한다. 첫 번째 배포 대상은 유럽의 한 대기업과 Fortune 10 기업 한 곳이다.
🔗 X에서 발표
DOE Genesis Mission: Google, OpenAI, Arcee AI의 대규모 참여
7월 22일 — 세 개의 서로 다른 주체가 같은 날 미국 에너지부(DOE)의 Genesis Mission을 둘러싼 새로운 참여를 발표했다. 이 이니셔티브는 10년 안에 과학적 발견 속도를 두 배로 늘리는 것을 목표로 한다.
| 조직 | 참여 | 세부 내용 |
|---|---|---|
| Google DeepMind | 4천만 달러 | 더 많은 국립 연구소 연구자가 Gemini와 다른 모델에 접근할 수 있도록 AI 토큰과 Google Cloud 크레딧 제공 |
| OpenAI | 1천7백만 달러 | 약 2,000명의 연구자를 위한 Codex 접근, 두 개의 과학 캠페인을 위한 API 지원, 250만 달러 지출 시 최대 1천만 달러 상당의 API 사용 제공, 생물학용 GPT-Rosalind 접근 |
| Arcee AI | 파트너십(금액 미공개) | 과학 계산 워크플로를 위한 거버넌스형 연구 하네스와 결합된 미국산 오픈 웨이트 모델 Genesis-Science-1(GS1) 구축 |
Google은 이미 계산 생물학(AlphaFold, Isomorphic Labs)을 중심으로 맺은 협력을 확장한다. OpenAI는 9개 국립 연구소에서 1,000명 이상의 과학자가 참여한 “AI Jam” 세션을 포함해, 국립 연구소 시스템과 함께 진행해 온 작업을 기반으로 한다. 한편 Arcee AI는 연구자, 연구소, 대학, 기업, 비영리 조직을 대상으로 한 기여 프로그램을 연다. 이 프로젝트는 아직 초기 단계로, GS1의 출시일이나 벤치마크는 아직 공개되지 않았다.
🔗 Google DeepMind X에서 — 🔗 해당 주제의 OpenAI 발표 — 🔗 Arcee AI X에서
Anthropic이 Claude 관련 발표를 잇달아 내놓다
Claude Security가 Claude Code용 베타로 제공되다
7월 22일 — Anthropic은 Claude Code용 플러그인 Claude Security를 베타로 출시한다. 이는 커밋 전에 변경 사항을 훑어 취약점을 찾거나 저장소 전체를 분석하는 기능으로, 별도의 타사 서비스 프로비저닝 없이 이미 사용 중인 Claude 추론을 터미널에서 그대로 활용한다. 이번 출시는 Claude Code를 OpenAI의 Codex Security나 GitHub Copilot의 강화된 secret scanning과 같은 영역에 올려놓는다. 베타 상태 외의 가격이나 해당 요금제는 명시되지 않았다.
Claude가 connector를 통해 Anthropic Economic Index를 조회할 수 있게 되다
7월 22일 — 새로운 기본 connector를 통해 공개 데이터셋인 Anthropic Economic Index에 접근할 수 있다. 이 데이터셋은 경제 전반에서의 AI 사용을 측정한다. connector 메뉴에서 활성화하면 Claude는 “어떤 직업이 AI를 가장 많이 사용하는가” 같은 질문에 Index의 데이터에 직접 기반해 답할 수 있으며, 일반 지식에만 의존하지 않는다.
Claude Managed Agents: effort, seeding, 500 skills, webhooks
7월 22일 — Anthropic은 Claude Managed Agents를 위한 기능 묶음을 배포한다. 에이전트별로 조절 가능한 effort 수준(낮은 effort에서는 더 빠르고 저렴한 응답), 생성 시 최대 50개의 이벤트가 들어간 “seeded” 세션, 한 세션의 모든 에이전트를 합쳐 최대 500개의 skills, 환경 및 메모리 저장소를 위한 webhooks, 그리고 하위 에이전트 이벤트 스트리밍이 포함된다.
데스크톱의 Claude Code가 iOS 시뮬레이터와 통합되다
7월 21일 — 데스크톱의 Claude Code가 iOS 시뮬레이터를 지원한다. 애플리케이션을 Claude가 빌드하고 실행한 뒤 이를 관찰하고 상호작용하며 작업이 끝날 때까지 반복할 수 있고, 이 모든 과정은 대화 옆 패널에서 진행된다. 오늘부터 공개 베타로 제공되며, macOS 전용이고 Xcode가 필요하다.
🔗 Claude Security — 🔗 Economic Index — 🔗 Managed Agents — 🔗 iOS 시뮬레이터
코드 도구: Amp, Warp, Replit
Amp가 Multiplayer를 출시하다, orb에서의 실시간 협업
7월 22일 — orb 기반 에이전트 출시 3주 만에 Amp가 Multiplayer를 추가했다. 이제 하나의 orb를 워크스페이스의 여러 구성원이 동시에 공유하고 작업할 수 있으며, 에이전트에 메시지를 보내고 포털을 확인하고 파일 변경을 실시간으로 관찰하며 공유 터미널을 사용할 수 있다. 이 기능은 thread의 Share 메뉴에서 활성화할 수 있다.
Warp가 OSC 8 하이퍼텍스트 링크를 지원하다
7월 22일 — Warp는 CLI와 코딩 에이전트가 일반 텍스트 대신 클릭 가능한 링크를 출력할 수 있게 해 주는 터미널 표준인 OSC 8 지원을 제공한다. 이 기능은 5년 전부터 열려 있던 요청에 외부 기여자가 개발한 것으로, 터미널 그리드 렌더링 엔진에 대한 추가 테스트를 진행하는 동안 기능 플래그(feature flag) 뒤에 있는 Dev 버전으로 배포된다.
Replit이 모바일 앱을 다시 내놓다
7월 22일 — Replit은 모바일 앱(iOS, Android는 단계적 배포)의 개편판을 공개한다. 새 홈 화면, Agent와 직접 대화할 수 있는 음성 입력, 채팅·작업·미리보기 간 스와이프 탐색, 앱 밖에서도 에이전트의 진행 상황을 실시간으로 보여 주는 iOS Live Activities가 포함된다.
🔗 Amp Multiplayer — 🔗 Warp OSC 8 — 🔗 Replit 모바일
Microsoft Asia가 컴팩트 이미지 생성 모델 Mage-Flow를 공개하다
7월 22일 — Microsoft Asia는 Hugging Face에 Mage-Flow를 공개했다. 이는 단 40억 개 파라미터의 이미지 생성 및 편집 모델로, 훨씬 더 큰 모델들과 비슷한 수준의 품질을 주장한다. 성능 면에서 이 모델은 1024×1024 해상도에서 4단계로 이미지를 1초도 안 되어 생성하며, 최대 4K까지 올릴 수 있다. 데모는 Hugging Face Spaces에서 제공된다.
🔗 X에서 발표
Gemini: Galaxy Unpacked 2026과 Gemini 3.5 Pro
삼성 관련 Gemini 신규 기능 세 가지
7월 22일 — Galaxy Unpacked 2026을 계기로 Google은 Galaxy 생태계를 위한 세 가지 Gemini 신규 기능을 공개했다. 40개 이상의 인기 앱으로 확장된 작업 자동화(장보기, 예약, 티켓 구매, 복잡한 이미지를 지시사항으로 처리하고 백그라운드에서 실행 가능), Galaxy Z Fold8 시리즈에 기본 탑재되는 Gemini Notebook(구 NotebookLM)과 Google AI Pro 6개월 체험, 그리고 손목만 들어 올리면 활성화되고 깨우기 단어가 필요 없는 Galaxy Watch 9의 Gemini다. 또한 Samsung과 함께 개발 중인 스마트 안경(Gentle Monster와 Warby Parker 프레임)이 2026년 가을에 예정돼 있다.
Gemini 3.5 Pro가 파트너 테스트에 들어가다
7월 21일 — Gemini를 총괄하는 Josh Woodward 부사장은 차기 주력 모델인 Gemini 3.5 Pro가 공식적으로 파트너 테스트 단계에 들어갔다고 확인했다. 일반 공개 일정은 아직 나오지 않았지만, 이 확인은 Gemini 3.5 Pro를 Gemini 모델 측에서 다음으로 기대되는 주요 출시로 자리매김하게 한다.
🔗 Galaxy Unpacked 2026 — 🔗 Gemini 3.5 Pro
Manus, Plan Mode 출시
7월 22일 — Manus가 Plan Mode를 도입했습니다. 이는 실행 전에 구조화된 검토 단계를 추가하는 것으로, 곧바로 구축에 들어가는 대신 에이전트가 목표, 단계, 제약 조건을 담은 Markdown 형식의 실행 가능성 계획을 생성하며, 사용자는 이를 검토 전 수정하거나 재검토하도록 할 수 있습니다. 활성화는 웹에서는 /를 통해, 모바일에서는 +를 통해 이루어지며, 작업 진행 중에도 다음 단계 계획을 위해 이 모드를 시작할 수 있습니다. 웹과 모바일에서 모든 사용자가 즉시 사용할 수 있으며, 옵트인 방식입니다.
GitHub Copilot: Canvases와 과금
GitHub Copilot, Canvases 출시
7월 21일 — GitHub가 캔버스를 도입했습니다. 이는 GitHub Copilot 앱 안에서 개발자와 에이전트가 실시간으로 협업하는 인터랙티브 작업 공간으로, 복잡한 정보 시각화, 직접적인 상호작용(클릭, 편집), 프롬프트 반복을 통한 세부 조정이 가능합니다. 생성은 /create-canvas 명령으로 합니다. 예시 사용 사례로는 카드 스와이프를 통한 이슈 분류, 대화형 아키텍처 다이어그램, worktrees 대시보드, 프롬프트 품질 코칭, 멀티플랫폼 지식 검색이 있습니다. 한 사용자는 앱이 브라우저 캔버스를 자동으로 열어 결제 화면까지 클릭해 기능을 확인했으며, 이 과정에서 수동으로 작성한 Playwright 테스트를 대체했다고 문서화했습니다.
Copilot이 단순한 API 접근을 넘어 제공하는 것
7월 22일 — GitHub가 이제 공개된 모델 API 요금에 따라 청구되는 AI 크레딧을 기반으로 한 과금 정책을 설명했습니다. 코드 완성과 Next Edit Suggestions는 유료 플랜에 계속 포함되며, 채팅과 에이전트성 작업은 AI 크레딧을 소모합니다. GitHub의 주장에 따르면, 모델에 대한 단순 접근을 넘어 Copilot은 통합된 흐름(issues, 저장소, pull requests, 조직 정책), 자체 평가 기준에서 과제 해결 동등성에 비해 줄어든 토큰 소비, 관리자용 정책 제어, 그리고 Copilot SDK를 통해 이미 실전에서 검증된 에이전트 인프라를 제공합니다.
🔗 Canvases — 🔗 Copilot vs 단순 API 접근
ElevenLabs: ElevenMusic과 우크라이나 공공 서비스
ElevenLabs, ElevenMusic에 Vocals와 Styles 추가
7월 22일 — ElevenLabs가 ElevenCreative의 Finetunes에도 제공되는 ElevenMusic에 두 가지 기능을 추가했습니다. Vocals는 자신의 목소리나 보컬 라이브러리의 목소리로 오리지널 곡을 생성할 수 있게 해 주며(음악 v2를 자신의 음색에 맞게 조정하기 위해 곡을 업로드하거나, 단일 녹음만으로 즉시 모드 사용 가능), Styles는 Vocals와 함께 전체 곡에서 스타일 일관성을 유지할 수 있게 해 줍니다. ElevenLabs는 모든 업로드가 저작권 준수 여부를 검토한다고 밝혔습니다.
ElevenLabs, 우크라이나 Obrii의 공공 고용 서비스용 음성 비서를 지원
7월 22일 — 우크라이나 노동시장용 새로운 디지털 생태계인 Obrii가 첫 번째 AI 서비스를 공개했습니다. 이는 ElevenLabs와 함께 개발한 공공 고용 서비스용 음성 비서로, 공습 경보 중에도 포함해 24시간 이용할 수 있습니다.
“Together with @ElevenLabs, we launched AI voice assistant for the State Employment Service — bringing public services closer to people, 24/7, even during air raid alerts.”
🇰🇷 ElevenLabs와 함께 우리는 공공 고용 서비스를 위한 AI 음성 비서를 출시했습니다. 이는 공습 경보 중에도 포함해 24시간 7일 내내 공공 서비스를 시민들에게 더 가깝게 다가가게 합니다. — @C_o_S X에서
NVIDIA: 의료 시뮬레이션, 텍사스 공장, Cosmos 모델
의료 물리 시뮬레이션 오픈소스 프레임워크
7월 22일 — NVIDIA가 NVIDIA Isaac for Healthcare에서 GPU 가속 의료 물리 시뮬레이션 프레임워크를 오픈소스로 공개했습니다. 이는 의료기기(카테터, 가이드)와 환자 해부 구조 간의 상호작용을 다루며, 고전 물리 시뮬레이션과 생성형 AI(Cosmos-H Dreams)를 결합한 동종 최초의 프레임워크로 소개됩니다. 8,192개의 환경을 병렬로 실행함으로써 NVIDIA는 로봇 정책(policies) 학습 시간을 5시간 이상에서 2분 미만으로 줄였다고 발표했습니다. CMR Surgical, Johnson & Johnson MedTech, XCath, Medtronic Structural Heart가 이미 이를 사용 중이며, 지금 바로 GitHub에서 이용할 수 있습니다.
NVIDIA와 Wistron, 포트워스에 슈퍼칩 공장 개소
7월 21일 — Wistron이 첫 미국 공장을 열었습니다. 텍사스 포트워스에 위치한 3만㎡ 규모의 이 시설은 이미 Grace Blackwell Ultra 슈퍼칩을 생산하고 있으며, 향후 Vera Rubin도 제조할 예정입니다. 7억 달러가 투자되었고, 500개 이상의 일자리가 창출되었으며(연말까지 1,000개 목표), 이는 미국 내 AI 플랫폼 제조를 위한 NVIDIA의 5천억 달러 약속의 일환입니다.
Cosmos 3 Super, 최대 25배 더 빠르게
7월 22일 — NVIDIA가 Cosmos 3 패밀리의 4단계 변형 모델인 Cosmos 3 Super를 공개했습니다. 이 모델은 원래 모델보다 이미지와 비디오를 최대 25배 더 빠르게 생성하면서도 Artificial Analysis에서 높은 순위를 유지하고 있습니다. 오디오 없는 이미지→비디오 부문 1위, 텍스트→이미지 부문 2위입니다. 지금 바로 Hugging Face에서 이용할 수 있습니다.
Kaggle의 Nemotron Model Reasoning Challenge 결과
7월 22일 — NVIDIA가 Kaggle에서 진행한 Nemotron Model Reasoning Challenge의 결과를 공개했습니다. 개방형 모델의 추론 개선 기법을 중심으로 4,000개가 넘는 팀에 속한 5,000명 이상의 참가자가 참여했습니다. NullSira, vli, YS-L 팀이 1~3위를 차지했습니다.
🔗 의료 시뮬레이션 — 🔗 Wistron 공장 — 🔗 Cosmos 3 Super — 🔗 Kaggle 결과
Kimi K3: AA-Briefcase에서 2위지만 비용과 속도는 부담
7월 21일 — Artificial Analysis가 Kimi K3(Moonshot AI)의 AA-Briefcase 결과를 발표했습니다. 이는 스프레드시트, 프레젠테이션, 인터페이스 목업 같은 에이전트형 지식 작업 벤치마크입니다. 이 모델은 두 번째로 높은 기록 점수를 받았으며, 이전 세대보다 700점 이상 상승했습니다.
| 평가 모델 | AA-Briefcase Elo | 작업당 평균 비용 | 작업당 평균 시간 |
|---|---|---|---|
| Claude Fable 5 (max) | 1574 | — | — |
| Kimi K3 | 1543 | 10.57달러 | 56.4분 |
| GPT-5.6 Sol (max) | 1501 | — | — |
| Claude Sonnet 5 (max) | 1388 | — | — |
| Claude Opus 4.8 (max) | 1347 | — | — |
| Kimi K2.6 (기준) | 816 | ~1달러 | — |
Kimi K3는 평가 그리드에서 51%의 성공률을 기록해 Claude Fable 5(56%) 바로 뒤를 이었으며, 분석 품질은 비슷하지만 발표 품질은 뒤처졌습니다. 반면, 작업당 평균 비용은 10.57달러로 Kimi K2.6보다 약 10배 높았는데, 이는 모델 요금, 높은 출력 토큰 사용량, 그리고 작업당 평균 83회 턴(Claude Fable 5는 67회, GPT-5.6 Sol은 50회) 때문입니다.
🔗 X의 공지
OpenAI: 언론 활용과 API 한도
언론사들이 OpenAI 도구를 사용하는 방식
7월 22일 — OpenAI가 언론 조직들이 자사 도구를 어떻게 활용하는지에 대한 개요를 공개했습니다. Associated Press는 보도, 검증(업로드 추적, 이미지와 비디오의 위치 확인 및 시간 확인), 수천 건의 대법원 문서를 구조화된 정보로 변환, 기사 내용을 방송용 스크립트로 변환하는 데 이를 사용하며, 동시에 기자들이 편집 판단을 주도하도록 하고 있습니다. POLITICO는 더 빠른 오리지널 보도를 위해 대량의 공공 문서를 분석하며, Axios도 언급되었습니다. OpenAI는 American Journalism Project에 대한 지원을 갱신하고 Lenfest Institute 및 WAN-IFRA와의 파트너십을 계속 이어가고 있습니다.
모든 API 계정으로 확대된 엄격한 지출 한도
7월 22일 — OpenAI가 이번 주부터 API Platform의 모든 계정에 엄격한 지출 한도(hard spend limits) 접근을 확대해, 각 개발자가 대시보드에서 실시간 사용량을 추적하면서 원하는 금액으로 소비를 제한할 수 있게 했습니다.
Cohere: 아랍어 다이아크리트화와 경량 코드 모델
Speech Tashkeel 2B와 Transcribe Arabic 커뮤니티 생태계
7월 22일 — Cohere가 Speech Tashkeel 2B를 소개했습니다. 이는 NAMAA가 개발한 파트너 모델로, 아랍어 원문을 완전히 다이아크리트화된 텍스트로 변환합니다(격 표지, harakāt, tanwīn, sukūn, shadda 포함). 4비트 양자화 버전도 제공됩니다. 이 발표에는 Cohere의 아랍어 음성 인식 모델인 Transcribe Arabic을 둘러싼 커뮤니티 기여도 함께 포함되었습니다. listen-habibi 애플리케이션, Ruby 네이티브 지원, Hugging Face에 공개된 GGUF/ONNX 양자화가 그것입니다. Cohere는 또한 HUMAIN과 파트너십을 맺어 이 작업을 자원 제약이 있는 다른 언어로 확장할 계획이라고 밝혔습니다.
North Mini Code, 가볍고 경제적인 코드 모델
7월 21일 — Cohere가 North Mini Code를 소개했습니다. 이는 디버깅, 단위 테스트 생성 같은 반복적이고 복잡도가 낮은 작업을 위해 설계된 오픈소스 코드 모델로, 추론 비용을 줄이기 위한 경제적인 대안으로 포지셔닝됩니다.
🔗 Speech Tashkeel 2B — 🔗 North Mini Code
단신
- Warp, 고성장 AI 스타트업의 경제적 압박에 관한 글을 게시 — 빠르게 성장하는 스타트업의 향후 수익 압박을 분석합니다. 🔗 출처
- Hugging Face, 도쿄에서 일본 첫 행사를 개최 — 오테마치에서 최근 도구와 일본 시장에 대한 회사의 계획을 소개했습니다. 🔗 출처
- Ai2, PaperFinder 새 버전 공개 — 정기적으로 사용하는 연구자가 호평한 과학 문헌 검색 도구로, 기술적 세부 사항은 공개되지 않았습니다. 🔗 출처
- Sakana AI, “One Model to Command Them All” Fugu 개요 공개 — 이미 다룬 Fugu-Cyber 변형을 넘어 오케스트레이션 모델의 범위를 넓히는 블로그 글입니다. 🔗 출처
- Gemini Live — 실시간 시각 지원용 카메라 가이드 — 상황을 글로 설명하지 않아도 맥락적 도움을 받기 위해 카메라를 물체나 문서에 비추는 방식입니다. 🔗 출처
- AlphaFold — 베이스 5주년을 앞두고 단백질 공학에 새로운 응용 — Pushmeet Kohli(Google DeepMind)가 생물학의 구조적 사각지대를 메우는 용도를 높이 평가했습니다. 🔗 출처
- 새로운 Copilot 지표 영향 대시보드(Enterprise) — 속도와 병합 지표를 사용자별로 보여주는 채택 코호트(Code-first, Agent-first, Multi-agent, Passive). 🔗 출처
- Copilot Business/Enterprise — 청구 주기별 AI 크레딧 가시성 — 이제 개별 예산이 배정되지 않아도 표시가 가능합니다. 🔗 출처
- GHES — 지원 번들 업로드 강화 예정(2026년 8월 18일) — 패치되지 않은 인스턴스에서의 업로드를 거부하며, 3.21.3, 3.20.5, 3.19.9, 3.18.12 또는 3.17.18로 업데이트가 필요합니다. 🔗 출처
- NVIDIA, Jetson Thor T2000 및 T3000 모듈 출시 — 로봇 공학과 엣지 AI를 위한 새로운 모듈로, 현재 상세 사양서는 제공되지 않았습니다. 🔗 출처
- Cisco, 코드 취약점 탐지를 위한 소형 모델 Antares 출시 — Antares-350M과 Antares-1B는 Hugging Face에서 제공되며, 민감한 코드를 클라우드로 보내지 않도록 로컬에서 실행할 수 있습니다. 🔗 출처
- HeyGen HyperFrames — 17/30일: 스토리보드 흐름 — 프레임별 댓글 검토가 포함된 3단계(카드, 스케치, 최종 렌더) 계획입니다. 🔗 출처
- Kling AI, 에이전트를 사용해 영화적 퍼포먼스를 만드는 MCP 튜토리얼 공개 — 에이전트 안에서 캐릭터, 감정, 배치 비디오 생성까지 이어지는 전체 창작 흐름입니다. 🔗 출처
- 한 가족이 ChatGPT를 자문역으로 삼아 나무 위 오두막을 건설 — 구조 설계, 자재 선택, 아이들의 아이디어를 실행 가능한 계획으로 바꾸는 과정이 포함됩니다. 🔗 출처
- Codex Live Build — 실시간 제작 세션 — Codex Micro 키보드 제작자들과 함께하는 라이브 스트리밍입니다. 🔗 출처
- 한 플레이어가 Codex로 이탈리아 돌로미티를 게임 속에 재현 — 등반, 활공, 기능하는 케이블카가 있는 오픈 월드 “Valdiluce”입니다. 🔗 출처
- ChatGPT Work 프로모션 — 100달러 크레딧 제공 — X에 ChatGPT Work에서 좋아하는 점을 게시한 첫 10,000명에게 제공됩니다. 🔗 출처
이것이 의미하는 것
모델 라우팅은 코드 도구 경쟁의 새로운 전장이 되고 있습니다. Cursor Router는 요청마다 적절한 모델을 자동으로 선택해 품질 저하 없이 60%의 비용 절감을 약속하는 반면, Artificial Analysis는 그와 대조적으로 자사의 에이전트형 지식 작업 벤치마크에서 두 번째로 높은 점수를 받은 Kimi K3가 이전 세대보다 약 10배 더 비싸고 작업당 거의 한 시간이 걸린다는 점을 보여줍니다. 양쪽 모두 전달하는 메시지는 같습니다. 모델의 단순한 원시 성능만으로는 그 사용을 정당화하기 어렵고, 대규모 배포를 하는 팀에게는 비용/품질/지연의 균형이 진짜 의사결정 기준이 됩니다.
기업용 에이전트는 분명히 데모 중심의 논리에서 프로덕션 중심의 논리로 이동하고 있습니다. OpenAI Presence는 모델의 추론을 둘러싼 정책, 안전장치, 인간 에스컬레이션을 명시적으로 구조화하고, Synthesia Roleplay Sessions는 실제 환경에서의 구체적인 역량 향상 효과를 수치로 보여 주며, GitHub Copilot Canvases는 에이전트가 결제 화면까지 스스로 작업을 검증해 수동 테스트를 대체한 사례를 문서화하고, Claude Managed Agents는 프로덕션의 복잡한 에이전트 워크플로를 위해 설계된 수준별 작업 강도와 웹훅을 추가합니다. 이들 발표는 하나의 요구로 수렴합니다. 에이전트를 단지 데모에서만 뛰어난 것이 아니라, 장기적으로 신뢰 가능하고 제어 가능하게 만드는 것입니다.
제도적 측면에서는 DOE의 Genesis Mission이 이제 세 주체, Google, OpenAI, Arcee AI 사이의 경쟁을 보여 줍니다. 각자는 미국 공공 과학 연구에 자리를 잡기 위해 서로 다른 논리를 내세웁니다. Google은 토큰과 클라우드 크레딧, OpenAI는 Codex와 API 접근, Arcee AI는 거버넌스가 적용된 개방형 모델입니다. 이러한 제도적 역동성은 물리 인프라 경쟁과도 맞물려 있습니다. Project Camellia(조지아주 3.2기가와트)와 Wistron의 포트워스 슈퍼칩 공장(7억 달러, 수백 개의 일자리)은 연산 능력과 지역적 기반이 이제 별도의 홍보 포인트가 되었으며, 숫자와 세부사항까지 공개적으로 제시된다는 점을 보여 줍니다.
마지막으로 멀티모달 생성은 아래와 위 양쪽에서 계속 다양화되고 있습니다. Qwen-Image-3.0은 프론티어 모델의 사실성과 전문적 활용성을 밀어붙이는 반면, Mage-Flow(Microsoft Asia, 40억 매개변수)와 Cosmos 3 Super(NVIDIA, 최대 25배 더 빠름)는 더 낮은 계산 비용으로 이런 기능을 접근 가능하게 만들기 위해 컴팩트함과 속도를 택합니다. 한편 우크라이나에서의 ElevenLabs/Obrii 사례는 이러한 음성 기술이 상업적 사용을 넘어서 사회적 영향이 큰 공공 서비스에도 활용된다는 점을 다시 상기시켜 줍니다.
출처
- Cursor Router — 변경 로그
- OpenAI 현황
- 프로젝트 Camellia
- Qwen-Image-3.0
- Synthesia 역할극 세션
- Google DeepMind — Genesis Mission
- OpenAI — Genesis Mission
- Arcee AI — Genesis-Science-1
- Claude 보안
- Anthropic 경제 지수 — 커넥터
- Claude 관리형 에이전트
- Claude Code — iOS 시뮬레이터
- Amp 멀티플레이어
- Warp — OSC 8 링크
- Replit — 모바일 애플리케이션
- Microsoft Asia — Mage-Flow
- Galaxy Unpacked 2026 — Gemini
- Gemini 3.5 Pro — 파트너 테스트
- Manus 계획 모드
- GitHub Copilot — 캔버스
- GitHub Copilot 대 원시 API 접근
- ElevenLabs — Vocals 및 Styles
- ElevenLabs — Obrii Ukraine
- NVIDIA — 의료 물리 시뮬레이션
- NVIDIA/Wistron — 포트워스 공장
- NVIDIA — Cosmos 3 Super
- NVIDIA — Nemotron Reasoning Challenge 결과
- Kimi K3 — AA-Briefcase
- OpenAI — 언론 활용 사례
- OpenAI — API 지출 상한
- Cohere — Speech Tashkeel 2B
- Cohere — North Mini Code