ai-powered-markdown-translatorfr에서 ko로 번역된 기사, gpt-5.4-mini로.
2026년 8월 3일에는 세 가지 주요 발표가 집중됐다: Alibaba는 2.4T 파라미터의 새 플래그십 모델 Qwen3.8-Max를 선보였고, Genspark는 자사 오피스 제품군 GenOffice를 오픈 소스로 전환했으며, Vercel은 v0를 위한 프로그래밍 API를 공개했다. 이 세 가지 출시를 중심으로 Cursor, GitHub, Sakana AI, MiniMax, Runway, ElevenLabs, Google도 제품 업데이트를 이어갔다.
코드와 코워크를 위한 Alibaba의 새 플래그십 모델, Qwen3.8-Max
Alibaba는 Qwen3.8-Max를 공개했다. 이 모델은 현재까지 회사가 만든 가장 강력한 모델로 소개되며, 코드와 AI와의 협업 작업(cowork)에 초점을 맞춘 포지셔닝을 갖는다. 이 모델은 2.4T 파라미터를 보유하며, API와 Qwen Studio를 통해 즉시 사용할 수 있다.
팀은 네 가지 진전 축을 강조한다: 장기간의 자율 개발(빈 폴더에서 시작해 배포까지, 10일 이상에 걸친 자체 진화, 그리고 프로젝트의 전체 추적 기록이 GitHub에 공개됨), 다양한 업무에서의 생산 수준 산출물, 긴 시간 범위에 걸친 자율 계획 — 예시로 최대 500회에 이르는 칩 설계 최적화 반복과 365일짜리 이커머스 전략이 언급됨 — 그리고 시각 정보가 계획, 실행, 자기 보정을 지속적으로 뒷받침하는 네이티브 멀티모달 지능이다.
Alibaba는 발표 다음 주에 Qwen3.8-Max의 가중치를 공개하고, 더 가벼운 버전인 Qwen3.8-27B도 open weights로 전환할 예정이라고 밝혔다. 이 모델은 발표와 동시에 익명 채팅 플랫폼 Venice에서도 사용할 수 있으며, 같은 날 추가 설명 없이 « Command Code »라는 도구와의 통합이 언급됐다.
| 지표 | 값 |
|---|---|
| 파라미터 | 2,4 T |
| 입력 가격 | 2,0 $ / million tokens |
| 출력 가격 | 6,0 $ / million tokens |
| 암묵적 캐시 | 0,25 $ / million tokens |
| 가중치 공개 | 다음 주 (Qwen3.8-Max + Qwen3.8-27B) |
🔗 X의 발표
Genspark, 자사 AI 오피스 제품군 GenOffice 코드를 공개
Genspark는 GenOffice의 오픈 소스 전환을 발표했다. 이는 PC와 Mac을 위한 최초의 완전한 오픈 소스 AI 오피스 제품군으로 소개됐다. 이 도구는 누구에게나 무료이며 광고도 없다.
이 제품군은 워드프로세싱(Docs), 스프레드시트(Sheets), 프레젠테이션(Slides), PDF 등 일반적인 오피스 작업을 다루며, 익숙한 편집 도구를 제공한다. Genspark는 여기에 Super Agent를 통합해 검색, 데이터 분석, 문서 작성 또는 프레젠테이션 구성을 수행할 수 있게 했으며, 이 과정에서 Genspark 크레딧을 사용한다.
개발 방식 측면에서 주목할 점은, Alpha 버전이 단 한 명의 엔지니어에 의해 일주일 만에 만들어졌고, 토큰 비용은 1만 달러였다는 것이다.
“One engineer, one week, $10,000 in tokens. That’s what it took to build the GenOffice Alpha.”
🇰🇷 한 명의 엔지니어, 일주일, 1만 달러의 토큰. GenOffice의 Alpha 버전을 만드는 데 바로 이 정도가 들었다. — @genspark_ai X에서
이 프로젝트는 Alpha 단계임을 분명히 하고 있다. Genspark는 커뮤니티가 도구를 시험해 보고, 버그를 보고하고, GenTeam의 전용 그룹 채팅을 통해 기능 요청을 제안하되 코드는 작성하지 않도록 초대한다. 가장 유용한 기여자들에게는 감사의 뜻으로 1,000개 이상의 Genspark 크레딧이 제공된다. 이 발표는 싱가포르에서 열린 AGI Playground에서 이뤄졌으며, Genspark는 모델이 점점 더 저렴해질수록 가치는 그 위에 구축된 최고의 경험으로 이동한다고 주장한다.
Vercel, v0용 프로그래밍 API 출시
Vercel은 오늘부터 사용할 수 있는 새로운 API v0를 공개했다. 이 API는 지금까지 채팅 인터페이스에만 제한되었던 애플리케이션 구축 기능을 프로그래밍 방식으로 접근할 수 있게 해준다. 즉, 이제 개발자는 웹사이트를 거치지 않고도 자신의 코드에서 직접 v0를 제어할 수 있다.
노출되는 작업은 네 가지다: 텍스트 프롬프트, 기존 코드 저장소, ZIP 아카이브로부터 대화를 시작하기, 개발 서버 미리보기를 생성해 결과를 실시간으로 확인하기, 후속 메시지를 보내 생성 결과를 반복 개선하기, 그리고 결과를 Vercel에 직접 배포하기다.
이 API는 v0를 단순한 소비자용 독립 제품이 아니라, 에이전트, 자동화 스크립트, 내부 통합 같은 타사 도구 체인에 통합할 수 있는 구성 요소로 바꾼다. 이는 Vercel이 v0를 다른 에이전트, 심지어 기존 채팅을 거치지 않고 v0를 조종하는 타사 에이전트까지 활용할 수 있는 인터페이스 생성 계층으로 만들려는 전략과도 일치한다.
이미 개발 에이전트를 구축하고 있는 팀들에게는, 사람의 개입 없이 코드 생성, 미리보기, 배포를 완전히 자동화된 파이프라인으로 연결할 수 있는 가능성이 열리는 셈이다.
🔗 X의 발표
Cursor: 더 효율적인 클라우드 에이전트와 새 Google Workspace 플러그인
Cursor는 같은 날 두 가지 별도 업데이트를 공개했다. 하나는 클라우드 에이전트의 성능에 관한 것이고, 다른 하나는 Google Workspace 통합에 관한 것이다.
클라우드 에이전트: 토큰 20~30% 절감
Cursor는 클라우드 에이전트의 효율이 크게 향상됐다고 발표했다. 전체 작업에서 소비 토큰이 20~30% 줄었고, 컴퓨터 제어(computer use)를 사용하는 작업에서는 최대 80%까지 효율이 향상됐다. 이러한 향상은 에이전트가 MCP 서버, skills, computer use를 더 잘 관리하게 된 덕분이다. 목표는 사용자가 토큰 예산 안에서 더 야심찬 작업을 위임할 수 있게 하는 것이다.
🔗 X의 발표
편집기 안에 통합된 Google Workspace 플러그인
이제 Cursor는 « Customize » 페이지 또는 Cursor Marketplace에서 접근할 수 있는 플러그인을 통해 Google Workspace를 직접 읽고, 쓰고, 조작할 수 있으며, 편집기를 벗어날 필요가 없다.
| Workspace 서비스 | 기능 |
|---|---|
| Google Drive | 파일 검색, 열기, 다운로드, 폴더 정리 |
| Gmail | 메일 검색 및 읽기, 메시지 작성 및 전송 |
| Google Calendar | 일정 확인, 이벤트 생성, 빈 시간 찾기 |
| Google Docs | 문서 열기, 읽기, 작성, 수정 |
| Google Sheets | 범위 읽기, 셀 업데이트, 시트 생성 |
| Google Chat | 스페이스와 메시지 접근, 메시지 전송 |
목표는 개발자가 브라우저를 오가며 이동하지 않고도, Cursor에서 바로 메일이나 일정의 맥락을 활용할 수 있게 하는 것이다.
GitHub Agentic Workflows, Aspire의 레포 간 문서화를 자동화
GitHub는 GitHub Agentic Workflows의 구체적인 활용 사례를 소개했다. Aspire 팀은 이를 사용해 병합된 기능을 여러 저장소에 걸친 문서 PR로 자동 변환한다. 이 시스템은 제한된 권한(scoped permissions)을 적용하고, 병합 전에는 주제 전문가의 수동 검토(SME review)를 의무화한다.
| 추적 지표 | 값 |
|---|---|
| 병합된 문서 PR | 82 / 82 |
| 중앙값 병합 지연 | 44,8시간 |
이 사례는 에이전트 워크플로에 대한 GitHub의 우선순위 중 하나를 보여준다. 즉, 반복적인 문서 유지보수 작업은 자동화하되, 사람이 검토 루프 안에 남아 있도록 하는 것이다.
🔗 X의 발표
GitHub, 2026년 7월 Ship Log 공개
GitHub는 개발자 선택권을 주제로 한 2026년 7월의 월간 출시 요약을 공개했다.
GitHub Copilot 데스크톱 앱은 이제 Copilot Free와 GitHub Education을 포함한 모든 요금제에서 사용할 수 있으며, 구독이 없는 개발자도 자신만의 모델 공급자 키(bring your own key)를 사용할 수 있다. Copilot의 모델 선택기도 확장됐다. Kimi K2.7 Code는 picker에서 선택할 수 있는 최초의 오픈웨이트 모델이 되었고, OpenAI GPT-5.6 계열이 Copilot에 합류했으며 GPT-5.6 Luna는 80%, GPT-5.6 Terra는 20% 가격이 인하됐다. Anthropic의 Opus 5도 일반 공개 상태가 됐다. 또한 GitHub Projects는 개선된 필터와 다중 선택 필드를 기반으로 한 태그 시스템을 갖추게 됐다.
Sakana Namazu, 일본 시장에 맞춘 LLM API
Sakana AI는 Sakana Namazu API를 공개했다. 이는 지금까지 Sakana Chat 앱 전용이었던 Namazu 모델을 서비스 형태로 제공하는 버전이다. 이 모델은 Moonshot AI의 오픈웨이트 모델인 Kimi K2.6을 기반으로 하며, Sakana AI가 일본어와 일본 업무용 사용 사례에 맞게 미세 조정했다.
이 API는 OpenAI 형식과 호환된다. 기존 코드에서 기본 URL과 API 키만 바꾸면 된다. 또한 웹 검색과 코드 실행용 내장 도구를 포함하며, 여러 단계를 자율적으로 이어가는 에이전트 기능도 제공한다.
Sakana AI는 세 가지 활용 사례를 강조한다: 시장 조사 보고서의 자율 생성, 고객 지원 자동화, 그리고 간단한 지시만으로 약 1,000마리의 애니메이션 물고기를 제어하는 창의적 애플리케이션이다. 일본 문화 맥락을 위한 벤치마크 FairPoliticsQA에서는 점수가 34,10%에서 56,30%로 상승했다.
🔗 공식 발표
MiniMax H3: 이제 가중치가 공개됐다
MiniMax는 7월 31일 자사의 개방형 멀티모달 모델 H3를 발표했으며 — 이미 이 지면에서 다룬 바 있다 — 8월 3일에는 실제로 open weights로 가중치를 공개했다. 오픈소스 추론 체인 전반에 걸쳐 « Day-0 » 지원을 제공한다고 주장한다.
| 추론 도구 | Day-0 지원 |
|---|---|
| ComfyUI | 네이티브 통합, 출시와 함께 1개 모델과 5개 워크플로 제공 |
| vLLM-Omni | OpenAI API 호환 비디오 엔드포인트 |
| SGLang / LMSYS | 사용자 지정 가능한 로컬 지원, NVIDIA 및 AMD 하드웨어에서 실행 |
| fal | 즉시 사용할 수 있는 프로덕션 인프라 |
MiniMax는 이번 출시를 발표와 실제 가용성 사이의 단계가 넘어갔음을 보여주는 사례로 설명한다. 즉, 가중치가 공개됐고 프로덕션 배포도 가능해졌다. 또한 파트너사 Magnific는 단일 생성만으로 캐릭터별 네이티브 립싱크 데모를 선보였다.
🔗 X의 발표
Runway, Seedance 2.5 7일 무제한 이용이 포함된 Max 요금제 출시
Runway는 새로운 구독 등급인 Max 요금제를 발표하며, 출시 혜택으로 플랫폼에서 Seedance 2.5가 제공되는 즉시 7일간 무제한 이용할 수 있다고 밝혔다.
이미 이전 호에서 다룬 Seedance 2.5는 아직 Runway에서 사용할 수 없다(« coming soon »). 즉, 오늘의 새 소식은 모델 자체가 아니라 새 요금제와 조기 이용 혜택이다.
🔗 X의 발표
ElevenAgents: 기업 규모로 확장된 ElevenLabs의 음성 AI
ElevenLabs는 자사의 음성 및 채팅 에이전트 플랫폼 ElevenAgents의 규모와 기능을 자세히 소개했다.
“More than 10 million conversations run on ElevenAgents every week.”
🇰🇷 ElevenAgents에서는 매주 천만 건이 넘는 대화가 처리된다. — @ElevenLabs X에서
각 대화는 환불 요청, 일정 예약, 서비스 문의, 항공편 변경처럼 자연스러운 어조의 음성 또는 채팅 에이전트가 처리하는 실제 상호작용을 의미한다. 이 플랫폼은 운영 전 시뮬레이션, 멀티채널 배포, 그리고 운영 중 대화를 모니터링하고 사전 개선 권고를 제공하는 Spotlight 도구를 통한 추적 기능을 제공한다. 기업 측면에서 ElevenLabs는 스타트업부터 정부 기관, Fortune 500 기업까지를 아우르는 고객을 위해 구성 가능한 안전장치와 지역별 데이터 거주 옵션을 강조한다.
Google과 PSG: Gemini가 클럽의 공식 AI 어시스턴트가 되다
파리 생제르맹과 Google은 2029년까지 이어지는 Premium 파트너십 체결을 발표했다. 이 협약에 따라 Google Gemini는 클럽의 공식 AI 어시스턴트가 되고, Google Pixel은 PSG의 공식 스마트폰이 된다.
이는 후원 및 유통 계약으로, 현재까지 관련 제품 기능이나 통합에 대한 기술적 세부 사항은 공개되지 않았다. 이번 조치는 Gemini를 기술 애호가 사용자 집단을 넘어 더 넓은 대중에게 알리려는 Google 전략의 일환으로, 세계에서 가장 많은 관심을 받는 축구 클럽 중 하나와 결합하는 형태로 진행됐다.
🔗 X의 발표
짧은 소식
- Vercel과 v0가 ChatGPT 계정으로의 연결을 지원 — 이제 로그인 페이지에 « Continue with ChatGPT » 버튼이 추가됐고, ChatGPT에서 사용할 수 있는 Vercel 플러그인도 제공된다. 🔗 출처
- Replit, Designathon 발표 — 모든 크리에이터에게 열린 1주일짜리 디자인 대회로, 8월 4일 오전 9시(태평양 표준시)에 생중계 시작과 함께 상금이 걸려 있다. 🔗 출처
- Together AI, Kimi K3 Max와 Fable 5 xhigh의 작업당 비용 비교 — DeepSWE 벤치마크에서 Kimi K3 Max는 실행당 비용의 약 3분의 1로 Fable 5 xhigh에 근접한 성능을 보였으며, 지출한 1달러당 처리되는 작업 수는 2.8배 더 많았다. 🔗 출처
- GitLab에서 GitHub Enterprise Cloud로의 마이그레이션, 일반 공개 — CLI 확장
gh gl2gh를 통해 이제 gitlab.com 또는 GitLab Self-Managed의 저장소를 GitHub Enterprise Cloud로 셀프서비스 마이그레이션할 수 있다. 🔗 출처 - Luma Ray 3.2, 제3자 플랫폼 Fuser에서 사용 가능 — 이 비디오 모델은 이 크롭 도구에 통합되어 있으며, 화면 비율을 바꿔도 장면의 동작을 유지한다고 약속한다. 🔗 출처
- NVIDIA NeMo Gym, Legal Agent Bench 통합 — Harvey와 함께 개발한 이 법률 에이전트 벤치마크가 오픈 라이브러리 NeMo Gym에 합류해 복잡한 법률 사용 사례에서 open weights 모델의 발전을 돕는다. 🔗 출처
- 30초 만에 학습된 파쿠르 에이전트에 대한 NVIDIA 데모 — 아주 짧은 참조 비디오 조각만으로 시뮬레이션이 전문가 수준의 행동을 습득했다고 하며, 추가 기술 세부 사항은 제공되지 않았다. 🔗 출처
- 프레젠테이션 생성을 위한 Kimi Slides 튜토리얼 — Moonshot AI는 그래프와 SmartArts를 포함해 Kimi K3로 구동되는 프레젠테이션 생성 도구 Kimi Slides에 대한 교육 시리즈의 첫 에피소드를 공개했다. 🔗 출처
의미하는 바
오픈 웨이트 경쟁은 여러 전선에서 동시에 계속되고 있다. 2.4T 파라미터를 가진 Qwen3.8-Max는 다음 주부터 공개될 예정이고, MiniMax H3는 발표 단계를 넘어 네 가지 서로 다른 추론 구성요소에 대한 Day-0 지원과 함께 실제 사용 가능 상태로 전환된다. 또한 Together AI의 Kimi K3 Max 비용/성능 분석은 왜 이런 오픈 모델들이 입지를 넓혀 가는지를 보여준다. 품질이 비슷하다면, 이들은 동급 폐쇄형 모델 가격의 일부만 든다. 오픈 모델과 폐쇄형 모델 간의 힘겨루기는 이제 단순한 벤치마크 점수보다 이런 경제적 측면에서 더 많이 갈리고 있다.
두 번째 축은 개발 도구의 브리크화된 프로그래밍 가능 구성요소로의 플랫폼화다. Vercel의 v0 API, Cursor의 클라우드 에이전트 효율 향상, Google Workspace 통합, 그리고 GitHub가 Aspire에서 문서화한 활용 사례는 모두 같은 흐름을 보여준다. 즉, 에디터들은 더 이상 단순한 채팅 인터페이스만 파는 것이 아니라, 다른 에이전트가 제어할 수 있는 자동화 체인을 제공하며, 이를 생산 환경에서 활용 가능하게 만들기 위한 안전장치 — 제한된 권한, 사람의 검토 — 를 함께 갖추고 있다.
일반 소비자 측면에서는 두 발표가 다른 결을 보인다. Genspark의 GenOffice 코드 공개는 무료와 커뮤니티 효과에 기대어 완전한 AI 오피스 제품군을 대중화하려는 시도인 반면, Google과 PSG의 파트너십은 기술 혁신보다는 브랜드 가시성 논리에 가깝다. 즉, Gemini는 새로운 기능 발표 없이도 대중 노출만은 늘어나게 된다.
마지막으로, ElevenLabs가 제시한 수치 — ElevenAgents에서 주당 1천만 건이 넘는 대화 — 와 Runway의 Seedance 2.5 관련 출시 프로모션은, 음성이든 영상이든 생성형 AI 생산 도구가 이제 단순한 기술 시연을 넘어 전용 모니터링 도구를 갖춘 기업 규모로 자리 잡고 있음을 확인시켜 준다.
출처
- Qwen3.8-Max — X에서의 발표
- GenOffice — X에서의 발표
- API v0 — X에서의 발표
- Cursor — X의 클라우드 에이전트
- Cursor — Google Workspace 플러그인
- Aspire의 GitHub Agentic Workflows
- GitHub Ship Log 2026년 7월
- Sakana Namazu — 공식 발표
- MiniMax H3 — 공개된 가중치
- Runway — Max 요금제
- ElevenAgents — X의 ElevenLabs
- Google과 PSG — X에서의 발표
- Vercel과 v0 — ChatGPT 연결
- Replit Designathon
- Together AI — Kimi K3 Max 대 Fable 5 xhigh
- GitLab에서 GitHub Enterprise Cloud로의 이전
- Fuser의 Luma Ray 3.2
- NVIDIA NeMo Gym — Legal Agent Bench
- NVIDIA — 파쿠르 시연
- Kimi Slides — 튜토리얼