ai-powered-markdown-translatorgpt-5.4-mini로 fr에서 ko로 번역된 기사.
2026년 8월 11일, Gemini 앱은 월간 사용자 10억 명을 돌파하며 Google 역사상 가장 빠르게 성장한 제품이 되었다. NVIDIA는 Nemotron 3.5 Lightning과 라우팅 라이브러리 NeMo Switchyard를 공개했고, Mistral은 자사 플랫폼을 외부 모델에 개방하며 유럽 계산 연합을 결성했으며, Alibaba는 오픈 소스 애니메이션 모델의 대규모 업그레이드인 Wan-Animate-2를 공개했다. 이 밖에도 ChatGPT 광고의 5개 신규 시장 확대, 개발자를 위한 새로운 도구들, 그리고 미디어 생성 분야의 긴 발표 목록도 포함된다.
Gemini, 월간 사용자 10억 명을 돌파하다
Gemini 앱은 공식적으로 월간 활성 사용자 10억 명을 넘어섰으며, Google에 따르면 이는 회사 역사상 가장 빠르게 성장한 제품이다. 이 발표는 공식 계정 @GeminiApp와 Google에서 Gemini 및 Labs 팀을 이끄는 Josh Woodward 모두에 의해 공유되었다.
Google은 이번 발표와 함께 성장을 이끈 사용 방식에 대한 수치도 공개했다.
| 측정된 사용 방식 | 수치 |
|---|---|
| 음성 상호작용 | 사용자의 63%가 음성을 사용 |
| Gemini Live 세션 | 5명 중 1명은 라이브 카메라 또는 화면 공유를 사용 |
| 학업 관련 요청 | 38%가 첨부 파일(문서)을 포함 |
| 이미지 생성 | 매일 1억 5천만 장 이상의 이미지 생성 |
| Android 자동화 | 40개 이상의 앱에서 자동화된 작업 수행 |
| iOS 사용자 | Apple 기기에서 1억 명 이상의 활성 사용자 |
이 수치는 텍스트 채팅을 넘어 음성, 카메라, 화면 공유, 멀티미디어 생성, 앱 간 자동화(식당 예약, 차량 호출) 등으로 사용이 다변화되고 있음을 보여준다.
🚀One billion for Gemini! Our goal remains to make it the most personal, proactive, and powerful assistant.
🇰🇷 🚀 Gemini가 10억 명을 돌파했습니다! 우리의 목표는 계속해서 그를 가장 개인적이고, 능동적이며, 강력한 비서로 만드는 것입니다. — @GeminiApp X에서
NVIDIA, 고부하 에이전트를 위한 Nemotron 3.5 Lightning과 NeMo Switchyard 출시
NVIDIA는 개방형 Nemotron 3 모델군을 Nemotron 3.5 Lightning으로 확장했다. 이 모델은 300억 매개변수(활성 30억)의 하이브리드 MoE로, 복잡한 추론보다 도구 호출, 결과 검증, 작업 위임 등 고부하 에이전틱 작업 수행을 위해 설계되었다. NVFP4와 BF16으로 제공되며 최대 100만 토큰의 컨텍스트를 지원한다. NVIDIA는 이 모델이 유사한 모델 대비 최대 4배의 출력 처리량과 작업 완료 시간 30% 단축을 달성한다고 주장한다. PinchBench에서는 10,000개 작업을 실행하며 Qwen3.6 35B보다 35% 더 빠르게, 동등한 정확도에서 86%의 정확도를 기록했다.
이 모델은 가중치, 학습 데이터, 레시피와 함께 배포되며 Hugging Face, ModelScope, OpenRouter, build.nvidia.com에서 이용할 수 있다. Together AI는 출시 첫날부터(day-0) 파트너로 참여해, 고부하 에이전틱 워크로드를 위한 Dedicated Model Inference 제공을 통해 예약 용량을 제공한다.
한편 NVIDIA는 NeMo Switchyard도 공개했다. 이는 각 요청을 품질, 지연 시간, 비용 측면에서 가장 적합한 모델로 라우팅하는 오픈 소스 라이브러리로, 애플리케이션 재작성 없이 적용할 수 있다. 즉, 경계 모델은 복잡한 추론에, Lightning은 특화된 실행에 할당된다. NVIDIA는 작업 완료 비용이 Opus 4.8 단독 사용 대비 약 3분의 1 수준으로 내려간다고 주장한다. 구체적 파트너 사례도 제시되었다. Boomi는 트래픽의 59%를 더 빠른 미세조정 모델로 라우팅하고, Cognition은 평균 비용을 28% 줄였으며, Ramp는 모델과 라우팅을 결합해 비용을 59%로, 실행 시간을 32% 줄였다.
🔗 NVIDIA 공식 글 · X의 모델 발표
Alibaba, 오픈 소스 캐릭터 애니메이션의 대대적 업그레이드인 Wan-Animate-2 공개
Alibaba의 Wan 팀은 오픈 소스 캐릭터 애니메이션 모델의 대규모 업그레이드로 설명되는 Wan-Animate-2를 공개했다. 네 가지 핵심 기능이 강조된다. 인간, 만화, 로봇, 동물 전반에 걸쳐 동작과 미세 표정을 재현하는 고충실도 애니메이션; 같은 장면 안에서 각 캐릭터가 고유한 정체성과 동작을 유지하는 다중 캐릭터 애니메이션; 원본 비디오와 분리된 텍스트 기반 카메라 제어(예: “탑뷰”); 그리고 누적 오차 없이 chunk 단위로 임의 길이의 시퀀스를 생성하는 실시간 스트리밍 생성이다.
기술적으로 Alibaba는 명시적 포즈 스켈레톤 대신 참조 비디오 자체를 동작 prior로 사용하며, Dual-Branch DiT(Diffusion Transformer), Time-Align RoPE 시간 인코딩, 그리고 품질 저하 없이 계산량을 줄이기 위한 Sparse-Ref Attention(Sparse-Ref Attention) 구조를 채택했다. 카메라 제어는 약 5만 개의 Unreal Engine 다중 시점 샘플로 학습된 LoRA에 기반한다.
이 모델은 오픈 소스로, 현재 ModelScope, Hugging Face, GitHub에서 온라인 데모와 함께 이용할 수 있다. NVIDIA의 8월 “Local AI” 캠페인에 따르면, 이 모델의 140억 매개변수는 RTX 시스템에서 경쟁 모델보다 16~26배 더 빠르게 생성되며, 이는 소비자용 하드웨어에서 로컬 배포에 최적화되어 있음을 보여준다.
Mistral, 지역별 추론을 출시하고 GLM-5.2로 플랫폼을 개방하며 유럽 계산 연합을 결성
Mistral은 지역별 추론 선택과 서비스 보장을 결합한 유일한 유럽 AI 연구소로 자리매김한다. 이미 OpenAI, Google, 중국계 사업자들과의 가격 및 기술 경쟁에 뛰어든 이 회사는 단순한 벤치마크 경쟁이 아니라 주권성과 서비스 예측 가능성을 차별화된 방향으로 내세운다. 플랫폼 측면의 두 가지 신규 기능은 다음과 같다.
| 기능 | 상태 | 설명 |
|---|---|---|
| Mistral Regional Endpoints | 제공 중 | 추론 실행 시 유럽 또는 미국 선택 가능 |
| Mistral Priority Tier | 공개 미리보기 | 가용성 SLA와 맞춤형 처리량 제한 |
또 다른 중요한 변화는 Mistral 플랫폼이 외부 모델에 개방된다는 점이다. 첫 대상은 Z.ai의 GLM-5.2로, Mistral 모델과 동일한 지역 제어 및 서비스 약정을 제공받게 된다. 이는 지금까지 저렴한 개방형 모델 부문에서 직접 경쟁하던 두 회사 사이의 첫 번째 수렴이다.
마지막으로 Mistral은 **European Compute Units (ECU)**를 출시한다. 이는 기업의 다년간 약정을 자사 계산 인프라 접근으로 전환하는 메커니즘으로, 목표는 2030년까지 1 GW의 용량 확보이며, 이는 대도시 하나가 소비하는 전력 규모와 맞먹는다. 발표된 창립 파트너는 ASML(Christophe Fouquet, CEO), CMA CGM(Rodolphe Saadé, Chairman 및 CEO), Amadeus(Luis Maroto, CEO), Caisse des Dépôts(Olivier Sichel, CEO)로, 미국 하이퍼스케일러로부터 독립된 유럽 계산 생태계를 구축하려는 야심을 보여준다.
OpenAI, 영국·멕시코·브라질·일본·대한민국에서 ChatGPT 광고 출시
OpenAI는 ChatGPT 내 광고 도입을 한 단계 더 확장했다. 2026년 2월 미국에서 Free 및 Go 요금제 대상으로 테스트를 시작했고, 3월에는 캐나다, 호주, 뉴질랜드로 확대했으며, 이제 광고 프로그램이 영국, 멕시코, 브라질, 일본, 대한민국의 5개 신규 시장에서 공식 출시된다. Plus, Pro, Business, Enterprise, Education 요금제에는 광고가 표시되지 않으며, 연말까지 추가 시장 확대도 예정되어 있다.
원칙은 변하지 않았다. 광고는 ChatGPT의 응답에 절대 영향을 주지 않으며, 후원 광고로 명확히 표시되고 자연 응답과 시각적으로 분리된다. 타게팅은 현재 대화의 주제와 과거 광고 상호작용 기록에 기반하지만, 광고주에게 대화 내용이나 개인 데이터는 절대 제공되지 않으며, 집계 통계(조회수, 클릭수)만 전달된다.
사용자 제어 측면에서 ChatGPT는 광고 숨기기, 노출 이유 확인, 한 번의 동작으로 광고 데이터 삭제, 언제든 개인화 관리 기능을 제공한다. 식별되었거나 추정되는 미성년 계정에는 광고가 표시되지 않으며, 건강, 정신 건강, 정치 같은 민감한 주제 근처에도 노출되지 않는다. OpenAI에 따르면 파일럿에서 사용자 신뢰에 대한 측정 가능한 영향은 없었으며, 이것이 이번 점진적 확대를 촉진했다.
오픈 소스 생태계와 추론
webAI Intelligence Lab, GPT-OSS-120B를 능가하는 3B 추론 모델 TwiL-LM3 공개
webAI Intelligence Lab(오스틴)은 자사의 첫 오픈 소스 형식 추론 모델 TwiL-LM3를 공개했다. 매개변수는 30억 개에 불과하지만, 테스트한 5개 형식 추론 벤치마크 중 4개에서 OpenAI의 GPT-OSS-120B를 능가한다고 주장한다. 이는 약 40배 적은 매개변수로 2.6배 더 빠른 추론이 가능하다는 뜻이다. 자동 수집 웹 콘텐츠가 아니라 검증된 독자 데이터로 학습되었으며, 클라우드에 의존하지 않고 Raspberry Pi부터 iPhone까지 구동 가능한 엣지 컴퓨팅을 목표로 한다.
🔗 공식 트윗
Meta, Muse Spark 1.2의 오픈 가중치 버전을 준비 중
Muse Glimmer를 발표한 스레드에서 Alexandr Wang(Meta Superintelligence Labs)은 Meta가 곧 Muse Spark 1.2의 오픈 가중치 버전을 공개할 것이라고 밝혔다. 이 모델은 현재까지 터미널 코드 에이전트 Muse Code를 구동하는 비공개 모델이다. 정확한 일정은 제시되지 않았지만, 이번 발표는 Meta가 Muse 제품군 전반에서 오픈 가중치를 더 확대하는 방향으로 전환하고 있음을 확인시켜 주며, Muse Glimmer의 가중치를 Apache 2.0 라이선스로 즉시 개방한 흐름과도 이어진다.
🔗 공식 트윗
Zuckerberg, Meta의 AI 철학에 대한 글을 게시하다
같은 날 Mark Zuckerberg는 “모든 사람은 초지능에 접근할 수 있어야 한다”는 내용을 담은 글을 게시하며, 긍정적인 AI 미래를 만들기 위한 Meta의 철학과 가치를 설명했다. 이 메시지는 Muse Glimmer 출시와 함께 공개되었으며, 가중치 공개를 단순한 마케팅이 아니라 근본적 선택으로 자리매김한다. 또한 그 주에 Meta가 펼친 오픈 가중치 전략에 대한 더 큰 커뮤니케이션의 일부로 읽힌다.
🔗 공식 트윗
Lightricks, 자사의 오픈 월드 모델 대규모 업데이트 LTX-2.5 공개
Lightricks는 영화, 로보틱스, 실시간 워크플로우에 이미 사용되고 있는 자사의 “world model” 새 버전인 LTX-2.5를 공개했다. 이번 업데이트는 더 높은 픽셀 충실도, 컷이 바뀌어도 일관성을 유지하는 멀티 플랜 장면, 그리고 Diffusion Fidelity Rendering이라는 새로운 렌더링을 통해 다양한 도메인에 맞춰 미세조정(fine-tuned)할 수 있도록 설계된 사전 학습 기반을 약속한다. 팀은 LTX-2.5를 임대형 도구가 아니라 개방형 기반으로 소개한다.
🔗 공식 트윗
IBM Research, ACE보다 토큰을 덜 쓰는 에이전틱 메모리 ALTK-Evolve 공개
IBM Research는 재학습 없이 AI 에이전트가 과거 실패에서 학습할 수 있게 해 주는 시스템 ALTK-Evolve를 공개했다. 이 시스템은 사용되는 모델의 용량에 따라 재주입할 지시문의 양을 조절하며, 매 단계마다 전체 “playbook”을 제공하는 ACE(Agentic Context Engineering)와 대비된다. AppWorld 벤치마크에서 DeepSeek-V3.2를 사용했을 때 ALTK-Evolve는 작업당 263K 토큰으로 89.3%의 작업 완료율을 기록한 반면, ACE는 80.4%와 634K 토큰을 기록했다. gpt-oss-120b를 사용할 경우에는 ACE의 추론 비용의 약 40%로 동등하거나 더 나은 정확도를 달성한다.
Together AI, IBM, NVIDIA가 IBM Cloud용 기업 추론을 위해 협력
Together AI는 IBM 및 NVIDIA와의 파트너십을 발표하여 Spectrum-X 네트워크를 갖춘 NVIDIA B300 GPU 전용 클러스터를 통해 IBM Cloud에 기업용 AI 추론을 제공한다. 이는 Together AI의 프로덕션 추론 플랫폼으로 구동되는 이 플랫폼에서의 첫 사례다. 이 제안은 다른 클라우드 제공업체로 이전하지 않고도 AI 워크로드를 배포하려는 기존 IBM Cloud 고객 기업을 대상으로 한다.
🔗 공식 트윗
개발자 도구: Amp, Replit, GitHub Copilot, Manus
Amp, orb용 글로벌 플러그인과 스킬을 출시
Amp(Sourcegraph)는 Amp가 실행되는 어디에서나, 특히 orb에서 사용할 수 있는 Amp 호스팅 중앙 집중식 플러그인 및 스킬 시스템을 도입했다. 두 계층이 공존한다. 하나는 개인용 계층으로, 같은 대화 스레드 내에서 라이브 리로딩(live reloading)이 가능한 실험용 샌드박스이며, 다른 하나는 워크스페이스 계층으로, 관리자가 관리하고 팀 전체에 기본 로드된다. 개인 항목은 워크스페이스로 공유할 수 있으며, 버전 관리는 기본적으로 지원된다(최신 버전으로 업데이트, 오래된 스킬 감지).
Replit MCP 베타: MCP를 통해 앱 생성, 로드, 검색, 게시하기
Replit은 MCP(Model Context Protocol) 베타를 강화하여, 웹 인터페이스를 거치지 않고도 MCP를 통해 애플리케이션을 직접 생성, 로드, 검색, 게시할 수 있는 새로운 기능을 추가했다. 목표는 Replit의 웹 UI에만 머무르지 않고, 호환 가능한 어떤 MCP 클라이언트에서든 실제 소프트웨어를 구축할 수 있게 하는 것이다. 즉, 에디터, 자율 에이전트, 제3자 도구 어디에서든 가능하다. 이번 확장은 Replit이 자사 플랫폼을 에이전틱 워크플로우를 위한 프로그래머블 구성 요소로 노출하려는 전략을 확인시켜 준다.
🔗 공식 트윗
MAI-Code-1.1-Flash가 GitHub Copilot에 도입되고, MAI-Code-1-Flash는 지원 종료
Microsoft의 최신 컴팩트 코드 모델인 MAI-Code-1.1-Flash가 네이티브 비전 지원과 코드 품질, 지시 따르기, 도구 사용 개선과 함께 GitHub Copilot에 배포됩니다. 연간 구독자의 프리미엄 요청 배수는 0.25×이며, MAI-Code-1-Flash보다 73% 저렴합니다. Free와 학생 요금제에서는 자동 선택되고, Pro, Pro+, Max, Business, Enterprise에서는 수동 선택이 가능합니다. 동시에 GitHub는 MAI-Code-1-Flash를 2026년 9월 10일에 지원 종료한다고 발표했습니다.
Manus가 다시 독립 기업이 됩니다
Manus가 다시 독립 기업이 된다고 발표했습니다. 일부 관할권의 규제 요건을 충족하기 위해, 일부 사용자는 2026년 8월 23일(싱가포르 시간 오전 7시 59분) 전에 데이터를 백업한 뒤, 2026년 8월 25일(싱가포르 시간 오전 8시)부터 복원을 시작해야 합니다. 영향을 받는 사용자에게는 이메일과 앱 내 알림으로 사전 안내가 이루어지며, 전환 기간 동안 청구는 없고 웰컴 보너스가 제공될 예정입니다.
🔗 공식 트윗
미디어 생성: Wan CLI, Motif 3, Luma Scenes, 그리고 800 VDC 전력 공급
Wan CLI: Alibaba가 에이전트에서 직접 Wan을 제어할 수 있게 하다
Alibaba가 Wan CLI를 공개했습니다. 이 새로운 명령줄 도구는 에이전트에서 직접 Wan 플랫폼을 호출해 이미지와 비디오를 프로그램 방식으로 생성할 수 있게 해 줍니다. 사용된 크레딧은 사용자의 Wan Video 계정과 완전히 동기화되어, 웹 인터페이스와 자동화 사용 사이의 이중 청구 관리를 피할 수 있습니다. 설치는 Wan 패널에서 명령을 받아 자신의 에이전트에 붙여넣는 방식이며, 시작을 돕는 비디오 튜토리얼도 제공됩니다.
🔗 공식 트윗
Motif 3: NVIDIA B200 GPU로 훈련된 최초의 한국 프런티어 모델
한국 스타트업 Motif Technologies가 프런티어 LLM 경쟁을 겨냥한 첫 모델인 Motif 3 Base와 Motif 3를 출시했습니다. 이 모델들은 한국 과학부의 지원을 받아 개발되었고 NVIDIA B200 GPU에서 훈련되었습니다. Motif 3는 NVIDIA NeMo-RL을 사용한 사후 훈련을 통해 Motif 3 Base 위에 구축되었습니다. NVIDIA와의 협업으로 팀은 최적화된 저정밀도 방식인 NVFP4 버전도 공개합니다. 전체는 기술 보고서와 함께 Hugging Face에서 제공될 예정이며, NVIDIA는 이번 출범을 한국 AI 생태계의 역동성을 보여 주는 사례로 평가했습니다.
🔗 공식 트윗
Luma Scenes: Uni-1로 구동되는 장면별 비디오 제작
Luma AI가 Luma Scenes를 출시했습니다. 이 도구는 최종 렌더링 전에 각 장면을 개별적으로 다듬고, 타이밍을 맞추고, 검증할 수 있게 해 주며, 많은 변형을 생성해 그중 하나만 쓸 수 있는 버전을 골라야 하는 전형적인 문제에 대응합니다. 장면 하나의 실패가 전체 제작을 망칠 수 있기 때문입니다. 이 도구는 Luma Layers(레이어 기반 편집, 7월 말)에 이어 Luma가 원클릭 생성보다 세밀한 제어에 집중하고 있음을 보여 주며, 전통적인 편집에 더 가까운 워크플로를 제공합니다.
🔗 공식 트윗
Ideogram Ad Resizer: 하나의 디자인, 모든 광고 형식
Ideogram이 Ad Resizer를 출시했습니다. 단일 디자인과 목표 광고 지면을 바탕으로, 이 도구는 캠페인에 바로 사용할 수 있는 전체 형식 세트(Instagram, Facebook, YouTube, 커넥티드 TV, 디스플레이, 인쇄물)를 자동 생성하며, 수동 리사이즈가 어려운 극단적인 비율도 포함합니다. 앱과 API를 통해 즉시 사용할 수 있어 자동화된 광고 제작 पाइ프라인에 통합할 수 있으며, 멀티채널 크리에이티브 팀을 위한 실질적인 마케팅 활용 사례입니다.
🔗 공식 트윗
HeyGen for Real Estate: 부동산 중개인을 위한 세 가지 비디오 형식과 함께 공식 출시
HeyGen이 HeyGen for Real Estate를 공식 출시했습니다. 카메라나 편집 없이 화면에 직접 등장하는 부동산 중개인을 위한 세 가지 비디오 형식을 제공하며, 목표는 이 업계가 요구하는 시각적 존재감을 유지하면서도 하루에 여러 번 게시할 수 있게 하는 것입니다. 프로모션 혜택으로, 발표 후 12시간 이내에 Creator 플랜에 가입한 사람은 30일 동안 White Glove 무료 액세스를 받습니다(미국 한정). HeyGen은 부동산을 넘어 다른 소규모 비즈니스로의 확장 가능성도 언급했습니다.
🔗 공식 트윗
NVIDIA가 미래의 « AI factories »를 위한 800 VDC 전력 아키텍처를 공개하다
NVIDIA가 Google, Microsoft와 함께 Open Compute Project를 통해 800볼트 직류 전력 아키텍처를 공개했습니다. 이 방식은 전력망과 GPU 사이의 전기 변환 단계를 줄여, 차세대 가속기의 계산 밀도를 뒷받침합니다. 이미 80개가 넘는 제조업체가 호환 제품을 개발 중입니다. 배포는 여러 단계로 진행되며, 2026년 하반기에 하이브리드 « Power Rack » 아키텍처, 2027년에 « Row Power Center », 그리고 향후 10년 내에 800 VDC 네이티브 설치가 예정되어 있습니다.
Qwen, Z.ai, 그리고 OpenAI: 새로운 모델과 에이전트 동기화
Qwen3.8-27B: 이번 주 오픈 웨이트 공개 예정
Alibaba Qwen이 Qwen3.8-27B의 오픈 웨이트가 이번 주에 공개될 것이라고 확인했습니다. 이는 이미 8월 초에 다룬 대표 모델 Qwen3.8-Max에 이어 Qwen3.8 계열의 새로운 규모입니다. 팀은 이 새 모델이 에이전트 코딩에서 Qwen3.6-27B보다 우수하다고 소개했으며, 이 중간 규모를 몇 주째 기다려 온 개발자 커뮤니티도 이미 긍정적으로 반응하고 있습니다.
🔗 공식 트윗
Z.ai: ZCode가 사용자 100만 명을 달성, GLM Coding Plan 한도 초기화
Z.ai가 GLM 모델 기반 코딩 도구인 ZCode가 사용자 100만 명을 넘어섰다고 발표했습니다. 이에 대한 감사의 뜻으로 회사는 GLM Coding Plan 모든 구독자의 사용 한도를 초기화하고, 장기 추론 능력을 실제로 완료된 작업으로 더 잘 전환하도록 설계된 업데이트를 배포합니다. 이 업데이트는 **98%**의 캐시 성공률을 제공하며, 구독자에게 약 1.8배 더 많은 사용량을 제공합니다.
🔗 공식 트윗
Codex가 포함된 ChatGPT 데스크톱 앱, Linux에서 미리보기로 제공
OpenAI가 데스크톱 애플리케이션을 Linux로 확장했습니다. 그동안은 macOS와 Windows에만 제공되었습니다. 미리보기는 Ubuntu 24.04/26.04 LTS, Debian 13, Fedora 43/44 등 네 가지 주요 배포판을 포함하며, x64와 ARM64용 .deb/.rpm 패키지를 제공합니다. 이 앱은 ChatGPT, ChatGPT Work, Codex를 하나의 기본 인터페이스로 묶고, 지원되는 프로젝트와 브라우저 워크플로에 접근할 수 있게 하며, 작업 환경을 바꾸지 않아도 됩니다.
🔗 공식 트윗
Codex와 ChatGPT Work가 다른 AI 에이전트의 작업을 가져옵니다
ChatGPT Work와 Codex를 위한 새로운 기능으로, 다른 AI 에이전트로 수행한 기존 작업을 OpenAI 생태계와 동기화된 상태로 유지할 수 있게 되었습니다. 구체적으로 사용자는 프로젝트, 대화, 기술, 플러그인을 가져오고, 가져오기 기록을 확인하며, 설정에서 자동 동기화를 활성화할 수 있습니다. 이제 ChatGPT 데스크톱 앱에서 바로 사용할 수 있어, 완전히 새로운 구성으로 처음부터 다시 시작하는 대신 도구 전환의 마찰을 줄여 줍니다.
🔗 공식 트윗
간단 소식
- Fable 청구 버그 해결, 196건 환불 — Anthropic은 설정 캐시 버그로 인해 초과 사용량이 잘못 표시되던 문제를 완전히 해결했다고 확인했습니다. 196명의 사용자에게 환불과 보상 크레딧이 지급되었습니다. 🔗 트윗
- v0(Vercel)이 사이드바를 전면 개편 — 프로젝트별로 묶인 대화, 실시간 상태 표시기, 호버 시 미리보기 카드. 🔗 트윗
- Amp가 orb의 디스크 크기를 60GB로 늘림 — 이전 40GB에서 증가했으며, 새 orb에는 추가 비용이 없습니다. 🔗 트윗
- DeepSeek V4 Flash 0731, Together AI에서 파인튜닝 가능 — SFT 또는 DPO로 특화한 뒤 프로덕션에 배포. 🔗 트윗
- Together AI가 전용 추론의 오토스케일링에 대한 두 번째 내용을 공개 — 같은 부하 아래 세 가지 정책을 테스트했지만, 실제로 적응한 것은 하나뿐이었습니다. 🔗 트윗
- Hugging Face가 Open Model Series 출시 — 오픈 모델과 로컬 사용법을 다루는 새로운 교육용 비디오 시리즈. 🔗 트윗
- FC 바르셀로나가 Google Pixel / Gemini 파트너십에 합류 — 바이에른 뮌헨과의 유사한 파트너십에 이어 클럽의 새로운 공식 파트너가 되었습니다. 🔗 트윗
- Copilot 사용 보고서: 모델별 토큰 세부 정보 — 소비된 AI 크레딧 뒤에서 입력, 출력, 캐시 토큰을 이제 확인할 수 있습니다. 🔗 변경 로그
- GitHub가 Copilot의 Rubber Duck 에이전트를 강조 — 주니어 개발자의 역량에 대한 채용 관련 글에서 소개되었으며, 이 에이전트는 생성된 코드를 비판하기 위해 두 번째 모델을 사용합니다. 🔗 트윗
- Perplexity Computer: 가장 많이 사용된 연결기는 GitHub — 대부분 비개발자(5명 중 4명)가 사용했습니다. 🔗 트윗
- Suno Studio 2.0(티저) — Suno의 음악 제작 환경 새 버전이며, 추가 세부 사항은 없습니다. 🔗 트윗
- 11월 11일 뉴욕에서 ElevenLabs Summit 개최 — 기술 및 비즈니스 리더들이 모이는 콘퍼런스의 하루 행사이며, 참가 신청이 열려 있습니다. 🔗 트윗
- FLUX 3 Video가 세계 #2 자리를 유지함을 확인 — Black Forest Labs가 플레이그라운드 무료 액세스를 8월 16일까지 연장하고, 4K와 비디오 편집을 예고했습니다. 🔗 트윗
- Runway의 Seedance 2.5에 캐릭터 참조 50개 추가 — 그리고 음악 트랙에 맞춘 동기화 클립도 포함됩니다. 🔗 트윗
- Runway에서 P-Image-Ideogram 사용 가능 — 0.6초만에 이미지를 생성하며, 네 가지 품질 모드를 제공합니다. 🔗 트윗
- Databricks에서 Kimi K3 사용 가능 — Moonshot AI 모델의 새로운 배포 채널입니다. 🔗 트윗
- ChatGPT Work로 마케팅을 전환한 Zapier — 리드 퍼널에서 이탈 감소, 자동화된 리포팅. 🔗 OpenAI
- ChatGPT Work로 고객 여정을 최적화한 Virgin Atlantic — 제품 검색과 계획 수립이 빨라졌습니다. 🔗 OpenAI
- Cohere — Aidan Gomez가 오픈 소스 및 주권 전략을 설명 — 맞춤 설정 가능하고, 합리적이며, 안전한 모델을 핵심으로 삼습니다. 🔗 트윗
의미하는 바
대중용 AI의 사용 규모가 새로운 국면에 들어섰습니다. 월간 사용자 10억 명과 함께 Gemini는 텍스트 채팅을 훨씬 넘는 사용 사례(음성, 카메라, 자동화)에 힘입어 Google의 가장 대규모 제품군에 속하는 아주 제한된 그룹에 합류했습니다. 그와 동시에 OpenAI는 ChatGPT 광고를 5개 신규 시장으로 확장하고 있는데, 이는 대규모의 충성도 높은 사용자 기반이 확보되면 대화형 어시스턴트의 대규모 수익화가 전략적 우선순위가 된다는 신호입니다.
인프라 측면에서는 이날이 단순한 프런티어 추론보다 특화된 에이전트 실행으로의 전환을 보여 줍니다. NVIDIA는 Nemotron 3.5 Lightning과 NeMo Switchyard를 통해 명확한 경제 모델을 제시합니다. 복잡한 계획에는 비싼 모델을 쓰고, 대량 실행은 더 가볍고 저렴한 모델에 맡기는 방식이며, 여러 파트너에서 비용 절감 효과가 측정되었습니다. IBM Research(ALTK-Evolve)와 Together AI(오토스케일링, IBM Cloud 파트너십)는 추론의 같은 경제적 흐름을 더 깊게 파고들고 있으며, Mistral은 European Compute Units와 지역 추론을 통해 자체적인 주권 노력을 구조화하고 있습니다.
오픈 웨이트의 확장은 계속해서 새로운 주체와 새로운 형태로 넓어지고 있습니다. Alibaba의 Wan-Animate-2, webAI의 TwiL-LM3, 예정된 Qwen3.8-27B, Alexandr Wang이 언급한 Meta의 Muse Spark 1.2, 그리고 NVIDIA 기술 스택 위에 구축된 첫 한국 프런티어 모델인 Motif 3까지 포함됩니다. 텍스트, 애니메이션, 온디바이스 추론이라는 지리적·형태적 다변화는 오픈 소스가 더 이상 소수의 서구 연구소만의 전유물이 아님을 확인시켜 줍니다.
마지막으로, 개발자 에이전트 도구는 계속 전문화되고 있습니다. Amp와 Replit은 관리 계층을 추가하고 있으며(전역 플러그인, 확장된 MCP), GitHub는 저비용 모델 라인업을 강화하고, OpenAI는 Codex와 ChatGPT Work가 다른 곳에서 수행된 작업을 가져올 수 있게 하여 서로 경쟁하는 생태계 사이에 명시적 다리를 놓고 있습니다. 이는 완전한 새 구성으로 다시 시작하기보다 이식성을 택하겠다는 베팅이며, 개발자들이 여러 AI 에이전트를 동시에 병행해 사용하는 시대에 맞는 선택입니다.
출처
- Gemini — 사용자 10억 명
- Gemini — X에서의 발표
- NVIDIA — Nemotron 3.5 Lightning 및 NeMo Switchyard
- Alibaba Wan — Wan-Animate-2
- NVIDIA — Local AI 수치 (Wan-Animate-2)
- Mistral — 지역 추론, GLM-5.2, 연합 계산
- OpenAI — ChatGPT 광고
- webAI — TwiL-LM3
- Meta — Muse Spark 1.2 (Alexandr Wang)
- Zuckerberg — Meta의 AI 철학
- IBM Research — ALTK-Evolve
- Together AI, IBM, NVIDIA — IBM Cloud 추론
- Amp — 전역 플러그인과 기술
- Replit — MCP 베타
- GitHub — MAI-Code-1.1-Flash
- Manus — 독립 기업
- Alibaba Wan — Wan CLI
- Motif Technologies — Motif 3
- Luma AI — Luma Scenes
- Ideogram — Ad Resizer
- HeyGen — for Real Estate
- NVIDIA — 800 VDC 아키텍처
- Alibaba Qwen — Qwen3.8-27B
- Z.ai — 사용자 100만 명 달성한 ZCode
- OpenAI — Linux용 ChatGPT 데스크톱 앱
- OpenAI — Codex/ChatGPT Work로의 에이전트 가져오기
- Anthropic — Fable 청구 버그 해결
- v0 — 사이드바 재설계
- Amp — 60GB orb
- Together AI — DeepSeek V4 Flash 0731 파인튜닝
- Together AI — 전용 추론 오토스케일링
- Hugging Face — Open Model Series
- FC 바르셀로나 — Google Pixel / Gemini 파트너십
- GitHub — 모델별 Copilot 사용 보고서
- GitHub — Rubber Duck 에이전트
- Perplexity Computer — GitHub 연결기
- Suno — Suno Studio 2.0
- ElevenLabs — 뉴욕 Summit
- Black Forest Labs — FLUX 3 Video
- Runway — Seedance 2.5
- Runway — P-Image-Ideogram
- Kimi Moonshot — Databricks의 K3
- OpenAI — Zapier
- OpenAI — Virgin Atlantic
- Cohere — 오픈 소스 및 주권 전략