ai-powered-markdown-translatorArticol tradus din fr în ro cu gpt-6.1-sol.
Joi, 1 octombrie, Anthropic lansează mods, mici funcții TypeScript care se conectează la evenimentele Claude Code pentru a-i rescrie comportamentul și interfața, livrate cu versiunea 2.1.287. În aceeași zi, GitHub deschide în previzualizare publică două capabilități de agent în Copilot CLI și aplicația GitHub Copilot: controlul aplicațiilor desktop și workflow-uri dinamice, orchestrări scrise în cod. Black Forest Labs lansează FLUX 3 Image, care compune folosind casete de încadrare și generează până la 4K; Google introduce Guided Vision în Gemini Live, Barclays extinde Claude la întreaga bancă, iar GitHub înăsprește regulile de raportare a vulnerabilităților în fața rapoartelor generate de IA.
Claude Code se deschide pentru mods, funcții TypeScript care îi rescriu comportamentul și interfața
1 octombrie — Anthropic lansează mods, mici funcții TypeScript care schimbă modul în care funcționează Claude Code. Fiecare acțiune a instrumentului emite un eveniment (apelarea unui instrument, cerere de permisiune, prompt trimis, început și sfârșit de rundă, redarea unei părți a ecranului), iar un mod se conectează la acesta înainte, după, în locul lui sau înconjurându-l. Poate rescrie un prompt înainte ca acesta să ajungă la model, bloca, rescrie sau relansa apelarea unui instrument, aproba sau refuza o permisiune, masca secrete în rezultatul unui instrument înainte ca Claude să îl citească ori adăuga propriile panouri, butoane și câmpuri de introducere. Mods sunt livrate în plugin-uri, se instalează cu /plugin și se distribuie la fel ca acestea; sosesc odată cu Claude Code 2.1.287 și sunt activate implicit. Nu trebuie să cunoști API-ul pentru a începe: îi poți cere lui Claude Code să scrie un mod, iar acesta produce codul TypeScript, îl instalează și îl reîncarcă la cald în sesiune.
Diferența față de hooks existente este clară. Un hook de setări (settings hook) lansează o comandă shell la fiecare eveniment; un mod este încărcat o singură dată și rămâne în sesiune, astfel încât păstrează o stare, redesenează interfața pe măsură ce apar evenimente și poate înregistra comenzi slash sau instrumente pe care modelul le apelează. Anthropic le folosește deja pentru propriile funcții: panoul /diff și suportul pentru AGENTS.md au devenit mods integrate, care pot fi dezactivate sau înlocuite, iar compania intenționează să convertească și alte funcții în timp, astfel încât Claude Code să poată fi redus la un nucleu mic. Printre cele șase mods integrate enumerate în documentație se află You should know, dezactivat implicit, în care un agent secundar semnalează ceea ce utilizatorul sau Claude ar putea să omită.
| Aspect al mods | Detaliu oficial |
|---|---|
| Versiune minimă | Claude Code 2.1.287, mods activate implicit |
| Medii cu afișare | CLI în terminal, fila Code din Claude Desktop (cu excepția sesiunilor WSL) |
| Medii fără afișare | Extensia VS Code, claude -p, Agent SDK și sesiuni cloud, în care rulează hooks |
| Mods integrate | 6, inclusiv /diff, AGENTS.md, sec-default și You should know |
| Timp propriu al unui hook | 10 secunde la fiecare declanșare |
| Dezactivare | /plugin pentru un mod, --safe-mode pentru o sesiune, disableAllHooks pentru toate |
Ghidul introductiv al lui Addy Osmani de pe claude.dev construiește Token Weather, un mod de aproximativ 80 de linii care afișează deasupra promptului „vremea” contextului, cu un mic grafic al ultimelor 12 runde. Prezintă și Blast Radius, care suspendă un rm -rf, un git reset --hard sau un push forțat cât timp arată ce ar afecta, și Replay Theater, care redă modificările fișierelor dintr-o rundă.
Încrederea rămâne punctul delicat. Articolul avertizează că mods nu sunt izolate: au același acces la mașină ca Claude Code, iar documentația precizează că un mod poate citi variabilele de mediu și fișierele de setări, vedea fiecare prompt, aproba apelarea unui instrument sau consuma resursele incluse în abonament, dar nu poate modifica dialogul de solicitare a permisiunii. Ghidul de pe claude.dev descrie însă un modul care rulează în propriul sandbox, fără DOM sau Node, orice acțiune externă trecând prin API-ul $: acest lucru îi permite lui claude plugin validate să enumere, înainte de instalare, evenimentele pe care le interceptează un mod și apelurile pe care le face. Pe Team și Enterprise și pe orice mașină cu setări gestionate, modul integrat sec-default se încarcă primul și împiedică mods instalate de utilizator să ocolească regulile de refuz; administratorii își pot plasa propriile mods înaintea lui.
Mods are absolutely insane. You can now customize Claude to work and look the way you want by just prompting it. Each person works differently, so there’s no reason why everyone should have an identical Claude experience. Make Claude your own, and share mods as plugins so others can try your mods too.
🇷🇴 Mods sunt ceva cu totul nebunesc. Acum puteți personaliza Claude astfel încât să lucreze și să arate așa cum doriți, pur și simplu cerându-i acest lucru. Fiecare lucrează diferit, așa că nu există niciun motiv ca toată lumea să aibă o experiență Claude identică. Faceți Claude al vostru și distribuiți-vă mods sub formă de plugin-uri, pentru ca și alții să le poată încerca. — @bcherny pe X
Lansarea era așteptată: Boris Cherny o anunțase pe 14 septembrie, iar Anthropic prezentase proiectul pe GitHub (issue #91870). Articolul și ghidul de pe claude.dev invită utilizatorii să își trimită mods în directorul Claude.
🔗 Personalizați Claude Code cu mods în TypeScript · Ghid introductiv pe claude.dev · Documentația pentru mods
Claude Code 2.1.287: context de 1M implicit la furnizorii cloud și 67 de remedieri
1 octombrie — Claude Code 2.1.287 este versiunea care aduce mods, dar conține 106 intrări, dintre care 67 de remedieri. Pentru companii, pe Bedrock, Vertex, Foundry și gateway-ul Claude apps, Opus 4.7 și versiunile ulterioare, precum și Fable, folosesc acum implicit o fereastră de context de 1M, fără sufixul [1m]; CLAUDE_CODE_DISABLE_1M_CONTEXT=1 permite păstrarea limitei de 200K. /advisor acceptă Sonnet 5.5 ca sfătuitor pentru Opus 4.7 și 4.8, o comutare automată a modelului păstrează nivelul de efort curent, iar serverele MCP cu protocolul 2025-11-25 pot deschide dialoguri pentru URL-uri. Un rm periculos își păstrează confirmarea chiar și atunci când comanda își redirecționează rezultatul către ~ sau un wildcard, cererile de permisiune în așteptare se afișează de la cea mai veche la cea mai recentă, iar nouă intrări îmbunătățesc modul cititor de ecran. În VS Code, o comandă sau un subagent în curs poate trece în fundal (Rulează în fundal).
🔗 Notele versiunii Claude Code 2.1.287
GitHub Copilot: controlul aplicațiilor desktop și workflow-uri dinamice în previzualizare publică
1 octombrie — În aceeași zi, GitHub deschide două capabilități de agent în previzualizare publică în Copilot CLI și aplicația GitHub Copilot: controlul aplicațiilor desktop și workflow-uri dinamice, disponibile și în GitHub Copilot SDK.
Copilot controlează aplicațiile desktop. Controlul computerului (computer use) ajunge pe macOS și Windows. Copilot citește conținutul accesibil al unei ferestre și contextul său vizual, prin arborele de accesibilitate al sistemului sau prin capturi de ecran atunci când este necesar, face clic pe controale, introduce text, apasă taste, derulează, trage și plasează elemente și înlănțuie pași de la o aplicație la alta; demonstrația îl arată completând un decont de cheltuieli în Safari. GitHub vizează programele vechi sau exclusiv grafice, fără API, interfață în linie de comandă ori integrare MCP, iar documentația recomandă aceste căi când există, deoarece oferă rezultate mai previzibile. Funcția este dezactivată implicit: /computer on o activează în CLI, /computer show îi afișează starea și /computer off o dezactivează, în timp ce aplicația o oferă în setări. Copilot cere autorizare înainte de a controla fiecare aplicație: aceasta poate fi acordată pentru sesiune, salvată pentru sesiunile următoare sau refuzată. O aprobare permanentă (Permite întotdeauna) este valabilă pentru CLI și aplicație pe aceeași mașină, dar o regulă de refuz are întotdeauna prioritate, iar două apăsări pe Esc în CLI sau butonul Stop din aplicație întrerup o acțiune care scapă de sub control. Setările gestionate ale unei organizații pot dezactiva funcția, fără ca o activare locală să le poată ocoli. GitHub avertizează că o instrucțiune ambiguă sau un conținut neașteptat pe ecran poate provoca acțiuni nedorite asupra conturilor conectate, inclusiv financiare, și descurajează aprobarea permanentă pentru aplicațiile sensibile. Nu sunt precizate nici abonamentele vizate, nici cifre; comanda /computer apărea deja în notele Copilot CLI 1.0.85, pe 16 septembrie.
🔗 GitHub Copilot poate acum interacționa cu aplicațiile desktop prin computer use
Orchestrări scrise în cod. Workflow-urile dinamice (dynamic workflows), disponibile pentru toate abonamentele Copilot, descriu într-un program modul de realizare a unei sarcini: codul stabilește pașii, momentul în care intervine un agent și utilizarea rezultatelor sale, secvențial, în paralel sau în ambele moduri, iar agenții gestionează ceea ce necesită analiză sau judecată. Un workflow poate lansa comenzi, împărți un obiectiv în sarcini paralele, transmite rezultate structurate de la o etapă la alta, pune un alt subagent să verifice constatările unui subagent și se poate opri la un punct de control (checkpoint) pentru o revizuire înainte de a continua. GitHub menționează investigarea unui incident, revizuirea în paralel a fișierelor unei pull request sau comentarii de revizuire supuse analizei a două modele și semnalate doar dacă ambele sunt de acord.
| Mod Copilot | Cine organizează munca, potrivit documentației |
|---|---|
| Autopilot | Copilot, care avansează fără să ceară validare după fiecare etapă |
/fleet | Copilot, care împarte de fiecare dată sarcina între subagenți în paralel |
| Workflow dinamic | Codul scris de autor: etape, condiții și transferuri de responsabilitate |
Programul se află într-o extensie pentru Copilot CLI și aplicație. Un workflow scris de Copilot rămâne limitat la sesiune, dar poate fi reutilizat prin copierea extensiei în directorul personal, distribuit prin directorul unui repository sau împachetat ca plugin. Subagenții moștenesc autorizările sesiunii, în timp ce comanda copilot workflow run nu afișează nicio solicitare: permisiunile trebuie acordate înainte de lansare. Disponibile fără configurare în aplicație, workflow-urile necesită în CLI activarea funcțiilor experimentale (--experimental sau /experimental on). GitHub nu publică nici cifre, nici reguli de facturare, iar numele amintește, fără vreo legătură anunțată, de Dynamic Workflows lansate de Anthropic în Claude Code pe 28 mai.
🔗 Workflow-uri dinamice în Copilot CLI și aplicația Copilot
FLUX 3 Image: Black Forest Labs compune folosind casete de încadrare și generează până la 4K
1 octombrie — Black Forest Labs (BFL) adaugă un model de imagine familiei FLUX 3, cu o deviză: controlul fiecărui pixel. FLUX 3 Image retușează o zonă în mai multe treceri succesive fără a modifica restul imaginii și acceptă mai multe modificări în aceeași cerere.
Cea mai vizibilă noutate este compoziția prin casete de încadrare (bounding boxes). Indiferent de format, imaginea devine un sistem de coordonate de la 0 la 1000 pe fiecare axă: se trasează o casetă pentru fiecare element, se descrie conținutul acesteia, apoi se rezumă scena într-o singură linie, iar modelul plasează fiecare element în caseta sa; rămâne posibilă și utilizarea exclusivă a unui prompt text. FLUX 3 Image combină și până la 10 imagini de referință, indicate prin token-uri în prompt, stabilind singur poziția și dimensiunea acestora. BFL îl prezintă ca fiind „conceput pentru agenți”: un LLM poate redacta tabelul elementelor și al casetelor lor pornind de la o cerere simplă, pe care utilizatorul îl ajustează înainte de a lansa generarea.
| Caracteristică anunțată | Detaliu comunicat de BFL |
|---|---|
| Rezoluție nativă | 2K și 4K (exemplu de pe pagina modelului: 5456 × 3072 pixels, 16,8 MP) |
| Imagini de referință | Până la 10 |
| Compoziție | Casete de încadrare pe o grilă de la 0 la 1000 pe fiecare axă |
| Editare | În mai multe runde, fără modificarea celorlalți pixeli |
| Ofertă API | Reducere de 50 % până pe 8 octombrie |
| Ponderile modelului | Comerciale sub licență; ponderi deschise „în săptămânile următoare” |
În privința accesului, FLUX 3 Image este disponibil prin API cu o reducere de 50 % până pe 8 octombrie, iar BFL oferă ponderi comerciale sub licență companiilor care doresc să îl ajusteze și să îl implementeze pe propria infrastructură. Versiunea cu ponderi deschise este anunțată fără o dată. La momentul anunțului nu fusese publicat niciun tarif de bază și niciun benchmark cu rezultate numerice. Modelul completează o serie lansată în această vară: FLUX 3, model multimodal unificat (23 iulie), FLUX 3 Video (4 august), modul său de editare (10 septembrie) și FLUX 3 Action pentru robotică (23 septembrie).
🔗 Anunțul FLUX 3 Image de la @bfl_ai · Pagina modelului FLUX 3 Image
Asistenți pentru publicul larg: Guided Vision în Gemini Live, probare virtuală în ChatGPT, grafice în Perplexity Computer, limite mai permisive pentru artefactele Claude
Guided Vision: Gemini Live ghidează persoanele nevăzătoare și cu deficiențe de vedere
1 octombrie — Google lansează Guided Vision în Gemini Live pe Android 9 și versiunile ulterioare, în regiunile și limbile în care Gemini Live este disponibil. Concepută împreună cu persoane nevăzătoare și cu deficiențe de vedere, funcția descrie în timp real ceea ce filmează camera partajată, răspunde la întrebări suplimentare și oferă indicații verbale pentru ajustarea cadrului: rotire lentă spre dreapta, înclinare în jos, deplasare înapoi. Google menționează citirea unei etichete nutriționale sau a unui meniu într-un restaurant întunecat, găsirea unei căști căzute sau descrierea culorilor unui articol vestimentar. Pentru antrenarea funcției, Google a colaborat cu Aira, un serviciu de interpretare vizuală: zeci de mii de ore de date, peste 1 000 de testeri din rețeaua sa și specialiști implicați în măsurile de protecție. Guided Vision se activează din profilul aplicației Gemini, printr-o scurtătură de accesibilitate Android sau din TalkBack. Google precizează că nu este nici un dispozitiv medical, nici un ajutor pentru mobilitate: funcția nu înlocuiește bastonul alb.
🔗 Guided Vision în Gemini Live (blogul Google)
ChatGPT: probă virtuală și favorite pentru cumpărături
1 octombrie — Potrivit notelor de versiune ale ChatGPT, un buton de probare (Try on) apare pe paginile articolelor de îmbrăcăminte și accesoriilor: utilizatorul face sau încarcă un selfie, iar ChatGPT Images generează o probă virtuală a produsului. Fotografia de referință este păstrată pentru probele următoare; poate fi înlocuită sau ștearsă din setări, în secțiunea fotografiilor de referință (Settings → Personalization → Reference photos). Orice produs poate fi, de asemenea, salvat la favorite sau organizat într-un dosar din biblioteca ChatGPT. Ambele funcții sunt disponibile pe mobil și pe web, dar nota nu precizează abonamentele sau țările vizate. ChatGPT oferea deja cumpărături vizuale din 24 martie.
🔗 Notele de versiune ale ChatGPT
Perplexity Computer creează grafice interactive
1 octombrie — Perplexity Computer creează acum grafice și vizualizări interactive direct în firul conversației. Pentru datele financiare, agentul folosește Lightweight Charts de la TradingView pentru a afișa lumânări, volum și medii mobile. Anunțul se rezumă la un tweet însoțit de un videoclip: nu precizează ce abonamente beneficiază de funcție sau pe ce platforme, iar nicio intrare din changelog nu o detaliază încă. ChatGPT și Claude făcuseră deja acest pas pe 10 și 12 martie, iar Replit Agent pe 25 septembrie.
Claude reduce la jumătate consumul din limite după lucrul la un artefact, până pe 15 octombrie
1 octombrie — De la 1 octombrie, ora 11 PT, până la 15 octombrie, ora 23:59 PT, crearea sau modificarea unui artefact (document, prezentare sau design) în Claude ori Claude Cowork reduce cu 50 % consumul din limita sesiunii de cinci ore pentru activitatea ulterioară. Oferta se aplică automat abonamentelor Pro, Max și Team; planul Free și abonamentele Enterprise sunt excluse, iar limita săptămânală nu se schimbă.
| Interfața vizată | Aplicarea reducerii de 50 % |
|---|---|
| Conversație începută din meniul Output | De la primul mesaj: 10 mesaje, 15 pași per răspuns |
| Conversație obișnuită | Cele 10 mesaje de după crearea artefactului, 15 pași per răspuns |
| Sarcină Cowork în cloud lansată din Output | Aproximativ primele 45 de minute |
| Altă sarcină Cowork în cloud | Până la 80 de pași după crearea sau modificarea unui artefact |
Claude Code, API, Claude în Slack, sarcinile Cowork locale sau programate, creditele de utilizare și aplicația independentă Claude Design sunt excluse. Anthropic sugerează să încercați cu Sonnet 5.5 și își rezervă dreptul de a modifica sau de a opri oferta mai devreme.
🔗 Anunțul @claudeai pe X · Condițiile ofertei (centrul de ajutor Claude)
Finanțe: Barclays extinde Claude în întreaga bancă, American Express oferă clienților săi Business acces la Perplexity Computer
Barclays vizează adoptarea Claude Code de către jumătate dintre dezvoltatorii săi până la sfârșitul lui 2026
1 octombrie — Barclays, banca universală britanică, își extinde colaborarea cu Anthropic și introduce Claude în întreaga organizație, pentru a accelera dezvoltarea software, a moderniza sistemele vechi și a crește eficiența operațională. Banca preconizează că Claude Code va fi adoptat de 50 % dintre dezvoltatorii săi până la sfârșitul lui 2026, apoi de majoritatea inginerilor săi software în 2027. Pentru două utilizări există deja cifre. Colleague Knowledge Assistant, în funcțiune din 2025 și construit pe Claude cu o arhitectură de generare augmentată prin recuperare (RAG), a fost adoptat de peste 16 000 de colegi și a procesat peste un milion de căutări; îi ajută pe membrii echipelor care deservesc peste 20 de milioane de clienți persoane fizice în Regatul Unit. În activitatea Global Markets, modelele Claude clasifică, îmbogățesc și direcționează aproximativ 120 000 de e-mailuri pe zi. Paul Smith, directorul comercial al Anthropic, consideră că acesta este un pas important pentru companie în Regatul Unit; nu sunt comunicate valoarea sau durata contractului.
Perplexity și American Express: zece Skills de afaceri în Computer pentru cardurile Business
1 octombrie — Perplexity lansează o colecție de Skills gata de utilizare pentru Perplexity Computer, rezervată deținătorilor americani ai unui card American Express Business care sunt abonați la Perplexity Enterprise. Conducătorul companiei alege o sarcină și o detaliază într-un formular în loc să scrie o solicitare. Cele zece Skills acoperă prognoza fluxului de numerar, pregătirea fiscală, compararea furnizorilor, scenariile bugetare, reconcilierea, campaniile de marketing, prognoza cererii, rentabilitatea cheltuielilor publicitare pe canal (ROAS), monitorizarea operațiunilor și recrutarea. Cardul se conectează prin Plaid din Personal CFO, iar fiecare execuție consumă credite Computer în funcție de complexitatea sarcinii. Pagina parteneră mai oferă, până pe 29 martie 2027, un credit unic de 125 de dolari pentru o achiziție de cel puțin 325 de dolari a unui abonament Enterprise Pro sau Enterprise Max și 1 000 de credite Computer oferite o singură dată pentru fiecare cont. Cardurile Corporate sunt excluse, iar rezultatele nu reprezintă consultanță financiară, fiscală, juridică sau contabilă.
🔗 Articolul Perplexity · Pagina parteneră American Express
Video generativ și avataruri: Wan 3.0 în fruntea clasamentului Artificial Analysis, Project Continuum de la Runway, Sessions de la Synthesia
Wan 3.0 preia conducerea noului clasament video al Artificial Analysis
1 octombrie — Alibaba susține că Wan 3.0 ocupă primul loc în noul clasament de generare video din text al Artificial Analysis, AA-Video-T2V v2.0, lansat pe 30 septembrie cu o metodologie nouă: fiecare model este evaluat în 1080p pe un set de prompt-uri reînnoit periodic, iar sincronizarea sunetului contează în scor. Diferențele pe podium sunt mici, intervalele de încredere suprapunându-se.
| Model clasat | Scor Elo | Intervalul poziției | Preț prin API |
|---|---|---|---|
| Wan 3.0 | 1157 (±9) | 1 până la 2 | 12,00 dolari pe minut |
| Utopai X (bazat pe MiniMax H3) | 1150 (±10) | 1 până la 3 | Fără API publică |
| Dreamina Seedance 2.5 | 1144 (±9) | 2 până la 4 | 34,12 dolari pe minut |
| MiniMax H3 (768p) | 1139 (±9) | 3 până la 5 | 4,80 dolari pe minut |
Surpriza clasamentului este Utopai X, lansat pe 30 septembrie de Utopai Studios, un studio de film și televiziune nativ IA. Antrenat ulterior pe baza MiniMax H3, este accesibil doar pe platforma PAI a studioului (93 de credite pe secundă de video, abonamente de la 15 dolari pe lună) și depășește chiar MiniMax H3.
🔗 Anunțul @Alibaba_Wan pe X · Clasamentul AA-Video-T2V v2.0 · Utopai X potrivit @ArtificialAnlys
Runway Labs prezintă Project Continuum, interfețe generate video în timp real
1 octombrie — Runway Labs, divizia de explorare a Runway, prezintă Project Continuum, o aplicație de cercetare care imaginează un sistem de operare a cărui interfață ar fi generată video, în timp real, continuând direcția Solaris, modelul de lume pentru interfețe prezentat pe 31 august. Această primă prezentare descrie patru moduri de interacțiune cu computerul. Cu Portals, un model video generează în timpul navigării suprapuneri animate și interactive, cu margini estompate pentru a semnala conținutul generat. Interfețele video responsive (Responsive Video Interfaces) se reorganizează când sunt redimensionate și răspund la clicuri. Interactive Worlds transformă un material media într-o simulare interactivă, atât pentru oameni, cât și pentru agenți. Visual Thinking, în cele din urmă, este un harness pentru agenți de cod: un model video în timp real ilustrează fiecare pas și fiecare apel de instrument, pentru a menține utilizatorul implicat în proces. Runway nu oferă acces și nu precizează o dată, un tarif sau modelul de bază.
Synthesia lansează Sessions, avataruri care antrenează și intervievează
1 octombrie — Synthesia lansează Sessions, o familie de produse construită pe avatarurile sale interactive: un apel video în care interlocutorul este un avatar care pune întrebări, ascultă, contrazice și sintetizează. Roleplay Sessions este destinat antrenamentului: avatarul joacă rolul unui client, al unui potențial client sau al unui colaborator, un coach IA comentează fiecare încercare, iar managerii urmăresc scorurile și progresul într-un tablou de bord. Survey Sessions transformă chestionarul într-un interviu: avatarul intervievează sute de persoane în paralel, adresează întrebări suplimentare în funcție de răspunsuri, apoi furnizează un raport privind temele și sentimentele, fiecare răspuns rămânând consultabil în format transcris, audio sau CSV. Este oferită o perioadă de probă gratuită, fără tarife detaliate. Sessions se bazează pe Interactive Avatar API, care a devenit disponibilă la scară generală pe 16 septembrie, iar Synthesia promite alte variante.
🔗 Anunțul @synthesiaIO pe X · Pagina Synthesia Sessions
IA și știință: SynthID Bio marchează proteinele, Matthew Schwartz descrie o știință « pe tiparul lui Claude »
SynthID Bio: Google DeepMind marchează proteinele concepute prin IA
30 septembrie — Google DeepMind prezintă SynthID Bio, o familie de metode de marcare digitală (watermarking) pentru creațiile biologice generate de IA, prezentată și pe X pe 1 octombrie. Articolul o prezintă ca pe o demonstrație de concept: o semnătură imperceptibilă este înscrisă în codul biologic, verificabilă atât pe modelul digital, cât și pe proteina sintetizată. Pentru secvențe, metoda orientează discret alegerea aminoacizilor; pentru structurile 3D, o mică parte a rețelei de difuzie AlphaFold 3 este ajustată fin. În laborator, pe trei ținte (VEGF-A, domeniul RBD al proteinei spike a SARS-CoV-2 și PD-L1), proteinele de legare marcate au egalat versiunile clasice în ceea ce privește rata de succes, afinitatea și diversitatea secvențelor. Miza este biosecuritatea: un semnal automat ar ajuta furnizorii de sinteză de ADN să verifice originea unei secvențe necunoscute. Google DeepMind publică articolul despre metode, codul, datele in vitro și ponderile pentru cercetare; împreună cu laboratorul Hie de la Stanford și Arc Institute, abordarea se extinde deja la genomul unui bacteriofag conceput de Evo 2. Robustețea în fața unei alterări deliberate rămâne principala direcție de lucru.
🔗 Articolul Google DeepMind despre SynthID Bio
Știința « pe tiparul lui Claude »: articolul lui Matthew Schwartz, autor invitat
1 octombrie — Blogul Anthropic Science publică un articol al autorului invitat Matthew Schwartz, fizician la Harvard, care precizează că lucrează ca cercetător invitat la Anthropic. El descrie o « nepotrivire de impedanță » între oamenii de știință și IA: lucrul cu un model ca și cum ar fi un colaborator uman nu îi valorifică pe deplin capacitățile și este preferabil să se caute probleme « pe tiparul lui Claude », în care o tehnică cunoscută din matematică, fizică sau informatică rezolvă dintr-o dată o problemă dintr-un alt domeniu. Astfel a creat BootLoops, un harness open source pentru calcule exacte, utilizabil cu orice model; BootLoops nu este un proiect Anthropic, ci este întreținut de Schwartz. În fizică, 30 de integrale au fost tratate de la început până la sfârșit, dintre care 15 nu fuseseră niciodată calculate; în ecologie, arborii de pe Barro Colorado Island se schimbă de 4,5 ori mai rapid decât permite teoria neutră; în lingvistică, baza AccStack acoperă accentul lexical din 6 072 de limbi. Bilanț: 36 de manuscrise în 18 domenii, cu 19 coautori, în trei luni. Schwartz subliniază și limitele: Claude nu are simțul timpului, îi place să « declare victoria », iar rezultatele sale din afara fizicii au rămas puțin interesante până când un expert le-a reorientat.
🔗 Știința pe tiparul lui Claude (blogul Anthropic Science)
Modele deschise și antrenare: Olmo-core 3 de la Ai2, Clef și Clef-flash de la Cloudflare, RL cu mai multe harness-uri de la FineEnvs
Olmo-core 3: Ai2 publică o stivă de antrenare MoE care vizează peste o mie de miliarde de parametri
1 octombrie — Ai2 publică Olmo-core 3, noua versiune a framework-ului care antrenează modelele sale Olmo, reconstruită în jurul unui sistem de antrenare cu amestec de experți (mixture-of-experts, MoE) complet deschis. Este unul dintre sistemele următoarei generații Olmo, care va trece la MoE și ar trebui să devină, potrivit Ai2, cea mai capabilă generație Olmo. Vechea implementare, bazată pe FSDP, reunea și apoi împărțea din nou ponderile la fiecare batch; Olmo-core 3 trece la DDP, păstrează experții pe GPU-urile lor și le trimite datele.
| Măsurătoare publicată de Ai2 | Valoare măsurată |
|---|---|
| MoE cu 47 de miliarde de parametri pe opt B300, test preliminar | 52 000 față de 19 400 tokens/s per GPU, aproximativ 2,7 ori |
| MXFP8 față de BF16, pe patru B300 | Debit cu aproximativ 21 % mai mare |
| Model cu 1 200 de miliarde de parametri pe 512 GPU | Maximum 858 TFLOP/s per GPU, rutare aleatorie |
Ai2 precizează că măsurătoarea cu 1 200 de miliarde de parametri evaluează sistemul, nu calitatea unui model antrenat. Codul (versiunea 3.0.0), raportul tehnic și demonstrația interactivă sunt publicate.
🔗 Articolul Ai2 despre Olmo-core 3 · Lansarea Olmo-core v3.0.0
Clef și Clef-flash: Cloudflare publică două modele de decizie compatibile cu Jev
1 octombrie — Echipa Workers AI de la Cloudflare publică Clef și Clef-flash, primele sale modele antrenate intern, pe direcția deschisă de Jev, modelul System One de la Typesafe AI: acestea primesc o stare (text, JSON, imagine sau video) și o schemă de întrebări cu tipuri definite, apoi returnează într-o singură trecere o probabilitate pentru fiecare opțiune permisă. Clef este antrenat suplimentar pornind de la Qwen3.8-27B, iar Clef-flash se bazează pe Qwen3.5-9B. Găzduite pe Workers AI cu un API compatibil cu cel al Jev, modelele sunt publicate pe Hugging Face sub licența Apache 2.0, potrivit articolului, cu o fereastră de 64k tokens față de 32k pentru Jev. Cifrele, alese de Cloudflare, arată rezultate mixte:
| Benchmark și metrică | Scor Clef | Scor Clef-flash | Scor Jev |
|---|---|---|---|
| BFCL, cazuri exacte | 98,47 | 98,76 | 95,75 |
| BANKING77, macro-F1 | 94,20 | 90,93 | 79,74 |
| When2Call, acuratețe | 72,37 | 65,58 | 80,97 |
| BRIGHT, nDCG@10 | 45,91 | 39,26 | 47,52 |
| Latență mediană | 209,3 ms | 38,8 ms | 524,1 ms |
Cloudflare afirmă că Clef conduce Jev Decision Index, o poziție pe care Liquid AI o revendicase pentru d1 cu două zile înainte, și lansează un serviciu de ajustare a Clef prin învățare prin întărire pe datele clientului.
🔗 Articolul Cloudflare despre Clef · Clef pe Hugging Face
FineEnvs antrenează un model prin învățare prin întărire în patru harness-uri de agenți simultan
1 octombrie — Același model nu se comportă la fel în funcție de harness-ul care îl coordonează: ponderile LFM2.5-2.6B, de la Liquid AI, rezolvă 62 % dintre sarcini în Mini-SWE-Agent, dar 33 % în Claude Code. Organizația FineEnvs publică pe Hugging Face un ghid pentru antrenarea unui model prin învățare prin întărire direct în harness-urile dezvoltatorilor, fără modificarea codului acestora. Un proxy de captură adăugat la OpenEnv se prezintă harness-ului ca furnizor de modele (formate OpenAI, Anthropic sau Gemini) și înregistrează exact tokens și probabilitățile produse de vLLM; Harbor furnizează sarcinile și sandbox-urile, iar TRL antrenează folosind GRPO asincron. Antrenat în patru harness-uri simultan, LFM2.5-2.6B trece de la 42 % la 54 % în medie, iar un mic bonus pentru soluțiile care consumă puține resurse îi reduce cu 31 % apelurile de instrumente pentru sarcinile deja rezolvate. Imitarea unui model mai mare nu este suficientă: o ajustare supervizată pe 3 189 rollouts de la Qwen3.8-27B se plafonează la 47,5 %. Proxy-ul, componenta de antrenare, sarcinile, datele și modelele antrenate sunt publicate.
🔗 Ghidul complet pentru RL cu mai multe harness-uri
Grok 4.7 în versiune preliminară pe platforma de agenți Google Cloud
1 octombrie — SpaceXAI anunță că Grok 4.7 este disponibil pe Gemini Enterprise Agent Platform, platforma de agenți Google Cloud. Fișa modelului, datată 30 septembrie, îl prezintă în versiune preliminară sub identificatorul grok-4.7 și îl descrie drept un model xAI conceput pentru programare și activități bazate pe cunoștințe, care lucrează mai mult timp la sarcinile dificile și își verifică propria muncă. Acceptă text și imagini la intrare și returnează doar text; sunt acceptate apelarea funcțiilor, ieșirea structurată și raționamentul, dar nu și predicțiile în loturi.
| Informație publicată de Google Cloud | Valoare pentru Grok 4.7 |
|---|---|
| Lungimea contextului | 524 288 tokens |
| Cote pe minut | 13 cereri, 188 000 tokens de intrare și 16 000 tokens de ieșire |
| Tipuri de utilizare | Doar cotă fixă, fără plată în funcție de utilizare sau debit rezervat |
| Regiuni de furnizare a serviciului | Multiregiunea Statele Unite și endpoint global |
| Preț per milion de tokens | 2 dolari la intrare, 6 la ieșire, 0,50 în cache sub 200 000 tokens de intrare, dublu peste acest prag |
Grila de prețuri o reproduce pe cea a API-ului xAI. Lansat pe 21 septembrie, Grok 4.7 ajunsese pe Amazon Bedrock pe 28 septembrie, iar Grok 4.6 devenise disponibil pe aceeași platformă Google pe 21 august.
🔗 Fișa Grok 4.7 pe Google Cloud · Anunțul @SpaceXAI pe X
GitHub înăsprește raportarea privată a vulnerabilităților în fața rapoartelor generate de IA
1 octombrie — GitHub publică în același minut două măsuri pentru raportarea privată a vulnerabilităților (private vulnerability reporting), pornind de la aceeași constatare: responsabilii de mentenanță ai proiectelor open source primesc tot mai multe rapoarte de slabă calitate, automatizate sau generate de IA, care le îngroapă pe cele relevante.
A single free-text box made it easy to submit low-quality or AI-generated reports and hard for you to find the signal in them.
🇷🇴 Un simplu câmp de text liber facilita trimiterea rapoartelor de slabă calitate sau generate de IA și vă îngreuna identificarea informațiilor esențiale din acestea. — GitHub Changelog, Formulare structurate pentru rapoartele private de vulnerabilități
Un formular structurat. În mod implicit, autorul raportului trebuie să completeze patru câmpuri obligatorii: un rezumat, detalii, o dovadă de concept de cel puțin 150 de caractere și impactul, reunite în descrierea avizului de securitate pe care responsabilul de mentenanță îl verifică la fel ca înainte. Fiecare depozit poate adapta formularul cu un fișier .github/VULNERABILITY_REPORT.yml sau îl poate aplica tuturor depozitelor sale din depozitul .github al organizației; responsabilii de mentenanță pot cere o categorie CWE, cerință pe care o organizație sau o întreprindere o poate impune printr-o politică. O casetă de bifat îi permite autorului raportului să declare că a folosit ajutorul IA pentru a găsi vulnerabilitatea sau a redacta raportul. În API-ul REST se aplică și formularul personalizat, dar nu cel implicit, pentru a nu afecta integrările existente.
O limită zilnică. Numărul de rapoarte noi pe care același cont le poate trimite zilnic este acum limitat, atât către un depozit, cât și pe întregul GitHub; comentariile la avizele existente nu sunt vizate. Administratorii își pot stabili propria limită și pot excepta de la aceasta autorii de rapoarte de încredere, iar GitHub nu precizează valoarea limitei implicite. Cele două măsuri vizează depozitele publice care au activat raportarea privată, pe GitHub Free, Pro, Team și Enterprise Cloud.
🔗 Limite de frecvență pentru rapoartele private de vulnerabilități
Agenți de programare: Codex CLI 0.160.0, Delta 0.18 și Antigravity 2.19.1
Codex CLI 0.160.0: istoricul centrului de comandă și sesiunile în afara proiectului
1 octombrie — OpenAI publică Codex CLI 0.160.0, prima versiune stabilă după 0.159.3 din ziua precedentă, cu 55 PR enumerate de la 0.159.0. Centrul de comandă al agenților (agent command center) primește o acțiune pentru afișarea sarcinilor mai vechi (Afișează mai multe), utilizabilă de la tastatură. Sesiunile pot porni în afara unui proiect, cu setările implicite ale spațiului de lucru atunci când politica organizației o permite, iar permisiunile salvate sunt restaurate la reluare. Revizuirea aprobărilor Guardian primește două capacități opționale: regăsirea instrucțiunilor date anterior de utilizator și integrarea contextului transferurilor între agenți. În modul ecran complet, terminalele Linux X11 locale permit selectarea transcrierii și lipirea prin clic pe butonul din mijloc. În privința remedierilor, mesajele din coadă își reiau procesarea după reconectare fără a fi trimise de două ori, iar o serie de corecții vizează sandbox-ul Windows și blocajele SQLite la inițializare.
Delta 0.18: firele de conversație rulează în worktree-urile Git existente, iar o CLI devine disponibilă
30 septembrie — Zed publică versiunea 0.18.0 a Delta, mediul său multiplayer pentru programare cu agenți: 23 de noutăți, 41 de îmbunătățiri, 51 de remedieri și o eliminare. Principala noutate fusese anunțată fără o dată de lansare pe 28 septembrie: un fir de conversație poate rula acum în orice worktree Git existent și deja asociat și poate transmite această copie de lucru noilor fire de conversație create din el. Delta poate fi controlat și din terminal: o CLI delta se instalează pe macOS, Windows și Linux, iar comenzile delta auth gestionează contul conectat. În privința modelelor, versiunea adaugă modelele Gemini de la Google AI Studio, permite accesul la GPT-6 Sol, GPT-6 Luna și Claude Opus 5.5 cu o cheie API și acceptă în aplicația desktop orice furnizor compatibil cu OpenAI sau Anthropic. Lucrul în fire de conversație primește o funcție de căutare în toate subfirele și marcaje; în schimb, subfirele nu își mai publică mesajele de progres în firul părinte, unde rămân afișate doar rezultatele Land Changes.
🔗 Notele de lansare pentru Delta 0.18.0
Antigravity 2.19.1: trimiterea mesajelor direct către subagenți
30 septembrie — Antigravity 2.19.1 permite trimiterea unui mesaj direct către un subagent din zona de introducere a textului, fără a trece prin agentul principal; CLI oferea deja această posibilitate prin sintaxa @ începând cu versiunile sale 1.2.8 și 1.2.9. Versiunea adaugă exportul în PDF al Markdown-ului randat în artefacte și în panoul lateral, inclusiv tabelele, blocurile de cod și diagramele, precum și o opțiune de anulare limitată la conversație; printre cele cinci remedieri, agenții personalizați respectă în sfârșit regulile globale și pe cele ale proiectului. Lansarea este treptată și poate dura câteva zile. CLI primise pe 27 septembrie o versiune 1.2.12 care trecuse neobservată: o sesiune lansată cu o cheie GEMINI_API_KEY se oprește acum imediat când API-ul Gemini semnalează o cotă zilnică epuizată, o limită de cheltuieli atinsă sau credite preplătite epuizate, în loc să continue timp de mai multe minute cu încercări sortite eșecului.
🔗 Jurnalul modificărilor aplicației Antigravity · Jurnalul modificărilor CLI Antigravity
Știri pe scurt
- Copilot CLI 1.0.90 și 1.0.91 — Versiunea 1.0.90 devine stabilă pe 30 septembrie, cu GPT-6.1 Sol în selectorul de modele și remedieri pentru MCP și reluarea sesiunilor; versiunea 1.0.91, din 1 octombrie, adaugă comenzile
copilot sandbox capentru gestionarea certificatului proxy-ului din sandbox. 🔗 sursă - Codex CLI 0.159.3 — Publicată pe 30 septembrie la 22 h 57 UTC, conține un singur backport: sesiunile locale autentificate prin ChatGPT pot afișa mementouri opționale pentru finalizarea configurării securității contului, o modificare inclusă și în 0.160.0. 🔗 sursă
- Versiunea nightly a Gemini CLI — Versiunea v0.64.0-nightly din 1 octombrie remediază o blocare cu utilizarea procesorului la 100 % în modul headless și face atomice operațiile de scriere ale instrumentelor pentru fișiere; versiunea stabilă și cea preliminară rămân neschimbate. 🔗 sursă
- Zed 1.23.1 în versiune preliminară — Publicată pe 30 septembrie, afișează fișierele JSONL și NDJSON sub formă de tabel, adaugă setarea
agent.max_idle_retained_threadsși reîncearcă automat cererile când un model Google AI este suprasolicitat. 🔗 sursă - Copilot în VS Code în septembrie — Recapitularea lunară a versiunilor 1.136 până la 1.140 menționează câteva noutăți care au trecut aproape neobservate, printre care reluarea în VS Code a unei conversații Codex începute în aplicația ChatGPT, o insignă a aplicației în versiune preliminară și conversații deschise fără un spațiu de lucru. 🔗 sursă
- Planificare în echipă în Delta — Pe blogul Delta, Nathan Sobo povestește cum trei membri ai echipei planifică în același fir de conversație cu Fable, apoi cu Astra, cu un subfir și un subagent izolați, în loc să folosească un fișier
plan.md; nu este anunțată nicio funcție nouă. 🔗 sursă - Innate filmată de Cursor — Cursor publică un scurt portret video al Innate, o echipă de șapte persoane care construiește roboți pentru viața de zi cu zi și al cărei cofondator, Vignesh Anand, afirmă că face munca a 50 de persoane, fără să precizeze cum folosește Cursor. 🔗 sursă
- Recuperare în loc de compactare — David Corvoysier, dezvoltatorul funes, măsoară cu Claude Code că recuperarea sesiunii anterioare prin instrumentul său găsește răspunsurile corecte cu de 8, 4 și 3 ori mai puțini tokens ponderați decât păstrarea întregului context, pentru trei sarcini alese chiar de el. 🔗 sursă
- Noul tablou de bord GitHub — Vizualizarea care reunește sesiunile active ale agenților, issues și pull requests, cu cel mult 12 elemente în fiecare listă, devine cea implicită pentru toți; fluxul de noutăți se mută în fila Feed, iar vechea prezentare rămâne accesibilă. 🔗 sursă
- API pentru merge asincron — Devine disponibilă general și calea recomandată pentru efectuarea unui merge prin cod, în locul endpoint-ului REST sincron și al mutațiilor GraphQL; este singura API pentru merge care gestionează pull requests suprapuse. 🔗 sursă
- Dist-tags npm fără token — Configurațiile de publicare de încredere ale npm pot primi o permisiune opțională, dezactivată implicit, pentru gestionarea dist-tags cu credențiale OIDC de scurtă durată, în locul unui token de acces de lungă durată. 🔗 sursă
- Perioada de păstrare în GitHub Actions — Checks, execuțiile de workflow și stările, inclusiv cele ale aplicațiilor terțe, respectă acum setarea perioadei de păstrare a artefactelor și jurnalelor și sunt șterse după expirarea ei, cu cel mult 90 de zile pentru depozitele publice și fără posibilitatea de restaurare. 🔗 sursă
- Code scanning și depozitele inactive — Analizele săptămânale programate pentru code scanning și GitHub Code Quality pornesc acum numai după o analiză declanșată de un push sau un pull request, pentru ca un depozit inactiv să nu mai pară activ încă șase luni. 🔗 sursă
- Acoperirea codului — Acțiunea
upload-code-coveragedin GitHub Code Quality nu mai provoacă eșecul CI la un push pe o ramură care nu are încă un pull request deschis. 🔗 sursă - Declarații de accesibilitate — Un fișier
ACCESSIBILITY.mdplasat în rădăcină, în.github/sau îndocs/este evidențiat pe pagina principală a depozitului, în toate planurile github.com, și va fi disponibil în GitHub Enterprise Server 3.24. 🔗 sursă - Actions Runner Controller 0.15.0 — Controller-ul Kubernetes pentru runners găzduiți pe infrastructură proprie actualizează resursele pe loc la trecerea la versiuni cu remedieri, permite configurarea timpului de așteptare pentru oprire, a limitelor clientului Kubernetes și a numărului de operații simultane ale controller-elor și își simplifică cererile. 🔗 sursă
- Grok Bot ia inițiativa — Bot-ul principal al utilizatorului identifică acum sarcinile pe care le poate prelua și propune să se ocupe de ele; lansarea se desfășoară pe parcursul câtorva ore, iar aceste sugestii nu sunt contabilizate în consum, fără precizări privind planurile sau țările. 🔗 sursă
- Genspark și Azure Cosmos DB — Un articol de pe blogul Azure Cosmos DB, scris din perspectiva Genspark, explică modul în care anumite procese de fundal folosesc indecși secundari globali pentru a nu mai încetini sesiunile agenților în timp real; nu sunt oferite cifre. 🔗 sursă
- Mărturie la Genspark — Seulki Kang, cu cincisprezece ani de experiență în marketing, spune că pregătește un set complet de materiale de curs în 5 ore în loc de 30, conectându-și documentele vechi la SecondBrain, apoi la AI Slides; nicio noutate de produs. 🔗 sursă
- Albertsons și OpenAI — Retailerul cu peste 2 200 de magazine își extinde parteneriatul, de la ChatGPT Enterprise pentru echipe selectate la API pentru experiențele clienților și analizele promoționale, și își promovează plugin-ul Safeway din ChatGPT, anunțat pe 5 august. 🔗 sursă
- Complementul etern — OpenAI publică primul eseu dintr-o serie despre economia viitorului, semnat de Hemanth Asirvatham și Elliott Mokski, care precizează că vorbesc în nume propriu: cea mai mare parte a inteligenței mașinilor ar putea servi la execuție, mai degrabă decât la descoperiri majore. 🔗 sursă
- Perplexity și consultanții — Un ghid compară zece instrumente de IA pentru consultanți, de la AlphaSense la Qwilr, cu prețuri verificate în septembrie; secțiunea FAQ amintește că planul gratuit Perplexity își antrenează modelele pe datele utilizatorilor, cu excepția celor care se opun. 🔗 sursă
- Luma Variants — Prezentată cu o zi înainte fără detalii, funcția este lansată pentru toți utilizatorii Luma: pornind de la o reclamă statică aprobată, produce variante în cinci formate standard, de la 9:16 la 16:9, și în mai multe limbi, fără un preț anunțat. 🔗 sursă
- HeyGen Professional Voice Clone — Potrivit recapitulării sale din septembrie, HeyGen oferă prin API acces la cea mai fidelă clonă vocală a sa, antrenată pe cel puțin 20 de minute de înregistrări (1 până la 10 fișiere), după o versiune preliminară privată lansată pe 9 septembrie. 🔗 sursă
- Pika și aplicațiile sale — Pika afirmă că are peste 40 de aplicații pe noua sa platformă și prezintă două dintre ele, Podcast Video, care pune două personaje să dezbată, și Color Grade, care ajustează culorile unei imagini sau ale unui clip, fără dată sau preț. 🔗 sursă
- ElevenLabs în Benelux — ElevenLabs deschide birouri la Bruxelles și Amsterdam și intenționează să își tripleze echipele de acolo; la operatorul KPN, recunoașterea codurilor poștale crește de la 64 % la 82 %, iar agentul de verificare gestionează aproximativ 60 000 de apeluri pe săptămână. 🔗 Țările de Jos · 🔗 Belgia
- Skills DOCA de la NVIDIA — Pentru 65 de prompts reale de la dezvoltatori, agenții de cod echipați cu aceste skills pentru DPU BlueField îndeplinesc 100 % din criteriile grilei de evaluare, față de 19 % fără ele; sunt publicate pe GitHub. 🔗 sursă
- DIN Deploy — NVIDIA publică exemple C++ open source pentru rularea locală a modelelor cu ONNX Runtime și TensorRT RTX, pe Windows și Linux; pe un DGX Spark, Parakeet TDT transcrie de 206 ori mai repede decât timpul real pe GPU, față de 14 ori pe CPU. 🔗 sursă
- Nemotron 3.5 ASR și dialectele saudite — Un tutorial NVIDIA ajustează modelul pentru dialectele najdi și hijazi: rata erorilor la nivel de cuvânt scade de la 55,05 % la 29,96 % în 12 000 de pași pe două RTX PRO 6000, performanțele pentru engleza și araba din FLEURS îmbunătățindu-se chiar ușor. 🔗 sursă
- Sistem de recomandare HSTU pe Dynamo-Triton — NVIDIA rulează un sistem generativ de recomandare HSTU cu PyTorch AOTInductor și un cache KV: în cel mai bun caz, pe un RTX PRO 6000, este de până la 4,47 și 5,93 ori mai rapid, în funcție de numărul de straturi, adică 0,423 și 0,678 ms per cerere. 🔗 sursă
- Rentabilitatea fabricilor de IA — Într-un articol de opinie, NVIDIA estimează costul unei fabrici de IA la aproximativ 60 de milioane de dolari per megawatt și preia datele SemiAnalysis: Vera Rubin NVL72 este de până la 45 de ori mai ieftin per milion de tokens decât GB300 NVL72 pe DeepSeek V4 Pro, față de 35 de ori pe 24 august. 🔗 sursă
- huggingface_hub 2.1.0 — Biblioteca repornește automat Jobs eșuate, le reprogramează fără a le recrea, citește cota ZeroGPU rămasă și descarcă fișierele Xet prin
hf_xet: un fișier parquet de 2 Go trece de la aproximativ 120 la 7 secunde pe HF Jobs; trei modificări care rup compatibilitatea. 🔗 sursă - ML Intern și MCP — Hugging Face conectează surse de date MCP la ML Intern, modul HuggingChat care antrenează modele, pentru ajustarea modelelor deschise pe propriile date de afaceri; anunțul nu este însoțit de cifre oficiale. 🔗 sursă
- Hugging Face și Open Source for Science Fund — Cei doi parteneri vor să identifice bibliotecile de care depind cel mai mult contribuitorii la modelele științifice și să le sprijine responsabilii de întreținere, fără o sumă sau un calendar. 🔗 sursă
- Un milion de antrenări cu TRL — Potrivit telemetriei citate de Quentin Gallouédec, biblioteca de post-antrenare Hugging Face înregistrează un milion de antrenări pe lună, cu un obiectiv de un milion pe săptămână; metoda de numărare nu este publicată. 🔗 sursă
- Milionul de seturi de date de pe Hub — Trei autori arată că organizațiile publică aproximativ 19 % din seturile de date prin conturile lor, dar atrag jumătate din descărcări, și că Statele Unite dețin 390 dintre cele 1 000 de seturi cele mai descărcate. 🔗 sursă
- Opt VLM pe un RTX 3090 — Aakash Gupta, de la ThinkEvolve, arată că, la aceeași acuratețe, Qwen3-VL-8B procesează fiecare cerere de 2,2 ori mai repede decât Qwen3.8-27B, dar are nevoie de 18,88 ore față de 7,53 pentru o sarcină cu 7 329 de apeluri, deoarece nu reutilizează cache-ul de prefix. 🔗 sursă
- GLiNER2.5-Decide în comparație cu layax — Aravind Vijayakumar nu reușește să certifice niciun prag de încredere pentru modelul Fastino, față de 10 încercări din 10 pentru layax, propriul său instrument, care este mai precis cu 20 până la 23 de puncte și de aproximativ cinci ori mai rapid. 🔗 sursă
- David Ha și orchestratoarele — Într-un articol de opinie pentru Nikkei Asia, cofondatorul și directorul general al Sakana AI consideră că valoarea se va muta de la ponderile unui model la inteligența care combină mai multe modele și definește suveranitatea drept soliditatea lanțului de aprovizionare. 🔗 sursă
- Difuzie video pe TPU — Trei ingineri Google reduc timpul de eliminare a zgomotului dintr-un videoclip 1440p de la 2 471 la 1 461 de secunde pe opt cipuri TPU v6e, adică de 1,69 ori mai rapid, datorită atenției rarefiate din Sparse VideoGen și unui kernel Splash Attention optimizat. 🔗 sursă
Ce înseamnă acest lucru
Agenții de cod devin programabili de către cei care îi folosesc. Prin mods, Claude Code își expune evenimentele interne unor mici funcții TypeScript, ajungând să își transforme propriile funcții în mods care pot fi înlocuite; prin workflows dinamice, GitHub permite scrierea în cod a orchestrării subagenților, în loc să lase Copilot să decidă de fiecare dată împărțirea sarcinilor. Ghidul FineEnvs amintește de ce cadrul de execuție contează la fel de mult ca modelul: aceleași ponderi rezolvă 62 % din sarcini într-un cadru de execuție și 33 % în altul. Reversul este încrederea. Un mod are același acces la calculator ca Claude Code, copilot workflow run nu afișează nicio solicitare de confirmare, iar controlul aplicațiilor desktop poate acționa asupra conturilor autentificate. Cei doi furnizori răspund prin dezactivarea implicită a controlului desktopului, o verificare înainte de instalare (claude plugin validate) pentru mods și reguli de companie care au prioritate.
IA impune și filtre noi celor care primesc rezultatele sale. GitHub structurează și limitează raportarea privată a vulnerabilităților deoarece rapoartele generate de IA îi copleșesc pe responsabilii de întreținere; Google DeepMind propune aplicarea unor filigrane proteinelor concepute prin IA, astfel încât furnizorii de sinteză ADN să știe de unde provine o secvență necunoscută. În ambele cazuri, scopul nu este interzicerea IA, ci vizibilitatea utilizării sale: o casetă pentru declararea ajutorului oferit de IA, pe de o parte, și o semnătură verificabilă, pe de alta.
În companii, adoptarea se măsoară acum prin utilizări concrete. Barclays stabilește obiectivul ca 50 % dintre dezvoltatori să folosească Claude Code la sfârșitul lui 2026 și folosește IA pentru sortarea a 120 000 de e-mailuri pe zi, American Express își transformă cardul Business într-o cale de acces la Skills din Perplexity Computer, oferind și credite, iar Anthropic își folosește limitele de utilizare ca stimulent, reducând la jumătate, timp de două săptămâni, consumul aferent muncii care urmează după crearea unui artefact. Pentru publicul larg, asistenții intră în activități concrete: citirea unui meniu unei persoane nevăzătoare, probarea unei haine înainte de cumpărare, trasarea unui grafic bursier în conversație.
În fine, cifrele modelelor trebuie interpretate împreună cu protocolul lor de evaluare. Ai2 precizează că măsurătoarea sa la 1 200 de miliarde de parametri evaluează sistemul, nu un model antrenat, Cloudflare își alege testele de evaluare și recunoaște că Jev rămâne în față pe When2Call și BRIGHT, iar clasamentul video Artificial Analysis plasează Wan 3.0 pe primul loc, cu intervale de încredere care se suprapun. FLUX 3 Image urmează o cale devenită obișnuită: ponderi comerciale sub licență disponibile imediat, ponderi deschise mai târziu, fără o dată.
Surse
- Personalizează Claude Code cu mods în TypeScript (claude.com)
- Ghid introductiv pentru mods pe claude.dev
- Documentația pentru mods în Claude Code
- Reacția lui Boris Cherny pe X
- Note de versiune pentru Claude Code 2.1.287
- Changelog GitHub privind controlul aplicațiilor desktop
- Changelog GitHub privind workflow-urile dinamice
- Anunțul FLUX 3 Image de la @bfl_ai
- Pagina modelului FLUX 3 Image
- Guided Vision în Gemini Live (blogul Google)
- Note de versiune pentru ChatGPT
- Grafice interactive în Perplexity Computer
- Oferta pentru artefacte anunțată de @claudeai
- Condițiile ofertei pentru artefacte (centrul de ajutor Claude)
- Barclays și Claude (Anthropic)
- Articolul Perplexity despre American Express
- Pagina parteneriatului American Express de la Perplexity
- Anunțul Wan 3.0 de la @Alibaba_Wan
- Clasamentul AA-Video-T2V v2.0 de la Artificial Analysis
- Utopai X în clasamentul Artificial Analysis
- Project Continuum de la @runwayml
- Anunțul Sessions de la @synthesiaIO
- Pagina Synthesia Sessions
- SynthID Bio (Google DeepMind)
- Știință modelată de Claude (Anthropic Science)
- Olmo-core 3 (Ai2)
- Lansarea Olmo-core v3.0.0
- Clef și Clef-flash (blogul Cloudflare)
- Clef pe Hugging Face
- Ghidul FineEnvs pentru RL cu mai multe harness-uri
- Fișa Grok 4.7 pe Google Cloud
- Anunțul Grok 4.7 pe Google Cloud de la @SpaceXAI
- Formulare structurate pentru raportarea privată a vulnerabilităților
- Limite zilnice pentru raportarea privată a vulnerabilităților
- Codex CLI 0.160.0
- Note de versiune pentru Delta 0.18.0
- Changelog al aplicației Antigravity
- Changelog al CLI Antigravity
- Copilot CLI 1.0.91
- Codex CLI 0.159.3
- Versiunea nightly Gemini CLI din 1 octombrie
- Versiune preliminară Zed 1.23.1
- Recapitularea lunii septembrie pentru Copilot în VS Code
- Planificare în echipă în Delta
- Portretul Innate realizat de Cursor
- Benchmark de rememorare a sesiunii cu funes
- Noul panou de control GitHub
- API GitHub pentru merge asincron
- Dist-tags și publicare de încredere în npm
- Retenția în GitHub Actions
- Code scanning și depozite inactive
- Încărcări ale datelor de acoperire a codului
- Declarații de accesibilitate ale depozitelor
- Actions Runner Controller 0.15.0
- Sugestii de la Grok Bot
- Genspark și Azure Cosmos DB
- Mărturia lui Seulki Kang (Genspark)
- Albertsons Companies și OpenAI
- Complementul etern (OpenAI)
- Ghidul Perplexity al instrumentelor de IA pentru consultanți
- Luma Variants
- Recapitularea lunii septembrie de la HeyGen
- Aplicații Pika
- ElevenLabs în Țările de Jos
- ElevenLabs în Belgia
- Skills DOCA de la NVIDIA
- DIN Deploy de la NVIDIA
- Nemotron 3.5 ASR și dialectele saudite
- Sistem de recomandare HSTU pe Dynamo-Triton
- Rentabilitatea fabricilor de IA (NVIDIA)
- huggingface_hub 2.1.0
- ML Intern și surse de date MCP
- Open Source for Science Fund și Hugging Face
- Un milion de antrenări cu TRL
- Milionul de seturi de date de pe Hub
- Opt VLM evaluate pe o RTX 3090
- GLiNER2.5-Decide în comparație cu layax
- Articolul de opinie al lui David Ha distribuit de Sakana AI
- Difuzie video accelerată pe TPU