sâmbătă, 19 septembrie 2026

Apocalipsa după Amodei


Când Dario Amodei, șeful Anthropic, a ieșit pentru a se opune modelelor open weight(adică gratis de utilizat pe propria infrastructură), a rezultat un scandal deoarece lumea a intuit imediat că personajul caută să-și facă un soi de „pârtie” pentru propria companie. Ulterior a negat această ipoteză, spunând că e vorba de ... securitate.

Iată că acum a ieșit cu un nou eseu(„We Must Pace the Frontier”) mult mai consistent, în care susține o idee care fusese expusă și de Musk în urmă cu ceva vreme, anume o încetinire și o supraveghere atentă a modelelor de frontieră pentru „a nu scăpa de sub control”. În esență, punctele principale ale eseului său sunt următoarele:

1. Frânarea autorecursivității(Recursive Self-Improvement) - adică a practicii de creare și optimizare a generațiilor viitoare de modele prin intermediul modelelor AI din generațiile curente. Această autorecursivitate poate depăși capacitatea oamenilor de a înțelege sau de a menține controlul asupra sistemelor.   
2. Audit permanent de la terți(Embedded Auditors) - adică marile laboratoare să dea acces permanent și complet evaluatorilor independenți la modelele pe care le dezvoltă direct din faza de antrenare.   
3. Standarde comune de siguranță între democrații - aici este o declarație geopolitică, propunând un set comun de practici astfel încât nicio companie să nu fie tentată să renunțe la protecție doar pentru a câștiga avantaje comerciale.   
4. Restricții geostrategice și pe hardware - adică pledează pentru menținerea unor controale stricte pe cipuri de înaltă performanță folosite la antrenare și limitarea distilării neautorizate de modele pentru chinezi. Ca să nu mai iasă scandal, precizează că nu susține interzicerea modelelor open-source/open-weight, ci doar aplicarea unor standarde riguroase de securitate.   
5. Prevenirea riscurilor catastrofale - adică evitarea pierderii controlului sau utilizarea AI în atacuri cibernetice complexe sau crearea de arme biologice.   

OK, la prima vedere pare a fi îngrijorarea normală a unui om care lucrează în industrie și care vede amenințările care pot apărea. Însă, dincolo de îngrijorările justificate, eu văd altceva, anume o disperare. La fel a fost și-n cazul lui Musk care sesizase că a rămas în urmă și căuta un soi de armistițiu astfel încât să-și pună pe picioare modelul. Nu i-a ieșit. Dar în cazul lui Amodei? Până una-alta Anthropic este liderul absolut în ceea ce privește eficiența modelelor sale. N-o spun eu, o spun testele. Și-atunci?

Părerea mea e că omul ăsta știe ce vorbește, iar temerile sale sunt reale. Însă nu e vorba de ceea ce susține și nici pe departe nu securitatea e ceea ce-l îngrijorează. Iar dacă ar fi să pronunț un nume cu care să-mi încep expozeul acesta ar fi DeepSeek 4.1. Flash. 

DeepSeek nu e produs de o companie mare, având doar 200 de angajați. Comparați cu cei 3 500 ai lui Anthropic sau OpenAI. Cu toate acestea, încă de la apariție, DeepSeek a adus inovații absolut excepționale în domeniu. În ceea ce privește ultimul lor model, au reușit câteva optimizari năucitoare. Cum mulți dintre cei care citesc materialul de față nu sunt specialiști în AI, o să prezint elementele în termeni simpli, astfel încât să fie înțelese. 

De exemplu, în procesul de generare a textului de răspuns se folosește ceea ce se numește „cache-ul KV”* și care este o memorie pe termen scurt(similară memoriei noastre pe termen scurt).  Aceasta devine uriașă dacă valoarea de intrare(ceea ce-i ceri modelului AI, împreună cu restul de context) este mare. Ei bine, DeepSeek a reușit să minimizeze utilizarea acestei memorii la 890 octeți per token**. Unui nespecialist nu-i spune nimic, dar dacă vă voi spune că această dimensiune este de 4 ori mai mică decât la modelul flash anterior al companiei și de ... 400 de ori mai mică decât în cazul unui model LLM clasic, veți înțelege că chinezii au obținut o optimizare extremă. Nu mai puțin de patru inovații esențiale au contribuit la aceasta: Shared Sparse Attention, Cuantizare extremă la FP4, Bounded Replay, Causal Encoder-Decoder Design. Le-am enumerat doar pentru a vă da puncte de pornire în cazul în care vă interesează cu adevărat. 

Cu toate că față de prima versiune a DeepSeek, versiunea actuală 4.1 Flash are de zece ori mai mulți parametri, în faza de prefill(cea de înțelegere a ceea ce-i este trimis) modelul are o eficiență de 8.3 ori mai mare, iar în faza de generare eficiența este de 4.2 ori mai mare. 

Ce înseamnă aceasta în termeni umani? Că în timp ce competitorii americani alocă cu nemiluita bani și resurse. chinezii performează într-o fereastră extrem de economică. Acest model despre care v-am povestit a fost optimizat pentru acceleratoarele grafice chinezești, încă mai slabe decât cele americane, dar asta nu înseamnă că nu se luptă de la egal la egal la nivel mondial. În ceea ce privește generarea de cod, task-uri de agent și terminal, matematică competițională, DeepSeek este pe primul loc, lăsând în urmă modelele mult mai grele occidentale. E adevărat că la raționamentul complex pe termen lung pierde în fața Fable 5.1 și GPT6 Astra, dar e vorba de un teren pe care, momentan, niciun model Flash nu poate concura cu un model de frontieră întrucât e vorba de limitări de design. Însă asta nu știrbește cu nimic performanțele și inovația extraordinară a chinezilor.

Să introduc acum un alt model, anume GLM de la Ziphu. Când a apărut GLM 5.2, întreaga comunitate a rămas mască deoarece se bătea cu greii domeniului în condițiile în care părea a fi apărut de niciunde. Aici vine un element care se leagă de „manifestul” lui Amodei. La scurt timp după 5.2, a apărut modelul GLM 5.3, mult mai bun, dar realizat exclusiv prin „șlefuirea” versiunii anterioare. 

În generarea unui model, cel mai mare cost este cel de antrenare. Când a prezentat versiunea 5.3 a modelului său, Ziphu de fapt n-a mai trecut prin procesul de antrenare, ci a optimizat automat, cu ajutorul propriului model AI, varianta 5.2. Cu alte cuvinte, varianta 5.2 a ajutat la generarea variantei 5.3. Mai mult, Ziphu a intrat pe piață cu varianta sa flash, testând-o sub numele „Ox Alpha” pe infrastructura OpenRouter și OpenCode. În timpul testelor, neștiind despre ce model e vorba, mulți l-au considerat un model de frontieră. Doar că el era varianta mini(sau flash) a lui GLM 5.3, obținută tot prin optimizări făcute tot automat, de către propriul lor model AI. 

Și-aici e marea problemă a lui Amodei. Care nu-i doar a sa, ci a abordării energoface a domeniului, făcută de SUA. Conform „ideologiei” americane, dacă nu merge cu ciocanul, dai cu barosul. Așa s-a ajuns ca, în domeniul inteligenței artificiale, SUA să devină o putere energofagă, consumând resurse absurd de mari. Și-aici vine problema extremă.

Până acum, exuberanța irațională a marilor granguri din domeniul inteligenței artificiale a fost susținută de piață și de banii ieftini. Ca să nu mai vorbim de credința conform căreia apariția AGI ar crea avantaje extraordinare țării care va reuși asta. A fost un soi de vrajă, de magie, care le-a prins creierii tuturor. Dar, probabil, vă întrebați de ce n-ar mai continua asta?

O să vă explic exact, iar dușmanii nu sunt chinezii. Sau nu doar chinezii. Inclusiv în lumea AI-ului american există numeroși revoltați. Trei dintre aceștia, Diogo Almeida, Erik Gafni și Sasha Sheng și-au făcut propriul laborator, lansând zilele trecute un model ultra-ieftin și extrem de util(nu insist pentru că e ceva mai mult de discutat pe marginea sa). E doar un exemplu din multe altele. Ideea, de fapt, e alta.

Părerea mea e că ceea ce vrea să evite Amodei, inclusiv prin controlul strict „de securitate” al modelelor, este dezvoltarea modelelor ultra-inteligente mici, care pot rula pe hardware-ul propriu al clientului. Deja piața americană este devastată de invazia modelelor chinezești open weight. O analiză de dată recentă arată că peste 70% dintre startup-urile americane utilizează modele chinezești. De ce? Pentru că sunt ieftine și pot fi rulate pe propria infrastructură. 

Ceea ce face DeepSeek, Ziphu și restul companiilor chinezești, alături de revoltații din mediul american este o tentativă de rupere a eficienței, de dezvoltare a unor modele mici și ultra-inteligente, capabile să fie rulate pe hardware ieftin. Asta înseamnă că-ți rulezi propriul model la tine acasă și nu mai transmiți datele tale către un server controlat de ei. Ceea ce e o catastrofă pentru modelul pus la punct de aceste companii. 

În ceea ce privește controlul exporturilor spre China, după cum limpede puteți observa, NU FUNCȚIONEAZĂ. Sau, mai bine spus, funcționează în favoarea Chinei care e obligată să-și dezvolte propriul ecosistem. De la dependența tehnologică de Vest, China devine pe zi ce trece suverană la procese complexe cum sunt cele de litografiere.

Și-abia acum atingem esența. Unde merge China cu aceste modele lansate la liber? Ipoteza că SUA ar putea rămâne cu sute de miliarde de dolari blocate în centre de date supradimensionate – în timp ce China democratizează AI-ul prin modele ultra-eficiente – este un scenariu dezbătut intens în Silicon Valley. De ce? Pentru că, în esență, China caută să ajungă la ceva extraordinar: antrenezi un model ultra-inteligent, pe care apoi îl scrii pe un chip cât o monedă pe care-l vinzi cu 20-30$. Ce rezultă de-aici? O trecere brutală de un model centralizat(cea a centrelor de date masive de azi) la cea de calcul distribuit, în care îți trebuie doar de un chip pentru a rula pe propriul computer sarcinile de care ai nevoie. Și-aici nu mai e nevoie decât de un singur pas. Care, de fapt, ași  fost făcut de canadienii de la Taalas(cumpărați între timp de AMD).

Posibilitatea de a scrie un model AI inteligent pe un chip e cumva limitată tehnologic de arhitectura modelului și de dimensiunea sa. De-aceea cursa către modelui AI ultra-optimizat, ultra-mic și ieftin este cea care, în realitate, devastează modelul de afaceri al giganților tehnologici. Dacă apare așa ceva, toate subscripțiile - care oricum nu acoperă costurile de funcționare ale giganților AI - zboară! Și întregul lor model de business se prăbușește. 

De fapt aici ne duce întreaga discuție. Cei din tagma lui Amodei vor să împiedice o astfel de dezvoltare deoarece simt că le fuge pământul de sub picioare, iar torentul de trilioanele de dolari investite în industrie nu doar că se va stopa, dar riscă să prăbușească și consecințele peste toți cei implicați. Și-aici e sursa mâniei! Sau Apocalipsa după Amodei.


________

*cache KV = în esență e un tabel având o cheie formată din token** și valoarea formată din informația pe care o poartă tokenul. 

**token = unitatea de bază în AI-ul actual, reprezentând un cuvânt al cerinței sau un fragment dintr-un cuvânt; de exemplu când trimiți către un model ceva care conține formularea „de dimineață”, în funcție de model tokenii generați pot fi:

  • în cazul modelelor noi avem 3 tokeni: „de” - primul, „dimin” - al doilea, „eață” - al treilea
  • în cazul modelelor mai vechi avem 4 tokeni: dim + in + ea + ta
Ca regulă, în limba română un cuvânt scurt conține un token, iar unul mediu-lung cam 3-4 tokeni. 

13 comentarii:

  1. Tehnocrația Apocaliptică19 septembrie 2026 la 11:11

    Amodei nu vorbește despre suflet, despre ascensiune sau despre evoluția conștiinței. El vorbește despre „recursive self-improvement”, despre „embedded auditors”, despre „standarde comune de siguranță între democrații”, despre „restricții geostrategice pe hardware” . Este o narațiune despre control, nu despre sens. Iar controlul, în această viziune, trebuie să rămână în mâinile câtorva laboratoare de frontieră, evaluate de „auditori independenți” cu „acces similar angajaților” . Practic, avem o structură narativă cu protagoniști complet diferiți: există o ființă ostilă care controlează omenirea (AI-ul nealiniat), există o cunoaștere ascunsă (capabilitățile de frontieră), există o transformare viitoare (AGI-ul), există un grup de oameni care trebuie să se trezească (auditorii, guvernele, publicul), și există, implicit, o promisiune a eliberării (pacea tehnologică).
    Amodei nu luptă împotriva Chinei, ci împotriva descentralizării. DeepSeek, GLM, modelele open-weight nu sunt o amenințare pentru că ar fi chinezești, ci pentru că rupe monopolul. Ele permit oricui să ruleze un model pe propriul hardware, fără să trimită datele către un server controlat de Anthropic sau OpenAI. Iar asta este o catastrofă pentru modelul de afaceri al giganților, care se bazează pe subscripții, pe acces gated, pe dependență . De aceea Anthropic este singura mare companie care nu a semnat scrisoarea pentru open-weight . De aceea Amodei vorbește despre „riscuri catastrofale” exact în momentul în care modelele chinezești devin competitive . De aceea insistă pe „restricții geostrategice pe hardware” și pe „limitarea distilării”.
    Iar tabăra celor care investesc în centralizare este uriașă. Anthropic a strâns 65 de miliarde de dolari într-o singură rundă, la o evaluare de 965 de miliarde, cu investitori precum Amazon, Google, Sequoia, Blackstone, Fidelity, GIC, Qatar Investment Authority . xAI a strâns 20 de miliarde, cu Nvidia și Qatar ca investitori strategici . Toți acești bani merg în centre de date, în GPU-uri, în infrastructură masivă, în energie. Este o economie a scalei, în care doar câțiva jucători pot participa. Iar dacă modelele mici și eficiente devin norma, această economie se prăbușește.
    Dacă ar fi să răspundem direct la întrebarea „unde se încadrează oamenii aceștia?”, răspunsul ar fi: ei aparțin tehnocrației apocaliptice centralizate, o specie narativă care controlează și o frică pe care o poate vinde. Îi găsim la o masă de consiliu, într-un sediu din San Francisco, semnând scrisori deschise despre „pacea frontierei”, în timp ce concurenții lor din Shenzhen lansează modele open-weight pe care le pot rula oricine, pe orice hardware, fără să ceară permisiunea nimănui. Iar dacă ar fi să alegem un loc pentru ei pe hartă am putea-o numi axa controlului, acolo unde mântuirea nu vine prin trezire, ci prin gated access, iar apocalipsa nu vine prin căderea cerului, ci prin democratizarea inteligenței.

    RăspundețiȘtergere
    Răspunsuri
    1. Exact. Mulțumim. Cu multe scrâșnete, până la urmă va învinge tehnologia chinezească, dar mai durează. Acum abia se trimit scrisori ,, de îngrijorare", vor urma restricțiile legiferate, apoi va urma acceptarea și posibile noi și noi tehnologii la care acum nici nu ne putem gândi

      Ștergere
  2. Toate aceste așa zise avansuri în dezvoltarea AI nu sunt bune pt omenire ,ba încă să te bucuri că pot fi dezvoltate modele pe un singur chip e nebunie , adică drone autonome fără control uman care au fost programate de băieții "deștepți" din finanțele globaliste să facă prăpăd.

    RăspundețiȘtergere
  3. MESAJ SPECIAL PENTRU DAN DIACONU:
    https://web.facebook.com/reel/2503140443499815

    RăspundețiȘtergere
  4. Cu ceva timp în urmă, adică pe la începutul anului, când am făcut contact cu primul model lingvistic, spuneam că viitorul inteligenței artificiale nu sunt centrele de date de tip industrial ci folosirea, locală, a modelelor lingvistice mici, capabile să ruleze pe un laptop obișnuit, fapt care va duce la un fenomen asemănător cu dispariția centrelor de calcul, depășite de apariția calculatoarelor personale... La fel eram, și sunt, din ce în ce mai convins, că se va petrece cu proaspăta industrie energofagă și extrem de scumpă a inteligenței artificiale centralizate, de acum, care va fi eliminată de proliferarea modelelor lingvistice mici. De fapt, elefantul ascuns în „cămăruța” acestei industrii, este spionita și controlul centralizat, pe care, nimeni, sănătos la cap, nu le poate accepta. Iată că ne îndreptăm spre, exact ceea ce spuneam.

    RăspundețiȘtergere
  5. Vasile-Cristian Brosteanu19 septembrie 2026 la 18:45

    Vad ca nu înțelegeți bula asta (A.I.).Totul începe cu denumirea A.I. care este incorecta acestea fiind doar niște L.L.M-uri. Tot ce auzim in legătură cu acestea este doar marketing. De fapt ele au la baza un asa zis browser automatic unde afișează informații din serverele necriptate după ce au fost eliminate U.R.L. Sunt foarte slabe la unele calcule complicate. Eu cred ca in minim 10 ani o sa avem cu adevărat A.I când vor întra in joc Rusia cu acel nou procesor ce nu are tehnologia A.R.M si integrat cu quantum compiuting pe care îl dezvolta aceasta fiind capabila sa își creeze singura task-urile.

    RăspundețiȘtergere
  6. Intotdeauna am avut convingerea caci daca un creier uman e capabil sa proceseze limbajul uman si consuma in jur de 30w energie trebuie sa fie o posibilitate prin care prin care un chip sa fie capabil sa proceseze acelasi limbaj si sa consume cel mult sute de wati. Apoi daca suprapunem faptul ca nevoile celor mai multi dintre noi isi pot efectua sarcinile cu modele mai reduse efectiv darama perspectiva rentei gigantilor. Vom avea o lupta similara mainframe -pc.

    RăspundețiȘtergere
  7. https://www.zerohedge.com/ai/total-psai-op-how-altman-amodei-and-ea-cult-are-faking-rogue-ai-breakouts-protect-trillion

    Apariția bruscă a unei „Panici legate de IA” în ultimele săptămâni și luni a fost extrem de suspectă încă de la început. Potrivit experților din domeniul tehnologiei, laboratoarele de inteligență artificială din Silicon Valley supraestimează în mod deliberat atacurile cibernetice „neinteligente legate de IA” pentru a face presiuni asupra guvernului federal să construiască un șanț de reglementare care ar bloca concurența viitoare - iar momentul ales, la câteva luni după ce atât OpenAI, cât și Anthropic și-au anunțat planurile de a se lista la bursă, nu putea fi mai evident.

    [...]

    Mișcarea Altruism Efectiv este o tendință apocaliptică care a petrecut un deceniu angajând personal pentru comisii de siguranță și laboratoare de testare a inteligenței artificiale, pornind de la premisa că inteligența artificială va ucide pe toată lumea dacă nu sunt conduși de ea de oamenii potriviți. Dacă Irregular este aliniat cu EA este decizia lui Ennis. Faptul că este singura firmă implicată în toate aceste incidente este dovedit de Axios, The Verge și chiar Anthropic.

    Jocul de ritm
    Cu șase zile înainte ca povestea Gemini să apară, Dario Amodei a publicat o postare pe 12 septembrie în care avertiza că, în termen de 6 până la 12 luni, un roi de inteligență artificială ar putea „preia controlul asupra întregului internet cu o botnet persistentă”, provocând potențial pagube de sute de miliarde de dolari. Rețeta sa: „Trebuie să încetinim ritmul în care îmbunătățim capacitățile modelelor de inteligență artificială”. Sam Altman și Elon Musk și-au exprimat sprijinul. Pe scurt, Pacing the Frontier ™ este o încercare de a deveni indispensabilă din punct de vedere strategic - prea mare pentru a eșua, cu Beijingul ca justificare.

    Jensen Huang de la Nvidia, cel care se ocupă de toate subiectele, a remarcat: „Ce modalitate mai bună de a crea cerere decât să creezi o problemă.” lol, da.

    CEO-ul Palo Alto Networks, Nikesh Arora, a numit-o o „mișcare NINJA” și apoi, după mai multe discuții cu laboratoare, proiecte open-source și guvern, a avertizat că ar putea avea efectul invers:....

    RăspundețiȘtergere
  8. Istoria se repeta. Si in cazul Internetului, primul val de investitori a produs o mare bula (dot-com bubble) care s-a spart rasunator, dar Internetul a ramas si a inflorit. La fel va fi si cu AI-ul. Va urma un crash, apoi piata isi va reveni si va urca si mai sus, intr-o bula si mai mare.

    RăspundețiȘtergere
  9. https://www.facebook.com/bobbydtiktok/videos/1607183607603495/

    Deci daca ganditi diferit de linia oficiala sunteti vicmime ale razboiului cognitiv?tocmai s-au semnat documentele pesntru declararea razboiului cognitiv in Uniunea Europeana?

    Rezoluția sugerează integrarea perspectivei de securitate cognitivă în toate instituțiile UE, înființarea unui grup consultativ științific civil-militar pentru amenințările cognitive și crearea unei capacități de apărare cognitivă (inclusiv echipe rapide de intervenție specializate) pentru a asista statele membre în detectarea și combaterea operațiunilor de influență cognitivă ostilă. Se propune, de asemenea, promovarea programelor de educație pe termen lung la nivel național, cu accent pe gândirea critică, alfabetizarea mediatică și conștientizarea erorilor cognitive.
    Europarlamentarul irlandez Clare Daly a declarat public pe rețelele sociale după adoptarea rezoluției: „Rezoluția susține că cetățenii UE se confruntă cu o 'creștere drastică a războiului cognitiv'... Toate acestea sună puțin nebunește, nu?" Ea a îndemnat cetățenii să întrebe parlamentarii: de ce nemulțumirea actuală a cetățenilor este considerată „război cognitiv", și nu un declin real al nivelului de trai al majorității oamenilor din UE în ultimii ani. Această critică evidențiază un punct cheie: riscul definirii „nemulțumirii" sau „opoziției" drept rezultat al manipulării externe constă în faptul că slăbește legitimitatea dezacordului intern.

    O nemulțumire poate fi definită ca „manipulare externă", de obicei nu din cauza conținutului în sine, ci din cauza „canalului de difuzare" sau a „intenției de amplificare" care o însoțește. Iar această practică are într-adevăr riscul real de a fi folosită pentru a suprima nemulțumiri rezonabile.

    Europarlamentarul irlandez Clare Daly, după adoptarea rezoluției privind războiul hibrid, a ridicat o întrebare esențială: de ce nemulțumirea cetățenilor este definită ca „război cognitiv", în loc să fie recunoscută ca un declin real al nivelului de trai al majorității oamenilor din UE în ultimii ani? Ea a îndemnat cetățenii să întrebe parlamentarii: „Sunteți dispuși să acceptați pur și simplu că toată nemulțumirea este rezultatul manipulării externe?"

    RăspundețiȘtergere
  10. Oare modelele de generare video și imagini vor deveni mai optimizate și vor genera mai rapid pe calculatoare care nu au componente de ultima generație, de tip low end pc? Am testat ComfyUI cu un model LTX să-mi genereze un filmuleț de 3 secunde la baza fiind o poza. Mi-a luat jumatate de ora, iar filmulețul nici măcar nu avea treaba cu poza și cerință data.

    RăspundețiȘtergere
  11. România este condusă de pe serverele Meta, deci Facebook - dezvăluirile fostului mason Florin Gulbenkian despre Călin Georgescu, Nicușor Dan și măsluirea voturilor, serverele Facebook de la Mera au prezis ce gândesc românii:

    https://www.facebook.com/reel/2442590296233837/

    RăspundețiȘtergere

Atenție! Comentariile sunt supuse moderării și vor fi vizibile după o perioadă cuprinsă între 1 și 4 ore. Sunt permise doar comentariile care au legătură cu subiectul.
Pentru discuţii mai flexibile folosiţi canalul de Telegram Dan Diaconu(t.me/DanDiaconu)