Heti AI-hírlevél · ITLine

2025-W04   2025-01-20 — 2025-01-26   ·   7 forrás

W04 — Stargate, DeepSeek R1 és Operator: az AI-verseny politikai szintre lép

Trump a Fehér Házban bejelenti az 500 milliárd dolláros Stargate-projektet. A DeepSeek MIT-licenccel adja az R1-et. Az Anthropic Davosban védekezik. Az OpenAI launcholja az Operator-t — egy hét, négy paradigmaváltás egyszerre.

Kép helye — Politika és tech keresztezi egymást: Trump, Altman, Son és Ellison a Fehér Házban + DeepSeek/Anthropic logók az ellenoldalon

Az év negyedik hetén a Frontier-verseny láthatóan politikai szintre lép. Január 20-án a kínai DeepSeek MIT-licenccel kiadja az R1-et — egy reasoning-modellt, ami az API-n $0.55 / $2.19 per M input/output tokenért eléri az o1-szintet. Január 21-én Trump a Fehér Házban Sam Altmannel, Larry Ellisonnal és Masayoshi Sonnal bejelenti a Stargate-projektet — $500 milliárd amerikai AI-infrastruktúrára 4 év alatt, $100 milliárd azonnal. Ugyanaznap Davosban Dario Amodei (Anthropic) predikciót tesz: 1 millió GPU 2026-ra, “country of geniuses” 2027-re. Január 23-án az OpenAI launcholja az Operator-t — az első valódi computer-use agent-jüket. Egy héten belül a verseny geopolitikai (kínai vs amerikai), architektonikai (open vs closed reasoning), gazdasági (állami vs vállalati GPU-pénz), és termék-szintű (chat → agent) síkon is kibillen.

DeepSeek R1 — open-source reasoning, 3%-os áron

2025. január 20-án a DeepSeek kiadja az R1-et és az R1-Zero-t MIT-licenc alatt. A modell a DeepSeek-V3 base-en épül, MoE-architektúra 671 milliárd paraméterrel, amiből inference-időben csak ~37 milliárd aktív. Kontextus: 128K. Performance: paritás az OpenAI o1-gyel, sok benchmarken meg is veri.

A Nate-féle 20-i videó a tréning-módszertanra fókuszál — és ez érdemi: az R1-Zero pure reinforcement learning-gel készült, SFT-warmup nélkül, Group Relative Policy Optimization (GRPO) algoritmussal. A modell spontán fejlesztett ki chain-of-thought reasoning-et, self-verification-mintákat és reflection-pattern-eket — vagyis a “thinking” képesség emergens RL-tréningből, nem külön emberi annotation-szal kódolt. Ez konceptuálisan erős eredmény: ha igaz, a reasoning-modell-építés sokkal hatékonyabb, mint amit eddig az OpenAI-féle process feltételezett.

Az árazás külön kategória: $0.55 per millió input token, $2.19 per millió output. Az o1-féle ár ~3%-a. A Nate-féle stratégiai elemzés: a DeepSeek nem közvetlenül akarja megverni az OpenAI-t — hanem a fejlesztői kultúrát fokozatosan átszippantja olcsó API-val. Ha 6-12 hónappal a Frontier-mögött, de 30× olcsóbban szállítja ugyanazt a képességet, a developer flow lassan átrendeződik.

Stargate — $500 milliárd, és négy év a 2023-as architektúrára

2025. január 21-én a Fehér Házban Trump bejelenti a Stargate Project-et. Az alapadatok: Stargate LLC, Delaware-ben bejegyezve; partnerek: OpenAI + SoftBank + Oracle + MGX; chairman: Masayoshi Son. $500 milliárd 4 év alatt, $100 milliárd azonnali deployment, állítólagos 100 ezer munkahely. Trump “largest AI infrastructure project in history”-nek hívja.

A Nate-elemzés (22-i videó) kritikusan közelít, és három pontot emel ki:

  1. A projekt egy nyertest koronáz a verseny közepén. A Stargate gyakorlatilag az OpenAI-nak juttat infrastruktúrát — Microsoft, Anthropic, Google, Meta, x.AI, és minden más szereplő kívül marad. Ez egyszerre politikai választás és piac-kép-deformálás.
  2. A 10 millió GPU-t emlegető architektúra 2023-as paradigmára épít. Pontosan az a “minél nagyobb pre-train cluster, annál okosabb modell” feltevés, amit Ilya 2024 decemberében Vancouverben elparentált. Az inference-time compute paradigma — ami a W03-ban tárgyalt Sky-T1-ben és most a DeepSeek R1-ben látszik — a Stargate dokumentumban nincs említve.
  3. Nincs explicit goalja. A Hold-program “vigyük fel és hozzuk vissza” üzenete tisztán mérhető. A Stargate-é “építsünk AI-infrát, oldjuk meg a rákot” — kontúr-nélküli ambíció.

A piaci válasz azonnali. Január 23-án Google további $1 milliárddal befektet az Anthropicba — összesen $3 milliárdra emelve a Google-Anthropic-pozíciót. Az AWS és az Anthropic közti együttműködés is felgyorsul (saját Trainium-chipek). A Stargate kívül-rekedt szereplői egy nappal a bejelentés után megerősítik a saját koalícióikat — ahogy Nate fogalmaz: “nothing exists in a vacuum”.

Davos — Dario Amodei a sarokban

Január 21-22 körül Dario Amodei a World Economic Forum Davos-i programján beszél. A számok, amiket a Nate-féle 21-i videó is kiemel:

A Nate-féle interpretáció kritikus: szerinte ez egy CEO, akinek nincs konkrét rövid-távú kiadása, és aki futurisztikus visionnel próbálja takarni a hiányt. A jelenlegi konkrétumok — “voice mode is coming for Claude”, “smarter model in coming months” — mind elmaradtak Anthropic versenytársaitól (R1 már megvan, o3-mini hamarosan). Nate gyanúja: a Cursor okozta GPU-pressure miatt az Anthropicnak nincs compute-kapacitása új modellt skálán bevezetni.

Ez a Nate-féle olvasat egyoldalú. Ami visszaüt rá: az Anthropic 2027-es timeline-ja nem önmagában szorultan tett védekező lépés — Amodei évek óta hasonló timeline-okat kommunikál, és az AI-safety-fókusza stratégiai pozíció, nem hiánypótló retorika. Plus: a Google ugyanazon a héten újabb $1 milliárdot dob be — vagyis a piaci szereplők szerint az Anthropic-pozíció erős. A Nate-féle “Anthropic in trouble” frame egy érvényes interpretáció, de érdemes látni: másik forrás szerint az Anthropic helyzete strukturálisan komplexebb, és a 2027-es timeline kommunikáció a vision-stratégia része, nem csak hiánypótlás.

Mindez azt mutatja, hogy a DAVOS-i nyilatkozatok komoly fact-check-igényesek — amit Nate egy módon olvas, az ellenőrizhető más adatokkal (befektetés-flow, model-release-history). A kontextusban a két olvasat kompatibilis: az Anthropic erős financial-pozícióban van, és a Cursor-féle GPU-felvevő-igényt valószínűleg gyakorlatilag is érzi.

OpenAI Operator — az első valódi computer-use agent

Január 23-án az OpenAI launcholja az Operator-t, operator.chatgpt.com URL-en, kizárólag $200/hó-s ChatGPT Pro-előfizetésre. A motor egy új modell: Computer-Using Agent (CUA), GPT-4o-ra építve. A működési alap: iteratív loop, ahol a CUA screenshot-okat kap, chain-of-thought-tal következtet a következő lépésre, és kattint / scroll / type-ol. Külső “side effect” előtt (rendelés-elküldés, email) megerősítést kér.

A Nate-féle 24-i tesztről három fontos dolog derül ki, amit a TechCrunch-elemzés is megerősít:

  1. Az UX dramatikusan jobb, mint a Claude MCP-é. A böngésző a chat-ablakban van, nem külön window — kvázi “watch the agent work”. Egy click-kel átveheted az irányítást, jelszót beírhatsz az agent szeme előtt eltakarva. A barrier-to-entry alacsony, és Nate szerint ez teszi “the most-used AI agent of 2025”-té.
  2. Még janky. Nate Amazon-shoppingot tesztelt: az Operator egy “messy cart”-ot autonóm módon kitakarított — nem ellenőrizte be —, és Nate elveszítette a 40 elnapolt tételt. A modell később “save for later”-be tette őket, de elfelejtette megemlíteni. Genuinely an agent — and that’s the new failure mode.
  3. A consumer-side branding az igazi áttörés. “AI agent” nem hatja meg a non-tech közönséget; “ChatGPT can run around the internet for you” megérthető és kíváncsiságot kelt. Az OpenAI itt a brand-erőt használja — a pozícióeljárás konkrét.

A háttér-érv egy szerkezetben az adatbiztonság. A CUA training-loopja végigfut a felhasználó session-én, ami autentikációs cookie-kkal és credentials-szel látja a fél internet-et. Az OpenAI system card-ja többször hangsúlyozza a “side effect confirmation”-t — de mérnöki oldalról egy kérdés marad: mi a vendor-felelősség határa egy ilyen agent által okozott kárnál? 2025 enterprise-AI-adoption egyik új jogi-frontvonal lesz.

Mellékszál — Reasoning distillation a Latent Space-en

A január 24-i Latent Space epizód “The Unreasonable Effectiveness of Reasoning Distillation” pontosan a héten releváns kérdést dolgozza fel: ha a reasoning emergens RL-ből (ahogy DeepSeek R1-Zero mutatja) és distillálható egy kisebb modellre (ahogy a W03-as Sky-T1 bizonyítja), akkor mi marad a Frontier Lab-ek értékajánlatában?

A swyx-Alessio interjú a kínálkozó válaszokat sorra veszi: vagy a service-réteg (UX, agent-loop, mint az Operator), vagy az ami a Frontier modellek mögött gyűlik fel és nem szivárog ki (sin még tisztán látható). A 2025-ös év AI-üzleti képének egyik nyitott kérdése pontosan ez — és a hét eseményei (Stargate-állam-pénz, DeepSeek-open-reasoning, Operator-agent-launch) mind ezt a kérdést keretezik.

Mellékszál — Három valós AI-deployment

Egy mellékvágány Nate 22-i második videójában: három tényleges, élesben működő AI-use case — atomenergia (reaktor-tervezés AI-segítséggel), gyógyszerkutatás, és gyártósori vizuális minőségellenőrzés. Ez a W03-as Mayo Clinic-folytatás: a hírlevél keretrendszerében ahol a hét fő témáit tárgyaljuk (Stargate, R1, Operator), érdemes néha visszanézni a lassú-de-valódi adoption-mintákra — ezek azok, ahol az enterprise-érték ténylegesen termelődik. Nem a launch-héten, hanem a 6-24 hónap utáni quiet deployment-ekben.

Mit viszünk magunkkal

Ez a hét három mérnöki / IT-vezetői kérdést hagy ott:

  1. Vendor-stratégiai diverzifikáció. Ha az OpenAI mögé állami pénz csordogál és a DeepSeek MIT-licenccel ad open-source reasoning-modellt, akkor egy enterprise stack szükségszerűen multi-vendor. A “Claude vs OpenAI vs Gemini” választás 2025-ben nem terméktulajdonság-választás, hanem politikai-gazdasági-és-jogi exposure-választás. Saját tesztsuite-tal érdemes vendorral független módon mérni a saját workflow-t.
  2. Computer-use agent jogi kérdéseinek tisztázása. Ha az Operator egy felhasználó hitelesítési cookie-jával vásárol, töröl, küld emailt — ki felel a hibákért? A Nate-féle “Amazon cart” példa egy jóindulatú anekdota, de enterprise-kontextusban bárki üzleti folyamata rákapcsolható. A 2025-ös audit / governance frontvonal egy konkrét feladata: agent-action-logok struktúrája és immutabilitása, és a session-szintű autorizációs határok.
  3. Reasoning-distilláció mint stratégiai lehetőség. Ha a DeepSeek R1 elérhető $0.55/$2.19-en és a Sky-T1-féle $450 distilláció működik, akkor saját domain-fókuszú reasoning-modell építése egy mid-size enterprise-nak már 2025-ben valódi opció. Nem mindenki Frontier-modell-kliens kell, hogy maradjon — a saját adatkészletre tréningezett kisebb modell versenyképes lehet specifikus task-okon.

A W05-ben várhatóan a DeepSeek-pánik indul be: az amerikai tőzsde, FBI-nyomozás, és az “új paradigma” pszichológiai sokkja egész hetes téma lesz.

Források

Fő forrás — Nate B Jones csatornája:

Körbejárás / tech-mélység — Latent Space podcast:

Fact-check és hivatkozott eredeti források (saját kereséssel verifikálva):


A heti hírlevelet saját gondolatainkból és független keresésekből állítjuk össze. Az eredeti források a fenti listában találhatók.