Heti AI-hírlevél · ITLine

2025-W26   2025-06-23 — 2025-06-29   ·   9 forrás

W26 — Karpathy Software 3.0, Bartz vs. Anthropic precedens, Cluely-paradox és a Warp 2.0 mint új fejlesztői workbench

Karpathy a YC-n kimondja: az LLM angol nyelven programozható ‘people spirit’, humán validátorral. Judge Alsup ítélete kettéhasítja a fair use-t a Bartz vs. Anthropic ügyben. Cluely $15M-os A16Z-kört üt, és a proaktív agent-UX-et tolja előre. Warp 2.0 ‘agentic development environment’ címszó alatt indul.

Kép helye — Két oldal: bal oldalt Karpathy YC-előadásának ‘Software 3.0 — English is the new programming language’ címslide-ja, jobb oldalt Judge Alsup ítéletének címoldala (‘training = fair use’) egy ‘piracy ≠ fair use’ bélyeggel áthúzva, alul Warp 2.0 multi-agent dashboard képkocka.

A hét két markánsan különböző szakmai síkon hoz tisztulást. Egyfelől Andrej Karpathy a Y Combinator AI Startup School színpadáról 2500 alapító előtt bevezeti a “Software 3.0” terminust — angol nyelven programozott LLM mint új computing-paradigma —, és kimondja, hogy a következő évtized a részleges autonómia évtizede lesz, nem a teljes autonómiáé. Ezzel ellentétes pólusra kerül a McKinsey ugyanezen a héten kiadott “Seizing the agentic AI advantage” board-prezentációja az “agentic mesh” koncepcióval — Nate Jones kemény kritikát ír a kettő ütközéséről.

Másfelől mérnöki és jogi infrastruktúra-réteg is építkezik: 2025-06-23-án Judge William Alsup a Bartz vs. Anthropic ügyben kettéhasítja a fair use kérdést — az LLM-tréning quintessentially transformative (vagyis fair use), de a Library Genesis-ről letöltött 7 millió könyv piracy és tárgyalandó. A héten Cluely (Roy Lee, ex-Columbia, kicsapva) $15 millió Series A-t üt az Andreessen Horowitz vezényletével — a “cheat at everything”-marketing mögött egy proaktív agent-UX szivárog be a desktopra. És Warp 2.0 “agentic development environment” címszó alatt indul: SWE-bench Verified 71%, multi-agent dashboard, in-line diff edit, 600 ezer aktív fejlesztő-felhasználó.

A közös szál: a “csak chatbot, csak coding-tool, csak terminal” kategóriák felbomlanak — egy új workbench-réteg épül, és a jogi keretrendszer is most íródik mellé.

Karpathy a YC-n: Software 3.0 és a “people spirit”

Karpathy 2017-es Tesla-AI-direktor-korszakában vezette be a Software 2.0 fogalmát — neurálisháló-súlyok mint kód. A 2025-06-19-i YC AI Startup School előadásán ehhez kanyarodik vissza: Software 3.0 = az angol nyelv mint kód, az LLM mint runtime. Az LLM-et három párhuzammal írja le: utility (token-alapú metering, mint az áram), OS (Mac vs. Windows-szerű felhasználói preferencia Claude vs. ChatGPT között), és fabrik (gyártósor-szerű, méretezhető compute).

A talk centrális metaforája Nate-nek (és sokaknak) megakad: az LLM-ek “people spirits”, vagyis emberek sztochasztikus szimulációi. Ez magyarázza, hogy miért tűnnek annyira embereknek, és miért olyan ugráló (jagged) az intelligenciájuk — a doktori-szintű fizika-választ ugyanaz a modell adja, ami el tudja téveszteni a 9.11 vs. 9.9 nagyságviszonyt.

Karpathy két tervezési irányt ad:

  1. Make the validation loop as easy as possible. Klasszikus szoftvermérnöki tanács: a generate-then-verify ciklus a szűk keresztmetszet. Ami nem ellenőrizhető olcsón, az nem skálázódik agenttel.
  2. Put the LLM on a short leash. Deliberátan korlátozzuk az AI-generációt — ne 100 hirdetésvariánst termeljen, ha az emberi validátor csak 10-et tud átnézni. A többi pazarlás. Ez ellentétes a “vágjunk neki, generáljunk mindent” hype-pal, és pont ezért tartós tanács.

A részleges autonómia (“partial autonomy”) koncepciót példákkal támasztja meg: Cursor, Perplexity — autonomy-slider, ami a felhasználói bizalom szerint engedi tovább az agentet. Karpathy nem azt mondja, hogy az AI-agent át fogja venni a feladatokat; azt mondja, hogy augmented iron man suit modell készül, ahol az ember a kontroller, az agent a kéz.

Egy önkritikus rész: Karpathy elismeri, hogy a 2024-es “vibe coding” mémje (amit ő dobott be) lokálisan kiválóan működik, de a deploy pipeline / CI/CD / integrations rétegben még nem. Ez visszahúzás, és megerősíti a SET-tézist: a verifier-réteg, a CI-gate-ek, a deploy-szabályzók pont ott állnak, ahol a vibe coding nem ér el — ezek a védőkorlátok nem opcionálisak.

A McKinsey-McKinsey: az “agentic mesh” mint board-narratíva

Ugyanezen a héten a McKinsey “Seizing the agentic AI advantage” jelentést ad ki — a Mistral CEO bevezetőjével. A központi koncepció az “agentic AI mesh”: egy elméleti substrate, ahol bármilyen agent USB-szerűen pluginolható bármilyen adatra, és az enterprise integráció ezáltal lineárisan skálázódik. A jelentés keményen prezentál egy fontos adatot: a vertikális (function-specific) AI use case-ek 90%-a stuck pilotban — a bonyolult dolgok nem skálázódnak.

Nate 2025-06-23-i videójában szembeállítja Karpathyt és a McKinseyt. Karpathy építő-tudást ad át (verification loop, short leash, jagged intelligence) — McKinsey “word salad”-et ad át a CEO-knak. Nate fő kritikája: a “plug-and-play agent” víziója nem buildable, és pont az ilyen narratíva miatt indít minden harmadik enterprise AI-projektet kudarccal — a CEO leül a fejlesztői csapathoz, és kérdezi, miért nem GPT-3.5 turbóval készült, hiszen a McKinsey említette.

A McKinsey-tartalom nem elfogadhatatlan abszolúton — a “vertikális vs. horizontális”, a “10% kerül production-be”, a “fewer than 10 percent of vertical use cases ever make it past pilot” számok valódiak. A probléma az implementáció-mintázat absztrakciója: ha a board-deck az építhetetlent eladja, az engineering-csapat fejéhez vágják.

A SET-szempont: ha CTO-ként vagy DevOps-vezetőként ilyen board-prezentáció után kapod a kérdést — “miért tart 6 hónapig, ha a McKinsey szerint plug-and-play?” — érdemes Karpathy “people spirit + jagged intelligence + verification loop” keretét explicit, írásos formában is referenciázni a tervezési dokumentumban. Nem mindenkit győz meg, de a beszélgetés szintjét emeli.

Bartz vs. Anthropic — a fair use kettéválik

2025-06-23-án Judge William Alsup a Northern District of California-ben summary judgment-tel zár le egy historikus AI-copyright-ügyet. A Bartz, Graeber és Wallace-Johnson szerzők perét. A döntés “split decision”:

A Nate-féle elemzés 2025-06-25-i videója emlékeztet arra, hogy az Anthropic 2024-ben megfordult: felvették Tom Turvey-t (a Google Books ex-vezetőjét), aki feladatként kapta, hogy “obtain all the books in the world” — millió dolláros budgettel. Anthropic fizikai könyveket vásárolt, szétvágták és beszkennelték. Az ítélet pont ezt fogadja el: a könyvek megvásárlása + szkennelés = legitim fair use input.

A július-augusztusi következmény (de már a hét után): Alsup class action-t certifikál, és 2025 augusztusában az Anthropic $1.5 milliárd dollár settlement-tel zárja — ez a legnagyobb copyright-settlement az amerikai történelemben. Ez a hét csak a precedens-pontot rögzíti, de a számok már a horizont felett vannak.

A SET / itline-szempont: ha vállalati fejlesztésben AI-feature-t építesz, ami valamilyen formában tréning-adatra hivatkozik (RAG-pipeline könyvi forrással, dokumentum-ingest cégen belül), érdemes az adatszerzés módját jegyzőkönyvezni — a piracy vs. licit beszerzés a per során külön-külön értékelődik. Egy “csak letöltöttem” elszámolás visszamenőleg statutory damages-szel jár, függetlenül attól, hogy a felhasználás transformative volt.

Cluely $15M és a proaktív agent-UX

A Cluely 2025-06-20-án bejelenti a $15 millió Series A-t az Andreessen Horowitz vezényletével — Roy Lee a CEO, akit korábban a Columbia kicsapott azért, mert egy Chrome-extension-t épített, ami AI-megoldást generált LeetCode interview-feladatokra. A cég nyilvánosan “cheat at everything”-manifesto-t hirdet — ez kiváltja a sajtót, és pontosan ez a cél.

Nate Jones 2025-06-24-i elemzése lehúzza a marketing-réteget a termékről, és három fontos pontot tesz le:

1. A modell nem érdekes — az UX igen. Nate teszteli a Cluely-t: “feels like ChatGPT 4o level intelligence”. Mid AI. De a proaktív agent-UX, ami láthatatlan üveglapként ül minden alkalmazás felett, képes screenshotot olvasni, és élőszóban válaszol — ez új paradigma. A Cluely Whisper Flow-t használ speech-to-text-re, screen-readerként működik, és nem csinál screenshot-ot magáról (anti-detection).

2. A targetelt habit-formálás a moat. A Cluely-csapat 7 marketing- vs. 4 mérnök-arány-ban épül — ez nem véletlen. A cél Gen Z és Gen Alpha napi használati szokást formálni, mielőtt a GPT-5 vagy a Claude 4.5 megjönne. Ha sticky daily habit, akkor a model-rotáció nem érinti őket.

3. A “cheat” framing inflációs. Nate kemény logikai pontot tesz le: ha mindenki használ Cluely-szerű proaktív AI-t, megszűnik a cheat-jelleg — pont, mint amikor mindenki ChatGPT-vel írja az önéletrajzot. A valódi termék-érték a proaktív agent UX, és a marketing csak ablakot nyit a distribution-csatornán.

A B2B-szál a meglepő: a Cluely 7-számjegyű deal-eket köt sales- és customer success-csapatokkal. Nem cheating; invisible co-pilot screen-share alatt. Innen nézve a “cheat at everything” inkább egy Trojan-marketing, ami a B2B termékre ablakot nyit.

A SET-szempont: a Cluely a proaktív agent-UX első működő implementációja. Aki ma agent-architektúrát tervez, érdemes átgondolnia a read-only screen overlay vs. traditional chat panel dilemmát — Karpathy short-leash-elve és a Cluely láthatatlan-overlay-koncepciója nem összeegyeztethetetlen, de a tervezésnél választani kell.

Warp 2.0 — a terminálból agentic development environment

2025-06-25-én a Warp kiadja a 2.0-t, és átnevezi magát “agentic development environment”-té (ADE). Zach Lloyd CEO és Ben Holmes a Latent Space epizódjában lebontják, mit jelent ez. A Warp 2.0 egy IDE-replacement, nem egy terminál:

Lloyd központi tézise: “the primary workflow of development is changing… if I want to make a change, I’m not going to open an IDE and open five files… I’m going to ask an agent.” Ez erős állítás — és jelenleg Cursor és Cloud Code irányában is felzárkózott, miközben a Warp 600 000 aktív felhasználóval és heti 5-15%-os bevétel-növekedéssel ér ide.

A pricing-modell érdekes adat: Warp Turbo plan 50 dollár/hó — Lloyd elismeri, hogy ez nehéz költség-modell, mivel egyes felhasználók 1000 dollár nagyságrendű compute-ot fogyasztanak havonta. Cursor-pszichológiai megfontolás vezérli az “egyetlen havi díj” modellt: a pure usage-based billing rationing-magatartást indukál a felhasználókban, ami terméken belül rontja az élményt.

A SET-szempont: ha a fejlesztői workflow valóban prompt-driven lesz, a CI/CD-nek és a verifier-rétegnek is up-to-date-en kell illeszkednie — a Warp-szerű multi-agent dashboard több párhuzamos PR-t generál egy fejlesztőtől, és ha a teszt-pipeline ezt nem bírja, az időmegtakarítás illuzórikus marad. Ez a klasszikus bottleneck-shift: a kódírás már nem a szűk keresztmetszet, a verifikáció és az integrálás az.

Mellékszál — rovatok

Mit viszünk magunkkal

A hét három mérnöki / IT-vezetői kérdést hagy ott:

  1. A “Software 3.0” nyelvet érdemes átvenni. Karpathy people spirit és jagged intelligence terminusai pontosabbak, mint a “smart agent” / “intelligent assistant” generikus címkék. Ha a belső dokumentumokban átállunk a Karpathy-féle keretre, az architektúra-döntések is élesebbek lesznek: mire állítok validációs réteget (mert jagged), hol rövidítsem le a leash-t (mert no internal clock), mit treatelek ellenőrizhetetlenül-stochastic-ként (mert people spirit, nem deterministic component).

  2. A Bartz-ítélet adatszerzési hygiene-t követel. Ha a stack-ben bárhol AI-tréning-adat vagy RAG-corpus van, a forrásnaplózást kötelezővé érdemes tenni. Nem a végcél a piracy-elkerülés (ezt eddig is tudtuk), hanem hogy statutory damage-szám szerint külön értékelhető legyen minden adatpont. Egy belső “data-provenance manifest” ma még belső koherencia-eszköz; egy év múlva már szabványellenőrzés.

  3. A workbench-réteg nyitva van. Warp 2.0, Cluely, Claude Code — három teljesen különböző UX-architektúra ugyanarra az általános problémára: az LLM mint runtime + ember mint validátor. A Cursor / Cloud Code / Warp / Cluely közül most kell kiválasztani egyet a fejlesztői csapat számára, és 6 hónap múlva felülvizsgálni, mert az architektúrák gyorsan távolodnak egymástól. Egy korai mismatch (pl. Cursor-only csapat, miközben a feladat profilja Warp-szerű multi-agent dashboard-ot kívánna) később nehezen migrálható.

A W27-ben a Mistral új modell-frissítései és az OpenAI-féle “ChatGPT for Mac”-frissítések várhatóak — a “GPT-5 előtti utolsó hónap”-narratíva tovább épül.

Források

Fő forrás — Nate B Jones csatornája:

Körbejárás / tech-mélység — Latent Space podcast és Peter Yang:

Fact-check és hivatkozott eredeti források:


A heti hírlevelet saját gondolatainkból és független keresésekből állítjuk össze. Az eredeti források a fenti listában találhatók.