Vitalik Buterin kaže da napredni lokalni modeli poput Qwen 3.8 Flash omogućavaju brzu lokalnu inferencu i bolju privatnost, ali ističe da kripto-novčanici moraju zadržati neovisne ograničene ovlasti i ljudsku potvrdu.
Bitne tačke
- Vitalik navodi da Qwen 3.8 Flash i poboljšanja u llama.cpp omogućavaju lokalnoj AI da obavi veliki dio zadataka na njegovom Strix Halo laptopu.
- Lokalna AI može zaštititi privatni kontekst i selektivno slati samo sažetak zahtjeva udaljenim modelima, ali ne bi smjela sama donositi ovlašćenja za transfer sredstava.
- Rješenja za sigurnost novčanika moraju ostati izvan modela — deterministička ograničenja, post-transakcijske provjere (EIP-7906) i ljudska potvrda ostaju obavezni slojevi.
Vitalik testira Qwen 3.8 Flash na laptopu i vidi praktičnost
Ethereum suosnivač Vitalik Buterin je 17. septembra objasnio da Qwen 3.8 Flash i nedavna poboljšanja u llama.cpp omogućavaju da lokalni modeli preuzmu "veliki dio" zadataka na njegovom Strix Halo laptopu.
U postu su prikazani benchmarki za deset radnih opterećenja koji navode ulazne brzine od 109,82 do 373,22 tokena u sekundi i brzine generisanja izlaza od 18,42 do 33,37 tokena u sekundi, što Vitalik opisuje kao podršku tvrdnji o odgovornosti na jednom visoko-performantnom laptopu.
Vitalik detaljno navodi da lokalna AI može biti glavno interfejs za svakodnevne zadatke i da selektivno poziva jače udaljene modele samo za zahtjevniji rad, pri čemu lokalna AI zadržava privatni kontekst korisnika.
Tehnički okvir Qwen 3.8 Flash i lokalne inferencе
Qwen 3.8 Flash, koji je razvio Qwen tim iz Alibabe, opisan je kao open-weight multimodalni mixture-of-experts model s glavnim dijelom od 125 milijardi parametara i dodatnih 51 milijardu u n-gram embedding tablicama, pri čemu se po tokenu aktivira oko 6 milijardi parametara.
Zvanični materijali dokumentuju lokalnu tekstualnu i vizuelnu inferencu kroz llama.cpp koristeći kvantizirane GGUF buildove; aktiviranje djela modela po tokenu snižava računarsko opterećenje, ali korisnik i dalje treba dovoljno memorije za odabrani build i kontekst.
Vitalik primjećuje da objavljeni benchmark brojevi ne uključuju ključne detalje poput sadržaja prompta, izbora kvantizacije i pune runtime konfiguracije, što ograničava opću primjenljivost rezultata na raznolikim sistemima.
Ograničenja modela i potreba za neovisnim kontrolama u novčanicima
Buterin jasno razlikuje sposobnost lokalne AI da privatno pripremi transakcije, generiše calldata ili predloži rutu od stvarne ovlasti za trošenje sredstava. On ponavlja da ovlast trošenja mora ostati iza fiksnih politika, transakcijskih provjera i ljudske potvrde.
Model može prepoznati prijeteće obrasce koje čovjek previdi, ali isto tako zlonamjerne instrukcije ugrađene u web-sajt, poruku ili opis transakcije mogu preusmjeriti modelov plan; zato Vitalik zagovara ljudsko-plus-model pravilo 2-of-2 za rizične akcije.
On navodi primjere determinističkih ograničenja — limitirane iznose, ciljeve i broj transakcija — te ljudski firewall za rizične operacije kao potrebne mjere koje model ne smije moći izmijeniti samostalno.
EIP-7906 i post-transakcijske provjere kao dodatni slojevi zaštite
Buterin spominje EIP-7906 (u nacrtu) kao mehanizam koji predlaže post-transakcijske asercije koje inspektuju stvarne promjene stanja koje je transakcija proizvela; asercija može odbiti ishod ako promjene krše specificirane uslove.
Takve asercije mogle bi spriječiti da swap mijenja neprihvaćene bilanse, da se pojavi skriveno odobrenje tokena ili da zaštićeni račun pretrpi izmjene. Vitalik napominje da asercija koja provjerava premalo može dati lažan osjećaj sigurnosti i da validacija novčanika mora zahtijevati odgovarajući asercijski okvir.
Prema njegovom opisu, lokalna AI, determinističke dozvole i asercije rješavaju različite dijelove problema: model postaje interfejs i planer, dok kontrola prava i ljudska potvrda ostaju autoritativni slojevi.
Projekti koji testiraju lokalni pristup u Ethereum ekosistemu
Ethereum Foundation je u ažuriranju raspodjele za drugi kvartal navela Steward, potpuno lokalnu macOS smart-account aplikaciju koju namjeravaju razviti kao light client s AI asistentom koji radi na uređaju. Finansiranje i opseg projekta su objavljeni, ali status proizvodne implementacije, nezavisnih audita i autonomne transakcijske ovlasti nisu utvrđeni u objavi.
Vitalik upoređuje svoj aprilovski opis i septembarsku procjenu, navodeći da se granica praktične uloge laptop-modela pomjerila: model više nije ograničen na usko okvirne zadatke poput transkripcije ili sažimanja, već može koordinisati širi spektar aktivnosti uz selektivno korišćenje udaljenih modela.


Komentari
Diskusija je otvorena za W3M korisnike. Komentare mogu čitati svi, a objavljivanje zahtijeva prijavu.
Za komentarisanje i odgovaranje potreban je W3M nalog.