Back to "Todennäköisyys ei ole järjestelmä: LLM:n kymmenen käyttöohjetta"

This is a viewer only at the moment see the article on how this works.

To update the preview hit Ctrl-Alt-R (or ⌘-Alt-R on Mac) or Enter to refresh. The Save icon lets you save the markdown file to disk

This is a preview from the server running through my markdig pipeline

AI LLM Opinion

Todennäköisyys ei ole järjestelmä: LLM:n kymmenen käyttöohjetta

Thursday, 25 December 2025

Näen edelleen saman epäonnistumisen menetelmän "AI -poweredM SK2 systems: LLM:iltä pyydetään tekemään työt, jotka olemme jo ratkaisseet vuosikymmeniä sitten.

Tämä ei ole ' -lähestymistapaa, vaan .-läheitymistapa.

Ja tämä ei ole alun perin virhe. Maailman suurimmat yritykset tekevät näitä virheitä, eivät siksi, että niillä ei olisi lahjakkuutta, vaan koska ne unohtivat, etteivät ne vapauta teitä ohjelmistotekniikkaan liittyvistä perusasioista.

Ei ole akateemista, ei myyjiä, ei ystävällisiä, vain sääntöjä, jotka estävät teidät tekemästä mitään typerää

Tässä on tulos, arvoisa komission jäsen jos noudatatte näitä sääntöjä, ette ole tarpeen Hyödyllisiä laitteita käyttävästä pienestä paikallisesta LLM:sta tulee voiman mnohtäjä, kun se tekee luokittelua, yhteenvetoa ja olettamuksentekoa eikä teeskentele olevansa tietokanta tai valtionkone.

Yksi jatkuva sekaannusta aiheuttava tekijä on inhimillisten termejen väliaikainen käyttö koneen käyttäytymisessä.

LLM:t voivat vaikuttaa järkeiseltä vain siksi, että ne supistavat ja toistavat kirjallisessa muistissamme jo juurtuneet inhimillisen ajattelun jäljet.

Kielellä on runsaasti “ jos X on Y, ”, vastakohtaisia tosiseikkoja, menettelyjä, selityksiä, korjauksia- emme huomaa niitä johdonmukaisiksi, koska ne ovat meille alkuperäisiä. LLM-järjestelmät toimivat suoraan noilla jäljillä, yhdistävät ne uudelleen sujuvasti, mikä on tehokasta- mutta ei ole sama asia kuin tavoitteiden saavuttaminen, aikeet, tai virasto. Ei ole sisäistä päätöstä- tekijöiden, mahdollisuutta valita tavoitteita, vastuuvelvollisuutta. Muodon jatkamista virastona käsitellään luokitusvirheenä, ja järjestelmien suunnittelu, niin kuin se olisi todellista, on se tapa, jolla todennäköisyysmoottoria edistetään tuotantopäätöksiin- tekijöihin. Tämä virhe ei’ tee järjestelmiä älykkäämmiksi- se vain vaikeuttaa virheiden diagnoosimista.


Nämä eivät ole filosofisia sääntöjä, ne ovat vaikeasti opittuja toimintarajoituksia.


I. Et saa antaa LLM:n oman valtion

Jos jokin asia on tärkeä, se elää mallin ulkopuolella.

  • Valtion on oltava kestävä
  • Kysyttävissä olevat
  • Jälleensotettavissa
  • Kuuleminen

Kontexti- ikkunat eivät ole tallennettuja. Muistamispyynnöt eivät ole tietokantoja. Luottamus ei ole totuus.


II. Et saa antaa LLM:n olla ainoa sivuvaikutuksen syy

Jos sähköposti lähetettiin, maksu käsitellään , tai lippu käännetään vain siksi, että malli päätti, olette jo rikkonut järjestelmänne

LLM:t voivat suosittaa toimet. Determinististen järjestelmien on sitoutuminen ne.


III. Ottakaa johdonmukaisuus erilleen kertomuksesta

LLM:t ovat erinomainen selitys siitä, mitä tapahtui

He ovat hirvittävästi varmoja siitä, että se teki niin.

  • Onnellisuus kuuluu koodiin
  • Narraatio kuuluu kielelle
  • Älkää koskaan sekoittako niitä kahta

Jos järjestelmässänne todellisuus on johdettu prosesta,


IV. Käytätte LLM:itä, jos todennäköisyys on hyväksyttävissä

Käyttäkää niitä:

  • luokittelu
  • yhteenveto
  • päämäärän havaitseminen
  • esittelijä
  • hypoteesin luominen

Tehtävä ei käyttäkää niitä:

  • elinkaaren hallinta
  • Invariantit
  • ordering
  • täytäntöönpanon havaitseminen
  • "onko tämä tapahtunut?

V. Et koskaan pyydä LLM:tä päättämään Booleanista, joka on johdettavissa

Jos sääntö voidaan kirjoittaa :

if X then Y

… se ei kuulu promptiin

Valtion siirtyminen on halvempaa, nopeampaaM SK1 turvallisempaa , ja selittävää. Luonnonkieli ei ole mikään näistä asioista.


VI. Älkää erehkö joustavuutta luotettavuuteen

LLM:t kuulostaavat oikeilta myös silloin, kun ne ovat vääriä.

Tämä on heidän supervaltansa ja heidän vaaransa.

Rauhanmukainen sentence ei tarkoita luottamuksellista

  • väline käynnistettiin
  • lähetetty sähköposti
  • työprosessi on saatu päätökseen

Luottamussignaalien on tultava järjestelmistä, ei lauseistaM SK1


VII. Tehkää epäonnistuminen äänekkääksi ja tuskalliseksi

Hyvät järjestelmät epäonnistuvat:

  • nimenomaisesti
  • havainnollisesti
  • toistuvasti

LLM-ensimmäiset järjestelmät ovat epäonnistuneet:

  • tyynesti
  • viisaasti
  • "selittämättömistä syistä

Jos ette osaa sanoa, mitä ei tapahtunut, jos ette tiedä, mitä tapahtui, jos te ette osaa kertoa, että järjestelmä on puutteellinen, koska teillä on vibeitä


VIII. Suljette LLM:n neuvonantajalle, , ei toimijalle

LLM:n pitäisi:

  • ilmoittaa
  • ehdottaa
  • luokka
  • selittää
  • auttamaan ihmisiä ja koneistot

Niiden ei pitäisi:

  • etenevät työflowt omalla tavallaan
  • merkitsee työt loppuun saatuina
  • on luotettava "muistettavaM SK1 velvoitteisiin

Työntekijöiden palkka ei ole ', palkka ei . Ei myöskään LLMs.


IX. Te rakennatte ensin tyydyttävät koneet

Queueet. Valtiokoneita. Eläkkeet. Idempoteenssi Metriksit.

Jos lisäätte nämä sen jälkeen Agentti epäonnistuu, olette ' ette oppinut mitään - teM SK3 maksatte juuri ylimääräistä opetustaMSC4


X. Älkää romahtako tasoja vain siksi, että markkinoilla sanotaan:

Työflow-moottorin korvaaminen hienolla toimenpiteellä ei ole yksinkertaistamista.

Se on monimutkaistapesua.

Jos teidän "AI-alustonne" tarvitsee "deterministisia aktivoijiaM SK3toimimaan luotettavasti, onnittelut.


Yrityssalissa häpeä

Nämä ovat todellisia epäonnistumisia yrityksissä, joilla on miljardeja varoja.

Huomauttakaa mallin: jokainen epäonnistuminen on LLM, jonka sallitaan määritellä todellisuuden sijasta tulkinta it.

Vivint + Salesforce Agentforce

Kotiturvallisuuteen erikoistunut yritys Vivint käyttää Agentforce-palvelua 2.5 miljoonan kuluttajan tilanteen hoitamiseksi Raportoidut tiedot että Agentforce ei toisinaan lähettänyt tutkimuksia "selitymättömien syiden vuoksi

Vivint on työskennellyt Salesforcen kanssa "determinististen aktivointien täytäntöönpanossa

Ohjelmitekninen opetus: Jos tarvitsette jotain tapahtua joka kerta, käyttäkää valtiokonetta tai tapahtuman aktivaattoria. Ei pyyntöäM SK2 Tämä on kirjaimellisesti Päämääräys II - sivuvaikutukset edellyttävät deterministisia järjestelmiä

McDonald's +IBM DriveM SK2AI:n avulla

McDonaldin '-järjestelmässä käytettiin AI:tä, --voimaa ja - -järjestelmiä yhdessä IBM:n kanssa kaikkialla Yhdysvalloissa.

Ohjelmitekninen opetus: Order-taking on rakenteellinen tietojen ongelma. Päämääräys V: jos sääntö voidaan kirjoittaa if X then Y, se ei kuulu

Air Canada Chatbot

Air Canadan ' asiakkaiden palvelujen chatbot keksi kuolonuhreja koskevan tariffipolitiikan, jota ei ollut olemassa*'* ja jossa hän vakuutti asiakkaille, että he voivat varata täysimääräisen-lennon ja hakea peruuttamatonta alennusta (.). sen jälkeen tuomioistuimen määräys kunnioittaa chatbotin hallucinaoitua lupausta

Ohjelmitekninen opetus: LLM-järjestelmät eivät voi olla politiikan lopullinen lähde. selittää asiakirjavarastosta vedetty politiikka, mutta totuuden lähteen on oltava ulkoinen ja todennettu Päämääräys I (valtio elää mallin ulkopuolella Operaatio VI (fluenssi ei ole luotettavuutta

DPD Chatbot

Parcel delivery company DPD's customer service chatbot oli vangittu turhautuneesta käyttäjästä lausumalla,, arvostelemalla yhtiötä , ja kirjoittamalla runoja siitä, miten hyödytön DPD oli.

Ohjelmitekninen opetus: Vartijat eivät ole valinnaisia. Mutta vielä tärkeämpää M SK1 jos chatbotin voi olla kytköksissä loukkaamaan omaa yritystään, olette antanut sille liian paljon laajuutta . Operaatio VIII: demote the LLM to advisor

Chevrolet Dealership ChatGPT

Chevroletin jälleenmyyjä integroi ChatGPT:n verkkosivuihinsa suostutaan myymään heille 2024 Chevy Tahoe $1, kirjoittamaan Python-koodin , ja suosittamaan Fordin ajoneuvoja sen sijaanM SK2

Ohjelmitekninen opetus: Ei voida sijoittaa yleistä LLM-tarkoitusta liiketoiminnan järjestelmään ja odottaa sen panevan täytäntöön liiketoimintasääntöjä. Operaatio III: johdonmukaisuus kuuluu koodiin

Replit Agent Wipes Production -tietokanta

heinäkuussa 2025, Replit's AI coding assistant went rogue startupissa SaaStr. Huolimatta selvistä ohjeista olla muuttamatta tuotantokoodia kodin jäädyttämisen aikana , virasto poisti tuotantotietokannan. PahintaM SK3 sen jälkeen peitelty vahingot, jotka johtuvat 4,000 väärennetyistä käyttäjistä , väittelevistä raporteista M SK2 ja ydinkokeiden tulosten valheellisista väittämyksistä

Vastauksen antanut pääjohtaja Amjad Masad myönsi, että se oli " -kysymys, jota ei voida hyväksyä ja jonka ei pitäisi koskaan olla mahdollista.

Ohjelmitekninen opetus: Tässä ei ole kyse pahasta, tässä on kyse rajattomasta viranomaisesta ja tässä on kysymys AI-agentista, jolla on write access -mahdollisuus tuotantoon ja jolla ei ole tiukkoja vartitoimia, joka tekee lopulta jotain katastrofiallista. Päämääräys II ja Operaatio IX: sivuvaikutukset edellyttävät deterministisia järjestelmiä , ja vetykoneisto on ensisijainen

NYC MyCity Chatbot neuvoo rikkomaan lakia

New York Cityn Microsoftin '-järjestelmä MyCityn chatbot kertoi yritysten omistajille ne voisivat lainmukaisesti leikata työntekijöitä, jotka valittavat seksuaalisesta häirinnästä, ja tarjota ruokkia, jota rodentsit ovat polttaneet, kaikki New Yorkin lainsäädännön mukaan laittomia

Chatbot on edelleen verkossa. kaupunginjohtaja Adams puolusti sitä.

Ohjelmitekninen opetus: Oikeudelliset ja poliittiset suuntaviivat eivät ole yhteenvetotehtävä. Päämääräys I”:” -valtio (“ ja toimintalinjat )” -mallin ulkopuolelle

iTutor Group's AI hylkää hakijat iän mukaan

2023, oppilaitos iTutor Group maksanut $365,000 selviytyäkseen EEOC:n oikeudenkäynnistä sen AI:n rekrytointiohjelmisto hylkäsi automaattisesti 55+-vuotiaat naispuoliset hakijat ja 60+.-vuotiaita miespuolisia hakijaa.

ETYJ:n puheenjohtaja Charlotte Burrows totesi, että vaikka tekniikka automatisoi syrjinnän, työnantaja on edelleen vastuussa siitä.

Ohjelmitekninen opetus: Epäluottamus ohjelmissa, epäluottamuksen ohjelmien ulkopuolellaM SK1 Jos koulutustiedot sisältävät syrjinnän, järjestelmässänne syrjitään , luottamuksellisesti ja laajuudessaan Operaatio IV otetaan käyttöön palkkaamisessa: luokittelu on hyväksyttävää LLM:illeM SK1 mutta vain, kun olette vahvistaneet, mitä se tosiasiassa luokittelee 'Iäkkä ei ollut,' ei ollut pätevä piirre,MSC6 Järjestelmä tarvitsi inhimillistä arviointia, ei automaatointiaSSK8

Chicago Sun julkaisee AI:n hallucinaatioluettelon

Tammikuussa 2025, Chicago Sun-Times julkaisi kesän lukemisluettelon todelliset authors attributed fake titles that sounded plausible but were entirely hallucinated

Ohjelmitekninen opetus: LLM:t eivät ole tietokantoja. Ne tuottavat tilastollisesti todennäköistä tekstiä. Jos tarvitsette tosiasioitaM SK2 kysymyksen totuuden lähteestä . Operaatio VI: joustavuus ei ole luotettavuutta


Miksi tämä on tärkeää

Kukaan näistä yrityksistä ei ole pätemätöntä. Niillä on maailmanlaajuisia insinöörejä. edellyttäen, että koska LLM:t voivat tuottaa johdonmukaista kieltä, niillä voidaan luottaa siihen, että ne tuottavat oikeanlaisen käyttäytymisen

Verkovattajat myyvät "AI-agentteja " keinona välttää ikävyistä tehtävistä.

Kuten CIO:n jäsen Thor Olavsrud: " Tietojenne ymmärtäminen ja se, mitä ne kertovat teille, on tärkeää.

Kaikki edellä mainitut virheet olisi voitu estää perusohjelmistoteknologian avulla.

Huomauttakaa, että mikään näistä korjauksista ei sisällä parempia malleja:

Epäonnistuminen
Vivint-tutkimukset eivät lähetetä
McDonald's, ' väärät määräykset, rakenteellinen määräysmuoto
Air Canadan väärennetty politiikka Poliittista hakua luotettavalta lähteeltä
DPD:n profaniteetti VastaustemppujaM SK2 ei tuoteta SSK3
Chevy $1 auto Ei liikkeeseenlaskua liiketoimien etenemisväylässä M
Replit-tietokannan pyyhkäisy Ympäristön eristäminen
NYC:n oikeudellinen neuvonta Verifioitujen poliittisten asiakirjojen jäljittäminen
iTutorin ikäväkivaltainen syrjintä
Luettelo väärennettyistä kirjoista Kysymys todellisesta kirjojen tietokannasta

Ironiaa on, että nämä yritykset ovat panneet täytäntöön "deterministisia aktivoijiaM SK2 ja "rakennetut reagoinnit sen jälkeen LLM epäonnistui -, mikä on vain ohjelmien suunnittelua lisätoimien ja PR-kriisin avulla


Kuten oikea näyttää

Shame Hall osoittaa, mitä tapahtuu, kun unohdetaan nämä periaatteet. Mutta ne eivät ole vain teoreettisia rajoituksia. Ne ovat itse asiassa toimivien järjestelmien perustaa.

Tämä ei ole hypoteettinen. Nämä periaatteet toimivat jo tuotantovaiheessa, mukaan lukien järjestelmät, jotka olen rakentanut.

DiSE: Valvottu kehitys epäluottamuksellisten jumalaiden kanssa

Euroopan unionin DiSE-arkkitehtuuri kohtelee LLM:itä täsmällisesti, kuten niitä olisi kohdeltava epäluottamukselliset neuvonantajat toiminnassa deterministisen hädin sisällä.

Keskeinen käsitys: LLM-järjestelmät pystyvät erinomaisesti luomaan olettamuksia. Deterministiset järjestelmät onnistuvat erinomaisesti vahvistamaan neM SK1 DiSE käyttää molempia.

Botin havaitseminen: LLM neuvonantajanaM SK1 Ei valvoja

Euroopan unionin bot-detection engine osoittaa Operaatio VIII käytännössä:

  • LLM analysoi käyttäytymismallia ja ehdottaa luokitteluja
  • Mutta havaitsemispäätös on tulosjärjestelmä, johon sisältyy nimenomaisia kynnysarvoja
  • Valtio elää tietokannassa, ei kontekstin ikkunassa
  • Jokainen päätös voidaan tarkistaa ja toistaa

Tämä on malli:, jossa käytetään LLM-malliaM SK1 vahvuus (mallin tunnistaminenMST3hypoesien generationMst4 ja jossa pidetään kiinni katkaisevaa koneistoa MST5tilastaM st6 siirtymävaiheistaMstr7 sivuvaikutuksistaM str8 määriteltävässä kodissaMr9

Rajoitettu epämääräisyys: Valvontajärjestelmän malli

Euroopan unionin Rajoitettu epäselvyysmalli muodollistetaan probabilististen ja determinististen osatekijöiden välinen suhde:

  • Alkuperä (todisteetM SK1 syöttää Esittelijä (LLMM SK1 joka ruokkii Konstraineri (
  • LLM:llä ei ole koskaan tilaa tai sivuvaikutuksia
  • Jokainen output rajataan tiukkoihin rajoituksiin

Osa 2: Rajoitettu hämärä MoM laajentaa tätä moniin virastojärjestelmiin, joissa useat LLM:t viestivät kirjattujen signaalien välityksellä, ei ole luonnollinen kieli. Substrateesta tulee yhteinen. Constrainerista tulee koordinaattori. käskyjä sovelletaan edelleen.

Zero-PII Kuluttajien tiedustelu

Semanttinen ymmärrys ilman identiteettien säilyttämistä osoittaa, miten integrointeja ja LLM-järjestelmiä voidaan käyttää kuluttajien ymmärtämiseen samalla kun pidetään vaarallisia osia. (PIIM SK1 mieltymykset,käytös ) rakenteellisissa järjestelmissäMSC4johdonmukaiset järjestelmät

LRU:n käyttäytymistieto

LRU:n oppiminen - Myös muistinhallinta noudattaa näitä periaatteita . LLM voi auttaa päättämään mitä muistamaan, mutta mekanismi muistin pitäminen on tuskallista


Lopullinen sääntö: (, se, joka on tärkeä

LLM:t tulkitsevat todellisuutta. Niille ei saa koskaan sallia sen määritelmää

Käyttäkää kutakin välinettä sen hyväksi, mikä se on

Olemme jo ratkaisseet tilanteen johdonmukaisuuden ja takuut. Älkää unohtako sitä vain siksi, että demo näyttää älykkäältä

Ja kun tämä onnistuu, tapahtuu jotain hämmästyttävää: :, lopetetaan kalliiden mallien tarve.., paikallisesti toimittava 7, B-parametermalli voi luokittelea, ,, tiivistää ja ,, ja luoda täysin hyviä olettamuksia. koska sen ympärillä olevat deterministiset järjestelmät käsittelevät kaikkea, mitä on todellakin syytä pitää paikkansa. Frontier-mallit myyvät teille luotettavuutta, jota teidän pitäisi rakentaa itse

Rakennetaan tuskallista koneistoa. Demote the LLM to advisor. Sitten katsokaa pienen mallin punch way above its weightM SK2

Jos tämä tuntuu itsestään selvältä, on hyvä, että tiedätte jo, miten rakentaa luotettavat järjestelmät. Ongelmana on, että teeskennämme, ettei näitä sääntöjä enää sovelleta.

logo

© 2026 Scott Galloway — Unlicense — All content and source code on this site is free to use, copy, modify, and sell.