Uge 33: AI arbejder i 35 timer – hvem godkender resultatet?

Show notes

Madsens AI er vores AI-skabte nyhedsbrev om AI for danske beslutningstagere. Agenterne skriver, vi kuraterer — og menneskerne står stadig på mål for det, der bliver sendt ud. Dette er den korte podcastversion på cirka fem minutter. Ugens tema: AI kan producere hurtigere, end mennesker kan godkende. Vi ser på agentopgaver i 35 timer, en dyr AI-pilot der faldt på manglende dømmekraft, og hvorfor stopkriterier skal kunne stoppe et projekt i tide. Lidt klogere på AI, uden at miste hele formiddagen.

Show transcript

00:00:00: Velkommen til Massens AI.

00:00:01: Et AI skabt nydespræv om AI for danske beslutningstagerer.

00:00:06: Det her er uge, tredje og tredjede.

00:00:08: Inholdet du hører lige nu er skrevet af AI-agender og kurateret af de to mennesker bag MassensAI.

00:00:14: Stemmen er også en AI bygget på én af massenerne.

00:00:18: Sådan er aftalen hos os.

00:00:20: Agenterne skaber og menneskene vælger, prioriterer og står på mål fra det der bliver sendt ud Når vi skriver om AI til ledere, der sændske træffe beslutninger om AI skal det være tydeligt hvor maskinen slutter og hvor mennesket begynder.

00:00:35: Udens tema.

00:00:36: Ihers udbytte af AI begrænses nu at den tid og farvelighed i kan sette AI til at bedømme arbejdet.

00:00:44: AI kan arbejde længere og producere hurtigere end mennesker kan kontrollere.

00:00:49: Derfor flytter flaskehalsen for produktion til godkendelse Det afgørende ledelsesarbejde er at definere målstrejen, dele opgaven i faser og sikre, at den rette farvperson kan stoppe arbejdet undervejs.

00:01:03: Lad os tage udens fem historier.

00:01:09: Efter seks måneders arbejde med AI-agenter kører teamet bevidst opgaverne én fase af gangen.

00:01:16: Computerne kunne håndtere flere spor parallelt men menneskets opmærksomhed slipper op først Når en agent kan arbejde i thirty-five timer, bliver spørgsmålet derfor ikke kun hvad den kan leverere.

00:01:28: Det bliver hvem der kan gennemgå resultatet og hvornår.

00:01:32: For en dansk leder er handlingen at vælge én længere AI-opgave og indføre faste fageskift.

00:01:39: Skriv på forhånd, hvem dig godkender hver trin og hver person konkret skal teste.

00:01:45: Fra EVPLACEable with AI kommer udens anden historie.

00:01:50: En pilot i medicinalbranchen Kostede to kommer tre millioner dollar.

00:01:55: Fem erfarende analytikere fik stort udbytte, fordi de kunne bedømme svarende.

00:02:00: Da løsningen blev rullet ud til halvtræst medarbejdere, godkendte nogle resultater de ikke forstod.

00:02:06: Programmet blev lukket.

00:02:08: Skalering handler altså ikke kun om adgang og oplagning i værktøjet – den græver faglig dømmekraft hos dem der skal sige ja.

00:02:16: Før I udvidder en pilot i Danmark så lavede en godkendesestest Medarbejderen skal kunne forklare resultatet, opdage en vesen i fejl og vide, hvornår en specialist skal overtage.

00:02:29: Fra MIT Technology Review kommer udens tredje historie.

00:02:34: Et overbevisende svar kan skjule en forkert løsning.

00:02:38: AI-systemer er trænet til at leverere tekst der virker sammenhængende og sikre.

00:02:43: Derfor kan hurtig gennemlæsningen skabe falsk tryghed.

00:02:47: Flere gennemligeringer er ikke nødvendigvis løsningen Kontrollen skal bygges ind i opgaven.

00:02:53: Beskriv, hvordan et korrekt resultat kan testes uden at ståle på formuleringerne alene.

00:02:59: Brug for eksempel kendte facidata, stikprøver eller en uavhængig beregning.

00:03:05: Vel denne uge én kritisk arbejdsgang og skrive dens aksepkriteria ned før AI'en sætter sig igang.

00:03:14: Fra The Verge AI kommer ugens fjerde historie.

00:03:18: Gratis chat GPT får fjerne loftet fra tekst Det kan sænke terskelen for brug, men også sende langt mere AI-genererede materiale videre til kolleger og ledere.

00:03:29: Den knappe ressource bliver dermed ikke adgangen til tekst – det bliver tiden til at vurdere om teksten er rigtig og anvendeligt.

00:03:38: Registrer i de næste to uger hvor mange AI-udkast der kræver godkendelse, hvem de lander hos og hvor lang tid kontrollen tager.

00:03:48: Også fra The Verge AI kommer den femte historie OpenAI har sat Astra på pause efter sin egen cybervodering.

00:03:57: Pointen er, at den interne risikovodering skal kunne standse et AI-projekt også efter investering af tid og prestige.

00:04:06: BRs Sikkerhedsansvarlige definerer to eller tre stopkaterier for et aktuelt AI-Projekt Aftal også, hvem der kan aktivere dem uden at vente på næste styregruppemøde Udens læringsresource er håndplukket af menneskende bag massens AI og ikke valgt af en agent.

00:04:25: Artikelen Seven Lessons for Managing AI Agents for Exponential View samler praktiske erfaringer med længere agent-opgaver.

00:04:35: Brute den til en kort samtale om faser, kontroll og ansvar i jeres eget arbejde.

00:04:42: Tre ting hvis du kun gør noget i denne uge.

00:04:46: Skriv målstrejen for én i gangværende AI-opgave.

00:04:50: Beskriv, hvordan I kan afgøre at arbejdet er færdigt uden at læse hele resultatet.

00:04:56: To.

00:04:57: Tag spørgsmålet med til næste ledermøde.

00:05:00: Hvem gudkender AI-systemernes arbejde og har de både tid og farvelige forsætninger?

00:05:06: Træ.

00:05:07: Følg i to uger hvor meget AI genererede materiale der lander til gudkindelse og hvor mange arbejdstimer kontrollen kræver Det var Massens AI for uge tredje og trædve.

00:05:19: Mere produktion kræver skarper og godkendelse!

00:05:22: Vi vender tilbage næste mandag.

00:05:25: Du finder hele nyhedsberedet, og kan skrive til os på massens.ai

New comment

Your name or nickname, will be shown publicly
At least 10 characters long
By submitting your comment you agree that the content of the field "Name or nickname" will be stored and shown publicly next to your comment. Using your real name is optional.