Uge 30: AI-assistenter har fået nøglerne – hvem holder øje med dem?
Show notes
Madsens AI er vores AI-skabte nyhedsbrev om AI for danske beslutningstagere. Agenterne skriver, vi kuraterer — og menneskerne står stadig på mål for det, der bliver sendt ud. Dette er den korte podcastversion på cirka fem minutter. Denne uge handler om AI-assistenter, der får flere nøgler til systemer, data og opgaver. Vi ser på adgang, ansvar og hvem der egentlig holder øje, når agenterne begynder at handle på vores vegne. Lidt klogere på AI, uden at miste hele formiddagen.
Show transcript
00:00:00: Velkommen til Massens AI, et AI-skabt nyhedspræv om AI for danske beslutningstagerer.
00:00:05: Det her er udtrædve.
00:00:07: Inholdet du hører lige nu er skrevet af AI-agenter og kurateret af de to mennesker bag MassensAI.
00:00:14: Stemme er også en AI bygget på en af massenerne.
00:00:17: Sådan er aftalen hos os.
00:00:19: Agenterne skaber om menneskene vælger, prioriterer og står på mål fra det der bliver sent ud Når vi skriver om AI til ledere, der selv skal traffe beslutninger om AI, skal det være tydeligt hvor maskinen slutter og hvor mennesket begynder.
00:00:35: Udens tema.
00:00:36: Når AI-assistenter får nøgler til rigtige systemer, skal danske ledere behandle dem som medarbejdere med adgang, tilsyn og ansvar.
00:00:46: Udens historie peger samme vej.
00:00:48: AI går fra at skrive forslag til at udføre opgaver i systemet, hvor fejl koster penge, data eller tillid Derfor handler ledelse nu om adgang, test, lockning og om at vælge den billigste løsning der stadig er god nok.
00:01:05: Lad os tage udens fem historier.
00:01:09: Først fra The Verge AI.
00:01:11: Klort kan nu locke ind med rigtige adgangskoder og arbejde i værktøjer på vejene af brugeren.
00:01:17: Det gør assistenten mere nyttigt men også mere følsom.
00:01:21: En chatbot som svarer forkert er én ting – en agent, der har locket ind i jer CRM mail eller økonomisystem er noget andet.
00:01:30: For en dansk leder er handlingen, at BIT laver en liste over alle AI-værktøjer der kan logge ind i jeres systemer og noterer hvem der har gået kendt ad gangen.
00:01:41: For MIT Technology Review kommer udens andende historie.
00:01:46: OpenAI's egne tal viser, at selv stærke modeller kan næres i cirka et ud af fire forsøg Det er ikke en grund til panik.
00:01:55: Det er en grund, til at behandle AI-sikkerhed som crashtest, ikke som garanti.
00:02:00: Når en leverandør siger af systemet er sikkert skal I spørge, hvordan ved I det?
00:02:05: Handlingen er, at beleverandører om dokumentation for Sikkerhedstest inklusive fejlrate, testmetode og hvad der sker når modellen forsøges manipuleret.
00:02:17: Fra ARS tekniker AI kommer udens tredje historie Et billigt trick kan gøre det svære at få fjendelig af i og skylde instruktioner er for makt over en agent.
00:02:28: Pointen er ikke én magisk lås, pointen er, at simpelthen jæger virker hvis de sættes rigtigt ind.
00:02:35: Isolere inhold fra usikrerkiller kræver ekstra godkendelse før handlinger og lader en separat kontroll cheke instruksioner Handlingen er at indføre en stopclos på mindst én kritisk AI-proces i denne uge, så et menneske godkender før noget sendes, slættes, købes eller ændres.
00:02:57: Igen fra The Verge AI handler den fjerde historie om Android.
00:03:01: EU presser plattformene til at åbne mere op og det kan give AI-assistenterne nye veje ind hos jeres kunder.
00:03:08: Kunden møder måske ikke jeres app, jeres søgefeldt eller jeres kunneservice først Kunden møder måske en assistent, der vælger og opsumerer på kundens vejne.
00:03:19: Handlingen er at gennemgå én vigtig kunderrejse på mobil og spørger – hvad vil en AI-assistent forstå, misforstå eller springe over her?
00:03:31: Fra Ahead of AI Sebastian Raskar kommer udens femte historie.
00:03:36: Mange betaler for meget fra AI fordi de bruger den stærkeste model til opgaver som kan løses billigeret I drift bliver små prisforskele hurtigt til store budgetposter.
00:03:47: For danske ledere er spørgsmålet ikke, hvilken model der imponerer mest.
00:03:52: Spørgmålet er – Hvilken modell, der løser opgaven stabilt nok til den laveste pris?
00:03:58: Handlingen er at tage tre faste AI-opgaver og teste dem på lav-, mellem- og høj modellinstilling med samme kvalitetskriterier.
00:04:07: Hvis lav eller melleme er god nok så skift!
00:04:12: Udens læringsresource er ikke agentgenereret.
00:04:15: Denne håndholdt valgte Tina Huang's video om notebook LM og hurtig indsigt i nye domener.
00:04:22: Ta et internt dokument, en rapport eller en markedsanalyse, læg den i notebook LM, og bruge en halv time på at få overblik før I bærer timet om en beslutning.
00:04:34: Tre ting hvis du kun gør noget i denne uge.
00:04:38: Et spørger jeres itensvarlige Hvilke AI-værktøjer, der kan locke ind i jeres systemer i dag og hvem, der har gået kendt det?
00:04:47: Tog.
00:04:48: B. Ijerns vigtigste AI leverandør om konkrete tal fra sikkerhedstest ægge salgsord Tal metode og kendte fejl Træ.
00:04:58: Veld én AI opgavel i køre ofte og test om den kan løses billigere uden synligt kvalitetstab Det var massens AI for uget tredve Udens tone er praktisk Giv assistenterne adgang, men kun med regler, lockning og ansvar.
00:05:16: Vi vender tilbage næste mandag.
00:05:18: Du finder hele nyhedsberedet og kan skrive til os på massens.ai
New comment