1
00:00:01,760 --> 00:00:05,520
Hoi, leuk dat je weer luistert naar korte aflevering van AIToday Live.
2
00:00:05,520 --> 00:00:08,640
Ik ben Joop Snijder, Head of AI bij Info Support.
3
00:00:09,040 --> 00:00:14,080
En vandaag misschien wel uitgesproken mening.
4
00:00:14,080 --> 00:00:17,920
Namelijk watermerken in tekst is een wassen neus.
5
00:00:19,440 --> 00:00:30,879
Anthropic maakte afgelopen week, deze week zo ongeveer bekend dat Claude een onzichtbaar merkteken, watermerk achterlaat in de tekst die het schrijft.
6
00:00:30,879 --> 00:00:33,279
En daar is best een hele hoop over te doen.
7
00:00:33,600 --> 00:00:38,559
En mijn eerste gedachte was iets anders dan verontwaardiging.
8
00:00:39,280 --> 00:00:47,520
Want het zou toch vreemd zijn als het mij zou uitmaken of iemand kan achterhalen dat ik een taalmodel heb gebruikt.
9
00:00:47,520 --> 00:00:48,799
Ja, ik gebruik dat.
10
00:00:48,800 --> 00:00:50,719
Het is een handig hulpmiddel.
11
00:00:50,719 --> 00:00:58,479
Het voelt een beetje als dat je een lettertype in je tekstverwerker maakt, dat lijkt op handschrift van een vulpen.
12
00:00:58,480 --> 00:01:06,000
En dat we vervolgens met elkaar gaan afspreken dat schrijven met een echte vulpen beter is dan schrijven met een tekstverwerker.
13
00:01:06,799 --> 00:01:08,079
Flauwekul.
14
00:01:08,079 --> 00:01:10,479
Maar goed, even naar de feiten.
15
00:01:10,480 --> 00:01:11,519
Anthropic.
16
00:01:11,519 --> 00:01:18,640
Die zegt dat ze sinds begin augustus, 2 augustus een merkteken in de tekst van een nieuwe modellen zetten.
17
00:01:20,960 --> 00:01:27,679
In tekst gaat mee als je knipt en plakt en overleeft misschien zelfs een deel van je bewerkingen.
18
00:01:28,000 --> 00:01:39,599
Ze zeggen ook dat er een detectiedienst komt waarmee je de tekst kan aanbieden en waarbij die dan detecteert of je dan de taalmodellen van Anthropic hebt gebruikt.
19
00:01:39,920 --> 00:01:45,840
Dat doen ze niet het vrije wil, zeggen ze, maar om te voldoen aan artikel 50 van de AI-verordening.
20
00:01:45,840 --> 00:01:47,039
De AI-act.
21
00:01:47,040 --> 00:01:51,439
En dat artikel geldt sinds 2 augustus van dit jaar.
22
00:01:52,000 --> 00:02:01,519
Aanbieders moeten gegenereerde output machine leesbaar markeren voor systemen die al op de markt waren gelden uitloop tot december.
23
00:02:03,120 --> 00:02:06,000
Wat zegt Anthropic hier dan zelf over?
24
00:02:06,159 --> 00:02:15,359
Die zeggen over hun eigen motivatie zeggen ze namelijk hebben ze twee redenen: transparantie aan het naleven van hun wettelijke verplichtingen.
25
00:02:15,439 --> 00:02:18,880
Ze zeggen ik heb dit overgenomen.
26
00:02:18,879 --> 00:02:27,120
Nu AI-tekst alledaags wordt, geeft een signaal over de herkomst mensen nuttige context bij de informatie die ze tot zich nemen.
27
00:02:27,120 --> 00:02:28,560
Dat is het doel.
28
00:02:29,200 --> 00:02:33,359
Maar lees dan ook even een eigen paragraaf over de beperkingen.
29
00:02:33,680 --> 00:02:42,240
Een gevonden merkteken watermerk betekent dat tekst door Claude verwerkt is en niet dat Claude de auteur is.
30
00:02:42,400 --> 00:02:42,879
Eén.
31
00:02:42,879 --> 00:02:47,599
Je kunt het model ook laten meelezen of vertalen.
32
00:02:47,840 --> 00:02:51,200
En geen watermerk gevonden, betekent eigenlijk niet.
33
00:02:51,439 --> 00:02:58,800
Dus bij een parafraze, een vertaling, zwaar bewerkte tekst of een korte passage, blijft er dan te weinig signaal over zeggen zij.
34
00:02:58,800 --> 00:03:03,199
Dus Anthropic zegt dus zelf wat het meetinstrument niet meet.
35
00:03:03,200 --> 00:03:06,159
En daarmee blijft in ieder geval één vraag hangen.
36
00:03:06,319 --> 00:03:10,560
Wat doe je met een uitslag die niet bewijst.
37
00:03:11,200 --> 00:03:14,319
Bij plaatjes en video's snap ik het volledig.
38
00:03:14,480 --> 00:03:19,120
Of iets daadwerkelijk gebeurd is, dat is een vraag die om herkomst.
39
00:03:19,360 --> 00:03:23,439
Maar bij tekst geloof ik er echt helemaal niets van.
40
00:03:23,439 --> 00:03:25,759
En daar heb ik twee redenen voor.
41
00:03:26,319 --> 00:03:31,360
De eerste is namelijk best wel technisch.
42
00:03:31,680 --> 00:03:39,680
In de traditionele machine learning waren we namelijk al gewend om black box, zwarte doosmodellen open te breken.
43
00:03:39,680 --> 00:03:42,400
En zo'n detector is precies zo'n zwarte doos.
44
00:03:42,400 --> 00:03:45,680
Dus je weet eigenlijk niet hoe die detecteert.
45
00:03:45,680 --> 00:03:47,280
Dus je stopt het tekst in.
46
00:03:47,280 --> 00:03:53,520
En er komt dan ja of nee uit het watermerk nog in.
47
00:03:54,080 --> 00:03:56,719
Da zit er dan in die zin het probleem.
48
00:03:56,719 --> 00:04:01,199
Want je hebt je eigen tekst tot op byte niveau.
49
00:04:01,200 --> 00:04:08,080
Dus we weten helemaal exact tot op de nulletjes en eentjes hoe die in elkaar zit, die heb je in handen.
50
00:04:08,080 --> 00:04:13,120
En je kunt eindeloos vragen blijven stellen aan zo'n detector.
51
00:04:13,120 --> 00:04:17,279
En dan kan je dus dan verander je bijvoorbeeld één woord je dat opnieuw.
52
00:04:17,280 --> 00:04:21,520
Je vraagt je verandert een komma, vraagt het opnieuw.
53
00:04:21,519 --> 00:04:28,319
En wie dat systematisch doet, achterhaalt welke keuzes het signaal van dat watermerk dragen.
54
00:04:29,040 --> 00:04:34,639
Die weet dan hoe uiteindelijk die detector, hoe die werkt, wat erin zit.
55
00:04:34,959 --> 00:04:37,520
Wie dat weet, haalt gewoon dat merkteken eruit.
56
00:04:38,160 --> 00:04:42,480
Ik zag zelfs al dat de eerste watermerkverwijderars al beschikbaar zijn.
57
00:04:42,480 --> 00:04:48,080
Waarvan ik helemaal niet weet of ze werken, omdat namelijk de detector van Anthropic er nog helemaal niet is.
58
00:04:48,400 --> 00:04:50,640
Maar goed, je ziet het gebeuren.
59
00:04:50,639 --> 00:04:56,079
Dus volgens nog is het vooral een soort van vind ik een vreemde waarschuwing van Anthropic.
60
00:04:56,160 --> 00:04:58,759
Wij weten dat je het gebruikt.
61
00:04:58,400 --> 00:05:00,680
Laten we eerlijk zijn.
62
00:05:01,000 --> 00:05:03,560
We hebben die detector niet eens nodig voor vermoeden, toch?
63
00:05:03,560 --> 00:05:11,079
Ik bedoel, toen het allemaal net uit was, de ChatGPT's en dat soort dingen, vond iedereen een tekst al verdacht bij een gedachtenstreepje de em-dash.
64
00:05:11,079 --> 00:05:15,080
Of bij een zin die begint met we duiken dieper in de wereld van.
65
00:05:15,319 --> 00:05:17,079
Daar heb je helemaal geen detector voor nodig.
66
00:05:17,079 --> 00:05:19,800
Maar goed, uiteindelijk maakt het ook niet zo heel veel uit.
67
00:05:19,800 --> 00:05:23,160
De tweede reden die ik heb is principieel.
68
00:05:23,399 --> 00:05:27,240
Ik vind namelijk dat je een tekst op zijn merites moet beoordelen.
69
00:05:27,240 --> 00:05:29,960
Is het een goede tekst of is dat niet.
70
00:05:29,959 --> 00:05:33,319
Maakt het dan uit hoe het tot stand gekomen is, toch?
71
00:05:33,319 --> 00:05:41,000
Ik bedoel, voor ChatGPT bestond, werd zo'n 20% van mijn langere artikelen geschreven door een ghostwriter, copywriter.
72
00:05:41,319 --> 00:05:44,439
En dat was hartstikke fijn, want dat bespaarde mij gewoon tijd.
73
00:05:44,439 --> 00:05:49,000
Wat er dan gebeurde is, ik liet de hond bijvoorbeeld uit en werd onderweg geïnterviewd.
74
00:05:49,000 --> 00:05:59,560
Van alles wat ik vertelde, maakte de ghostwriter dan een gestructureerd verhaal dat ik daarna nakijk en waar ik eventueel verbeteringen op aangaf.
75
00:05:59,560 --> 00:06:01,160
Dat klinkt toch niet anders dan nu.
76
00:06:01,159 --> 00:06:09,079
En nu spreek ik in de auto als ik terugrij van een klant of zo mijn gedachten in, soms gestructureerd, soms rommelig.
77
00:06:09,079 --> 00:06:14,439
En dan gebruik ik het taalmodel om daar gewoon een eerste nette versie van te maken.
78
00:06:14,920 --> 00:06:23,560
Kijk, wij mensen vertellen best wel heel vaak onsamenhangend verhalen en copywriters maken er dan iets moois van.
79
00:06:23,879 --> 00:06:25,480
En ja trouwens.
80
00:06:25,800 --> 00:06:31,239
Op een gegeven moment was ik heel blij dat ik namelijk ook een hele goede toegewezen kreeg.
81
00:06:31,240 --> 00:06:36,840
Want soms kwamen van andere slechtere copywriters kwamen de teksten terug.
82
00:06:37,000 --> 00:06:41,160
Die waren echt te slecht om als basis te gebruiken voor wat dan ook.
83
00:06:41,159 --> 00:06:45,000
Misschien herkenbaar met of je taalmodellen goed of slecht gebruikt.
84
00:06:46,920 --> 00:06:52,280
Ik heb het geluk dat ik aardig kan schrijven, aardig laten we het niet overdrijven.
85
00:06:52,279 --> 00:07:07,879
Maar iemand met dyslexie, of iemand die moeite heeft met structuur, heeft met een taalmodel in één keer een versterkend middel in handen om wat in zijn of haar hoofd zit op papier te krijgen en dat in één keer met de wereld te kunnen delen.
85
00:07:08,439 --> 00:07:14,920
In de aflevering in seizoen 7, aflevering 35, zei Erdinç Saçan, die zei het heel scherp.
86
00:07:14,920 --> 00:07:19,080
We werden vroeger boos op studenten die de spellingchecker gebruikten.
87
00:07:19,080 --> 00:07:27,319
En het idee dat we elkaar hierop moeten betrappen, is dan de omgekeerde wereld, wees blij dat mensen dingen goed kunnen doen.
88
00:07:27,960 --> 00:07:29,480
Zo kijk ik er ook naar.
89
00:07:29,480 --> 00:07:31,000
En ja, weet je, natuurlijk.
90
00:07:31,159 --> 00:07:32,760
Er bestaat AI-slop.
91
00:07:32,759 --> 00:07:37,479
Maar dat verdwijnt vanzelf zodra de lat komt te liggen waar die hoort.
92
00:07:37,960 --> 00:07:44,440
Er zijn ook taalconstructies waar ik zelf de kriebels van krijg, of dat nou wel of niet met een taalmodel geschreven is.
93
00:07:44,439 --> 00:07:48,200
Maar taal beweegt, wij bewegen mee.
94
00:07:48,200 --> 00:07:54,120
En wat we nu nog verdacht vinden, is over een paar jaar misschien gewoon hoe we schrijven.
95
00:07:54,360 --> 00:07:57,160
En daar wringt het watermerk.
96
00:07:57,159 --> 00:07:59,400
Het legt een grens vast.
97
00:07:59,399 --> 00:08:02,680
Die zelf aan het schuiven is, denk ik zo.
98
00:08:03,399 --> 00:08:11,000
Voor mij blijft de conclusie staan dat watermerken in tekst een wassen neus is.
99
00:08:12,519 --> 00:08:15,479
Ik snap het hele gedoe eromheen.
100
00:08:15,480 --> 00:08:18,520
En ook helemaal niet elkaar.
101
00:08:18,920 --> 00:08:24,920
Ook kunnen betrappen op het gebruik van een tool wat gewoon hartstikke handig is.
102
00:08:25,240 --> 00:08:35,240
Ik ben hartstikke benieuwd wat jij ervan vindt, wil je in ieder geval op de hoogte blijven van de ontwikkelingen binnen AI, druk dan op de volgknop in je podcastapp en mis je geen aflevering.
103
00:08:35,399 --> 00:08:36,360
Bedenk:
104
00:08:36,840 --> 00:08:40,600
AI is niet de oplossing voor elk probleem, maar onmisbaar waar het past.
105
00:08:40,600 --> 00:08:42,520
Tot de volgende keer.