Reklamskylten för ChatTJB i San Francisco - powered by AI, där AI står för average individual
TechspaningarAIAI-säkerhetKonstEU AI Act

Techspaningar v.34 - ChatTJB, "AI-chatten" som visade sig vara en enda konstnär, och Anthropics osynliga vattenmärkning

Mobile Interaction

Är du säker på att du pratar med en AI? Den frågan borde tusentals människor i San Francisco ha ställt sig de senaste veckorna. Den här veckan handlar våra två spaningar om samma sak fast från varsitt håll: hur vi avgör vad som är AI-genererat - och hur lätt vi litar på något bara för att det ser ut som AI.

1. ChatTJB - AI-chatten som egentligen är en enda trött konstnär

I korsningen Sixth and Folsom i San Franciscos SoMa-kvarter sitter en 14 gånger 48 fot stor reklamskylt som utlovar "the leading chat interface powered by AI" - följt av en asterisk. Läser man det finstilta står det "average individual". Asterisken skyms dock delvis av ett träd, något Bryant själv beskriver som ett lyckokast: skämtet är gömt precis där man inte tittar.

Reklamskylten för ChatTJB i korsningen Sixth and Folsom i San Francisco
Reklamskylten för ChatTJB. Asterisken som avslöjar skämtet - AI = average individual - skyms av trädet.

Bakom skylten står Tucker Bryant, en 32-årig konceptkonstnär, föredragshållare och tidigare anställd på Google. För 6 000 dollar - en bråkdel av de 150 000 dollar i månaden som skyltarna över Highway 101 kostar - hyrde han platsen i en månad. Sajten chattjb.org lanserades redan i april, men det var när skylten kom upp den 27 juli som det exploderade.

Allt besvaras för hand. ChatTJB:s "bildgenerering" består av att Bryant ritar svaren själv - de senaste dagarna har han bland annat ritat en groda som äter spaghetti och San Franciscos borgmästare David Lurie som Godzilla. Frågorna spänner från det triviala till det personliga: vad man ska äta till middag med ingredienserna man har hemma ("jag skulle lägga korven i salladen och blanda den med linser, för jag är en riktigt dålig kock"), vad man ska döpa sin krukväxt till ("kanske något som antyder att den kommer finnas med dig för evigt, som 'immortalus' eller 'laktosintolerans'") och våffelrecept - som han svarar på ur minnet, "förmodligen fel".

Trafiken växte i trappsteg: 50-100 frågor om dagen de första 48 timmarna, runt 1 000 om dagen efter tre dagar - och efter ett viralt Instagram-inlägg slog floden in med upp till 5 000 frågor i timmen. Bryant stängde sajten tillfälligt, dels för att hinna ikapp, dels för att bygga in stöd för användare med allvarligare frågor. Han svarade till klockan ett på natten och började igen klockan fyra. Totalt har ChatTJB tagit emot över 30 000 frågor.

Idén är i grunden: tänk om jag skapade något som ser ut som en LLM, men där upplevelsen bara är riktigt medelmåttig - riktigt genomsnittlig. Så att nästa gång någon pratar med en annan AI-produkt, är de lite mer benägna att ta det de får lite mindre på allvar, och inte bara lita på det för att det ser coolt ut.

- Tucker Bryant, till SFGate

Bakgrunden är ett begrepp Bryant fastnat för: "cognitive surrender" - att vi lämnar över allt mer av vårt eget tänkande till AI. Han berättar om när han frågade en LLM vad han skulle ha på sig en 18-gradersdag i San Francisco - i en stad han bott i i sju år. "Jag vet hur man hanterar vädret. Och ändå kändes det enklare att överlåta det rådet till en LLM."

Att det är ett konstprojekt - och inte en startup - skriver han rakt ut på sajten. "Arkitekturen" presenteras med formuleringar som "human-grounded inference" och "zero-synthetic generation", modellen har en "concurrency ceiling" på n=1 och är "pre-revenue by strategic design". Premium-tjänsten ChatTJB Pro kostar 5 dollar i månaden och beskrivs som "en värdelös nivå" - ungefär fyra personer har betalat. Bryant vibekodade sajten med verktyget Lovable och är noga med att han inte är emot AI; det han vill är att folk ska ta en extra titt på sitt eget förhållande till tekniken. Själv kallar han ChatTJB för "the worst LLM of all time".

Kort klipp där Bryant själv beskriver projektet som "the worst LLM of all time".

Intresset har tvingat fram en uppskalning: över 3 000 personer har ansökt om att bli frivilliga "average individuals" och tio valdes ut - fortfarande med svarstider som mäts i dygn snarare än sekunder. En grupp gick för övrigt inte på det lika lätt: gen Z, uppvuxna med AI-hype och AI-skepticism samtidigt, lät sig inte imponeras av stämpeln.

Varför det är intressant för oss

ChatTJB fungerar som ett användartest i naturlig miljö av något vi ägnar mycket tid åt i vårt arbete: förtroende är till stor del en UX-fråga. Tusentals människor tog handskrivna, medvetet medelmåttiga svar på allvar för att gränssnittet såg ut som en AI-produkt - precis som en polerad app kan få en tveksam lösning att kännas trygg i företagsmiljö. Lärdomen är dubbel: vi som bygger produkter måste vara medvetna om hur mycket förtroende själva ramverket skapar - och inte missbruka det. Samtidigt är användarens kritiska tänkande det enda skyddsnät som aldrig kan byggas bort.

2. Anthropics osynliga vattenmärkning - så ska AI-text gå att känna igen

Från en människa som låtsas vara AI till en AI som ska kunna avslöjas som AI. Den 14 augusti förklarade Anthropic hur Claude framöver vattenmärks. Utrullningen har redan börjat - sedan den 2 augusti kräver EU:s AI-förordning att leverantörer som riktar sig mot EU-marknaden märker AI-genererat innehåll - men alla modeller stödjer det inte ännu: äldre modeller omfattas av en övergångsperiod och vattenmärks under de kommande månaderna.

Metoden är SynthID-Text, ursprungligen publicerad av Google DeepMind 2024. Vattenmärket gömmer sig i själva ordvalsprocessen: när modellen skriver en mening finns det ofta flera ord som fungerar lika bra - "mulet" eller "grått" - och valet avgörs av en slumptalsgenerator. I en vattenmärkt modell styrs slumpen i stället av en hemlig nyckel tillsammans med de föregående orden. För läsaren är skillnaden osynlig, men den som har nyckeln kan i efterhand räkna ut sannolikheten att en given text har passerat Claude.

Det finns inga dolda tecken, inga extra tokens, ingen prispåverkan och enligt Anthropic ingen mätbar kvalitetsskillnad. Vattenmärket bär heller ingen information om vem som ställt frågan - det går inte att spåra till en person eller organisation. Anthropic tillämpar märkningen globalt eftersom man ännu inte har ett hållbart sätt att avgränsa den regionalt, och ett API för att kontrollera texter är på väg.

Men det är värt att förstå vad vattenmärket faktiskt bevisar. Det svarar bara på frågan "hur sannolikt är det att Claude varit inblandad i den här texten?" - inte att texten är människoskriven, och inte om den kommer från ett annat AI-system. På korta texter, faktapassager och kod blir märket tunt, eftersom det där finns färre "valfria" ord - modellen kan inte nudda formuleringar där exakthet krävs. På översättningar är det däremot starkt, eftersom varje ord då väljs av modellen. En fullständig omskrivning för hand kan också radera vattenmärket - men då är texten knappast längre AI-genererad.

För filer och bilder används en annan metod: C2PA-standarden, där en kryptografiskt signerad etikett skrivs in i filens metadata. Bakgrunden är EU:s Code of Practice för transparens av AI-genererat innehåll, som ungefär 190 aktörer - däribland flera andra stora AI-leverantörer - skrivit under i juli.

Varför det är intressant för oss

De två nyheterna den här veckan är i praktiken komplement. ChatTJB visar hur lätt vi litar på ett skal, och vattenmärkningen är ett tekniskt verktyg för att återupprätta det förtroendet - om än med tydliga gränser. För oss som bygger AI-funktioner i appar är poängen konkret: transparens går inte att klistra på i efterhand, vare sig det handlar om att vara tydlig mot användaren kring vad som är AI-genererat eller att designa gränssnitt som hjälper människor värdera information kritiskt. Ett vattenmärke - synligt eller osynligt - ersätter aldrig människans eget omdöme. Precis som en AI-etikett aldrig gjorde det för ChatTJB:s användare.

Vi ses nästa vecka

En konstnär som bevisar att vi litar på skalet, och ett AI-lab som ger oss verktyg att se förbi det. Den röda tråden: vem - och vad - vi väljer att lita på. Har ni sett något vi borde ha med nästa vecka? Hör av er, vi är alltid nyfikna.

Läs vidare

Vill ni diskutera detta?

Kontakta oss för en förutsättningslös diskussion om hur vi kan hjälpa er med er digitala satsning.

Kontakta oss