
Techspaningar v.34 - ChatTJB, "AI-chatten" som visade sig vara en enda konstnär, och Anthropics osynliga vattenmärkning
Är du säker på att du pratar med en AI? Den frågan borde tusentals människor i San Francisco ha ställt sig de senaste veckorna. Den här veckan handlar våra två spaningar om samma sak fast från varsitt håll: hur vi avgör vad som är AI-genererat - och hur lätt vi litar på något bara för att det ser ut som AI.
1. ChatTJB - AI-chatten som egentligen är en enda trött konstnär
I korsningen Sixth and Folsom i San Franciscos SoMa-kvarter sitter en 14 gånger 48 fot stor reklamskylt som utlovar "the leading chat interface powered by AI" - följt av en asterisk. Läser man det finstilta står det "average individual". Asterisken skyms dock delvis av ett träd, något Bryant själv beskriver som ett lyckokast: skämtet är gömt precis där man inte tittar.

Bakom skylten står Tucker Bryant, en 32-årig konceptkonstnär, föredragshållare och tidigare anställd på Google. För 6 000 dollar - en bråkdel av de 150 000 dollar i månaden som skyltarna över Highway 101 kostar - hyrde han platsen i en månad. Sajten chattjb.org lanserades redan i april, men det var när skylten kom upp den 27 juli som det exploderade.
Allt besvaras för hand. ChatTJB:s "bildgenerering" består av att Bryant ritar svaren själv - de senaste dagarna har han bland annat ritat en groda som äter spaghetti och San Franciscos borgmästare David Lurie som Godzilla. Frågorna spänner från det triviala till det personliga: vad man ska äta till middag med ingredienserna man har hemma ("jag skulle lägga korven i salladen och blanda den med linser, för jag är en riktigt dålig kock"), vad man ska döpa sin krukväxt till ("kanske något som antyder att den kommer finnas med dig för evigt, som 'immortalus' eller 'laktosintolerans'") och våffelrecept - som han svarar på ur minnet, "förmodligen fel".
Trafiken växte i trappsteg: 50-100 frågor om dagen de första 48 timmarna, runt 1 000 om dagen efter tre dagar - och efter ett viralt Instagram-inlägg slog floden in med upp till 5 000 frågor i timmen. Bryant stängde sajten tillfälligt, dels för att hinna ikapp, dels för att bygga in stöd för användare med allvarligare frågor. Han svarade till klockan ett på natten och började igen klockan fyra. Totalt har ChatTJB tagit emot över 30 000 frågor.
Idén är i grunden: tänk om jag skapade något som ser ut som en LLM, men där upplevelsen bara är riktigt medelmåttig - riktigt genomsnittlig. Så att nästa gång någon pratar med en annan AI-produkt, är de lite mer benägna att ta det de får lite mindre på allvar, och inte bara lita på det för att det ser coolt ut.
Bakgrunden är ett begrepp Bryant fastnat för: "cognitive surrender" - att vi lämnar över allt mer av vårt eget tänkande till AI. Han berättar om när han frågade en LLM vad han skulle ha på sig en 18-gradersdag i San Francisco - i en stad han bott i i sju år. "Jag vet hur man hanterar vädret. Och ändå kändes det enklare att överlåta det rådet till en LLM."
Att det är ett konstprojekt - och inte en startup - skriver han rakt ut på sajten. "Arkitekturen" presenteras med formuleringar som "human-grounded inference" och "zero-synthetic generation", modellen har en "concurrency ceiling" på n=1 och är "pre-revenue by strategic design". Premium-tjänsten ChatTJB Pro kostar 5 dollar i månaden och beskrivs som "en värdelös nivå" - ungefär fyra personer har betalat. Bryant vibekodade sajten med verktyget Lovable och är noga med att han inte är emot AI; det han vill är att folk ska ta en extra titt på sitt eget förhållande till tekniken. Själv kallar han ChatTJB för "the worst LLM of all time".
Intresset har tvingat fram en uppskalning: över 3 000 personer har ansökt om att bli frivilliga "average individuals" och tio valdes ut - fortfarande med svarstider som mäts i dygn snarare än sekunder. En grupp gick för övrigt inte på det lika lätt: gen Z, uppvuxna med AI-hype och AI-skepticism samtidigt, lät sig inte imponeras av stämpeln.
ChatTJB fungerar som ett användartest i naturlig miljö av något vi ägnar mycket tid åt i vårt arbete: förtroende är till stor del en UX-fråga. Tusentals människor tog handskrivna, medvetet medelmåttiga svar på allvar för att gränssnittet såg ut som en AI-produkt - precis som en polerad app kan få en tveksam lösning att kännas trygg i företagsmiljö. Lärdomen är dubbel: vi som bygger produkter måste vara medvetna om hur mycket förtroende själva ramverket skapar - och inte missbruka det. Samtidigt är användarens kritiska tänkande det enda skyddsnät som aldrig kan byggas bort.
2. Anthropics osynliga vattenmärkning - så ska AI-text gå att känna igen
Från en människa som låtsas vara AI till en AI som ska kunna avslöjas som AI. Den 14 augusti förklarade Anthropic hur Claude framöver vattenmärks. Utrullningen har redan börjat - sedan den 2 augusti kräver EU:s AI-förordning att leverantörer som riktar sig mot EU-marknaden märker AI-genererat innehåll - men alla modeller stödjer det inte ännu: äldre modeller omfattas av en övergångsperiod och vattenmärks under de kommande månaderna.
Metoden är SynthID-Text, ursprungligen publicerad av Google DeepMind 2024. Vattenmärket gömmer sig i själva ordvalsprocessen: när modellen skriver en mening finns det ofta flera ord som fungerar lika bra - "mulet" eller "grått" - och valet avgörs av en slumptalsgenerator. I en vattenmärkt modell styrs slumpen i stället av en hemlig nyckel tillsammans med de föregående orden. För läsaren är skillnaden osynlig, men den som har nyckeln kan i efterhand räkna ut sannolikheten att en given text har passerat Claude.
Det finns inga dolda tecken, inga extra tokens, ingen prispåverkan och enligt Anthropic ingen mätbar kvalitetsskillnad. Vattenmärket bär heller ingen information om vem som ställt frågan - det går inte att spåra till en person eller organisation. Anthropic tillämpar märkningen globalt eftersom man ännu inte har ett hållbart sätt att avgränsa den regionalt, och ett API för att kontrollera texter är på väg.
Men det är värt att förstå vad vattenmärket faktiskt bevisar. Det svarar bara på frågan "hur sannolikt är det att Claude varit inblandad i den här texten?" - inte att texten är människoskriven, och inte om den kommer från ett annat AI-system. På korta texter, faktapassager och kod blir märket tunt, eftersom det där finns färre "valfria" ord - modellen kan inte nudda formuleringar där exakthet krävs. På översättningar är det däremot starkt, eftersom varje ord då väljs av modellen. En fullständig omskrivning för hand kan också radera vattenmärket - men då är texten knappast längre AI-genererad.
För filer och bilder används en annan metod: C2PA-standarden, där en kryptografiskt signerad etikett skrivs in i filens metadata. Bakgrunden är EU:s Code of Practice för transparens av AI-genererat innehåll, som ungefär 190 aktörer - däribland flera andra stora AI-leverantörer - skrivit under i juli.
De två nyheterna den här veckan är i praktiken komplement. ChatTJB visar hur lätt vi litar på ett skal, och vattenmärkningen är ett tekniskt verktyg för att återupprätta det förtroendet - om än med tydliga gränser. För oss som bygger AI-funktioner i appar är poängen konkret: transparens går inte att klistra på i efterhand, vare sig det handlar om att vara tydlig mot användaren kring vad som är AI-genererat eller att designa gränssnitt som hjälper människor värdera information kritiskt. Ett vattenmärke - synligt eller osynligt - ersätter aldrig människans eget omdöme. Precis som en AI-etikett aldrig gjorde det för ChatTJB:s användare.
Vi ses nästa vecka
En konstnär som bevisar att vi litar på skalet, och ett AI-lab som ger oss verktyg att se förbi det. Den röda tråden: vem - och vad - vi väljer att lita på. Har ni sett något vi borde ha med nästa vecka? Hör av er, vi är alltid nyfikna.
Läs mer om hur vi arbetar

Techspaningar v.24 - Gabi, robotmunken som svor klosterlöften i Seoul, och Anthropic som vill att världen ska kunna "pausa" AI
I ett buddhisttempel i Seoul tog en humanoid robot vid namn Gabi emot klosterlöften - däribland att spara energi och behandla andra robotar fredligt. Samtidigt föreslår Anthropic att världen borde ha möjligheten att tillfälligt pausa AI-utvecklingen, vilket utlöste en högljudd debatt. Välkommen till veckans techspaningar.
Läs mer
Techspaningar v.33 - Googles översättare körs helt offline på en Raspberry Pi, och AI skapar virus för första gången
Google visar att en fullvärdig språkmodell kan köra helt offline på en Raspberry Pi och översätta tal i realtid. Samtidigt har forskare vid Arc Institute och Stanford använt generativ AI för att designa fungerande virus från grunden, vilket startat en het säkerhetsdebatt. Välkommen till veckans techspaningar.
Läs mer
Techspaningar v.25 - SpaceX börsdebuterar och skapar världens första triljonär, och Anthropic tvingas dra tillbaka Fable 5 och Mythos 5
SpaceX gjorde sin entré på Nasdaq och rusade 19% på debuten - värderingen passerade två biljoner dollar, ungefär 4 400 anställda blev miljonärer och Elon Musk blev officiellt världens första dollar-triljonär. Samma vecka tvingades Anthropic abrupt stänga av Fable 5 och Mythos 5 efter ett exportkontrolldirektiv från USA:s regering. Välkommen till veckans techspaningar.
Läs merVill ni diskutera detta?
Kontakta oss för en förutsättningslös diskussion om hur vi kan hjälpa er med er digitala satsning.
Kontakta oss