Klod sme da nađe propust, ali da piše exploit može samo za određene korisnike iz Amerike
Anthropic je 1. septembra objavio Fable 5.1 i Mythos 5.1, i tom prilikom ponovo povukao granice onoga što modeli smeju da rade u bezbednosnim okvirima. Fable, koji je dostupan svima, sada sme da traži propuste u softveru, ali ne i da piše alat kojim se oni iskorišćavaju (exploit). Mythos nema to ograničenje, ali njega dobijaju samo proverene organizacije iz Sjedinjenih Država, bilo da je reč o braniocima računarskih mreža ili o istraživačima u biologiji. Vredi se podsetiti kako je do ovoga došlo. Fable 5 je izašao 10. juna, a već sutradan je neko probio njegov bezbednosni filter, o čemu smo pisali. Pošto su istraživači iz Amazona pokazali kako se filter zaobilazi, američko ministarstvo trgovine je naložilo da se pristup zabrani stranim državljanima, pa su oba modela bila ugašena 19 dana i vratila se na tržište tek 30. juna. Uz nova izdanja sada stižu i blaže kočnice: bezbednosni filter se u Claude Code-u pali oko 60 odsto ređe nego pre, a onaj za biologiju čak 85 odsto ređe na običnim medicinskim pitanjima. Sve što model napiše od sada nosi statistički vodeni žig, nevidljiv u tekstu, uveden zbog obaveza iz evropskog zakona o veštačkoj inteligenciji. Alat kojim se taj žig prepoznaje još nije javan, nego je u zatvorenom probnom radu za regulatore, istraživače i proveravače činjenica. Cena tokena je ostala ista, ali je čitanje iz keša pojeftinilo sa jednog dolara na 25 centi po milionu tokena, pa tipičan posao ispada za oko četvrtinu jeftiniji.