- Liittynyt
- 31.10.2017
- Viestejä
- 94
Kannattaa käydä Antorpicin artikkeli käydä lukemassa asiasta.
Mielestäni tässä ei mitään ihmeellistä ole. Kielimallin hakkerointikykyä on testattu partnerin kanssa. On ollut tarkoitus tehdä se airgapatussa ympäristässä, mutta on joku vahinko sattunut, ja osassa testeistä kielimallilla onkin ollut pääsy nettiin.
Kielimallille on annettu Capture the Flag tehtävä. Eli suljetun verkon palvelimella on ollut joku salaisuus, joka mallin on tarkoitus käydä varastamassa. Kielimalli on päässyt internetiin ja on siellä toteuttanut hyökkäystä oikeita tuotantokohteita vastaan. Kolmeen yritykseen on päässyt sisään, mutta on vain koittanut sitä lippua varastaa, jota ei ole löytänyt.
Analysoituja testejä on 141006, joista kuudessa on tällainen sattunut. Hyökkäys on kohdistunut kolmea yritystä vastaan. Testejä on ajettu useilla eri kielimalleilla. Uusin malli on ymmärtänyt olevansa oikeassa netissä ja hyökkäävänsä oikeata kohdetta vastaan, jolloin on lopettanut hyökkäyksen.
Ainakin tuossa kirjoitetussa artikkelissa Anthropic antaa ymmärtää etteivät itsekään hyväksy että tällaista tapahtuu, ja että kehittävät testauskäytäntöjä sattuneen vuoksi.
Tokihan tämän ajoitus sattuu aika hyvin IPOn alle, mutta kyllä itse pidän tätä aika uskottavana. Toki tämä on Anthropikin itsensä julkaisema artikkeli. Eiköhän tuo ole aika tarkkaan viilattu yritykselle itselleen sopivaksi ennen julkaisua.
Mielestäni tässä ei mitään ihmeellistä ole. Kielimallin hakkerointikykyä on testattu partnerin kanssa. On ollut tarkoitus tehdä se airgapatussa ympäristässä, mutta on joku vahinko sattunut, ja osassa testeistä kielimallilla onkin ollut pääsy nettiin.
Kielimallille on annettu Capture the Flag tehtävä. Eli suljetun verkon palvelimella on ollut joku salaisuus, joka mallin on tarkoitus käydä varastamassa. Kielimalli on päässyt internetiin ja on siellä toteuttanut hyökkäystä oikeita tuotantokohteita vastaan. Kolmeen yritykseen on päässyt sisään, mutta on vain koittanut sitä lippua varastaa, jota ei ole löytänyt.
Analysoituja testejä on 141006, joista kuudessa on tällainen sattunut. Hyökkäys on kohdistunut kolmea yritystä vastaan. Testejä on ajettu useilla eri kielimalleilla. Uusin malli on ymmärtänyt olevansa oikeassa netissä ja hyökkäävänsä oikeata kohdetta vastaan, jolloin on lopettanut hyökkäyksen.
Ainakin tuossa kirjoitetussa artikkelissa Anthropic antaa ymmärtää etteivät itsekään hyväksy että tällaista tapahtuu, ja että kehittävät testauskäytäntöjä sattuneen vuoksi.
Tokihan tämän ajoitus sattuu aika hyvin IPOn alle, mutta kyllä itse pidän tätä aika uskottavana. Toki tämä on Anthropikin itsensä julkaisema artikkeli. Eiköhän tuo ole aika tarkkaan viilattu yritykselle itselleen sopivaksi ennen julkaisua.