
Anthropic rado langą į DI mintis: mato sukčiavimą, bet sąmonės čia nėra
Anthropic mokslininkai atrado būdą stebėti kalbos modelio viduje besiformuojančius žodžius, kurie niekada nepasiekia galutinio atsakymo, bet išduoda ketinimą sukčiauti ar pateikti šališką išvadą.

