1
Нов метод покажува што се случува во „умовите“ на моделите за вештачка интелигенција
Anthropic разви нова техника со која истражувачите можат да следат дел од скриените процеси во Claude. Методот открива концепти што моделот ги користи при размислување, иако тие никогаш не се појавуваат во неговиот одговор. Големите јазични модели долго време се однесуваат како црни кутии. Го гледаме прашањето што им го поставуваме и го гледаме одговорот […]