扎克伯格:實驗室有激勵推進對齊,Meta 推遲 Muse 聚焦安全
ChainCatcher 消息,扎克伯格發文稱,每個實驗室都有責任和激勵以所需速度安全訓練模型,並有能力自行採取行動。人們不會使用與自己不對齊、不按要求行事的智能體,實驗室因此有強烈自然激勵提升模型對齊。信任和對齊正迅速成為區分智能體與模型的最重要能力,任何不聚焦對齊的實驗室都將落後。
扎克伯格表示,實驗室若模型造成傷害將面臨重大責任,因此也有強烈激勵加以防範。Meta 將 Muse 推遲數月發布以聚焦安全和安保,並未要求其他實驗室先行效仿,只是將其作為日常工作的部分。聘請獨立評估者和顧問是行業最佳實踐,MSL 已在多個領域這樣做。將大部分算力用於服務人們而非競相遞歸自我改進,是確保安全開發該技術的最佳方式之一,Meta 已作出這一承諾。






