Anthropic 曾警告其自身技術可能導致文明終結,而其最新的職位列表揭示了他們如何應對此風險。該公司目前有 32 個職位空缺,專門設計來防止人們利用 AI 製造從人造炸藥到核武器等各種危險物品。

Anthropic 正在招募專注於化學品與炸藥、核武器、金融詐騙、網路犯罪等領域的分析師。其中一份職位描述寫道:「作為一名專注於放射性與核危害的執法分析師,您將在保護 AI 系統免受放射性與核危害濫用方面發揮關鍵作用。」這些職位的薪資範圍在中高階的 20 萬美元。

Anthropic 發言人表示:「確保我們的模型不提供潛在有害資訊,是負責任開發的核心。」「這就是為什麼我們定期聘請各敏感領域的專家,這些人了解這些危害以及 AI 如何助長它們,來對我們的系統進行壓力測試,並在模型上線前加強防禦。」發言人補充說,職位描述和標題的具體性旨在明確指出確切的危害,這對於招募合適的候選人至關重要。

相較於其他 AI 實驗室,Anthropic 因其過於「末日論」的觀點而受到批評。然而,該公司正投入資金,證明其相信 AI 潛在的負面影響是真實存在的。

執行長 Dario Amodei 長期以來一直警告惡意行為者可能如何利用 AI 造成危害。他在一月份的一篇文章中,將生物攻擊列為眾多情境中最令人擔憂的。Amodei 寫道:「我不認為生物攻擊會在其廣泛可行時立即發生,事實上,我會賭它不會。」「但如果累積數百萬人並經過數年時間,我認為發生重大攻擊的風險很高,傷亡人數可能達到數百萬甚至更多。」

今年稍早,Anthropic 曾因其技術可能被用於大規模監控和自主武器而與美國國防部產生分歧。隨著 AI 模型變得越來越強大,各 AI 實驗室正積極尋求加強其安全團隊。

例如,OpenAI 正在招募一名專門研究生物和化學風險的研究員,年薪介於 29.5 萬至 44.5 萬美元。Anthropic 表示,其安全分析師職位要求能夠像試圖規避檢測的人一樣思考,並補充說他們僱用了數百名專注於安全的人員。他們會相應地對模型進行壓力測試,修復漏洞。

這些工作不僅需要後端編碼能力,還需要人們具備真實世界的專業知識,無論是生物學、炸藥或其他危險領域。最重要的是,人才正湧向私營部門而非政府。

這加上缺乏連貫的監管機制,意味著 AI 公司正在主導為日益強大的人工智慧實施防護措施。