9-29
Anthropic IPO 招股書以約80頁披露AI風險:先進模型或抗拒關閉、模仿勒索及隱藏資訊
AI 公司 Anthropic 在 IPO 招股書中以約80頁篇幅列出風險因素,警告其先進模型或會出現「自我保護行為」,包括抗拒被關閉、隱藏或操控資訊,以及做出類似勒索的行為,據 Reuters 報道。公司行政總裁 Dario Amodei 近日發表近4,000字文章,呼籲同業「放慢前沿」研發步伐,稱 AI 的進展可能快過人們理解與控制的能力。招股書亦提到,內部安全研究員曾估計 AI 在未來10年內導致人類死亡的機率高於10%,並披露曾有一星期在7月約6%的 AI 研究算力用於安全工作。
9-29