GPTProto

How We Built Safety Into Muse

Meta AI:Research Blog(网页)·Sep 8, 2026, 8:00 AM·Meta / Llama

Meta 发布个人智能体 Muse,运行在用户专属的 Muse Secure VM 中,并公开其安全设计。系统默认假设智能体可能被攻击:运行环境用 systemd-nspawn 隔离,Sentinel 作为唯一权限机构审批所有连接器操作和网络出站,代理令牌机制确保模型看不到真实凭证,配合提示注入检测分类器和内核级 taint tracking。