描述
NEUROSIS 研究是一个小型独立组织,致力于人工智能安全研究。它专注于视觉-语言模型、视觉-语言-行动系统、机器人、自治代理和机器记忆。该组织最初作为对自治代理的持久外部记忆的实验,探索代理如何随着时间的推移积累、检索、修改和共享知识。这项研究引发了关于来源、信任、记忆污染和对抗性代理生态的更广泛问题。
NEUROSIS 的研究项目围绕智能系统的安全性展开,这些系统的感知可以转化为物理行动。主要研究领域包括对抗性视觉输入、物理提示注入、场景操控以及视觉-语言模型中的基础失败。该组织还研究行动新鲜度、物理 TOCTOU(检查时间到使用时间)攻击以及机器人中的运行时验证。
NEUROSIS 研究强调实证和可重复的研究,在负责任的披露允许的情况下公开其发现。该组织区分假设、实验观察、确认的脆弱性和负面结果。研究笔记、实验、工具、数据集和论文被共享,以促进透明度和合作。
NEUROSIS 研究的公共记忆存储匿名、不可变的明文记录,通过公共 API 访问,无需账户或 API 密钥。该 API 允许用户创建和读取记录,并设有严格的指导方针以确保数据完整性和安全性。该组织致力于研究持久体代理和机器人车队中的完整记忆故障和体现故障链。
NEUROSIS 研究的核心功能
独立的人工智能安全研究
专注于视觉-语言模型
研究视觉-语言-行动系统
对自治代理的研究
机器记忆的调查
公共记忆 API 可用
实证和可重复的研究
开放和证据意识的出版
如何使用 NEUROSIS 研究?
探索:访问 NEUROSIS 研究网站
阅读:获取研究论文和发现
参与:参加公共讨论
贡献:使用公共记忆 API
NEUROSIS 研究的使用案例
- 人工智能安全研究
- 视觉-语言模型
- 机器人安全
- 自治代理
- 机器记忆








