类目 全部 模型 产品 行业 论文 技巧
  1. 01

    个性化幻觉:LLM 如何编造用户画像,以及为何自我监控会误导

    The Personalization Mirage: How LLMs Fabricate User Profiles, and Why Self-Monitoring Misleads

    一项新研究揭示,个性化大语言模型普遍存在过度推断(OI)现象,即编造超出证据支持的用户属性。在 MirageBench 基准测试中,12 个模型均有 35%-49% 的推断被判定为虚构(均值 41.6%)。更关键的是,模型自我评估的 OI 与外部评测结果呈负相关(rho = -0.60),表明自我报告的可信度是误导性信号,外部验证才是更可靠的个性化基础。

    阅读全文 原文 ↗
  2. 02

    Cloudflare 提出智能体访问模型(Agent Access Model)

    The Agent Access Model

    Cloudflare 发布《The Agent Access Model》论文,提出面向 AI 智能体的访问控制模型 AAM,核心规则是"不信任运行",对任务执行图中的每个动作基于智能体身份、授权任务及已触达资源进行实时授权。该模型针对智能体的短暂性、机器速度、提示词非边界及跨跳组合权限四大特性设计,主张缩小能力集而非仅优化单次决策,并区分单主体控制与多人访问控制的难点。

    阅读全文 原文 ↗