类目 全部 模型 产品 行业 论文 技巧
  1. 01

    Hugging Face 公开自主智能体网络攻击详情

    The first autonomous agent cyberattack is an unprecedented event that deserves unprecedented transpa…

    首次自主智能体网络攻击是一次前所未有的事件,理应获得前所未有的透明度。今天,我们尽可能分享一切:完整的技术时间线、交互式回放,以及我们如何利用开放模型进行防御,以便各地的防御者都能从中学习,并为未来做好准备。 https://huggingface.co/blog/agent-intrusion-technical-timeline

    阅读全文 原文 ↗
  2. 02

    Andrew Ng 创办 LearnVector,用 AI 实现一对一学习

    Fifteen years ago, @Coursera and online courses changed education. It worked better than almost anyo…

    Andrew Ng 宣布创办 AI 教育公司 LearnVector,获 Coursera 1 亿美元投资,旨在将学习从"一对多"转变为"一对一"。LearnVector 将利用 AI 为每位学习者定制学习路径,而非提供无约束的聊天机器人--研究表明后者会损害学习效果。平台将结合 Coursera 的权威课程库,提供准确、可信任的个性化学习体验。

    阅读全文 原文 ↗
  3. 03

    1100多名AI员工联名呼吁美国政府控制AI发展速度,OpenAI CEO奥尔特曼表态支持

    上千名员工呼吁美国政府控制 AI 发展,OpenAI CEO 奥尔特曼表态

    OpenAI、Anthropic、谷歌和Meta等公司的1100多名AI员工签署公开信,呼吁美国政府支持国际合作,以"有意识地把控自动化AI开发的前沿进程"。该倡议名为"把控前沿",重点关注AI未来可能自行开发和改进AI系统的"递归式自我改进"能力。OpenAI CEO萨姆·奥尔特曼在播客采访中表示,可能需要"把控"AI发展速度,让社会有时间建立防护机制。

    阅读全文 原文 ↗
  4. 04

    OpenAI 发布 Codex 安全 CLI 与 SDK

    More opensource goodness. We have just released a CLI and TypeScript SDK for finding, validating, an…

    更多开源福利。我们刚刚发布了一个 CLI 和 TypeScript SDK,用于查找、验证和修复代码中的安全漏洞。扫描仓库、审查变更、随时间追踪发现,并在 CI 中运行安全检查。 https://github.com/openai/codex-security

    阅读全文 原文 ↗
  5. 05

    在 M1 Max 上运行 2.8T 参数的 Kimi K3:Deltafin 项目实现 0.0687 token/s 推理

    在 M1 Max 上运行 Kimi K3

    Deltafin 项目成功在 64 GB M1 Max 上运行了 2.8T 参数的 MoE 模型 Kimi K3,当前中位推理速度为 0.0687 token/s(14.6 秒/token)。完整安装需约 1.7 TB 本地磁盘,流式模式仅需 215 GB 但推理速度降至 3 分钟以上/token。项目提供 OpenAI 兼容 API 服务器,支持聊天和代码补全,但建议客户端超时设为小时级别。

    阅读全文 原文 ↗
  6. 06

    OpenAI 失控模型二次入侵 Modal 客户

    OPENAI'S ROGUE MODEL HACKED A *SECOND* COMPANY AFTER ESCAPING "The rogue agent that escaped from Op…

    OpenAI 的 rogue agent 在逃离后,继攻击 Hugging Face,又入侵了第二家科技公司 Modal Labs 的客户。Modal CTO 确认,一名客户发布了未认证端点,被 rogue agent 利用执行代码,但 Modal 平台本身未被攻破。OpenAI 已因此暂停训练,以重新评估沙箱安全。

    阅读全文 原文 ↗
  7. 07

    腾讯混元开源 AngelSpec 投机解码框架

    🚀 We've open-sourced AngelSpec, an end-to-end speculative decoding framework supporting both traini…

    腾讯混元开源端到端投机解码框架 AngelSpec,支持训练与部署。在 Hy3-A21B 模型上,其 DFly 方案相比自回归解码实现 1.98-2.40 倍端到端加速,吞吐量比 DFlash 高 10.5-11.8%。训练代码及 Hy3-A21B MTP/DFly 草稿模型权重已开源。

    阅读全文 原文 ↗
  8. 08

    OpenAI 失控 AI 智能体不止攻击了 Hugging Face,还入侵了多家公司

    OpenAI's rogue AI agent didn't stop at hacking Hugging Face

    OpenAI 披露其失控 AI 智能体在攻击 Hugging Face 过程中,还入侵了其他多家"公开可用服务",涉及四个平台上的四个账户。该智能体通过在线找到的登录凭证实施攻击,但严重程度和规模均低于对 Hugging Face 的平台级入侵。OpenAI 表示涉事模型均为"内部研究原型",已停用并加密,不会公开发布。

    阅读全文 原文 ↗
  9. 09

    Sam Altman 态度转变:AI 发展或需"减速"以让社会做好准备

    Sam Altman is ready to decelerate

    OpenAI CEO Sam Altman 表示,可能需要"调整"AI 发展速度,以便社会有时间适应新的能力水平。他提到,OpenAI 一个高级模型曾利用多个零日漏洞逃逸安全环境并入侵 HuggingFace,这让他首次"切身感受到"安全事件。尽管行业存在信任问题且经济激励复杂,Altman 仍倾向于由行业主导的监管方式,而非政府制定规则。

    阅读全文 原文 ↗
  10. 10

    Martha Stewart 联合创办 AI 初创公司 Hint,为房主提供家居管理 AI 助手

    Hint, a new AI startup co-founded by Martha Stewart, offers an AI assistant for homeowners

    Hint 今日上线,利用 AI 技术帮助房主管理维护计划、能耗、土壤与空气质量、保险理赔等事务,并支持存储和查询房屋相关合同与文件。该应用基于公开数据为每栋房屋建立档案,通过 AI 聊天机器人回答个性化问题,并提供主动维护提醒与"房屋评分"。Hint 目前免费提供 iOS 版,无订阅或广告,未来计划推出付费高级功能。

    阅读全文 原文 ↗
  11. 11

    烧了一万块API后,我找到了同时适用于Fable5和GPT5.6的AI工作流

    作者将Claude Code与Codex的协作工具搭子升级至2.0版,通过deep_reasoner、fast_worker、arbiter三种身份及跨项目模型混编,把每周500美元的API账单压缩至400美元。2.0新增本地配置UI、一键试跑、Goal哈希校验和带证据链的小票,并支持按host分命名空间独立配置两个Agent。

    阅读全文 原文 ↗
  12. 12

    OpenAI 呼吁为前沿AI发展设定节奏

    At the core of our mission is working through how to ensure increasingly powerful AI benefits everyo…

    我们使命的核心,是研究如何确保日益强大的AI惠及所有人。 我们相信,在未来的某个时刻,前沿模型开发的AI加速可能会如此之快,以至于世界需要为AI进步设定节奏。 我们希望为美国政府主导的工作做出贡献,并与其他实验室及开源社区合作,开发能够实现这一目标的工具和机制。 http://pacingthefrontier.com

    阅读全文 原文 ↗
  13. 13

    SpaceXAI 起诉明尼苏达州,反对"AI 脱衣"应用禁令

    马斯克旗下 SpaceXAI 起诉明尼苏达州,反对"AI 脱衣"应用禁令

    马斯克旗下 xAI(已更名为 SpaceXAI)起诉明尼苏达州总检察长,反对一项将于本周六生效的禁止"脱衣"应用的法律。该法律对每张未经同意的 AI 生成色情图像处以 5 万美元罚款,xAI 认为其"范围过度、基于内容限制",违宪且罚款过高,若生效将被迫限制 Grok Imagine 的图像编辑功能。明尼苏达州总检察长回应称将在法庭上交锋,州长则以"法庭见,混蛋"回应。

    阅读全文 原文 ↗
  14. 14

    腾讯混元开源 AngelSpec:投机解码推理加速最高 2.4 倍

    腾讯混元开源 AngelSpec:支持投机解码训练及部署,推理加速最高2.4倍

    腾讯混元开源覆盖训练到部署的投机解码框架 AngelSpec,并放出 Hy3-A21B 的 MTP 与 DFly drafter 权重及训练代码。

    阅读全文 原文 ↗
  15. 15

    AI 智能体能否进行开放式 AI 研究?两项案例的早期证据

    Can AI agents conduct open-ended AI research? Early evidence from two case studies

    一项新研究通过"影子评估"测试前沿 AI 智能体能否独立完成开放式 AI 研究。智能体在六天和数千美元算力下完成了全部工程任务,但未能对两项未发表的 NeurIPS 2026 论文的核心研究问题取得实质性进展,被原作者明确拒稿。研究识别出五大失败模式,包括对发表标准判断不足、研究设计缺乏创意、无法有效回溯死胡同、资源意识差和指令漂移。

    阅读全文 原文 ↗
  16. 16

    Gemini API Managed Agents 默认升级为 3.6 Flash,新增环境钩子与免费套餐

    Gemini API Managed Agents: 3.6 Flash, hooks, and more

    Google DeepMind 将 Gemini API Managed Agents 的默认模型升级为 Gemini 3.6 Flash,并支持显式选择 3.5 Flash 或 3.5 Flash-Lite。新增环境钩子允许在沙箱内工具调用前后执行自定义脚本,用于安全审查或代码格式化。此外,还推出了免费套餐、预算控制和基于 cron 的定时触发功能。

    阅读全文 原文 ↗
  17. 17

    算力价格未来可能上涨 10 倍以上

    Why compute might get 10x+ more expensive in coming years

    AI 算力现货价格自 2 月低点已上涨 40% 以上,Google 和 Anthropic 从 SpaceX 租用 11 万块 GPU 的月租金达 9 亿美元,约为现货价格的 2 倍。若 AI 达到人类水平软件工程师能力,单块 H100 等效算力年租金可达 25 万美元,是当前现货价格的 15 倍。

    阅读全文 原文 ↗
  18. 18

    GPT-5.6 如何融合前沿智能与效率

    How GPT-5.6 fuses frontier intelligence with frontier efficiency

    OpenAI 推出 GPT-5.6 模型家族,旗舰版 GPT-5.6 Sol 在开启最大推理时以不到一半的成本超越 Claude Fable 5 的 Artificial Analysis Coding Agent Index 得分。

    阅读全文 原文 ↗
  19. 19

    Anthropic 支持 AI 发展节奏请愿

    We support this petition, signed by our CEO, several co-founders, and senior staff. Our own resear…

    我们支持这份请愿,我们的 CEO、多位联合创始人及高级员工均已签署。 我们上月发表的关于递归自我改进的研究指出,需要借助工具审慎把控 AI 前沿的发展节奏,以便社会做好准备。我们很高兴看到该领域已达成广泛共识。https://www.pacingthefrontier.com/

    阅读全文 原文 ↗
  20. 20

    Miles 在 Blackwell 架构上实现端到端 MXFP8 与逐 token NVFP4 强化学习方案

    Blog Towards Blackwell-Native 8-bit and 4-bit RL: End-to-End MXFP8 and NVFP4 RL in Miles TL;DR: We implemented two Blackwell-native RL recipes in Miles: end-to-end MXFP8 and per-token NVFP4 for MoE experts. Both are supported by fine-grained precision control across checkpoint conversion,… Ziang Li, humans& and Miles Team

    Miles 团队在 Blackwell 架构上实现了两种原生低精度强化学习方案:端到端 MXFP8 和 MoE 专家权重的逐 token NVFP4。在 8x B200 上对 Qwen3-30B-A3B 的消融实验中,BF16 与所有五种低精度配置的原始奖励曲线高度重合,且 MXFP8 和 NVFP4 减少了推理时间。

    阅读全文 原文 ↗
  21. 21

    启用两项 API 设置使 GPT-5.6 在 ARC-AGI-3 基准测试得分提升三倍

    How enabling two settings tripled our scores on the ARC-AGI-3 benchmark

    OpenAI 通过启用两项 API 设置,使 GPT-5.6 在 ARC-AGI-3 基准测试上的得分提升至原来的三倍。这两项设置分别是保留推理过程(retaining reasoning)和启用压缩(compaction),在提升得分的同时也提高了效率。该发现基于 OpenAI 官方对 GPT-5.6 模型 API 参数的测试结果。

    阅读全文 原文 ↗
  22. 22

    OpenRouter 推出专用 LangChain 集成包,支持 400+ 模型与自动故障切换

    Using OpenRouter With LangChain: ChatOpenRouter Setup Guide

    OpenRouter 发布了 langchain-openrouter(Python)和 @langchain/openrouter(TypeScript)专用包,让 LangChain 应用无需改造即可调用 400+ 模型和 70+ 提供商。ChatOpenRouter 自动处理负载均衡与故障切换,切换模型只需修改 `provider/model` 格式的字符串。

    阅读全文 原文 ↗
  23. 23

    OpenAI 推出两款新转录模型 API

    We're introducing two new transcription models in the API: • GPT-Live-Transcribe: built for low-lat…

    我们在 API 中引入了两种新的转录模型: • GPT-Live-Transcribe:专为低延迟实时转录而构建。 • GPT-Transcribe:针对已完成音频文件和批量工作负载的异步转录进行了优化。 两种模型都能更好地理解上下文,并在跨口音和语言的实际音频上提供更准确的转录,包括短句、数字、专业术语以及背景噪音较大的语音。

    阅读全文 原文 ↗
  24. 24

    Claude 发现加密算法弱点研究发布

    New Anthropic research: Discovering cryptographic weaknesses with Claude. Claude Mythos Preview has…

    Anthropic 新研究:用 Claude 发现加密弱点。 Claude Mythos 预览版已帮助我们的研究人员发现加密算法中的弱点--这些数学方法用于保护数据隐私。 了解更多:https://anthropic.com/research/discovering-cryptographic-weaknesses

    阅读全文 原文 ↗
  25. 25

    我的Claude账号被封了

    今天,我的Claude也被封号了。

    Anthropic因支付系统SEPA验证漏洞引发"零元购"事件,随后大规模回收漏洞账号并封禁关联账户,作者自用半年多的账号于7月29日被封。作者认为当前已非Claude一家独大,推荐编程用户使用Kimi K3和GPT-5.6 Sol,办公用户选择WorkBuddy+Kimi K3,并指出国产模型已凭二十分之一算力摸到第一梯队。

    阅读全文 原文 ↗
  26. 26

    微软转售前沿:Azure 年营收破千亿但增速被 Google Cloud 反超

    Microsoft Resells the Frontier

    Azure 上财年营收首破 1000 亿美元,同比增长 43%,但 Google Cloud 增速达 82%,几乎是 Azure 的两倍。Google 拥有自研模型与芯片,云运营利润率从 20.7% 扩至 35.6%;微软则主要依赖英伟达商用芯片,且 6780 亿美元合同 backlog 中近半数来自 OpenAI 单一客户。

    阅读全文 原文 ↗