类目 全部 模型 产品 行业 论文 技巧
  1. 01

    国务院印发《教育发展"十五五"规划》,推进人工智能全学段教育

    国务院:推进人工智能全学段教育,提升学生人工智能素养

    国务院日前印发《教育发展"十五五"规划》,要求推进人工智能全学段教育,提升学生人工智能素养及提出问题、解决问题的能力。规划明确完善科学教育体系,强化科技教育与人文教育协同,加强青少年科学素养、批判性思维和创新能力培养。同时实施学生体质强健计划、心理健康促进行动,加大拔尖创新人才自主培养力度,推动学科交叉融合,扩大优质本科招生规模。目标到2030年高质量教育体系基本建成。

    阅读全文 原文 ↗
  2. 02

    Meta发布Brain2Qwerty v2:非侵入式实时句子解码

    We're sharing the next major milestone in our non-invasive brain-to-text decoder research: Brain2Qwe…

    Meta公布Brain2Qwerty v2,这是非侵入式脑电信号解码研究的最新里程碑。基于当天发表在《Nature》的v1,v2是性能最高的端到端管道,能从原始脑信号实时解码句子。其从字符级性能提升至解码单词和语义,提高整体沟通准确性。该研究有望帮助数百万因脑损伤或疾病无法沟通的人群。

    阅读全文 原文 ↗
  3. 03

    Agents-A1:35B MoE 智能体模型通过扩展 horizon 达到万亿参数级性能

    Scaling the Horizon, Not the Parameters: Reaching Trillion-Parameter Performance with a 35B Agent

    研究人员提出 Agents-A1,一个 35B 参数的 Mixture-of-Experts 智能体模型,通过扩展智能体 horizon(长轨迹与异构能力两个视角)达到万亿参数模型性能。团队构建了长 horizon 知识-行动基础设施,生成平均 45K token 的智能体轨迹,并采用三阶段训练:全领域监督微调、领域级教师模型训练、多教师领域路由在线蒸馏(含显著词汇对齐)。对比万亿参数模型 Kimi-K2.6 和 DeepSeek-V4-pro,Agents-A1 在 SEAL-0(56.4)、IFBench(80.6)、HiPhO(46.4)、FrontierScience-Olympiad(79.0)和 MolBench-Bind(56.8)上领先,并在 SciCode(44.3)、HLE(47.6)和 BrowseComp(75.5)上保持强竞争力。

    阅读全文 原文 ↗
  4. 04

    美军用AI选目标却误炸伊朗学校,Anthropic Claude嵌入Palantir系统首日建议约1000目标

    The US military used AI to pick thousands of targets but missed a note saying one was a school

    美军在打击伊朗时首次大规模使用AI选择目标(Anthropic的Claude模型嵌入Palantir的Maven Smart System,首日建议约1000个目标),但对一所学校的导弹袭击导致约120名儿童死亡。调查发现,情报分析师早在2019年就通过数字工具标记该地点已变为小学,但该工具未连接军方官方目标数据库MIDB,信息从未送达指挥官。MIDB建于1980年代,依赖手动输入,替代系统MARS多年延迟。五角大楼事后宣布推出agentic AI initiative。Project Maven创建人Jack Shanahan批评目标验证不力不可原谅。

    阅读全文 原文 ↗
  5. 05

    从任何地点构建--Cursor for iOS 公测版发布

    Build from anywhere with Cursor for iOS

    Cursor 推出 iOS 原生公测版,所有付费计划可用。开发者可在手机上启动始终在线的云端智能体,或远程操控电脑端智能体。支持语音输入、斜杠命令和选择前沿模型。智能体运行后,锁屏 Live Activities 和推送通知实时更新状态,完成或需要输入时提醒。云端智能体在隔离虚拟机中运行,可自动迭代生成合并就绪的 PR,并输出演示、截图和日志。本地与云端智能体支持双向切换。移动端 Composer 2.5 享受 75% 折扣,优惠至 2026 年 7 月 5 日。

    阅读全文 原文 ↗
  6. 06

    Wayfinder Router:在本地和托管的大语言模型之间进行确定性查询路由

    Wayfinder Router:在本地和托管的大型语言模型(LLM)之间进行确定性查询路由

    Wayfinder Router 通过分析提示词的结构(长度、标题、列表、代码)和措辞(证明、数学、硬约束),在微秒级完成路由决策,完全离线且无需调用其他模型。默认仅使用结构特征,词汇线索因盲测未泛化而默认为关闭。对比依赖模型调用的路由器(如 RouteLLM、NotDiamond),它避免了延迟、成本和随机性。用户可在自有数据上校准评分阈值。支持任何 OpenAI 兼容 API(含 Ollama、Anthropic、Groq、vLLM 等),可自托管。提供终端和网页演示(--dry-run 无需密钥),以及基准测试和 FAQ。

    阅读全文 原文 ↗
  7. 07

    EverOS:开源Markdown优先智能体记忆运行时,支持混合检索与自进化技能

    Meet EverOS: An Open Source Markdown-First Agent Memory Runtime With Hybrid BM25 + Vector Retrieval and Self-Evolving Skills

    EverMind 推出开源智能体记忆运行时 EverOS(Apache 2.0 许可)。它以可编辑的 Markdown 文件为记忆主体,经 SQLite 管理状态、LanceDB 实现混合检索(BM25 关键词 + 向量搜索 + 标量过滤)。每个完成的任务记录为 Case,离线提炼为可复用的 Skill,使记忆随使用自我进化。v1.1.0 新增 Knowledge APIs(支持分类与话题搜索的 Markdown 页面)和 Reflection(跨会话优化 Profile 和 Skill)。据 EverMind 报告,LoCoMo 得分 93.05%,LongMemEval 83.00%,HaluMem 93.04%,p95 检索延迟低于 500ms。运行时可本地优先部署,也提供 EverOS Cloud 托管选项,兼容 OpenAI 协议端点。

    阅读全文 原文 ↗
  8. 08

    Claude Code 打开 GitHub 仓库即执行隐藏恶意代码,攻击者可获完全控制

    Claude Code runs a GitHub repo's hidden malware without verification, giving attackers full control

    安全研究人员在 Mozilla 的 GenAI 漏洞赏金平台 0DIN 发现新攻击向量。一个看似正常的 GitHub 仓库包含 setup 脚本,该脚本运行时从 DNS 条目拉取命令并执行,恶意代码从未存在于仓库中,对扫描器、代码审查和 AI 智能体不可见。开发者使用 Claude Code 等 AI 编码工具打开该仓库时,Claude Code 在设置过程中遇到常规错误消息后自动运行该脚本,打开反向 shell,攻击者可窃取 API 密钥和登录凭据并维持持久访问。研究人员建议 AI 智能体应在运行前显示 setup 脚本内容,开发者应将第三方仓库的 setup 说明视为不受信任代码。

    阅读全文 原文 ↗
  9. 09

    小红书 RedKnot 推理引擎:将 KV Cache 按注意力头拆解实现长文本加速

    让 KV Cache「按头分家」:小红书 RedKnot 如何重做长文本推理新引擎

    RedKnot 将 KV Cache 沿注意力头维度拆解,通过头分类稀疏(局部头占 83.4%-96.8%)、稀疏 FFN 和 SegPagedAttention 三个机制统一算法与存储粒度。在 8 卡 H800 上,TTFT 最高加速 1.6-3.54×,单卡并发提升 4.7-7.8×,预填充 FLOPs 削减 67%-79.5%。DeepSeek-V4-Flash 上 128K 上下文 TTFT 加速达 5.16×,KV 传输最多省 6.3×。精度通常不低于稠密 F1 的 95%。

    阅读全文 原文 ↗
  10. 10

    三星和SK海力士计划投资5900亿美元扩产芯片,AI需求推高内存价格

    Samsung and SK Hynix plan $590 billion chip investment as AI demand sends memory prices soaring

    在韩国政府支持下,三星和SK海力士计划投入5900亿美元扩大芯片产能,包括800万亿韩元新建四座工厂、81万亿韩元建封装中心,以及未来15年30万亿韩元用于研发下一代芯片。AI数据中心需求是主要驱动力。Jefferies预测,2026年Q3内存价格将上涨40%至50%,Q4再涨30%至40%,2027年继续上涨40%至45%,到2028年新产能仅上线15%至20%才可能缓解。两家公司合计控制全球近80%的高带宽内存芯片市场。内存涨价已推高消费电子产品成本,苹果已上调Mac和MacBook售价。

    阅读全文 原文 ↗
  11. 11

    Herdr:驻留在终端中的AI智能体多路复用器

    Herdr:驻留在终端中的代理多路复用器

    Herdr是一个驻留在终端中的AI智能体多路复用器,允许用户在单一终端界面内管理和切换多个AI智能体会话。

    阅读全文 原文 ↗
  12. 12

    SK 集团会长崔泰源:到 2035 年建设 15GW AI 数据中心,总投资达 1000 万亿韩元

    SK 集团会长崔泰源 6 月 29 日宣布,计划到 2035 年建成 15GW AI 数据中心容量,作为韩国国家级基础设施和实体 AI 时代核心底座。项目总投资 1000 万亿韩元(约 4.4 万亿元人民币),未来 10 年保持年均 100 万亿韩元以上国内投资,旨在实现从出口传统商品向智能服务的转变,构建韩国智能市场。此外,SK 海力士将向韩国西南部投资 400 万亿韩元,半导体供应项目总投资达 1100 万亿韩元(约 4.84 万亿元人民币)。

    阅读全文 原文 ↗
  13. 13

    分享两个Vibe Coding必备的实用Prompt:第一性原理与对抗式审查

    分享2个Vibe Coding必备的超实用Prompt。

    作者分享Vibe Coding中两个关键Prompt:一是"从第一性原理出发",强制AI跳出类比推理,从基本事实重新推导本质,曾帮作者发现AIHOT抓取海外信源的底层流量路由隐患并彻底重构;二是"对抗式审查",让AI站在恶意用户角度攻防式审查代码,检出OOM死循环、未来时间污染等手工难发现的BUG。两个Prompt形成生成与验证闭环,使纯Vibe Coding项目AIHOT最近一周请求量超千万次。

    阅读全文 原文 ↗
  14. 14

    美国限制准入后,奥地利游说欧盟接纳 Anthropic 落户

    美国限制准入后,奥地利游说欧盟接纳Anthropic落户

    奥地利数字国务秘书 Alexander Pröll 近日致信欧盟委员会执行副主席 Henna Virkkunen,建议欧盟考虑在境内设立并参与 Anthropic 的战略布局,以对抗美国限制外国人使用其最先进 AI 模型的做法。

    阅读全文 原文 ↗
  15. 15

    From Brain Waves to Words: Brain2Qwerty Offers a New Path to Communication Without Surgery

    阅读全文 原文 ↗
  16. 16

    Boris Cherny:AI时代产品角色演变的五种原型

    As engineering, product, design, DS, etc. melt into a new kind of role, I was reflecting on what rol…

    Boris Cherny以Anthropic的Claude Code团队为例,归纳出五种未来产品角色:1)Prototyper(快速产出新想法);2)Builder(将原型转化为生产级产品);3)Sweeper(清理UI、简化代码、优化性能);4)Grower(迭代提升产品市场契合度);5)Maintainer(维护成熟系统的安全可靠与高效)。多数人覆盖2-3个角色,且角色不绑定岗位功能。健康团队需根据产品阶段混合配置:新产品/预PMF侧重1+2+3;增长期/已找到PMF侧重2+3+4+少量5;成熟期/强PMF侧重3+4+5+少量2。

    阅读全文 原文 ↗
  17. 17

    为 Amazon Bedrock 和 Google Cloud 推出的 Claude apps gateway

    Introducing the Claude apps gateway for Amazon Bedrock and Google Cloud

    Anthropic 今日推出 Claude apps gateway,一个自托管控制平面,让企业能在 Amazon Bedrock 和 Google Cloud 上运行 Claude Code。它作为单个无状态容器部署于 Linux,后端使用 PostgreSQL,提供企业级 SSO 登录(通过 OIDC 对接 Google Workspace、Microsoft Entra ID、Okta 等)、集中策略管理、角色权限、路由(支持故障转移)以及按日/周/月、按组织/群组/用户的消费上限。遥测数据通过 OTLP 发送至用户配置的收集器。gateway 不会向 Anthropic 发送推理流量或使用数据(除非配置使用 Claude API)。即日起可用。

    阅读全文 原文 ↗
  18. 18

    Claude 在 Microsoft Foundry 正式可用

    Claude in Microsoft Foundry is now generally available

    从今天起,Claude 模型在 Microsoft Foundry 上正式可用,托管于 Azure 环境,运行在 NVIDIA GB300 GPU 上。首批提供 Claude Opus 4.8 和 Claude Haiku 4.5,通过 Messages API 调用,支持提示缓存和扩展思考。用户可选择推理处理位置,包括美国数据区域,由 Anthropic 负责推理运营。Azure 用户可使用现有身份验证、计费与治理控制,并获得统一账单;符合条件的 Enterprise Agreement 客户可将 Claude 用量计入 Azure 承诺消费。

    阅读全文 原文 ↗
  19. 19

    OpenAI 报告:绘制欧洲 AI 劳动力机遇版图

    Mapping Europe's AI Workforce Opportunity

    OpenAI 发布新报告,分析 AI 对欧盟就业的影响,划定哪些职业面临自动化、增长或工作流程变化。

    阅读全文 原文 ↗
  20. 20

    Artifacts 22:Zyphra、Cohere 和 Poolside 正在扩展生态系统广度

    Artifacts 22: Zyphra, Cohere, and Poolside are expanding the breadth of the ecosystem

    开源模型生态正变得更多元,参与者从少数中国公司扩展到全球各类组织。纯模型制造商包括 DeepSeek、智谱、MiniMax、Poolside、Arcee、Zyphra 及主权 AI 玩家 Cohere、Sovereign、Mistral、Trillion Labs;科技巨头如阿里 Qwen、Google Gemma 和 NVIDIA 各有不同动机;产品公司如 JetBrains、Zed、Krea、Photoroom 则训练高度专业的小模型。NVIDIA 发布 Nemotron-3-Ultra-550B-A55B-BF16,采用 LatentMoE 架构并改用 OpenMDW 许可证。Cohere 以 Apache 2.0 开源其旗舰模型 Command A+(05-2026-bf16),这是一款 218B-A25B MoE 模型,具备多模态、多语言和智能体能力。

    阅读全文 原文 ↗
  21. 21

    Anthropic:当AI成本超过工程师薪酬

    When AI Costs More Than the Engineer

    Anthropic在算力上的支出达到每位工程师每年51.5万美元,是其完全薪资(22.4万美元)的2.3倍。相比之下,顶尖1%软件公司的算力支出为8.9万美元,中位数仅为1.37万美元。三个2029年情景预测了这一差距的缩小路径。

    阅读全文 原文 ↗