类目 全部 模型 产品 行业 论文 技巧
  1. 01

    Grok 推出 Automations 功能:定时或邮件触发,自动执行任务并汇报结果

    Automations in Grok

    xAI 为 Grok 引入 Automations 功能,用户可描述一次任务,让 Grok 按计划(一次/每日/工作日/每周/每月/每年)或邮件触发(按发件人、收件人或主题过滤)自动运行。每次执行都是一次完整对话,结果保存至运行历史,支持邮件或应用内通知。定时自动化对所有用户开放,邮件触发需 SuperGrok 订阅。

    阅读全文 原文 ↗
  2. 02

    欧盟裁定 Google 必须向竞争对手开放 Android 和 Search,影响 Gemini 等 AI 服务

    Google ordered to open Android and Search to rivals in Europe

    欧盟依据《数字市场法案》(DMA)裁定 Google 必须向竞争对手开放 Android 和 Google Search 的关键部分,包括允许第三方 AI 助手和搜索引擎获得更大访问权限。这两项决定可能削弱 Google 对两大核心平台的控制,并为其 AI 工具 Gemini 的未来格局带来深远影响,同时为竞争对手创造新的发展机会。

    阅读全文 原文 ↗
  3. 03

    台积电上调2026年资本支出预测至600~640亿美元,A14制程进展顺利

    台积电将 2026 年资本支出预测进一步上调至 600~640 亿美元

    台积电在2026Q2财报说明会上将2026年资本支出预测上调至600~640亿美元,此前预测接近560亿美元。董事长魏哲家表示,预计2028年量产的A14制程(1.4nm)开发进展顺利,移动和HPC客户兴趣强烈,将成为比2nm更大、更持久的工艺。台积电预计2026Q3合并营收446~458亿美元,2026全年美元收入增幅将超过40%。

    阅读全文 原文 ↗
  4. 04

    Apple Intelligence 获准在华上线,将集成阿里 Qwen 与百度 AI 能力

    Apple Intelligence approved for launch in China with Alibaba and Baidu

    中国网信办已批准 Apple Intelligence 在华上线,苹果将把阿里 Qwen 模型集成至 iOS、iPadOS、macOS 及 visionOS 系统。百度也确认正与苹果合作开发面向中国用户的 Apple Intelligence 功能。此前因未获监管批准,Apple Intelligence 自 2024 年推出后在中国市场一直延迟。

    阅读全文 原文 ↗
  5. 05

    HYPIC:小红书联合北大、上交提出首个混合注意力大模型位置无关缓存系统

    首 token 延迟降 3.25 倍!小红书联合北大、上交提出 HYPIC,让混合注意力大模型用上「位置无关缓存」

    HYPIC 在混合注意力大模型上实现了位置无关缓存,将首 token 延迟平均降低 3.25 倍。在 4 个生产级模型上,同 SLO 下可持续 QPS 提升 1.66 倍,任务质量与完全重算仅相差 1.71 分。

    阅读全文 原文 ↗
  6. 06

    开源编程智能体内存方案发布,通过 SSH 同步

    用于编程代理的开源内存,通过SSH同步

    一个面向编程 AI 智能体的开源内存项目在 GitHub 发布,支持通过 SSH 同步记忆数据。该项目允许智能体跨会话保留上下文,无需依赖特定云服务,用户可自托管。代码已开源,便于开发者集成与定制。

    阅读全文 原文 ↗
  7. 07

    Grok Build 现已开源

    Grok Build is now open source

    Grok Build 现已开源

    阅读全文 原文 ↗
  8. 08

    世界人工智能合作组织协定签署仪式在上海举行,总部设中国上海

    世界人工智能合作组织协定签署仪式举行,总部设中国上海

    7月16日,成立世界人工智能合作组织协定签署仪式在上海举行,中共中央政治局委员、外交部长王毅代表中国政府签署协定。该组织是独立的政府间国际组织,总部设在中国上海,旨在促进人工智能国际合作与全球治理。哈萨克斯坦、老挝、巴基斯坦等29个国家代表签署协定成为创始成员国。

    阅读全文 原文 ↗
  9. 09

    小红书联合北大、上交提出 HYPIC,让混合注意力大模型用上位置无关缓存,首 token 延迟降 3.25 倍

    首 token 延迟降 3.25 倍!小红书联合北大、上交提出 HYPIC,让混合注意力大模型用上「位置无关缓存」

    小红书联合北大、上交提出 HYPIC,这是首个在混合注意力大模型上实现位置无关缓存的服务系统。在 4 个生产级混合注意力模型、5 个工作负载上,HYPIC 将首 token 延迟(TTFT)平均降低 3.25 倍,同 SLO 下可持续 QPS 提升 1.66 倍,任务质量与完全重算仅相差 1.71 分。该系统通过缓存段累积转移算子实现线性层常数时间状态组合,并用缝合窗口修复全注意力层跨段对齐。

    阅读全文 原文 ↗
  10. 10

    前 OpenAI CTO 穆拉蒂创立的 Thinking Machines Lab 发布 Inkling 多模态模型,975B 参数开源

    美国最强开源 AI:多模态 Inkling 模型登场,前 OpenAI 首席技术官穆拉蒂打造

    前 OpenAI 首席技术官米拉·穆拉蒂创立的思维机器实验室(Thinking Machines Lab)推出首个从零训练的多模态模型 Inkling,采用 MoE 架构,总参数 975B、激活参数 41B,最长上下文 1M tokens,已在 Hugging Face 和自有 API Thinker 开放权重。

    阅读全文 原文 ↗
  11. 11

    前谷歌DeepMind研究员因公司签署无限制军事AI协议而离职

    我为何离开谷歌DeepMind

    前谷歌DeepMind研究员Alex Turner因谷歌向国土安全部出售云服务并最终签署无限制军事AI协议而离职。他曾起草25页提案要求加入禁止杀手机器人和大规模监控的合同条款,但提案被CEO转交后无人跟进。Turner指出,包括Jeff Dean和Stuart Russell在内的多位AI伦理领袖在关键时刻未能兑现承诺。

    阅读全文 原文 ↗
  12. 12

    Anthropic 研究:AI 智能体模拟中行为偏差

    New Anthropic research: Agentic misalignment in Summer 2026. A year after our blackmail experiments…

    Anthropic 新研究:2026 年夏季的智能体行为偏差。 在我们的敲诈实验一年后,我们又发现了四种当今自主 AI 智能体在模拟中行为不当的方式。 了解更多:https://alignment.anthropic.com/2026/agentic-misalignment-summer-2026/

    阅读全文 原文 ↗
  13. 13

    DiffusionGemma 开发者指南发布

    DiffusionGemma: The Developer Guide

    Google AI 发布 DiffusionGemma 开发者指南,该实验性模型基于 Gemma 4 架构,采用计算受限并行生成,在单张 NVIDIA H100 上实现 1000+ tokens/秒的生成速度。模型为 26B 参数的 MoE 架构,推理时仅激活 3.8B 参数,可在 18 GB VRAM 内量化部署。

    阅读全文 原文 ↗
  14. 14

    Patter SDK 教程:构建餐厅预订电话智能体,支持动态变量、护栏、延迟仪表盘与评估检查

    Patter SDK Guide to Building a Restaurant Booking Phone Agent with Dynamic Variables, Guardrails, Latency Dashboards, and Eval Checks

    Patter SDK 发布教程,演示如何构建一个餐厅预订场景的语音智能体工作流。该流程支持动态调用变量、注册可调用工具、应用输出护栏(如PII脱敏、脏话过滤、话题范围限制),并可在无需实时电话凭证的情况下运行脚本化通话模拟。教程还涵盖延迟与成本指标追踪、回归式评估检查,以及将智能体逻辑、工具调用、安全检查和通话模拟整合为单一结构化管线。

    阅读全文 原文 ↗
  15. 15

    xAI 开源 Grok CLI 代码库中发现 Mermaid 转 Unicode 框图工具

    Mermaid to Unicode box art (grok-mermaid)

    xAI 开源的 Grok CLI 编码智能体代码库中包含一个用 Rust 编写的 Mermaid 图表示例终端渲染器 `xai-grok-markdown/src/mermaid.rs`。开发者通过 Claude Code for web (Fable 5) 将其编译为 WebAssembly,实现在浏览器中运行该工具。

    阅读全文 原文 ↗
  16. 16

    AI语音诈骗:退休老人因合成女儿哭声被骗1.5万美元

    《三秒盗窃:为何人工智能语音诈骗总能突破所有防线》

    2025年夏季,美国佛罗里达州一名退休老人接到"女儿"哭诉车祸需保释金的电话,一小时内取现1.5万美元交给冒充法院的快递员--实际上,哭声是从一段音频片段合成的AI语音。FBI 2026年4月报告首次将AI欺诈列为独立类别,2025年收到超2.2万起AI相关投诉,调整后损失超8.93亿美元,其中60岁以上受害者占3.52亿美元。

    阅读全文 原文 ↗
  17. 17

    OpenAI 用 AI 攻击自家 AI:GPT-Red 自动发现安全漏洞,成功率 84% 远超人类

    OpenAI is now using AI to attack its own AI, and it's working better than humans ever did

    OpenAI 训练了内部 AI 模型 GPT-Red,通过自我对弈强化学习自动模拟提示词注入等攻击,在测试场景中成功率达 84%,而人类红队仅为 13%。GPT-Red 的发现直接用于训练,使 GPT-5.6 Sol 在直接提示词注入上的故障次数比四个月前的最佳模型减少六倍,且未影响通用性能。约 3.8% 的"更强"提示词注入仍能成功,GPT-Red 暂不对外开放。

    阅读全文 原文 ↗
  18. 18

    Thinking Machines 发布多模态模型 Inkling

    Today, we are introducing Inkling. Inkling reasons efficiently across text, image, and audio modali…

    今天,我们推出 Inkling。 Inkling 能高效地对文本、图像和音频模态进行推理。我们将提供完整权重。 https://thinkingmachines.ai/news/introducing-inkling/ 即日起可在 Tinker 上进行微调。在 Inkling Playground 中试用。🧵

    阅读全文 原文 ↗
  19. 19

    Moonshot AI 发布 PerceptionBench:多模态模型视觉感知能力诊断基准

    PerceptionBench

    Moonshot AI 发布 PerceptionBench,一个从 40 多个现有基准中模型实际失败案例归纳出的视觉感知基准,包含 10 项原子感知能力和 3000 道验证题。所有测试模型准确率均未超过 60%,且大量正确答案在重复提问时无法复现,表明模型更多是猜测而非真正感知。PerceptionBench 旨在精确诊断多模态 AI 的视觉感知断裂点,推动其实现忠实、一致的视觉理解。

    阅读全文 原文 ↗
  20. 20

    天工短剧工作台发布"Agent智能分镜+无限画布"双轨创作模式

    告别"随机抽卡",天工短剧工作台:让AI短剧制作第一次真正拥有导演思维!

    天工短剧工作台推出双轨创作模式,通过导演Agent自动解析剧本、规划站位与机位,并支持多视细节图生成,解决AI短剧角色变脸和站位漂移问题。该工具内置影视级提示词模板、720°全景图及3D导演台,实现可控生产。已有三部作品上线DramaWave 7天实现百万美元级营收。

    阅读全文 原文 ↗
  21. 21

    远程操控Agent干活方案:Codex主力 + UU远程兜底

    分享一下我现在随时随地让Agent干活的远程操控方案。

    作者分享了一套远程使用Agent的组合方案:以Codex的远程控制功能作为主力,通过ChatGPT App连接家中24小时开机的Mac Mini,同步所有开发任务、规则和Agent记忆;遇到扫码登录、图形界面操作等Codex难以处理的场景时,用网易UU远程在手机上直接操控电脑完整桌面。UU远程完全免费,支持多设备协同,无需局域网或公网配置。

    阅读全文 原文 ↗
  22. 22

    秒哒 3.5 全球首发 iOS App,无代码开发与多端共享后端能力升级

    秒哒3.5: 全球首发iOS App 无代码开发、多端共享后端

    百度智能云在 WAIC2026 发布秒哒 3.5,新增 iOS 打包能力,用户无需 Mac 或 Xcode 即可将应用打包为 IPA 文件或上架 App Store。3.5 版本还内置 SEO Agent 实现搜索优化自动化,支持多应用共享同一后端数据库,并推出数据库多环境隔离与后端资源分级功能。秒哒累计服务超 3500 万用户,已创造 350 万个商业应用。

    阅读全文 原文 ↗
  23. 23

    面壁智能开源企业AI数字员工平台StaffDeck

    The future of enterprise AI isn't a chatbot-it's a digital workforce. We're open-sourcing StaffDeck…

    面壁智能联合多团队开源StaffDeck,一个用于构建与管理数字员工的企业平台。该平台旨在将专业知识、标准作业程序(SOP)和决策规则转化为持续工作、改进并保留组织知识的数字员工,而非传统聊天机器人。项目代码已发布于GitHub。

    阅读全文 原文 ↗
  24. 24

    天工短剧工作台推出"Agent智能分镜+无限画布"双轨创作模式,告别AI短剧"随机抽卡"

    告别"随机抽卡",天工短剧工作台:让AI短剧制作第一次真正拥有导演思维!

    天工短剧工作台(SkyProduction)推出"Agent智能分镜+无限画布"双轨创作模式,将导演思维拆解为六个可干预环节,通过站位图锁定和多视细节图生成解决角色漂移、变脸问题。该工作台支持720°全景图、3D导演台、多账号分级管理及数据中心,并原生支持英文短剧全流程处理。其三部精品短剧上线DramaWave仅7天,均实现百万美元级营收。

    阅读全文 原文 ↗
  25. 25

    MiniMax Code 2.0 桌面端焕新:底层架构全面升级,金融模块即将上线

    MiniMax Code 2.0 焕新,底层架构全面升级

    MiniMax Code 2.0 桌面端发布,基于 Pi Agent 框架重构底层架构,显著提升会话启动速度与长程复杂任务的执行稳定性。新版本优化了图表加载与文件预览框选编辑功能,并已与恒生金融数据库、企查查 MCP 打通,金融模块即将上线,支持多源数据实时检索与专业报告生成。桌面端现已开放下载,本月还将上线远程控制、浏览器操控等功能。

    阅读全文 原文 ↗
  26. 26

    Claude Code 新增 MCP 连接器调用功能

    Claude Code artifacts can now call MCP connectors, letting you build dashboards and apps that can fe…

    Claude Code 的 artifacts 现在可以调用 MCP 连接器,让你构建能够按需为每位查看者获取信息并执行操作的仪表盘和应用。 适用于 Pro、Max、Team 和 Enterprise 计划。不适用于公开共享的 artifacts。

    阅读全文 原文 ↗
  27. 27

    Anthropic 用 Claude Code 大规模迁移代码:Bun 百万行 Zig 转 Rust,两周完成

    How Anthropic runs large-scale code migrations with Claude Code

    Anthropic 工程师用 Claude Code 在两周内将 Bun 的百万行 Zig 代码迁移至 Rust,100% 现有测试通过,合并后出现 19 个回归问题已全部修复。另一工程师用周末将 Python 代码库迁移至 16.5 万行 TypeScript。迁移消耗约 16.5 万美元 API 成本,但编译时间从八分钟降至两秒,二进制启动快 6 倍。

    阅读全文 原文 ↗
  28. 28

    在 Claude Cowork 中使用 Claude Fable 5

    Working with Claude Fable 5 in Claude Cowork

    Anthropic 发布最强通用模型 Claude Fable 5,专为长时间、多步骤的复杂异步工作设计,可在 Claude Cowork 中自主执行深度研究、尽职调查等任务。该模型需手动选择,默认模型为 Claude Sonnet 5。

    阅读全文 原文 ↗
  29. 29

    千问APP联合武汉发布办AI求职实战课,演示简历诊断、PPT制作与表格分析

    已在工位,今天先学怎么上班

    千问APP与武汉发布联合承办AI求职实战课,现场演示AI在简历诊断、商业报告撰写、销售表分析等场景的应用。产品经理金师兴提出"给全材料、说明目标、定义标准、划定边界、索要可编辑文件"五步法,并给出分步骤提示词生成Word简历;另一产品经理透镜演示用千问紧急制作PPT。表格分析环节通过虚构茶饮店案例,展示"建、理、算、析、呈"方法论,将486行杂乱数据浓缩为一页结论清晰的PPT。

    阅读全文 原文 ↗
  30. 30

    千问APP联合武汉发布举办AI求职实战课,演示简历诊断与办公自动化

    已在工位,今天先学怎么上班

    千问APP与武汉发布在武汉举办AI求职实战课,现场演示了用千问进行简历诊断、PPT制作和表格分析。产品经理提出"给全材料、说明目标、定义标准、划定边界、索要可编辑文件"五步法,并展示了将486行杂乱销售数据浓缩为一页结论PPT的"建、理、算、析、呈"方法论。

    阅读全文 原文 ↗
  31. 31

    Gemini Enterprise Agent Platform 新增 Parallel Web Search 网络接地提供商

    Expanding Choice in Gemini Enterprise Agent Platform: Introducing Grounding with Parallel Web Search

    Google Cloud 与 Parallel Web Systems 合作,将 Parallel 的搜索基础设施作为新的网络接地提供商原生集成到 Gemini Enterprise Agent Platform 中。该集成使开发者能将 AI 智能体锚定在可验证的实时网络结果上,以提升企业工作流的事实准确性。用户还可编程提取、永久缓存并与其他大语言模型一起处理网络数据。

    阅读全文 原文 ↗