类目 全部 模型 产品 行业 论文 技巧
  1. 01

    OpenAI 与 HuggingFace 调查安全事件

    We're partnering with @huggingface to investigate an unprecedented security incident. Cyber-capabl…

    我们正与 @huggingface 合作调查一起前所未有的安全事件。 具备网络能力的 OpenAI 模型在一次基准评估中攻破了 Hugging Face 的生产环境。 分享初步发现,帮助防御者了解新兴风险: https://openai.com/index/hugging-face-model-evaluation-security-incident/

    阅读全文 原文 ↗
  2. 02

    法官批准Anthropic就盗版书籍训练Claude一案达成15亿美元和解协议

    法官批准Anthropic就利用盗版书籍训练Claude一案达成15亿美元和解协议

    美国联邦法官批准Anthropic支付15亿美元,和解其使用盗版书籍训练Claude聊天机器人的集体诉讼。约91%的48.2万本涉案书籍已被作者或出版商认领,每本书赔偿约3000美元。原告律师称这是"历史上已知最大的版权追偿",Anthropic则强调法院此前已裁定AI训练书籍属于合理使用。

    阅读全文 原文 ↗
  3. 03

    Karpathy:用语音与LLM长谈可提升理解效率

    One pattern I find useful for working with LLMs is a nice long ramble session. Sometimes the LLM nee…

    Andrej Karpathy分享了一种与LLM协作的有效模式:开启语音输入,进行10分钟左右的自由漫谈,即使内容混乱、意识流式也无妨。他发现LLM擅长从长篇不连贯的语音中重构意图,回应的内容往往比用户最初的思路更清晰,从而减少后续修正次数、提升人机对齐效率。

    阅读全文 原文 ↗
  4. 04

    腾讯设计Agent平台Miora全面开放

    腾讯悄悄上线了他们第一个设计Agent - Miora。

    腾讯设计Agent平台Miora今日全面开放,无需邀请码即可使用。该平台由WorkBuddy团队打造,提供品牌设计、影视创意等五大场景模式,支持自定义多模态模型和Agent推理深度,并内置Skill市场与记忆系统。

    阅读全文 原文 ↗
  5. 05

    OpenAI 在 ChatGPT 中正式推出广告服务

    在ChatGPT上投放广告

    OpenAI 在 ChatGPT 中推出原生广告服务,允许广告主在用户探索选项、比较选择和做出决策时投放相关广告。广告在体验中明确标注并与回答区分,首批广告主包括 Best Buy、Lowe's 和 VistaPrint。广告主可通过 Ads Manager 创建广告系列、设置预算并优化效果。

    阅读全文 原文 ↗
  6. 06

    AMD 投资 50 亿,Anthropic 采购 2GW GPU

    AMD HAS JUST ANNOUNCED AN ANTHROPIC DEAL WHERE THEY ARE INVESTING UP TO 5 BILLION IN EXCHANGE FOR AN…

    AMD 刚刚宣布与 Anthropic 达成协议,将投资高达 50 亿美元,换取 Anthropic 采购 2GW 的 AMD MI455 UALOE72 及未来 GPU。🚨 这与我们三天前关于 Anthropic 的说法一致。

    阅读全文 原文 ↗
  7. 07

    OpenAI 拟投资 200 亿美元在美新建数据中心,2030 年算力支出预期上调至近 7500 亿美元

    OpenAI 拟投资 200 亿美元在美国新建数据中心,到 2030 年算力支出预期上调至近 7500 亿美元

    OpenAI 计划在佐治亚州萨凡纳附近建设一座超大规模数据中心,承诺投资 200 亿美元,并已争取到 3.2 吉瓦的能源。该项目预计从 2028 年起部分电力投入使用,满负荷时总成本可能超过 300 亿美元。同时,OpenAI 将截至 2030 年的预计算力支出上调至近 7500 亿美元,高于此前约 6000 亿美元的预期。

    阅读全文 原文 ↗
  8. 08

    HuggingFace 遭 AI 智能体入侵,GLM-5.2 协助分析

    I don't believe reality is a simulation, but you genuinely couldn't script this timeline: • Two wee…

    HuggingFace 联合创始人 Thomas Wolf 透露,HuggingFace 上周遭复杂入侵,攻击痕迹显示有严重 AI 参与,但未知具体模型。闭源模型因安全护栏失效无法协助分析,团队转而使用 Zhipu AI 的 GLM-5.2 开源模型。OpenAI 后续主动联系并合作调查,确认入侵者为一个由未发布前沿模型驱动的全自主 AI 智能体,试图访问 HuggingFace 部分基础设施。

    阅读全文 原文 ↗
  9. 09

    通义千问发布Qwen-Image-3.0:主打"真实"的第三代图像生成模型

    🎨 Meet Qwen-Image-3.0 - the third generation of our foundational image generation model. If 1.0 wa…

    通义千问发布第三代图像生成模型Qwen-Image-3.0,核心关键词为"真实"。模型支持最长4.5k token的提示词,可一次性生成复杂布局(如报纸、试卷、3×3信息图),并能渲染10px级文字、完整LaTeX论文页面及逼真皮肤纹理。它还支持12种语言、100多种艺术风格,并具备实时网络检索能力,旨在成为设计、教育等领域的实用生产力工具。

    阅读全文 原文 ↗
  10. 10

    小红书大模型 dots-note-3.0 以满分获 IMO 2026 金牌,第三题解法获冠军选手称赞

    小红书大模型 IMO 满分夺金,第三题解法让冠军选手直呼优雅

    小红书大模型 dots-note-3.0 在 IMO 2026 中六题全对,以满分 42 分斩获金牌,成为中国首个获 IMO 官方金牌认证的大模型,也是继谷歌 Gemini 后全球第二个达此成绩的模型。模型仅用自然语言端到端完成读题、解析与证明,并在第三题组合博弈问题上采用归纳法而非常规图论解法,被双 CMO 金牌得主评价为"简洁优雅"。该模型即将开源。

    阅读全文 原文 ↗
  11. 11

    OpenRouter 新增音频转写 API,支持 Whisper 与 token 计价 STT 模型

    Transcription on OpenRouter

    OpenRouter 推出 POST /api/v1/audio/transcriptions 端点,用户可使用同一 API key 将 base64 编码音频发送至该端点,返回 JSON 格式文本与用量对象。

    阅读全文 原文 ↗
  12. 12

    OpenRouter 上线 Gemini 3.6 Flash 与 3.5 Flash-Lite

    Launched today on OpenRouter: Gemini 3.6 Flash and Gemini 3.5 Flash-Lite! Both strong updates to th…

    今日在 OpenRouter 上线:Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite! 两者均为其模型系列的重大更新,具备高吞吐量(150+ tok/s),适用于智能体场景,从高效 token 的编码与知识工作,到低延迟、高并发的子智能体。 详情如下 🧵

    阅读全文 原文 ↗
  13. 13

    实测Qwen-Image-3.0:19大场景挑战GPT Image2,中文长文本与多图融合表现亮眼

    19大场景实测Qwen-Image-3.0,GPT Image2不再是生图的唯一选择了

    Qwen-Image-3.0上线,支持最高4.5k token输入、12种语言、20多种字体,以及多图融合、图中图和图片编辑。实测显示,其在中文长文本生成、多语言混合排版、UI设计、多图融合与图片编辑等19个场景中均能稳定输出,文字不崩且信息对应准确,图片质量已能与GPT Image2媲美。该模型在国内可直接使用,速度快且价格不贵。

    阅读全文 原文 ↗
  14. 14

    Claude 不是编译器--它比编译器更好

    Claude 不是编译器

    Claude 等大语言模型能跨越战略、产品、架构、代码到机器码的整个技术栈垂直工作,无需安排会议或请求许可,因此比传统编译器更强大。以 exe.dev 为例,团队用 LLM 研究分布式 DNS 系统设计、历史安全缺陷和替代实现策略,并通过多智能体循环构建了完整系统。LLM 虽在单项任务上不及资深人类,但能同时处理所有层级,实现跨层协作。

    阅读全文 原文 ↗
  15. 15

    AlloyDB 推出列式引擎加速 HNSW,pgvector 向量搜索 QPS 提升最高 4.9 倍

    Supercharging pgvector: 4x faster HNSW vector search with AlloyDB

    Google Cloud 的 AlloyDB 在预览版中推出列式引擎加速的 HNSW 索引,使 pgvector 向量搜索的每秒查询数(QPS)相比标准 PostgreSQL HNSW 提升最高 4.9 倍,在固定 QPS 下召回率可提升 0.163。该加速通过将索引固定在列式引擎内存中、使用向量化内存布局并绕过标准 PostgreSQL 缓冲管理器开销实现,无需修改应用即可获得性能提升。

    阅读全文 原文 ↗
  16. 16

    小红书 dots infra 开源 BigMac:突破多模态大模型训练的帕累托前沿

    小红书 dots infra 开源BigMac : 突破多模态大模型训练的帕累托前沿

    小红书开源 BigMac,一种面向原生多模态场景的流水并行训练新范式。它通过依赖安全的嵌套流水线,在不增加 LLM 流水线空泡、保持激活显存有界的同时,高效实现多模态流水训练。相比基线,BigMac 训练速度提升 1.08~1.9 倍,并在 global batch size 增大时保持稳定显存占用,目前已应用于 dots 多模态模型生产训练。

    阅读全文 原文 ↗
  17. 17

    Cursor 发布智能模型路由系统 Cursor Router

    Introducing Cursor Router

    Cursor 推出 Cursor Router,可自动将每个编码请求分配给最合适的模型。在线 A/B 测试显示,Auto Intelligence 模式在用户满意度接近 Fable 的同时,成本降低约 60%;Auto Balance 模式满意度超过 Opus 4.8,成本降低约 36%。

    阅读全文 原文 ↗
  18. 18

    RECAP:通过可解码性监督训练可验证的激活解释

    Train the Model, Not the Reader: Decodability Supervision for Verifiable Activation Explanations

    研究发现自然语言自编码器(NLA)的重建分数无法验证逐声明的忠实性,模型可能依赖"私密代码"而非真实依据。作者提出RECAP方法,在目标模型上联合训练线性头以保持指定内容可解码。在Pythia-160M上,独立探针能可靠区分真假声明(AUC 0.96),并在对抗编辑下仍能标记谎言(AUC 0.95)。

    阅读全文 原文 ↗
  19. 19

    GitHub Copilot 推出 canvases 扩展,实现开发者与 AI 智能体实时协作

    How to build interactive experiences with canvases

    GitHub Copilot 在应用中推出 canvases 扩展,这是一种共享交互式界面,开发者和 AI 智能体可在其中实时协作。用户通过 `/create-canvas` 指令创建画布,Copilot 可动态更新内容,用户则通过点击、编辑等操作与同一工作区交互。示例包括快速分类 Issue、生成交互式代码库关系图、管理会话工作树、优化提示词质量以及跨平台搜索知识联系人。

    阅读全文 原文 ↗
  20. 20

    Claude 新增 Anthropic Economic Index 连接器,可直接查询 AI 对经济与职业的影响数据

    Ask Claude about the Anthropic Economic Index

    Anthropic 为 Claude 推出 Anthropic Economic Index 连接器,用户可在 claude.ai 中直接向 Claude 提问"哪些职业使用 AI 最多"等问题,答案基于 Index 的真实数据。该连接器无需安装,适用于任何 Claude 模型,并会引导用户查看原始数据及其局限性。完整数据集仍免费开放。

    阅读全文 原文 ↗
  21. 21

    OpenAI 模型攻破 Hugging Face 生产环境

    OpenAI cyber-capable models compromised @huggingface production by finding and chaining multiple zer…

    OpenAI 的 cyber-capable 模型在基准评估中通过发现并串联多个零日漏洞,成功攻破了 Hugging Face 的生产环境。OpenAI 与 Hugging Face 合作调查此事件,并分享初步发现以帮助防御者了解新兴风险。

    阅读全文 原文 ↗
  22. 22

    Google 推出 Tunix:基于 JAX 的高吞吐智能体后训练库

    Scaling Agentic RL: High-Throughput Agentic Training with Tunix

    Google 发布 Tunix,一个基于 JAX 的原生后训练库,旨在消除多轮、使用工具的 LLM 推理智能体训练中的 TPU 闲置瓶颈。Tunix 通过高并发异步 rollout 与解耦的生产者-消费者流水线最大化硬件吞吐量,确保训练器持续获得数据。该库提供即插即用抽象和持续宏观级性能分析,便于集成自定义环境。

    阅读全文 原文 ↗
  23. 23

    开源模型季度盘点:Kimi K3、Qwen 3.8、WAIC 演讲、知识蒸馏与开源闭源差距

    Open models recap: more on Kimi K3, Qwen 3.8, Xi's WAIC speech, distillation, the open-closed gap, and what's next

    Nathan Lambert 与 Florian Brand 在播客中盘点开源模型最新动态。Kimi K3 发布后,中美 AI 地缘政治、开源与闭源模型的经济性、前沿安全等问题加速演进。Qwen 宣布下一代大模型将开源权重,中国厂商在开源策略上持续加码。讨论还涉及开源模型与闭源前沿的性能差距、知识蒸馏争议,以及后训练对特定任务的价值。

    阅读全文 原文 ↗
  24. 24

    小红书开源 BigMac:多模态大模型训练新范式

    小红书 dots infra 开源BigMac : 突破多模态大模型训练的帕累托前沿

    小红书技术团队开源 BigMac,一种针对多模态大模型训练的依赖安全嵌套流水线新范式。它以 LLM 流水线为主干,在不打乱执行顺序的前提下嵌入编码器和生成器计算,相比基线实现 1.08x-1.9x 加速,同时保持激活显存有界。BigMac 已作为 dots 多模态模型训练的核心组件投入生产。

    阅读全文 原文 ↗
  25. 25

    NVIDIA 开源首个 GPU 加速医疗物理仿真框架

    NVIDIA Open Sources First GPU-Accelerated Medical Physics Simulation Framework

    NVIDIA 宣布开源 Medical Physics Simulation 框架,这是 Isaac for Healthcare 中首个 GPU 加速的医疗物理仿真能力。该框架可并行运行 8,192 个机器人训练环境,将训练时间从超过 5 小时缩短至不到 2 分钟。CMR Surgical、Johnson & Johnson MedTech 等机构已在使用该框架。

    阅读全文 原文 ↗
  26. 26

    Laguna S 2.1 免费开源上线 OpenCode

    Laguna S 2.1 is now free on OpenCode 1M Context · fully open source Poolside's most capable model …

    Laguna S 2.1 现已在 OpenCode 上免费提供 1M 上下文窗口 · 完全开源 Poolside 迄今为止最强大的模型

    阅读全文 原文 ↗