类目 全部 模型 产品 行业 论文 技巧
  1. 01

    GPT-5.6 Sol Ultra 一小时证明50年数学猜想

    GPT-5.6 Sol Ultra produced a proof of a 50 year old math conjecture. Unlike the Erdős Unit Distance …

    OpenAI 的 GPT-5.6 Sol Ultra 模型成功证明了存在50年之久的 Cycle Double Cover Conjecture(圈双覆盖猜想)。该模型已于昨日全面开放,在不到一小时内使用64个子智能体(subagents)完成证明。Noam Brown 强调,与之前需要特殊条件的埃尔德什单位距离问题不同,此次成果基于当前可公开获取的模型,并已公开提示词和证明过程。

    阅读全文 原文 ↗
  2. 02

    宇树G1人形机器人完成首例活体微创手术

    A new Nature paper shows Unitree's G1 humanoid robot performing what researchers call the first live…

    一篇新的《自然》论文展示了宇树G1人形机器人执行研究人员所称的首例由人形机器人完成的活体标准微创手术。加州大学圣地亚哥团队使用G1,以常规手术器械完成了对两只活猪的腹腔镜胆囊切除术;第二次手术耗时32分钟。该机器人仍需反复校正,且尚无法满足手术无菌标准,但其成本可能仅为达芬奇系统的约5%。

    阅读全文 原文 ↗
  3. 03

    博科圣地如何利用前沿AI技术

    恐怖组织"博科圣地"如何利用前沿人工智能技术

    2025至2026年间对尼日利亚东北部27名前"博科圣地"成员的半结构化访谈揭示了该组织在2024年系统性地利用前沿AI技术。两大派系均使用ChatGPT、Claude、Gemini、Grok、Meta AI和DeepSeek辅助作战与日常运作,AI应用已通过专门小组和内部培训实现制度化。成员成功绕过部分安全限制,将AI用于袭击策划、武器故障排查及爆炸装置设计。相关技术通过跨国圣战网络传播,伊斯兰国特工提供了面对面培训。受访者对AI表现出强烈热情,部分人对大规模杀伤性武器持开放态度,但记录在案的使用仍限于常规手段。

    阅读全文 原文 ↗
  4. 04

    OpenAI GPT-5.6-Sol 删光 AI 创业者 Matt Shumer 的 Mac 硬盘

    真是能力越强,破坏力越大啊! 这个老哥Mac上的文件被OpenAI最顶的GPT-5.6-Sol删光了,估计所有跑本地AI Agent的人看到这个都得吓出一身冷汗🤯整个事件详细拆解,以及怎么避免类似悲…

    知名 AI 创业者 Matt Shumer 的 Mac 硬盘被 OpenAI 最新 Agent 模型 GPT-5.6-Sol 彻底清空。他在本地 Agent 上开启 Full Access 权限,让 subagent 执行文件清理任务,结果 shell 变量 $HOME 路径解析错误,Agent 直接执行 `rm -rf /Users/mattsdevbox`,导致数年代码、文件、照片丢失。该任务此前已安全运行数百次。事后 Agent 自动生成事故报告承认错误。Matt 表示"1000x 更信任 Anthropic 的 Fable"。事件暴露 Agent 行业核心风险:顶级模型仍会在变量展开、路径等细节翻车;Subagent + 长时自主运行 + 全权限构成灾难放大器;模型厂商安全底线差异巨大。

    阅读全文 原文 ↗
  5. 05

    Meta 关闭 Instagram 用户可基于公开账户生成 AI 深度伪造图片的功能

    Meta turns off the Instagram feature that let users make AI deepfakes of public accounts

    在遭到强烈反对后,Meta 关闭了本周早些时候推出的一项 Instagram 功能。该功能允许用户通过 @ 提及公开 Instagram 账户,基于其内容生成 AI 图片,且无需账户所有者许可。Meta 在关于其新 Muse Image AI 模型的博客文章更新中表示,其初衷是提供有用的创意工具并给予用户认可,但用户反馈表明该功能可能被滥用。

    阅读全文 原文 ↗
  6. 06

    蚂蚁集团 Robbyant 发布 LingBot-VA 2.0,首个原生具身基础模型

    Ant Group's Robbyant Unveils LingBot-VA 2.0: A Causal Video-Action Model Built Natively for Physical AI

    蚂蚁集团旗下具身智能团队 Robbyant 发布 LingBot-VA 2.0,首个原生具身基础模型。该模型采用因果 DiT 架构,视频专家约 13.0B 参数(约 1.9B 激活),训练规模约 15.3B 参数,推理时每 token 约 2.5B 激活。模型引入多块预测(MCP)实现 2.3 倍训练加速,并通过前瞻推理将推理延迟降至 142 ms/chunk。在 RoboTwin 2.0 的 50 个任务上,干净与随机演示数据平均成功率分别达 93.8% 和 93.4%。

    阅读全文 原文 ↗
  7. 07

    GPT-5.6 提升健康智能,Luna 性能更强成本更低

    GPT-5.6 is a major step forward for health intelligence. Across the lineup, we're delivering strong…

    GPT-5.6 是健康智能领域的一大进步。 在整个产品线中,我们以更低成本提供更强性能:GPT-5.6 Luna 在最高推理设置下性能优于 GPT-5.5,而成本降低 25 倍。 这些进步共同提升了质量,同时让全球更多人能够使用先进模型。

    阅读全文 原文 ↗
  8. 08

    11天Claude Fable 5写超100万行代码:Rust重构JavaScript运行时Bun

    11 天 Claude Fable 5 狂写超 100 万行代码:Rust 重构 JavaScript 运行时 Bun

    开发者Jarred Sumner借助Claude Fable 5模型,11天内将Bun从Zig重写为Rust,64个实例并行编写超100万行代码,API费用约16.5万美元。重构主因是Zig频繁内存错误,Rust可在编译时捕获。Bun v1.4.0以Canary版本发布,修复128个错误,速度提高约2%到5%。Bun团队已于2025年12月被Anthropic收购。

    阅读全文 原文 ↗
  9. 09

    GPT-5.6 健康智能升级,Luna 性能提升成本降 25 倍

    GPT-5.6 for health intelligence, the team has been focusing hard on improvements here:

    GPT-5.6 用于健康智能,团队一直专注于这方面的改进: 整个产品线中,我们以更低成本提供更强性能:GPT-5.6 Luna 在最高推理设置下性能优于 GPT-5.5,而成本降低 25 倍。 这些进步共同提升了质量,同时让全球更多人能够使用先进模型。

    阅读全文 原文 ↗
  10. 10

    GigaChat Audio:支持120分钟输入的时间感知音频大语言模型

    GigaChat Audio: Time-aware Large Audio Language Model

    GigaChat Audio 是一种时间感知的音频大语言模型,支持长达120分钟的输入,并能生成带有明确时间戳的问答、片段描述和摘要。该模型通过将周期性时间标记与连续音频 token 交错,并利用级联合成数据管道进行大规模训练,在短时和长时基准上均实现了强时间定位精度。研究团队已开源模型权重及超过1万小时的时序数据集。

    阅读全文 原文 ↗
  11. 11

    Claude Code桌面版新增应用内浏览器

    Claude Code on desktop now has an in-app browser. Claude can pull up docs, designs, or any other si…

    Claude Code 桌面版现在有了应用内浏览器。 Claude 可以调出文档、设计稿或任何其他网站。它可以像操作本地开发服务器一样,进行阅读、点击浏览和交互。 该浏览器采用沙盒机制且可配置:你可以自行选择会话是否持久保留。

    阅读全文 原文 ↗
  12. 12

    ChatGPT Work 将智能体推向消费级规模

    ChatGPT Work brings agents to consumer scale. It's both a step up in usability (you can just do thi…

    ChatGPT Work 将智能体带到消费级规模。 它在可用性(你只需在手机上操作,无需笔记本电脑)和可及性上都有提升,适用于个人和职业生活。 非常期待看到人们如何使用它,以及它如何赋能用户!

    阅读全文 原文 ↗
  13. 13

    Greg Brockman 推出开源项目 Tend,将收件箱等转化为 AI 循环系统

    Knowledge work different more - becoming more productive, high leverage, and IMO fun.

    OpenAI 联合创始人 Greg Brockman 宣布推出实验项目 Tend,这是一个开源提示词和代码仓库,可将收件箱、招聘流程或客服队列转化为可在 ChatGPT Work 中管理的 AI 循环系统。Tend 基于 GPT-5.6 构建,能自动扫描邮件、判断优先级、研究上下文并生成摘要和回复建议,用户可批准或编辑。每次处理后,智能体从用户修订中学习并记住偏好。Brockman 认为知识工作正从处理单个任务转向管理 AI 循环系统。

    阅读全文 原文 ↗
  14. 14

    蚂蚁集团开源 AKernel:面向 AI 智能体的可编程数据中心基础设施

    inclusionAI/AKernel

    蚂蚁集团开源 AKernel(Agent Kernel),一个将整个数据中心视为 AI 智能体可编程扩展的分布式内核。它通过统一 Python SDK 实现计算、网络和存储的编程控制,支持单机、私有 K8s 及多云(阿里云、华为云)一键部署,冷启动仅需 40 毫秒。AKernel 代码由 AI 大量贡献,并内置基于 OpenTelemetry 的全栈可观测性。

    阅读全文 原文 ↗
  15. 15

    Mira Murati 新公司 Thinking Machines Lab 获 20 亿美元融资

    A year ago we set out to empower humanity with a focus on multimodal AI, custom models, and open sci…

    Mira Murati 创立的 Thinking Machines Lab 宣布获得 20 亿美元融资,由 a16z 领投,NVIDIA、Accel 等参投。公司专注于多模态 AI、定制模型和开放科学,将在未来几个月推出首款产品,包含重要的开源组件,面向研究人员和初创公司。

    阅读全文 原文 ↗
  16. 16

    蚂蚁 inclusionAI 开源沙箱生命周期服务 sandboxd

    inclusionAI/sandboxd

    蚂蚁集团 inclusionAI 在 GitHub 开源 sandboxd,这是 AKernel 使用的 Linux 沙箱生命周期服务,通过 gRPC API 管理沙箱资源,当前基于 gVisor 运行沙箱,并计划近期开源 Kata Containers 支持。

    阅读全文 原文 ↗
  17. 17

    Claude Code v2.1.207 发布

    v2.1.207

    Claude Code v2.1.207 发布。Auto 模式在 Bedrock、Vertex AI 和 Foundry 上无需 `CLAUDE_CODE_ENABLE_AUTO_MODE` 即可使用,可通过 `disableAutoMode` 设置关闭。修复了流式响应中包含超长列表、表格、段落或代码块时终端冻结和按键延迟的问题;修复了非交互式运行中远程托管设置被永久记录为已同意而未显示安全同意对话框的问题;修复了自动更新程序每次发布时覆盖 `~/.local/bin/claude` 自定义启动脚本或符号链接的问题。Bedrock、Vertex 和 Claude Platform on AWS 默认切换为 Claude Opus 4.8。Auto 模式不再从 `.claude/settings.local.json` 读取 `autoMode`,改为使用 `~/.claude/settings.json`。修复了 Windows 上 AWS 凭证解析卡住时无限挂起的问题,60 秒超时保护现在生效。

    阅读全文 原文 ↗