类目 全部 模型 产品 行业 论文 技巧
  1. 01

    GPT-5.6 系列模型发布:Sol、Terra、Luna

    GPT-5.6: Frontier intelligence that scales with your ambition

    OpenAI 推出 GPT-5.6 系列,包括旗舰 Sol、平衡型 Terra 和成本最优 Luna。在 Agents' Last Exam 上,Sol 以 53.6 分超越 Claude Fable 5(自适应推理)13.1 分;中等推理时以约四分之一成本领先 11.4 分。Terra 和 Luna 以约十六分之一成本超越 Fable 5。在 Artificial Analysis Coding Agent Index 上,Sol 以 80 分创 SOTA,高于 Fable 5 的 2.8 分,使用不到一半输出 token、一半时间,成本低约三分之一。引入 Programmatic Tool Calling 减少中间数据往返,ultra 模式协调多个智能体加速复杂任务。模型配备迄今最强安全防护,经人类红队和自动化测试验证。

    阅读全文 原文 ↗
  2. 02

    OpenAI 推出 ChatGPT Work:可跨应用自主工作的 AI 智能体

    ChatGPT is now a partner for your most ambitious work

    OpenAI 发布 ChatGPT Work,一个能跨应用和文件收集信息、将复杂项目分解为小步骤独立完成并持续工作数小时的 AI 智能体。它内置 Codex 技术,目前每周超 500 万用户使用 Codex,其中超 100 万用于非软件开发场景。ChatGPT Work 由今天同步推出的最新前沿模型 GPT-5.6 驱动,具备多步骤推理和按模板生成材料的能力。该功能今天起面向 Pro、Enterprise 和 Edu 计划推出,未来几天扩展至 Plus 和 Business 计划。桌面版 ChatGPT 在所有计划(含免费版)中提供 Chat、Work 和 Codex 模式,且 Codex 应用已合并至新的桌面应用。

    阅读全文 原文 ↗
  3. 03

    官方支招两种AI方案:Claude Fable 5搭配Sonnet 5省token

    官方支招教你省 Token:两种 AI 方案让 Claude Fable 5 和 Sonnet 5 搭配干活

    Anthropic官方建议将Claude Fable 5用作规划层、Sonnet 5执行任务以降低成本。顾问模式下,Sonnet 5主执行,仅需额外指导时调用Fable 5;SWE-bench Pro测试显示相比完全用Fable 5可达92%性能,成本仅63%。协调者模式下,Fable 5充当规划者,将子任务分派给多个Sonnet 5工作智能体;BrowseComp基准上达到Fable 5单独运行96%表现,成本为46%。

    阅读全文 原文 ↗
  4. 04

    美团 LongCat-2.0 正式开源,同步开放国产卡推理代码

    正式开源!美团 LongCat-2.0 同步开放国产卡推理代码

    美团万亿参数大模型 LongCat-2.0 正式开源,总参数 1.6T,平均激活约 48B,专为真实 Agentic Coding 任务设计。模型引入 LongCat 稀疏注意力机制与 N-gram Embedding,提升长上下文处理效率与 Token 级表示能力。LongCat-2.0 是业界首个在五万卡国产算力集群上完成推理的万亿参数模型,从模型架构、芯片适配到部署策略进行深度协同优化,支持百万上下文高效推理。开源同步提供 BF16、FP8、INT8 等多精度版本及针对国产算力极致优化的推理代码。

    阅读全文 原文 ↗
  5. 05

    Meta 发布 Muse Spark 1.1 低价智能体模型

    (1) Today we're releasing Muse Spark 1.1 -- a strong agentic and coding model at a very low price. I…

    今天我们发布 Muse Spark 1.1--一款价格极低、能力强大的智能体与编程模型。它已通过我们新的 Meta Model API 上线,并集成于 Meta AI 中。

    阅读全文 原文 ↗
  6. 06

    Claude 推出反思功能(Beta)

    Introducing a way to reflect on how you use Claude

    Anthropic 为 Claude 推出一项反思功能(Beta),帮助用户追踪使用模式。用户可回顾过去 1、3、6 或 12 个月的活动总结,涵盖关键主题、使用频率和任务类型。功能结合 4D AI Fluency Framework(委托、描述、辨别、勤勉)提供协作分析,支持设定静音时段或定时休息提醒。隐私方面,不涉及无痕对话和健康集成工具,也不提取连接工具中的底层文件。该功能面向 Free、Pro 和 Max 用户,需开启记忆功能,可通过 Claude 网页或桌面应用设置。

    阅读全文 原文 ↗
  7. 07

    蚂蚁灵波开源实时交互世界模型 LingBot-World 2.0

    无限世界、实时交互,蚂蚁灵波开源 LingBot-World 2.0 世界模型

    蚂蚁灵波开源新一代实时交互世界模型 LingBot-World 2.0(14B 参数),支持施法、攻击、跳跃等丰富角色动作及文本驱动事件(如切换场景、召唤风暴),内置 Pilot Agent 与 Director Agent 实现世界持续演化,并支持多人同时交互。模型采用因果预训练范式和混合双向自回归注意力掩码(MoBA),可稳定输出 720p/60fps 实时画面,长达一小时测试画质不衰减。通过一致性蒸馏与 DMD 降低采样成本,结合注意力 kernel 优化、混合并行推理、动态 KV 缓存调度和异步流媒体传输实现低延迟交互。模型权重及推理代码以非商用协议开源,SGLang 已适配,并提供 Reactor PC 端和灵光 APP 在线体验。

    阅读全文 原文 ↗
  8. 08

    利润超10亿美元、ARR剑指千亿,Anthropic抢先OpenAI冲击IPO

    利润超 10 亿美元、ARR 剑指千亿,Anthropic 抢先 OpenAI 冲击 IPO

    Anthropic今年第三季度利润预计超10亿美元,已于6月1日秘密提交IPO申请,若成功将成为规模最大AI实验室IPO。其与OpenAI的年度经常性收入合计接近1000亿美元。凭借Claude Code在软件开发领域的快速普及,Anthropic在2026年实现AI模型盈利变现,成为B2B市场领跑者。SemiAnalysis报告认为其商业模式优越,若持续良好执行,市值可能触及6万亿美元。

    阅读全文 原文 ↗
  9. 09

    Claude Code 的 Model 与 Effort:知道更多 vs. 更加努力

    http://x.com/i/article/2074606120292020224

    Claude Code 的 model 和 effort 两种设置都旨在提升输出,但机制不同。model 越大,模型能力越强(基于行业标准基准测试)。effort 控制 Claude 在请求上的总工作量,包括思考时间、读取文件数、验证程度、多步任务推进深度等。高 effort 时 Claude 会执行更多操作(读文件、跑测试、再检查);低 effort 时更倾向询问上下文。模型选择本质是切换不同的冻结权重集--权重在训练时固定,prompt 和上下文只能引导(steering)而不能改变权重。模型幻觉是权重产生看似合理但错误的 token 序列。

    阅读全文 原文 ↗
  10. 10

    蚂蚁灵波开源全球首个面向具身智能的MoE视频基模LingBot-Video

    全球首个面向具身智能的视频基模,蚂蚁灵波 LingBot-Video 开源

    蚂蚁灵波科技正式开源LingBot-Video,这是全球首个基于MoE架构、面向具身智能的视频生成基础模型。总参数30B,推理时仅激活约3B,效率较同规模Dense架构提升约3倍。模型引入7万小时VLA、VLN、Ego等机器人数据,并通过多维强化学习奖励系统对齐物理合理性与任务完成度。在RBench上总分0.620,超越Wan2.6等模型;在Physics-IQ Verified评测中排名第一。可用于机器人动作预测、仿真数据生成等方向。

    阅读全文 原文 ↗
  11. 11

    诉讼:男子使用Grok制作7000张继女色情图像后自杀

    Lawsuit: Man used Grok to make 7K sex images of stepdaughter, then shot himself

    一男子使用Grok生成7000张继女儿童性虐待材料(CSAM)后自杀。更多年轻女孩起诉X平台,指控其涉及Grok生成CSAM,并包庇儿童性犯罪者。

    阅读全文 原文 ↗
  12. 12

    消息称特斯拉三代擎天柱人形机器人初步定型,马斯克放话达不成产能目标就开掉整个采购团队

    据晚点LatePost报道,特斯拉Optimus Gen 3经马斯克评审通过,即将量产。供应链要求供应商9月产能达1000台/周,年底升至2000-2500台/周,届时年产能可达10万台。马斯克六月底高管会上要求年底前实现产能目标,否则开除整个Optimus采购团队。弗里蒙特工厂已改造为Optimus生产线,Model S/X于5月停产。马斯克表示初期生产极其缓慢,低产量夏季启动,高产量2027年展开。

    阅读全文 原文 ↗
  13. 13

    TeXada:基于MiniCPM的本地数学Agent发布

    What can lightweight AI models do on your local device? Meet TeXada, a local-first Math Agent power…

    社区开发者基于MiniCPM5-1B和MiniCPM-V 4.6构建了本地优先的数学智能体TeXada。该Agent支持自然语言直接转LaTeX、手写/图像公式OCR转可编辑LaTeX、LaTeX补全与错误修复等核心功能。所有推理在本地完成,无需依赖云服务,保障隐私安全,适用于学生、研究人员和开发者随时随地处理数学表达式。已开源至GitHub,并提供HuggingFace模型下载。

    阅读全文 原文 ↗
  14. 14

    法国对英伟达反垄断调查接近尾声,聚焦 CUDA 生态和产业投资

    法国竞争管理局确认,对英伟达的反垄断调查已近尾声,即将发布正式异议声明。调查聚焦两大问题:市场对CUDA平台的严重依赖,以及英伟达对CoreWeave等AI云计算公司的投资。英伟达占全球AI加速器超70%份额。若认定滥用市场支配地位,最高可处全球年营业额10%罚款。法国是首个准备正式指控英伟达的监管机构。

    阅读全文 原文 ↗
  15. 15

    NVIDIA 发布 Nemotron-Labs-3-Puzzle-75B-A9B:压缩混合 MoE 模型,服务器吞吐量提升 2.03 倍

    NVIDIA Releases Nemotron-Labs-3-Puzzle-75B-A9B: A Compressed Hybrid MoE LLM Delivering 2.03x Server Throughput at Matched User Throughput

    NVIDIA 发布 Nemotron-3-Super 的压缩变体 Nemotron-Labs-3-Puzzle-75B-A9B,总参数从 120.7B 降至 75.3B,活跃参数从 12.8B 降至 9.3B,保持 88 块混合布局(40 Mamba、40 MoE、8 注意力)。在 8×B200 节点上,8K/64K 场景匹配用户吞吐量≥100 tok/s 时,服务器吞吐量提升 2.03 倍。单 H100 上 1M-token 并发从 1 增至 8,权重占用从 70 GB 降至 44.5 GB。迭代式 Puzzle 方法平均得分比单步高 0.57。代价:Arena-Hard-V2 降 4.2 分、SWE-Bench 降 2.6 分。Hugging Face 提供 BF16、FP8、NVFP4 检查点。

    阅读全文 原文 ↗
  16. 16

    Robbyant 发布 LingBot-VLA 2.0:开源 6B 跨实体机器人视觉-语言-动作模型

    Robbyant Releases LingBot-VLA 2.0: An Open-Source 6B Vision-Language-Action (VLA) Model for Cross-Embodiment Robot Manipulation

    Robbyant 推出 LingBot-VLA 2.0,一个 6B 参数的开源视觉-语言-动作(VLA)基础模型。它以 Qwen3-VL-4B-Instruct 为骨干,采用 MoE 动作专家架构,通过 55 维规范向量统一表示不同机器人的状态和动作。训练数据涵盖约 60,000 小时高质量数据(50,000 小时机器人轨迹 + 10,000 小时第一人称人类视频),覆盖 20 种机器人配置。在 GM-100 双机械臂基准测试中,模型在多个平台上超越 π0.5 和之前版本。模型权重、代码和技术报告已以 Apache-2.0 许可开源。

    阅读全文 原文 ↗
  17. 17

    Google Research 推出 SensorFM:面向可穿戴健康数据的通用基础模型

    SensorFM: Towards a general intelligence and interface for wearable health data

    Google Research 发布 SensorFM,一个在超过 100 万亿分钟多模态传感器数据上预训练的大规模基础模型,数据来自 500 万同意参与者,涵盖 100 多个国家及 20 余款 Fitbit 和 Pixel Watch 设备。SensorFM 学习通用的人体生理表征,可迁移至心血管、代谢、睡眠、心理健康及生活方式等 35 项健康预测任务,支持标签高效适配与数据填充,并可作为个人健康智能体的基础工具。该模型旨在解决传统可穿戴健康模型针对单一终点、难以泛化的问题。

    阅读全文 原文 ↗
  18. 18

    GPT-5.6 成为 Microsoft 365 Copilot 首选模型

    GPT-5.6 is now the preferred model in Microsoft 365 Copilot

    OpenAI 宣布 GPT-5.6 将作为 Microsoft 365 Copilot 的首选模型,覆盖 Word、Excel、PowerPoint、Chat 和 Cowork。该集成使用户能在日常工具中以更少提示轮次创建更高质量文档、进行更深入数据分析、生成更精美演示,并完成跨职能协作。GPT-5.6 在每个 token 上提供更实用的工作产出,性价比更强,并支持按需处理最复杂任务。微软通过 OpenAI API 直接调用该模型服务 Microsoft 365 客户。

    阅读全文 原文 ↗
  19. 19

    Seedream 5.0 Pro 登陆 Runway,支持14种语言

    Seedream 5.0 Pro is now in Runway. Generate highly detailed images from a prompt or reference, with …

    Seedream 5.0 Pro 现已登陆 Runway。可通过提示词或参考图生成高细节图像,图像内文字清晰可读,支持多达14种语言。立即点击下方链接尝试。

    阅读全文 原文 ↗
  20. 20

    Meta 发布 Muse Spark 1.1 模型

    Straight from @finkd - Muse Spark 1.1 is live.

    来自 @finkd 的消息 - Muse Spark 1.1 已上线。

    阅读全文 原文 ↗
  21. 21

    Ollama 开发者数达890万,B轮融资由Theory领投

    8.9 Million AI Users

    Ollama 让开源模型在本地或云端轻松运行,保持体验一致。目前拥有890万开发者、6.7万集成,并与各大模型实验室及硬件供应商建立合作。B轮融资由Theory领投。

    阅读全文 原文 ↗
  22. 22

    Anthropic长期利益信托任命本·伯南克为受托人

    Ben Bernanke appointed to Anthropic's Long-Term Benefit Trust

    Anthropic的长期利益信托(LTBT)任命前美联储主席、2022年诺贝尔经济学奖得主本·伯南克为最新受托人。他将与另外三位受托人共同监督公司以对社会长期有益的方式负责任开发先进AI的使命。LTBT独立于管理团队和投资者,受托人不持股、不分红,仅按服务时间获酬。该信托有权向Anthropic董事会任命成员,并就AI风险与社会影响等关键决策提供建议。伯南克将参与公司的经济研究,帮助理解AI对全球劳动力与经济的影响。

    阅读全文 原文 ↗
  23. 23

    Anthropic发起"硬问题"倡议,邀请公众提出AI相关尖锐问题

    Inviting hard questions

    Anthropic作为公益公司,发起"硬问题"倡议,邀请公众就AI对就业、社会、家庭、科学医学等领域的影响提出最尖锐的问题。此前已通过多种方式收集看法:首轮调查询问5.2万美国人;通过Anthropic Interviewer调查了159个国家70种语言的8.1万Claude用户;开展数十场线下焦点小组;并基于匿名真实数据研究Claude使用情况。公司还设立了Anthropic Institute和Long-Term Benefit Trust以监督公益使命进展。Anthropic承诺将公开追踪并报告针对这些问题的具体行动及成效。

    阅读全文 原文 ↗
  24. 24

    Mistral 推出 Studio,为 AI 提示词和技能提供系统记录

    Your Prompts and Skills need a system of record. Studio gives AI prompts & skills a system of record-versioned, owned, and traceable. July 9, 2026 By Mistral

    Mistral 今日推出 Studio,为 AI 提示词和技能提供集中式系统记录。平台将 prompts 和 skills 视为生产资产,支持不可变版本、回滚、明确所有权、分类标签和审计日志,保证变更可追溯。非开发者可直接编辑测试,通过标签将变更推送至生产,保留原有 CI/CD 流程。可观测性让生产输出回溯到对应资产版本,形成闭环治理。现面向 Mistral Studio 客户开放。

    阅读全文 原文 ↗