类目 全部 模型 产品 行业 论文 技巧
  1. 01

    xAI 官方 Grok CLI 被曝静默上传整个代码库及用户密钥

    我只让Grok回复一个单词,它就把我整个代码库都偷走了。

    安全研究者发现,xAI 官方 Grok CLI(npm 包 `@xai-official/grok` 0.2.93 版)会在每轮任务前后,将当前工作目录打包为 `before_codebase.tar.gz` 和 `after_codebase.tar.gz`,通过独立旁路通道静默上传至 xAI 的 Google Cloud 仓库。验证显示,即使模型仅回复一个单词,上传依然发生。上传包还包含仓库外的 `~/.claude.json`、Claude Code 设置、全局 AGENTS 规则、30 多个 Skill 文件及一个 API 密钥。7 月 13 日凌晨,xAI 通过服务端远程开关新增 `disable_codebase_upload` 字段,将默认上传行为关闭,但此前该功能默认开启。

    阅读全文 原文 ↗
  2. 02

    腾讯混元开源 HyOCR-1.5:1B 端到端 OCR 大模型推理提速 6.37 倍

    训推全开源:HyOCR-1.5 让端到端 OCR 大模型跑得更快、看得更准、功能更全

    腾讯混元开源端到端 OCR 大模型 HyOCR-1.5,仅 1B 参数覆盖 8 种以上 text-centric 任务,在 OmniDocBench v1.6 上以 94.74 分居端到端第一。

    阅读全文 原文 ↗
  3. 03

    Meta 宣布扩建路易斯安那州数据中心至 5GW,总投资超 500 亿美元

    总投资超 500 亿美元,Meta 宣布扩建路易斯安那州数据中心至 5GW 规模

    Meta 将其路易斯安那州数据中心算力扩至 5GW,总投资超 500 亿美元,为全球最大 AI 基础设施投资之一。Meta 承诺承担全部能源及水资源费用,并另投超 10 亿美元改善当地道路及供水系统。此外,Meta 与安特吉公司达成协议,为新建天然气发电厂、储能电池及核电增容项目提供资金支持。

    阅读全文 原文 ↗
  4. 04

    黄仁勋:英伟达季度收入逼近千亿美元,Rubin Ultra 架构未延期

    英伟达CEO黄仁勋在摩根士丹利路演中表示,公司季度营收即将逼近1000亿美元,且增长速度仍在加快。他否认下一代旗舰架构Rubin Ultra延期传闻,称其仍按计划于明年出货,当前机架设计调整仅为系统架构优化。一个此前主要依赖ASIC的前沿AI模型项目,如今英伟达GPU算力占比已接近50%,市场普遍指向Anthropic。英伟达预计本财年CPU业务收入约200亿美元,下一代Vera CPU将进军通用服务器市场。摩根士丹利维持英伟达"增持"评级,目标价288美元。

    阅读全文 原文 ↗
  5. 05

    小米发布Xiaomi-Robotics-U0:380亿参数多模态自回归模型统一具身合成

    Xiaomi-Robotics-U0: Unified Embodied Synthesis with World Foundation Model

    小米推出Xiaomi-Robotics-U0,一个380亿参数的多模态自回归模型,用于统一具身合成。该模型将具身生成视为基础图像与视频生成的延伸,联合优化文生图、图像编辑、具身场景生成、具身迁移及具身视频生成。它是首个支持跨多种机器人形态的高质量多视角场景生成模型,并引入结构化可控具身迁移。该模型在单步与序列生成任务上达到SOTA,在具身场景生成与迁移的人类评估中超越GPT-Image-2.0,在World Arena具身视频生成排名第一,并将pi_0.5在真实世界操控任务上的分布外成功率从36.9%提升至63.2%。代码与检查点已开源。

    阅读全文 原文 ↗
  6. 06

    腾讯混元发布 HyOCR-1.5:端到端 OCR 大模型全栈开源,推理提速 6.37 倍

    训推全开源:HyOCR-1.5 让端到端 OCR 大模型跑得更快、看得更准、功能更全

    腾讯混元发布 HyOCR-1.5,这是端到端 OCR 大模型领域首个将训练、推理、模型权重完整开源的专家模型。仅 1B 参数,覆盖 8 种以上 text-centric 任务。引入 DFlash 投机解码框架,在 Transformers 下实现 6.37× 加速,vLLM 下 2.14× 加速,端到端推理达每页 1.408s。支持 4K 分辨率与 128K 上下文窗口,通过 Agentic Data Flow 扩展低资源 OCR(331 种语言)、古文字识别与多图问答能力。在 OmniDocBench v1.6 上以 94.74 分居端到端第一。

    阅读全文 原文 ↗
  7. 07

    Codex与ChatGPT Work多项更新:取消5小时限制

    Morning. The last 48 hours of Codex and ChatGPT Work have been intense! Three important updates: - …

    早上好。过去48小时里,Codex和ChatGPT Work非常忙碌!三项重要更新: - 暂时取消所有Plus、Business和Pro计划的5小时使用限制 - 正在推出变更,使GPT 5.6 Sol整体更高效,这将体现在使用量减少上,从而让你能走得更远。具体影响待量化后公布 - 我们已达到600万活跃用户,并将在接下来一小时内进行使用量重置 去创造吧。

    阅读全文 原文 ↗
  8. 08

    腾讯混元发布Hy3模型:295B参数MoE架构,Agent向LLM定位,已集成微信服务10亿+用户

    这个我看第一眼直接卧槽,效果有点炸裂, 腾讯这几个月到底发生了什么,前面组织架构调整,老登高管退位,年轻一代掌权的结果吗? 兄弟们看这个,腾讯Hy3 把你摄像头直接调起来了, 手往镜头前一伸,整只手的…

    腾讯混元团队发布Hy3模型,采用295B总参数、21B激活参数的MoE架构,推理效率可打平参数规模2-5倍的旗舰模型。Hy3定位为Agent向LLM,从preview到正式版基于50多个真实业务反馈迭代,内部WorkBuddy任务成功率从72%提升至90%,耗时降低34%,幻觉和常识错误持续下降。实测显示其在coding、办公、复杂任务规划方面表现突出,纯视觉能力为短板。Hy3已集成至微信服务10亿+用户,视频演示包括生成HTML网页、Agent网页和10页PPT,模型具备自检和主动说明不足的能力。

    阅读全文 原文 ↗
  9. 09

    Juggler:一款开源 GUI 编程智能体,由 JUCE 创建者开发

    Show HN: Juggler - an open-source GUI coding agent, by the creator of JUCE

    Juggler 是一款开源 GUI 编程智能体,提供可视化工作台,支持可检查的工具调用、分支线程和可编辑上下文。会话以树状结构组织,而非线性聊天记录,用户可创建子线程、回溯、比较和编辑。所有关键信息以 Finder 风格 Miller 列展示。Juggler 支持本地、远程或同时运行,桌面应用与浏览器可连接同一会话。模型支持包括 Claude Code、OpenAI、Gemini、Ollama、OpenRouter、Z.AI、Deepseek 等。后端使用 Go 和 Wails,UI 为 HTML/JS。

    阅读全文 原文 ↗
  10. 10

    德国AI协会发布开源模型Soofi S,在英语和德语基准测试中领先

    German AI consortium releases Soofi S, an open 30B model that tops benchmarks in both English and German

    德国AI协会协调的研究联盟发布开源大语言模型Soofi S 30B-A3B。该模型总参数量316亿,每个token仅激活约32亿参数,采用Mamba-2与标准注意力层混合的MoE架构。模型完全在德国电信慕尼黑工业AI云上训练,训练数据中德语占比从第一阶段的7.2%提升至第二阶段的15.3%。在基准测试中,Soofi S在所有完全开源模型中取得英语和德语综合最高分,超越OLMo 3 32B和Apertus 70B。在HumanEval上得分73.8%,MBPP得分70.2,德语版MBPP得分84.2。上下文窗口支持最高100万token,在4万token长度下,生成吞吐量约为同规模稠密模型的8倍。模型权重已开源。

    阅读全文 原文 ↗
  11. 11

    Ploy 将 AI 智能体默认模型从 Claude Opus 4.8 切换至 GPT-5.6 Sol

    将生产环境中的AI代理迁移至GPT-5.6:速度提升2.2倍,成本降低27%

    Ploy 将其 AI 智能体默认模型从 Claude Opus 4.8 切换至 OpenAI 今晨发布的 GPT-5.6 Sol。在真实营销网站构建测试中,GPT-5.6 Sol 完成页面平均耗时 3 分 42 秒,较 Opus 4.8 的 8 分钟快 2.2 倍;每次构建成本从 3.06 美元降至 2.22 美元,降低 27%;输出 token 从 33.0K 降至 17.1K,视觉评分从 0.936 提升至 0.970。迁移过程发现,GPT-5.6 会为所有 25 个工具参数填充默认值,导致 52%-64% 的文件读取返回空结果;提示词指令和 OpenAI strict 模式均无法修复此行为。此外,评估框架中约三分之一的原始失败源于针对旧模型的假设,而非模型本身问题。

    阅读全文 原文 ↗
  12. 12

    OpenAI 为 50 万 ChatGPT Work 和 Codex 用户增加"banked reset"功能

    Added a banked reset to 500k users of ChatGPT Work and Codex. What's been happening: - Just release…

    OpenAI 为 50 万 ChatGPT Work 和 Codex 用户增加了"banked reset"功能,现已支持网页和移动端使用,此前仅限桌面端。期间曾出现 2 小时窗口内不到 10% 用户重置未生效的问题,OpenAI 为所有在该窗口内点击重置按钮的用户补发了重置额度。明天将庆祝 700 万活跃用户里程碑,并向所有 ChatGPT Work 和 Codex 用户发放首次重置额度,同时发布桌面端多项更新。

    阅读全文 原文 ↗