类目 全部 模型 产品 行业 论文 技巧
  1. 01

    苹果诉OpenAI窃取商业机密:指控涉及400多名前员工及"LOL"消息

    The wildest allegations in Apple's trade secrets lawsuit against OpenAI

    苹果在一份41页诉状中指控OpenAI系统性窃取其商业机密。诉状称,OpenAI前硬件主管Tang Yew Tan(曾在苹果任职24年)指示面试者携带苹果"实际零件"和"原型机"参加面试。苹果声称,一名前员工在发现可访问苹果网络存储后发消息称"LOL,太搞笑了",并利用认证漏洞从同事电脑持续窃取数据。诉状透露,已有超过400名前苹果员工在OpenAI任职。

    阅读全文 原文 ↗
  2. 02

    Kimi K3 发布:2.8T 参数开源模型,具备原生视觉与百万 token 上下文窗口

    Kimi K3

    月之暗面发布 Kimi K3,一个 2.8T 参数的开源模型,采用 Kimi Delta Attention 和 Attention Residuals 架构,支持原生视觉能力与 100 万 token 上下文窗口。

    阅读全文 原文 ↗
  3. 03

    腾讯混元将Hy3旗舰模型量化至1bit与4bit,单卡即可部署

    极致量化,近三千亿参数 Hy3 单卡即可部署

    腾讯混元将295B参数的Hy3旗舰模型权重量化至1bit与4bit并打包成GGUF,配合llama.cpp生态,使原本需多卡集群部署的模型最少一张96GB推理显卡即可运行。1bit版将权重从598GB压缩至85.5GiB,4bit版体积169.9GiB,两张显卡可承载;量化版在长文理解、Agent与代码任务上贴近满血效果,开启MTP后解码速度提升约50%-60%。

    阅读全文 原文 ↗
  4. 04

    OpenAI 面向普通用户发布提示词指南:从结果出发,少写步骤

    OpenAI's new prompting guide tells users to stop overthinking and start with the result

    OpenAI 整合了一份面向普通用户的提示词指南,涵盖目标、上下文、输出格式和边界四个可选模块。指南建议以结果而非步骤开头,用一两条硬性规则替代逐步骤脚本。Chat 处理快速任务,基于 Codex 技术和 GPT-5.6 模型的 ChatGPT Work 负责多源、多步骤的复杂项目。Codex 新增 Steer(重定向当前运行)、Queue(排队下一条消息)和沙盒模式,支持 `/plan`、`/goal` 和 `/review` 等斜杠命令。用户无需一次性写对提示词,后续追问是预期调整方式。

    阅读全文 原文 ↗
  5. 05

    前沿模型实际成本:tokenizer 差异导致隐性涨价

    前沿模型的实际价格。代币 * 价格,对吧?

    同一份 TypeScript 文件在 GPT-5.x 上为 681 个 token,在 Claude 最新 tokenizer 下为 1,178 个,相差 1.73 倍。Anthropic 新 tokenizer 比旧版多产生约 30% 的 token,标价不变,构成隐性涨价。Claude Opus 4.6 与 Opus 4.8 标价同为 $5.00 / $25.00,但新 tokenizer 使同一代码的 token 数增加约 32%。Claude Sonnet 5 的 $2.00 / $10.00 为促销价,2026 年 8 月 31 日后恢复 $3.00 / $15.00,届时相同代码成本将比 Sonnet 4.6 高出约 32%。跨厂商对比中,Claude 新 tokenizer 在代码上比 GPT 多产生 1.50x 至 1.73x 的 token,TypeScript 差距最大。

    阅读全文 原文 ↗
  6. 06

    普林斯顿教授 Narayanan 提出"AI as Normal Technology"框架

    What will be left for us to work on?

    普林斯顿大学教授 Arvind Narayanan 在 ICML 上提出,除非出现递归自我改进等不连续性,否则 AI 应被视为一种变革性但可适应的正常技术。他呼吁 AI 社区不应接受工作将被完全取代的叙事,而应专注于培养与 AI 互补的技能,以实现人机"共超智能"。

    阅读全文 原文 ↗
  7. 07

    实测LibTV Agent:100个AI视频工作流重组为Skill,实现创意自由

    实测LibTV Agent,把100个AI视频工作流重组成Skills后我创意自由了

    LibTV推出Agent功能并内置Skill Hub,提供100多个覆盖武侠电影、皮克斯动画广告、电商口播等类型的视频Skill。用户输入想法后,Agent会分析需求并询问方向,自动生成视频分镜并串联成完整节点工作流,每个节点可查看和修改提示语。生成后LibTV会启动自查机制,自动检测并返修有问题的镜头。故事板视图提供图片与视频资产总览,支持在成片中直接打开剪辑时间线进行精细调整。用户还可自行创建Skill,上传三个文件即可,无需编程。实测中,Agent能输出剧情连贯、带粤语配音的成片,并支持双语字幕生成。

    阅读全文 原文 ↗
  8. 08

    商汤开源 SenseNova-Vision-7B-MoT 多任务视觉模型

    SenseNova-Vision-7B-MoT, fully open-sourced: one model, �…

    商汤发布并完全开源 SenseNova-Vision-7B-MoT,一个统一处理检测、OCR、GUI、深度与法线估计、分割、多视图等主要视觉任务的模型。该模型支持通过自然语言定义新的视觉任务变体,跨传统任务边界重组视觉能力。开源内容包括模型权重及 SenseNova-Vision Corpus(含 5000 万示例子集及复现剩余公开数据的完整工具包)。

    阅读全文 原文 ↗
  9. 09

    Boogu-Image-0.1 发布:开源统一多模态理解与生成模型,训练成本仅约 40 万美元

    Boogu-Image-0.1: Boosting Open-Source Unified Multimodal Understanding and Generation

    Boogu-Image-0.1 系列开源统一多模态理解与生成模型发布,包含 Base、Turbo、Edit 和 Edit-Turbo 四个变体,支持高质量文生图、快速推理、指令编辑及中英双语文本渲染。

    阅读全文 原文 ↗
  10. 10

    腾讯混元 Hy3 量化版发布:1bit 版本单卡可部署,4bit 版本接近满血性能

    极致量化,近三千亿参数 Hy3 单卡即可部署

    腾讯混元团队为旗舰模型 Hy3(295B 参数)推出量化版本。1bit 版本(IQ1_M)将权重从 598 GB 压缩至 85.5 GiB,缩小 6.7 倍,单张 96GB 推理显卡即可部署;4bit 版本(Q4_K_M)体积 169.9 GiB,两张显卡可承载。量化版在 Agent、多语言代码、工具调用、长文理解等任务上表现接近满血模型。团队还提供 GPTQ Int4 版本,支持 vLLM 部署。配合 MTP 投机解码,1bit 版本解码速度提升约 50%,4bit 版本提升近 60%。所有版本已开源并打包为 GGUF 格式,适配 llama.cpp 生态。

    阅读全文 原文 ↗
  11. 11

    高德发布通用世界模型工坊 ABot-WorldStudio,已开放测试

    内置"任意门",高德发布通用世界模型工坊 ABot-WorldStudio

    阿里巴巴旗下高德发布通用世界模型工坊 ABot-WorldStudio,并开放测试。该产品将交互式视频生成与 3DGS 场景生成统一,用户输入文字或图片即可生成可实时交互、可分享的 AI 世界。工坊内置"时空任意门",穿越后可跃迁至另一完整 3D 世界。官方实测单次连续推理稳定运行超1小时,无崩溃、无质量衰减。底层模型 ABot-World0 与 ABot-3DWorld0 均可在单张 5090 上本地部署,已全面开源。

    阅读全文 原文 ↗
  12. 12

    纽约州暂停所有新建大型数据中心项目

    New York State halts construction of all new data centers

    纽约州成为全美首个暂停数据中心建设的州。州长Kathy Hochul签署行政令,暂时禁止州政府批准50兆瓦及以上大型数据中心的新建许可,可能影响十余个项目。Hochul表示数据中心不应带来更高的电费、水资源消耗或噪音污染,且不能豁免地方区划和审批。禁令将在州政府完成数据中心环境审查流程后解除,预计耗时约一年。Hochul还考虑要求数据中心为州电网提供资金支持,并阻止超大规模数据中心享受税收优惠。此举正值纽约州立法机构推进更严格措施之际,上月一项法案已推进暂停20兆瓦以上数据中心建设一年。

    阅读全文 原文 ↗
  13. 13

    Google AI 发布 Gemini 3.5 Live Translate,支持 70+ 语言近实时语音到语音翻译

    http://x.com/i/article/2067347903761485824

    Google AI 发布 Gemini 3.5 Live Translate,支持 70+ 语言、近实时延迟的语音到语音翻译。该模型直接处理原始音频流,保留说话者语调、节奏和音高。东南亚超级应用 Grab 正探索将其用于司机与乘客间的跨语言沟通,其用户每月发起超 1000 万次语音通话。开发者可通过 Gemini Live API 集成 LiveKit、Fishjam、Pipecat 或 Vision Agents 构建应用。LiveKit 已实现虚拟会议室多语言即时理解;Software Mansion 结合 MoQ 协议突破流媒体瓶颈;VisionAgents AI 展示了动态多语言切换能力。开发者可在 Google AI Studio 试用并获取 Cookbook 示例代码。

    阅读全文 原文 ↗
  14. 14

    GPT-5.6 sol 价格减半 token 效率翻倍

    GPT-5.6 sol is half the price and ~twice as token efficient as fable in many cases for accomplishing…

    GPT-5.6 sol 价格减半,且在多数情况下完成相同任务时 token 效率约为 fable 的两倍。 很高兴能以四分之一的价格交付。

    阅读全文 原文 ↗
  15. 15

    普林斯顿教授 Narayanan 在 ICML 2026 发表主旨演讲:AI 作为正常技术,人类应主动适应而非躺平

    那我们还能做些什么呢?

    普林斯顿大学教授 Arvind Narayanan 在首尔 ICML 2026 上发表主旨演讲,提出三个核心论点:第一,"AI 作为正常技术"框架是思考 AI 影响的正确方式;第二,即使应认真对待递归自我改进,实验室中没有任何里程碑会突然让所有人失业;第三,未来工作将发生根本性变化,需要大量适应。他呼吁 AI 社区不应接受工作被取代,而应主动建立与 AI 互补的技能(如判断力、品味),并展望了人类与 AI 的"共超智能"愿景。

    阅读全文 原文 ↗
  16. 16

    视频生成创企 PixVerse 完成 4.39 亿美元 C 轮扩展融资,估值超 20 亿美元

    Video generation startup PixVerse raises $439M, valuation soars past $2B

    新加坡视频生成初创公司 PixVerse 完成 C 轮扩展融资,共筹集 4.39 亿美元,估值突破 20 亿美元。公司提供 V 系列(消费者及 API)、C 系列(专业影视)及今年初发布的 R 系列世界模型(游戏开发)。用户可生成最高 4k 分辨率并自带音频的视频,消费端注册用户超 1.5 亿,月活超 1500 万,图生视频每分钟 4.80 美元。本轮投资者包括阿里巴巴等。公司计划今年推出新 V 系列模型及新版世界模型,并全球拓展企业客户。

    阅读全文 原文 ↗
  17. 17

    DiffusionGemma 发布:文本扩散模型实现 4 倍加速推理

    DiffusionGemma: 4x faster text generation

    Google 发布实验性开源模型 DiffusionGemma,采用文本扩散技术并行生成 256 token 块,推理速度最高提升 4 倍。该 26B MoE 模型仅激活 3.8B 参数,量化后适配 18GB VRAM 消费级 GPU,在单张 H100 上达 1000+ tokens/s。

    阅读全文 原文 ↗
  18. 18

    Demis Hassabis:AGI 数年可至,影响达工业革命10倍

    http://x.com/i/article/2076946210397552640

    Google DeepMind 联合创始人 Demis Hassabis 发文称,AGI 可能仅需数年即可实现,其影响将达工业革命的10倍且速度更快。他指出,前沿模型在网络安全、核与生物风险方面已构成挑战,未来需对日益智能体化、递归自我改进的系统建立稳健防护。Hassabis 呼吁美国率先建立类似 FINRA 的前沿AI标准机构,采用联邦监督下的公私合作或自律组织模式,由独立技术专家和开源代表组成董事会,资金主要来自行业以吸引顶尖人才和算力。他强调,当前商业与地缘竞赛导致技术进步快于理解,需以谨慎乐观态度推进公共政策,兼顾创新与安全。

    阅读全文 原文 ↗
  19. 19

    合成随机向量数据会误导 PostgreSQL 和 AlloyDB 的向量搜索性能测试

    How your sample data impact vector tests in PostgreSQL and AlloyDB.

    Google AI 工程师指出,使用合成随机向量数据测试向量搜索性能可能导致误导性结果。对于 HNSW 索引,合成数据构建耗时 6,601,789 毫秒,而真实数据仅需 4,174,196 毫秒,速度快 1.5 倍,因为随机向量缺乏自然聚类结构,使图索引的节点连接更难建立。

    阅读全文 原文 ↗
  20. 20

    Claude Enterprise Admin API 开放 Beta 版,支持用户与群组管理

    Claude Platform release notes - July 14, 2026

    Claude Enterprise 组织现可通过 Admin API(Beta)管理成员、群组及自定义角色,包括按邮箱查找、更改角色、移除成员及管理邀请。群组与自定义角色请求需添加 `anthropic-beta: ce-user-management-2026-07-13` 标头,拥有 `read:org_audit` 权限的密钥可调用所有 GET 端点。

    阅读全文 原文 ↗
  21. 21

    Anthropic 推出 Claude for Teachers

    Introducing Claude for Teachers

    Anthropic 发布 Claude for Teachers,为美国认证的 K-12 教师免费提供高级 Claude 功能、教学技能库及对接全美 50 州学术标准的课程资源。该工具连接 Learning Commons,可调用 OpenSciEd、IM v.360 等课程资源,并集成 ASSISTments、Brisk Teaching、Canva Education 等第三方工具。教师可基于高质量教材规划课程、为不同水平学生差异化教学,还能通过 Claude Code 和 Cowork 自动分析班级数据、安排重复任务。教师数据不用于模型训练,学生信息受 FERPA 合规的 K-12 数据处理附录保护。Anthropic 同时发布与 Teach for America 及美国教师联合会共创的 AI 素养课程。

    阅读全文 原文 ↗
  22. 22

    Google ADK 2.4.0 发布:Agent 可直接触发动态工作流

    The (no longer) missing multi-agent pattern: triggering dynamic workflows from an agent

    Google 发布 ADK 2.4.0,允许将 Workflow 直接注册为 Agent 的工具列表中的一等工具,使协调 Agent 能自动调用动态工作流。该模式通过 `@node` 装饰器定义动态执行节点,支持在运行时根据用户输入的任务列表迭代调用子 Agent 生成执行计划。示例使用 gemini-3.5-flash 模型实现任务协调,代码已开源至 devrel-demos 仓库。

    阅读全文 原文 ↗
  23. 23

    小红书企业级 AI 个人助理:从 0 到全员覆盖的架构实践

    小红书企业级 AI 个人助理--从 0 到全员覆盖

    小红书以 3 人 3 天推出内测版本,约一个月实现全员覆盖,核心是 AI Native 项目运作机制。技术选型基于 OpenClaw 二次开发,通过 Seal AI Zone 隔离集群与 NEX 沙箱解决安全,Self-GC 使输入 Token 下降 10%~15%、Auto 模式路由使成本降低 69%,并自研 LLM Wiki 三层记忆架构与 Skill Hub 生态。

    阅读全文 原文 ↗
  24. 24

    Anthropic 经济指数:加拿大 Claude 使用情况分析

    How Canada uses Claude: Findings from the Anthropic Economic Index

    基于2026年2月Claude.ai对话样本,加拿大占全球流量的2.6%,人均使用量是预期的4.4倍,在总使用量前十国家中仅次于美国。加拿大内部采用率高度集中:安大略省占43.9%对话,不列颠哥伦比亚省人均使用量达预期的1.4倍,而纽芬兰与拉布拉多省仅为0.2倍。省级人均使用量与收入无关,而与专业、科学和技术服务业的就业占比高度相关。各省使用场景稳定:工作占34-40%,课程作业占13-18%,个人用途占44-51%。翻译请求与公共管理就业份额正相关,反映加拿大联邦双语政策;文档翻译是加拿大相对于其他英语国家最独特的使用场景。加拿大整体使用偏向学术和早期职业场景。

    阅读全文 原文 ↗
  25. 25

    面壁智能CTO曾国洋专访:端侧模型是AI落地关键路径

    专访面壁智能CTO曾国洋:「Her」成为现实,还有几道坎

    面壁智能CTO曾国洋指出,端侧模型是AI落地的关键路径。其原创方法论"模型风洞"可在小规模实验中预测完整训练效果,并基于"知识密度"提出"面壁定律":知识密度每3.5个月翻一番。2B参数的MiniCPM表现优于同期8B竞品。面壁已完成高通、联发科、英特尔、英伟达、AMD等芯片适配,新发布的BitCPM-CANN模型系列可在华为昇腾芯片上让同一内存多装约6倍模型。全双工全模态模型MiniCPM-o4.5支持实时打断与情绪调整。团队开发了全球首个完全由AI编写的生产级训练框架ForgeTrain,并引入行为模式库实现无需开口的"默契系统"。

    阅读全文 原文 ↗