类目 全部 模型 产品 行业 论文 技巧
  1. 01

    腾讯设计Agent平台Miora全面开放

    腾讯悄悄上线了他们第一个设计Agent - Miora。

    腾讯设计Agent平台Miora今日全面开放,无需邀请码即可使用。该平台由WorkBuddy团队打造,提供品牌设计、影视创意等五大场景模式,支持自定义多模态模型和Agent推理深度,并内置Skill市场与记忆系统。

    阅读全文 原文 ↗
  2. 02

    OpenAI 在 ChatGPT 中正式推出广告服务

    在ChatGPT上投放广告

    OpenAI 在 ChatGPT 中推出原生广告服务,允许广告主在用户探索选项、比较选择和做出决策时投放相关广告。广告在体验中明确标注并与回答区分,首批广告主包括 Best Buy、Lowe's 和 VistaPrint。广告主可通过 Ads Manager 创建广告系列、设置预算并优化效果。

    阅读全文 原文 ↗
  3. 03

    OpenRouter 上线 Gemini 3.6 Flash 与 3.5 Flash-Lite

    Launched today on OpenRouter: Gemini 3.6 Flash and Gemini 3.5 Flash-Lite! Both strong updates to th…

    今日在 OpenRouter 上线:Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite! 两者均为其模型系列的重大更新,具备高吞吐量(150+ tok/s),适用于智能体场景,从高效 token 的编码与知识工作,到低延迟、高并发的子智能体。 详情如下 🧵

    阅读全文 原文 ↗
  4. 04

    AlloyDB 推出列式引擎加速 HNSW,pgvector 向量搜索 QPS 提升最高 4.9 倍

    Supercharging pgvector: 4x faster HNSW vector search with AlloyDB

    Google Cloud 的 AlloyDB 在预览版中推出列式引擎加速的 HNSW 索引,使 pgvector 向量搜索的每秒查询数(QPS)相比标准 PostgreSQL HNSW 提升最高 4.9 倍,在固定 QPS 下召回率可提升 0.163。该加速通过将索引固定在列式引擎内存中、使用向量化内存布局并绕过标准 PostgreSQL 缓冲管理器开销实现,无需修改应用即可获得性能提升。

    阅读全文 原文 ↗
  5. 05

    小红书 dots infra 开源 BigMac:突破多模态大模型训练的帕累托前沿

    小红书 dots infra 开源BigMac : 突破多模态大模型训练的帕累托前沿

    小红书开源 BigMac,一种面向原生多模态场景的流水并行训练新范式。它通过依赖安全的嵌套流水线,在不增加 LLM 流水线空泡、保持激活显存有界的同时,高效实现多模态流水训练。相比基线,BigMac 训练速度提升 1.08~1.9 倍,并在 global batch size 增大时保持稳定显存占用,目前已应用于 dots 多模态模型生产训练。

    阅读全文 原文 ↗
  6. 06

    Cursor 发布智能模型路由系统 Cursor Router

    Introducing Cursor Router

    Cursor 推出 Cursor Router,可自动将每个编码请求分配给最合适的模型。在线 A/B 测试显示,Auto Intelligence 模式在用户满意度接近 Fable 的同时,成本降低约 60%;Auto Balance 模式满意度超过 Opus 4.8,成本降低约 36%。

    阅读全文 原文 ↗
  7. 07

    Claude 新增 Anthropic Economic Index 连接器,可直接查询 AI 对经济与职业的影响数据

    Ask Claude about the Anthropic Economic Index

    Anthropic 为 Claude 推出 Anthropic Economic Index 连接器,用户可在 claude.ai 中直接向 Claude 提问"哪些职业使用 AI 最多"等问题,答案基于 Index 的真实数据。该连接器无需安装,适用于任何 Claude 模型,并会引导用户查看原始数据及其局限性。完整数据集仍免费开放。

    阅读全文 原文 ↗
  8. 08

    Google 推出 Tunix:基于 JAX 的高吞吐智能体后训练库

    Scaling Agentic RL: High-Throughput Agentic Training with Tunix

    Google 发布 Tunix,一个基于 JAX 的原生后训练库,旨在消除多轮、使用工具的 LLM 推理智能体训练中的 TPU 闲置瓶颈。Tunix 通过高并发异步 rollout 与解耦的生产者-消费者流水线最大化硬件吞吐量,确保训练器持续获得数据。该库提供即插即用抽象和持续宏观级性能分析,便于集成自定义环境。

    阅读全文 原文 ↗
  9. 09

    小红书开源 BigMac:多模态大模型训练新范式

    小红书 dots infra 开源BigMac : 突破多模态大模型训练的帕累托前沿

    小红书技术团队开源 BigMac,一种针对多模态大模型训练的依赖安全嵌套流水线新范式。它以 LLM 流水线为主干,在不打乱执行顺序的前提下嵌入编码器和生成器计算,相比基线实现 1.08x-1.9x 加速,同时保持激活显存有界。BigMac 已作为 dots 多模态模型训练的核心组件投入生产。

    阅读全文 原文 ↗
  10. 10

    NVIDIA 开源首个 GPU 加速医疗物理仿真框架

    NVIDIA Open Sources First GPU-Accelerated Medical Physics Simulation Framework

    NVIDIA 宣布开源 Medical Physics Simulation 框架,这是 Isaac for Healthcare 中首个 GPU 加速的医疗物理仿真能力。该框架可并行运行 8,192 个机器人训练环境,将训练时间从超过 5 小时缩短至不到 2 分钟。CMR Surgical、Johnson & Johnson MedTech 等机构已在使用该框架。

    阅读全文 原文 ↗
  11. 11

    Laguna S 2.1 免费开源上线 OpenCode

    Laguna S 2.1 is now free on OpenCode 1M Context · fully open source Poolside's most capable model …

    Laguna S 2.1 现已在 OpenCode 上免费提供 1M 上下文窗口 · 完全开源 Poolside 迄今为止最强大的模型

    阅读全文 原文 ↗