类目 全部 模型 产品 行业 论文 技巧
  1. 01

    NVIDIA 推出 Nemotron 3.5 Lightning,加速本地智能体任务

    NVIDIA and Local AI Community Fuel Open Source Models and Intelligent Agents

    NVIDIA 发布 Nemotron 3.5 Lightning,一款可定制的开源 30B 混合专家(MoE)模型,专为常驻智能体设计。相比同类开源模型,其 token 生成速度最高提升 4 倍,任务完成时间缩短 30%。该模型采用开放权重,支持用户微调以匹配特定任务,并可在 RTX PC、DGX Spark 及 Jetson 等设备上运行。

    阅读全文 原文 ↗
  2. 02

    SGLang 宣布 Day-0 支持 NVIDIA Nemotron 3.5 Lightning

    Blog SGLang Adds Day-0 Support for NVIDIA Nemotron 3.5 Lightning SGLang is excited to announce Day-0 support for NVIDIA Nemotron 3.5 Lightning, a customizable open model built to power always-on agents across local systems, the edge, the datacenter, and the cloud. … NVIDIA Nemotron Team and SGLang Team

    SGLang 宣布对 NVIDIA Nemotron 3.5 Lightning 提供 Day-0 支持,该开源模型为 30B 总参数、3B 激活参数的混合专家架构,支持最长 1M token 上下文,可从 Hugging Face 下载 BF16 和 NVFP4 权重。模型支持 MTP、DFlash、DSpark 三种投机解码技术,并可通过 OpenAI 兼容 API 接入智能体工作流。

    阅读全文 原文 ↗
  3. 03

    Ling-3.0-tiny 正式开源:1.3B 激活参数如何进入真实任务

    Ling-3.0-tiny 正式开源:让 1.3B 激活参数,进入真实任务

    蚂蚁百灵开源 Ling-3.0-tiny,一款总参数 7.9B、推理时仅激活 1.3B 参数的原生混合推理模型,同步提供 BF16、FP8 和 INT4 三个版本。

    阅读全文 原文 ↗