类目 全部 模型 产品 行业 论文 技巧
  1. 01

    Kimi K3 发布:2.8T 参数开源模型,具备原生视觉与百万 token 上下文窗口

    Kimi K3

    月之暗面发布 Kimi K3,一个 2.8T 参数的开源模型,采用 Kimi Delta Attention 和 Attention Residuals 架构,支持原生视觉能力与 100 万 token 上下文窗口。

    阅读全文 原文 ↗
  2. 02

    商汤开源 SenseNova-Vision-7B-MoT 多任务视觉模型

    SenseNova-Vision-7B-MoT, fully open-sourced: one model, �…

    商汤发布并完全开源 SenseNova-Vision-7B-MoT,一个统一处理检测、OCR、GUI、深度与法线估计、分割、多视图等主要视觉任务的模型。该模型支持通过自然语言定义新的视觉任务变体,跨传统任务边界重组视觉能力。开源内容包括模型权重及 SenseNova-Vision Corpus(含 5000 万示例子集及复现剩余公开数据的完整工具包)。

    阅读全文 原文 ↗
  3. 03

    Boogu-Image-0.1 发布:开源统一多模态理解与生成模型,训练成本仅约 40 万美元

    Boogu-Image-0.1: Boosting Open-Source Unified Multimodal Understanding and Generation

    Boogu-Image-0.1 系列开源统一多模态理解与生成模型发布,包含 Base、Turbo、Edit 和 Edit-Turbo 四个变体,支持高质量文生图、快速推理、指令编辑及中英双语文本渲染。

    阅读全文 原文 ↗
  4. 04

    腾讯混元 Hy3 量化版发布:1bit 版本单卡可部署,4bit 版本接近满血性能

    极致量化,近三千亿参数 Hy3 单卡即可部署

    腾讯混元团队为旗舰模型 Hy3(295B 参数)推出量化版本。1bit 版本(IQ1_M)将权重从 598 GB 压缩至 85.5 GiB,缩小 6.7 倍,单张 96GB 推理显卡即可部署;4bit 版本(Q4_K_M)体积 169.9 GiB,两张显卡可承载。量化版在 Agent、多语言代码、工具调用、长文理解等任务上表现接近满血模型。团队还提供 GPTQ Int4 版本,支持 vLLM 部署。配合 MTP 投机解码,1bit 版本解码速度提升约 50%,4bit 版本提升近 60%。所有版本已开源并打包为 GGUF 格式,适配 llama.cpp 生态。

    阅读全文 原文 ↗
  5. 05

    GPT-5.6 sol 价格减半 token 效率翻倍

    GPT-5.6 sol is half the price and ~twice as token efficient as fable in many cases for accomplishing…

    GPT-5.6 sol 价格减半,且在多数情况下完成相同任务时 token 效率约为 fable 的两倍。 很高兴能以四分之一的价格交付。

    阅读全文 原文 ↗
  6. 06

    DiffusionGemma 发布:文本扩散模型实现 4 倍加速推理

    DiffusionGemma: 4x faster text generation

    Google 发布实验性开源模型 DiffusionGemma,采用文本扩散技术并行生成 256 token 块,推理速度最高提升 4 倍。该 26B MoE 模型仅激活 3.8B 参数,量化后适配 18GB VRAM 消费级 GPU,在单张 H100 上达 1000+ tokens/s。

    阅读全文 原文 ↗