类目 全部 模型 产品 行业 论文 技巧
  1. 01

    Swiftlet:在 Mac 上运行 80B 版 Qwen(内存 4.3 GB),在 iPhone 上运行 35B 版

    Show HN: 在 Mac 上运行 80B 版 Qwen(内存 4.3 GB),在 iPhone 上运行 35B 版

    Swiftlet 是一个 Swift + Metal 运行时,可在普通 Apple 设备上运行 Qwen3-Next 和 Qwen3.5/3.6 MoE 混合模型,仅将小型稠密核心驻留内存,按需从存储流式加载路由专家权重。

    阅读全文 原文 ↗
  2. 02

    Reflex 开源 XY:基于 Rust 的超快 Python 绘图库,可保持 1 亿点图表交互流畅

    Reflex Open Sources XY: A Rust-Backed Super-Fast Python Charting Library That Keeps 100 Million Point Charts Interactive

    Reflex AI 发布 Apache-2.0 许可的 Python 交互式 2D 绘图库 XY,通过 Rust 原生核心、二进制缓冲传输和 WebGL2 渲染,在 1 万至 1 亿点范围内保持约 0.08 秒的渲染时间。

    阅读全文 原文 ↗
  3. 03

    面壁智能开源 ForgeStencil:一周自动优化 100+ 工业与科学软件,全程零人工介入

    面壁智能开源 ForgeStencil:一周优化 100+ 工业与科学软件,全程 0 人工介入,国产「智」造升级加速

    面壁智能联合 OpenBMB 开源全球首个支持 Stencil 自动研究、自动部署的 AI 优化系统 ForgeStencil,由 Kernel Agent 与 App Agent 闭环协作,实现从算子优化到应用集成的全自动流程。

    阅读全文 原文 ↗
  4. 04

    OpenRouter 推出 ori CLI:为 Claude Code 等 Harness 提供开箱即用的优化配置

    Ori Harness: The Best Way to Use OpenRouter with Any Harness

    OpenRouter 发布 ori CLI,用户安装并登录后即可获得针对 Claude Code、Codex、OpenCode、Hermes 等 harness 的优化配置,省去手动设置大量环境变量的麻烦。

    阅读全文 原文 ↗
  5. 05

    SpecForge v0.3.0 发布:统一解耦与共置投机解码栈,新增开放 SpecBundle 草稿模型

    Blog SpecForge v0.3.0: a Unified Disaggregated and Colocated Speculative Decoding Stack, and New Open SpecBundle Draft Models When we first released SpecForge, a training job owned both the frozen target model and the draft model being optimized. This made EAGLE3 draft-model training practical and directly compatible with SG… The SpecForge Team

    SpecForge v0.3.0 将目标模型推理与草稿模型训练分离,支持 EAGLE3、EAGLE3.1、P-EAGLE、DFlash、Domino、DSpark 等多种投机解码算法,并统一在线、离线与解耦工作流。

    阅读全文 原文 ↗
  6. 06

    Cloudflare 让智能体通过本地追踪调试 Workers

    Your agent can now debug Workers with local tracing

    Cloudflare 即日起在 wrangler dev 和 vite dev 中自动为本地 Worker 调用捕获 OpenTelemetry 追踪,无需安装 SDK 或配置智能体。智能体可通过 Local Explorer API 查询追踪数据,定位失败操作、修复本地环境并验证结果。开发者也可在浏览器界面 Local Explorer 中可视化查看 spans、时序、错误及关联控制台日志。

    阅读全文 原文 ↗
  7. 07

    Cloudflare 推出 Agents 平台,率先上线智能体追踪功能

    Introducing: Cloudflare Agents

    Cloudflare 推出 Cloudflare Agents,将部署在平台上的智能体会话统一到一个视图中,并率先上线 agent tracing 功能。该功能支持 OpenTelemetry 兼容的 Think、Flue 和 AI SDK 等智能体框架,可测量每次模型调用、工具执行和 token 消耗。

    阅读全文 原文 ↗
  8. 08

    GPT-Live实时音频新架构发布

    GPT-Live is a new architecture and stack for realtime audio:

    GPT-Live 是一种用于实时音频的新架构和栈: GPT-Live 可以在说话的同时聆听。 为了让这种体验在 ChatGPT 规模下显得自然,我们从客户端到模型重建了语音栈。 这一新架构让音频持续流动,因此更深入的推理和工具使用不会打断对话。

    阅读全文 原文 ↗
  9. 09

    微软开源 Orchard 智能体训练框架

    Orchard is an open-source framework for the research community to train and evaluate AI agents acros…

    Orchard 是一个面向研究社区的开源框架,用于跨任务类型训练和评估 AI 智能体。它降低了复杂性,同时通过让研究人员复用同一套基础设施,支持较小模型也能实现强劲性能。https://msft.it/6019a8fqP

    阅读全文 原文 ↗
  10. 10

    NVIDIA 开源 cuFile API,推动 GPU 直连存储

    As AI Increases Demands on Memory, Storage Steps Up

    NVIDIA 在 FMS 大会上宣布开源 cuFile API 及底层存储软件栈,让 GPU 可直接读写存储,访问延迟降至微秒级。其 Vera CPU 在两级压缩与加密流水线中吞吐量比 x86 CPU 最高提升 3.21 倍,并联合 40 多家厂商推出 Storage-Next 计划。

    阅读全文 原文 ↗
  11. 11

    Cloudflare 推出 Agent Development Lifecycle,让智能体接管更多软件开发生命周期

    The Agent Development Lifecycle has arrived on Cloudflare

    Cloudflare 宣布推出 Agent Development Lifecycle(ADLC),以取代传统 SDLC,让 AI 智能体从仅生成代码扩展到承担更多开发流程。

    阅读全文 原文 ↗
  12. 12

    Cloudflare 推出 CI SDK:在 Cloudflare 上为百万级仓库运行 CI/CD 流水线

    Run CI/CD for millions of repos - on your platform, on Cloudflare

    Cloudflare 推出基于 Workflows 和 Sandbox SDK 的 CI SDK,让平台方直接在 Cloudflare 上运行 CI/CD 流水线,支持构建、lint、类型检查、单元测试、依赖缓存及条件部署。

    阅读全文 原文 ↗