类目 全部 模型 产品 行业 论文 技巧
  1. 01

    Qwen3.8-Max 发布:开源最强编码与协作模型,2.4T 参数

    Qwen3.8-Max: A New Bar for Coding and Cowork

    Qwen 正式发布 Qwen3.8-Max,这是 Qwen 家族迄今最强的模型,拥有 2.4T 参数(95B 激活),并首次开源 Qwen-Max 级权重,开放权重将于下周发布。

    阅读全文 原文 ↗
  2. 02

    MiniMax H3 正式开源:通用全模态生成系统支持 2K 视频与原生立体声

    开放通用智能,MiniMax H3 正式开源

    MiniMax 正式开源新一代通用视频模型 H3,可统一理解文本、图像、视频和音频,生成最高 2K 分辨率、最长 15 秒、带 32 kHz 原生立体声音频的视频。

    阅读全文 原文 ↗
  3. 03

    UEmbed:统一稀疏与稠密的多模态嵌入模型

    UEmbed: Unified Sparse and Dense Multimodal Embeddings

    UEmbed 是一种仅解码器的多模态嵌入模型,可在单次因果前向传播中同时生成稀疏词级和稠密表示,通过可学习特殊 token 与词汇表分区突破单 token 信息瓶颈。

    阅读全文 原文 ↗
  4. 04

    Cloudflare 推出 Billable Usage API:为自助账户提供按产品与计费周期的程序化成本可见性

    Introducing the Billable Usage API: programmatic cost visibility for Cloudflare

    Cloudflare 发布 Billable Usage API,为自助账户提供单一端点,一次调用即可返回按产品和计费周期拆分的用量与成本,覆盖 Workers、R2、D1、Workers AI、Vectorize、Images 和 Stream。

    阅读全文 原文 ↗
  5. 05

    Kimi Work 幻灯片制作教程发布

    Build Slides with Kimi Work - Tutorial #1. Kimi Slides handles the entire slide-building process: -…

    使用 Kimi Work 制作幻灯片 - 教程 #1。 Kimi Slides 处理整个幻灯片制作流程: - 清晰的结构与研究,由 Kimi K3 驱动 - 连贯的设计,包括精美的图表和 SmartArts - 可编辑并可直接下载 欢迎在评论区告诉我们你还想看什么内容!

    阅读全文 原文 ↗
  6. 06

    SwanTale:面向指令与零样本任务的统一多说话人语音与音频生成

    SwanTale: Unified Multi-Speaker Speech and Audio Generation for Instruct and Zero-Shot Tasks

    SwanTale 提出统一的多说话人语音与音频生成模型,同时支持零样本与指令任务。研究配套推出 SwanData-Caption 数据方案,通过清洗、合成覆盖与多级标注解决数据稀缺问题,并引入 SwanVAE、Unified MoE、GRPO 后训练等技术。实验显示,SwanTale 在多项零样本与指令指标上领先,并在两项任务的表达力评分中均取得最佳成绩。

    阅读全文 原文 ↗
  7. 07

    OpenRouter 推出 Ori Eval 简化评估流程

    Introducing Ori Eval: the easiest way to write your first eval. There's no definitive best model, o…

    推出 Ori Eval:编写首个评估的最简单方式。 没有绝对最好的模型,只有最适合每项任务的模型。Ori Eval 利用 OpenRouter 的 API 处理代码库中的每项任务,然后评估结果。 curl -fsSL https://openrouter.ai/skills/spawn-ori-eval

    阅读全文 原文 ↗
  8. 08

    商汤发布 SenseNova U1.5-Lite-Preview 开源模型

    Introducing SenseNova U1.5-Lite-Preview. An early open-source previ…

    商汤推出 SenseNova U1.5-Lite-Preview,一个基于 NEO-Unify 架构的轻量级原生统一多模态模型,仅 8B-MoT 参数即可达到商业闭源模型的生成与编辑质量。

    阅读全文 原文 ↗
  9. 09

    Cloudflare 推出 @cloudflare/computer 预览版:为智能体提供虚拟文件系统与多执行环境

    Your agent needs a computer, not a container - introducing @cloudflare/computer

    Cloudflare 发布 @cloudflare/computer 早期预览版,这是一个开源智能体运行时,为每个智能体提供虚拟文件系统,并支持在 isolate、容器沙箱或浏览器中执行代码。

    阅读全文 原文 ↗
  10. 10

    OpenAI 新模型 Astra 数学表现出色,但被过度吹捧

    OpenAI's amazing - but vastly oversold - new model Astra

    OpenAI 内部测试的新模型 Astra 在数学问题上表现惊艳,但 Gary Marcus 指出相关讨论犯了"合成谬误":擅长某类数学不等于擅长所有数学、科学乃至一切认知任务。数学之所以成为突破口,是因为它便于用符号工具验证且能廉价生成海量合成数据,而开放世界问题无法如此模拟。此外,OpenAI 未公布方法细节,尚无法评估其真实意义。

    阅读全文 原文 ↗
  11. 11

    EA 首席战略官谈生成式 AI 如何进入可游玩的实时游戏世界

    How EA Is Bringing Generative AI Into Living, Playable Worlds

    EA 首席战略官 Mihir Vaidya 认为,游戏是 AI 的试验场,但生成式 AI 进入游戏面临 60 帧/秒、数千玩家同步和低延迟等严苛约束,不能只追求"看起来真实",而必须"行为正确"。他主张采用神经符号架构,在生成能力之外保留确定性与可控性,并称"控制是下一个前沿"。EA 将 AI 影响分为效率、扩展和转型三个层面,其中《模拟人生》已服务超 5 亿玩家,拥有近万亿种游玩排列组合。

    阅读全文 原文 ↗
  12. 12

    Google Agent Skills 幕后:如何构建、测试与规模化

    Behind the scenes: How we build, test, and scale Google Agent Skills

    Google Agent Skills 团队详解其开源技能库的构建与治理流程:项目始于 Google Cloud Next 2026 前的"swarm"冲刺,发布后 GitHub 星标超 15,000。为保证规模化下的质量,每个技能须通过标准化目录结构、CI/CD 流水线(含 linter、链接检查、AI 辅助清单)及提交时与每周的持续评估,并优先引用远程 MCP 工具。

    阅读全文 原文 ↗
  13. 13

    Cloudflare Workers 与 Containers 现已支持入站 TCP 连接和 gRPC

    Cloudflare Workers and Containers now support inbound TCP connections and gRPC

    Cloudflare 在 Agents Week 期间推出 Workers 运行时新处理器 connect(socket),可直接接受 Spectrum 提供的入站 TCP 套接字,并支持将套接字转发至 Durable Objects 或 Containers,实现全双工通信。

    阅读全文 原文 ↗