类目 全部 模型 产品 行业 论文 技巧
  1. 01

    字节跳动发布 Seed Audio 1.0 音频创作模型,统一建模人声与音效实现端到端影视级音频生成

    从"会说"走向"会创作"| Seed Audio 1.0 音频创作模型发布

    字节跳动 Seed 团队发布音频创作模型 Seed Audio 1.0,在统一框架下联合建模人声、音效和环境声,支持 100ms 间隔精度的时间控制、单次约 2 分钟音频的延展生成及 20+ 语种自然生成。该模型已在火山方舟体验中心上线,多数场景音频可用率达 90% 以上,多语言音频自然度 MOS 超 4 分。

    阅读全文 原文 ↗
  2. 02

    小红书、北大开源 UltraEP:面向大规模 MoE 训推的「最优」负载均衡方案

    小红书与北大开源 UltraEP,首次将基于精确路由信息的实时负载均衡引入生产系统,在每个 microbatch 和每一层动态复制热点专家,平均达到理想性能的 94.3%,相比业界 SOTA 训推框架提升 1.49 倍。该方案已在 288B 参数 MoE 模型的完整预训练中部署,保持不低于理想性能 92% 的水平。

    阅读全文 原文 ↗
  3. 03

    LoRA Speedrun 公开排行榜:6分05秒微调Qwen2.5-1.5B达GSM8K 61.1%准确率

    LoRA Speedrun--一个针对微调技术的公开实际运行时间排行榜

    LoRA Speedrun项目推出公开排行榜,在固定硬件(单张L40S)上比拼Qwen2.5-1.5B的微调运行时间。当前纪录由@Saivineeth147以6分05秒保持,采用序列打包与仅完成损失掩码技术,相比基线11分57秒提速约2倍且准确率更高(61.1%)。项目提供免费Modal沙箱验证,任何提交需经3次独立复现确认。

    阅读全文 原文 ↗
  4. 04

    Grok for Excel 发布:在 Microsoft Excel 中用自然语言提问、写公式和运行场景

    Grok for Excel

    xAI 将 Grok 引入 Microsoft Excel,推出免费 Microsoft 365 加载项。用户可在工作表中用自然语言提问、根据描述编写公式或运行场景,答案会引用具体单元格,图表可直接插入工作表。该加载项还支持连接 SharePoint 或 Google Drive 获取上下文,并已同步支持 Word 和 PowerPoint。

    阅读全文 原文 ↗
  5. 05

    小红书与北大开源 UltraEP:面向大规模 MoE 训推的实时负载均衡方案

    小红书、北大开源 UltraEP:面向大规模 MoE 训推的「最优」负载均衡方案

    小红书与北大提出 UltraEP,首次将基于精确路由信息的实时负载均衡引入生产系统,在每个 microbatch 和每一层动态复制热点专家。在 Qwen3-235B 等模型上,训练吞吐平均达到理想性能的 94.6%,相比 Megatron-LM 提升 42%;推理 prefill 吞吐相比 SGLang 提升 1.56 倍。

    阅读全文 原文 ↗
  6. 06

    Cursor 测试新型 AI 智能体集群:规划者+执行者分工,4小时通过80% SQL测试

    Agent swarms and the new model economics

    Cursor 测试了新型 AI 智能体集群,将任务分解为规划者(使用最强模型)和执行者(使用快速廉价模型)。使用 Grok 4.5 时,新集群在 4 小时内通过了 80% 的 SQL 测试套件,而旧集群在第二小时前失败。该系统已用于构建浏览器、修复漏洞和生成数十亿 token 合成训练数据。

    阅读全文 原文 ↗