类目 全部 模型 产品 行业 论文 技巧
  1. 01

    Cognition 推出 SWE-1.7,接近 GPT 5.5 与 Opus 智能水平

    SWE-1.7 的覆盖范围接近 GPT 5.5 和 Opus Intelligence

    Cognition 发布迄今最强模型 SWE-1.7,基于 Kimi K2.7 基座训练,通过强化学习管线改进(基础设施、训练稳定性、数据质量、长程任务技术)实现前沿智能水平并大幅降低成本。在 FrontierCode 1.1 Main 基准上达 42.3%(Kimi K2.7 Code 为 30.1%,GPT-5.5 为 43.0%,Opus 4.8 为 46.5%),Terminal-Bench 2.1 达 81.5%,SWE-Bench Multilingual 达 77.8%。模型针对长周期异步任务优化,现已在 Devin(Web、桌面、CLI)通过 Cerebras 以 1000 TPS 提供。

    阅读全文 原文 ↗
  2. 02

    GPT-5.6 Sol 发布,速率限制将重置两次

    To celebrate the launch of GPT-5.6 Sol, we will reset the rate limits again (twice) across ChatGPT W…

    为庆祝 GPT-5.6 Sol 发布,我们将在接下来 24 小时内(两次)重置 ChatGPT Work 和 Codex 的速率限制。 我们希望你有时间真正尝试有挑战性的任务并掌握它。祝探索愉快!

    阅读全文 原文 ↗
  3. 03

    GPT-5.6 Sol 是目前最强模型

    GPT 5.6 Sol is our best model so far at ~everything. It's remarkable how stark the difference is w…

    GPT 5.6 Sol 是我们迄今为止在几乎所有方面最好的模型。 与GPT-5.5相比,在编码、困难上下文与策略任务、搭建网站……以及任何我需要完成的事情上,差异非常显著。这完全要求你提升自己的尝试目标。

    阅读全文 原文 ↗