类目 全部 模型 产品 行业 论文 技巧
  1. 01

    字节发布 Seedance 2.5:单次生成 30 秒视频,支持多模态参考与精准编辑

    一镜成片,随心参考|Seedance 2.5 正式发布

    字节跳动今日正式发布新一代视频创作模型 Seedance 2.5,单次视频生成时长从 15 秒提升至 30 秒,并支持多轮延长,可产出数分钟连贯内容。模型支持单次输入最多 30 张图片、10 段视频和 10 段音频作为参考素材,并升级白模参考、运动参考及绿幕编辑、时间戳精准编辑等能力。Seedance 2.5 已陆续上线即梦 AI、豆包专业版等平台,API 服务近期将上线火山方舟。

    阅读全文 原文 ↗
  2. 02

    MiniMax H3 发布:开源全能多模态生成模型,支持 2K 原生立体声视频

    MiniMax H3: An Open Model Breaking the Boundaries Between Tasks and Modalities

    MiniMax 正式推出全能多模态生成模型 H3,可联合理解文本、图像、视频和音频,生成最高 2K 分辨率、15 秒时长且带原生立体声的视频。H3 在指令跟随、文字与品牌呈现、V2V 动作迁移上表现突出,2K 下每秒价格低于主流模型三分之一,768p 下低于主流 720p 价格一半。官方计划近日开源模型权重,以支持开源社区并加速硬件兼容。

    阅读全文 原文 ↗
  3. 03

    DeepSeek-V4-Flash 正式版 API 上线公测

    DeepSeek-V4-Flash 更新

    DeepSeek-V4-Flash 正式版 API 上线公测,模型名设为 deepseek-v4-flash 即可使用,调用方式不变。其 Agent 能力大幅增强,Terminal Bench 2.1 得分 82.7,NL2Repo 54.2,Toolathlon verified 70.3,DSBench-Hard 59.6,多项基准远超 V4-Pro-Preview。

    阅读全文 原文 ↗
  4. 04

    MiniMax H3 发布并将开源,主打视觉包装与后期特效

    MiniMax H3发布,还要开源,AI视频终于有了自己的后期之王。

    MiniMax 发布 AI 视频模型 H3,并宣布开源。该模型主打视觉包装与后期特效,可生成动态 MV、动态海报、Vlog、电影片头、游戏 UI 等,语义遵循能力极强,在广告与动效领域表现优于 Seedance 2.0,但影视级张力镜头稍逊。H3 开源后预计将出现大量垂直领域特化版本。

    阅读全文 原文 ↗
  5. 05

    DeepSeek V4 Flash 正式版发布:后训练重做,九项 Agent 测试全面超越 V4 Pro Preview

    等了好久,DeepSeek V4的正式版终于来了。 可惜,来的还是DeepSeek-V4-Flash,V4 Pro正式版还得继续等。 但我看到消息的第一反应,还有很开心的。 因为V4 Flash对我现在的生活,反而比V4 Pro还要重要。 这次,DeepSeek V4 Flash它的模型结构和参数规模完全没变,只重新做了后训练,但是强了特别多。 Terminal Bench 2.1从61.8涨到了82.7。 DeepSWE从7.3涨到了54.4。 DSBench-FullStack从37.0涨到了68.7。 官方列出的九项Agent测试里,它已经全部超过了V4 Pro Preview。 同时还原生支持Responses API,专门针对Codex进行了适配。 讲真,DeepSeek这次在后训练上,应该是憋了个大的。 但如果让我非常坦率地评价,DeepSeek V4 Flash在最顶级的Coding和Agent任务里,跟GPT-5.6 Sol、Claude Opus 5、Kimi K3这些最强模型,依然会有巨大的差距。 复杂项目的架构设计、长时间自主执行、充满意外的多步任务,我大概率还是会优先把最强的模型挂上去。 这没什么可避讳的。 但模型真正进入生产环境以后,能力上限只是一部分。 还有一个经常被低估到离谱的指标: 你到底用不用得起。 这也是我为什么反而更期待Flash。 我自己的AIHOT,现在每天差不多要抓一万条新闻。 这些新闻进来以后,要做结构化、数据清洗、预筛、标注、实体提取、原子事件分离、聚类、语义合并等等,还有一大堆后续判断。 最后才回到真正的精选打分环节那一步。 这里面绝大多数环节,都需要AI介入。 有些流程复杂到甚至需要Agent自己调用工具、检查结果、决定下一步。 一万条新闻,乘上一大串处理链路,最后就是一个极其恐怖的调用量。 按照我现在的调用规模,每个月大概API的消耗量在1000多人民币,你要是换成我常用的那些顶级模型,成本至少得翻十倍以上。 但DeepSeek V4 Flash就很适合干这个。 智能水平在中上等,却又便宜得离谱。 WorkBuddy里也是一样。 真正难到天上的任务,大家可以接K3。 可绝大多数日常任务,DeepSeek V4 Flash已经完全能处理,而且单次只消耗0.06积分。 行业当然需要那些一次跑通世界级难题的顶级模型。 可这个世界上更多的真实需求,是每天重复一万次、十

    DeepSeek V4 Flash 正式版发布,模型结构和参数规模不变,仅重做后训练,Terminal Bench 2.1 从 61.8 涨至 82.7,DeepSWE 从 7.3 涨至 54.4。

    阅读全文 原文 ↗
  6. 06

    Inkling-Small 发布,276B 参数性能持平原版

    Today, we are releasing Inkling-Small. Inkling-Small achieves comparable performance to Inkling at …

    今天,我们发布 Inkling-Small。 Inkling-Small 在仅为 Inkling 四分之一规模的情况下,实现了与之相当的性能。它拥有 276B 总参数,12B 激活参数。我们将开放完整权重。 https://thinkingmachines.ai/news/inkling-small/ 现在即可在 Tinker 上对其进行微调,或在 Tinker Playground 中以文本、图像和音频形式与之对话。

    阅读全文 原文 ↗
  7. 07

    DeepSeek-V4-Flash API公测上线,Agent能力大幅升级

    🚀 DeepSeek-V4-Flash Official API is now LIVE in public beta! 🔷 We've massively upgraded its Agent…

    🚀 DeepSeek-V4-Flash 官方 API 现已上线公测! 🔷 我们大幅升级了其 Agent 能力--基准测试分数现已远超 V4-Pro-Preview。查看下方巨大的性能飞跃!👇 🔷 官方 V4-Flash 现已原生支持 Responses API 格式,并已完全适配 Codex! 查看我们官方 API 文档中的配置详情:https://api-docs.deepseek.com/quick_start/agent_integrations/codex

    阅读全文 原文 ↗