Mage-VL用视频编解码信号减少75%视觉词元
微软Mage团队开发,稀疏采样关键区域,实现高效视频流式理解与主动交互
A
打开原文 
微软Mage团队开发,稀疏采样关键区域,实现高效视频流式理解与主动交互
MiniMax M3 是 MiniMax 推出的多模态基础模型,支持文本、图像、视频输入,可生成文本输出,拥有100万token的上下文窗口,适用于长周期智能体任务、代码开发等场景,能为相关领域的高效工作提供有力支撑。
模型MiniMax M2.7(免费版)是一款面向自主现实场景生产力与持续优化的下一代大语言模型,它专为深度参与自身迭代而打造,通过多智能体架构集成了先进的智能体能力,能够在实际应用中主动适配需求、持续成长,为用户提供更贴合真实场景的高效服务。
模型Inkling Small 是 Thinking Machines Lab 推出的开源多模态混合专家模型,总参数达2760亿,其中激活参数为120亿,定位为该系列中体积更小、效率更高的成员,具备多模态处理能力,可适配各类轻量化场景的智能任务需求。
模型Inkling 是 Thinking Machines Lab 推出的一款开放权重的混合专家多模态模型,总参数规模达9750亿,其中激活参数为410亿。
模型Z.ai推出的GLM 5.2(免费版)是一款大规模推理模型,支持文本输入与输出,配备1M token的上下文窗口,适配长周期智能体工作流、项目级软件工程等场景,可满足相关领域对长文本处理与复杂任务推理的需求。
模型DeepSeek V4 Pro 0813 是深度求索(DeepSeek)推出的大规模混合专家模型,属于 DeepSeek V4 Pro 的正式发布版本。