DeepSeek V4 Flash 是深度求索(DeepSeek)推出的一款效率优化型混合专家模型,总参数量达 2840 亿,单次激活参数量仅 130 亿,支持百万级超长上下文窗口(100 万令牌)。该模型专为高速推理与高吞吐业务场景打造,同时具备出色的逻辑推理与代码编写能力。 模型搭载混合注意力机制,可高效处理超长上下文文本,并支持推理模式自定义配置。非常适配代码助手、智能对话系统、智能代理工作流等对响应速度与成本可控性要求较高的落地场景。
算能MiniMax-M3 是 MiniMax 最新推出的旗舰级语言模型,采用全新注意力架构 MSA(MiniMax Sparse Attention),支持原生多模态能力与 1M超长上下文。作为 Frontier Coding 模型,MiniMax-M3 专为 Agent 推理、工具调用、代码生成和长上下文任务优化,具备优秀的交错思维链能力,可处理复杂的 Agentic 工作流。模型支持通过 Anthropic SDK、OpenAI SDK 等多种方式接入,并支持图片、视频等多模态输入。
优云智算MiMo-V2-Pro 是小米的旗舰基础模型,拥有超过 1T 的总参数量和 1M 的上下文长度,深度优化以适应代理场景。它能高度适应 OpenClaw 等通用代理框架。在标准的 PinchBench 和 ClawBench 基准测试中,其表现排名全球顶尖,感知性能接近 Opus 4.6。 MiMo-V2-Pro 设计用于作为代理系统的大脑,协调复杂的工作流程,推动生产工程任务,并可靠地交付结果。
七牛云Kimi K2.7 Code 是 Moonshot AI Kimi K2 系列中专注于编码的模型,旨在可靠地完成长时间上下文中的端到端编程任务。它采用原生多模态混合专家架构,支持文本和图像输入,并始终以思考模式运行,从而在多轮对话中保留完整的推理内容。凭借 25.6 万个词元的上下文窗口,它适用于长时程编码、智能体任务分解和多轮对话。该模型激活了约 1 万亿个参数中的 320 亿个
Qwen-Image 是由阿里巴巴通义千问团队发布的图像生成基础模型,拥有 200 亿参数。该模型在复杂的文本渲染和精确的图像编辑方面取得了显著进展,尤其擅长生成包含高保真度中英文文字的图像。Qwen-Image 不仅能够处理多行布局和段落级文本,还能在生成图像时保持排版的连贯性和上下文的和谐。除了卓越的文本渲染能力,该模型还支持广泛的艺术风格,从写实照片到动漫美学,能够灵活适应各种创作需求。同时,它也具备强大的图像编辑和理解能力,支持风格迁移、物体增删、细节增强、文本编辑乃至人体姿态操控等高级操作,旨在成为一个集语言、布局和图像于一体的综合性智能视觉创作与处理基础模型
七牛云MiniMax-M3 是 MiniMax 最新推出的旗舰级语言模型,采用全新注意力架构 MSA(MiniMax Sparse Attention),支持原生多模态能力与 1M超长上下文。作为 Frontier Coding 模型,MiniMax-M3 专为 Agent 推理、工具调用、代码生成和长上下文任务优化,具备优秀的交错思维链能力,可处理复杂的 Agentic 工作流。模型支持通过 Anthropic SDK、OpenAI SDK 等多种方式接入,并支持图片、视频等多模态输入。
算能智谱GLM-5.1是智谱于2026年4月8日发布的新一代开源模型,发布当天上线华为云 ,同期摩尔线程宣布完成对该模型的适配。摩尔线程在其旗舰级AI训推一体全功能GPUMTT S5000上实现了对GLM-5.1的适配 。
算能GLM-5 Turbo 是 Z.ai 推出的一款全新模型,专为 OpenClaw 等基于代理的场景而设计,旨在实现快速推理和卓越性能。它针对涉及长执行链的真实代理工作流程进行了深度优化,改进了复杂指令分解、工具使用、调度和持续执行,以及在扩展任务中的整体稳定性。
算能MiniMax-M2.7 是一款为自主、实际应用生产力与持续改进而设计的下一代大型语言模型。为了积极参与自身的进化,M2.7透过多代理协作整合先进的代理能力,使其能在动态环境中规划、执行和优化复杂任务。 经过生产级性能的训练,M2.7能处理包括实时侦错、根本原因分析、金融建模以及跨 Word、Excel 和 PowerPoint 的完整文件生成等工作流程。它在 SWE-Pro 基准测试中达到 56.2% 的成绩,在 Terminal Bench 2 基准测试中达到 57.0%,同时在 GDPval-AA 上达到 1495 ELO 分数,为实际数位工作流程中运作的多代理系统设立了新的标准。
算能Kimi K2.7 Code 是 Moonshot AI Kimi K2 系列中专注于编码的模型,旨在可靠地完成长时间上下文中的端到端编程任务。它采用原生多模态混合专家架构,支持文本和图像输入,并始终以思考模式运行,从而在多轮对话中保留完整的推理内容。凭借 25.6 万个词元的上下文窗口,它适用于长时程编码、智能体任务分解和多轮对话。该模型激活了约 1 万亿个参数中的 320 亿个
算能Kimi K2.6 是月之暗面(Moonshot AI)于 2026年4月20日 开源的新一代旗舰大语言模型,基于万亿参数混合专家(MoE)架构,总参数 1T,激活参数 32B,采用 MLA 注意力 + SwiGLU 激活函数。核心定位:长程编程 + Agent 集群双专精。支持 256K 超长上下文、最多 300 个子 Agent 并行协作、单次最长 12 小时自主运行,涵盖 Rust/Go/Python 全栈代码生成、前端设计、跨平台自动化等任务。模型以 Modified MIT 许可证开源。
算能Qwen3.6 原生视觉语言 Flash 模型效果较 3.5-Flash 大幅提升,重点增强智能体编码、数学与代码推理能力,视觉层面空间智能、物体定位及目标检测提升显著。
优云智算MiniMax-M3 是 MiniMax 最新推出的旗舰级语言模型,采用全新注意力架构 MSA(MiniMax Sparse Attention),支持原生多模态能力与 1M超长上下文。作为 Frontier Coding 模型,MiniMax-M3 专为 Agent 推理、工具调用、代码生成和长上下文任务优化,具备优秀的交错思维链能力,可处理复杂的 Agentic 工作流。模型支持通过 Anthropic SDK、OpenAI SDK 等多种方式接入,并支持图片、视频等多模态输入。
文本处理API是一款功能强大的文本分析服务,提供文本分词、关键信息抽取、分类、词性语法分析等功能。该API具有高效、准确、灵活和易用的特点,兼容多种编程语言和平台,适合各种用户在多种场景下使用。
七牛云DeepSeek V4 Pro 是 DeepSeek 推出的大规模混合专家(Mixture-of-Experts)模型,总参数量达 1.6 万亿,每次前向传播激活 490 亿参数,支持长达 100 万 token 的上下文窗口。该模型专为高级推理、编程和长程智能体工作流设计,在知识、数学和软件工程基准测试中均表现出色。它基于与 DeepSeek V4 Flash 相同的架构,引入了混合注意力系统以实现高效的长上下文处理,并支持多种推理模式,可根据任务需求在速度和深度之间取得平衡。它非常适用于全代码库分析、多步骤自动化和大规模信息综合等复杂工作负载,这些场景对能力和效率都有极高要求。
算能GLM 5.2 是 Z.ai 推出的大规模推理模型。它支持 100 万个标记的上下文窗口的文本输入和输出,适用于长期代理工作流、项目级软件工程和复杂的多步骤自动化。
七牛云Kimi 是一款AI智能助手,由 Moonshot 自研的大语言模型驱动,支持在线搜索、深度思考、多模态推理和超长文本对话。
七牛云Seed-2.0-mini 针对延迟敏感、高并发及成本敏感的场景,强调快速反应和灵活的推论部署。它提供与 ByteDance-Seed-1.6 相当的性能,支援 256k 语境,四种推理努力模式(最小/低/中/高),多模态理解,并针对轻量级任务进行优化,其中成本和速度优先。
算能MiniMax-M2.5是MiniMax于2026年2月发布的最新旗舰模型,基于大规模强化学习在数十万真实复杂环境中深度训练而成。
算能GLM-5 是智谱推出的新一代大语言模型,专注于复杂系统工程和长周期 Agent 任务。模型规模 744B 参数(40B 激活),预训练数据 28.5T tokens。
七牛云MiniMax-M2.5是MiniMax于2026年2月发布的最新旗舰模型,基于大规模强化学习在数十万真实复杂环境中深度训练而成。
算能Qwen3.5-397B-A17B 是阿里巴巴通义千问团队于 2026年2月(春节前夕)正式开源的旗舰级原生多模态混合专家模型(MoE)。它证明了“大参数总量 + 小激活量”的 MoE 路线是通往高效 AGI 的关键路径。对于开发者而言,这意味着你可以用极低的硬件成本(单卡可跑),享受到万亿参数级别的智能体验。
算能全球首个开源的 3 万亿级别模型,拥有 100 万 token 上下文窗口,面向长程编程、知识工作和推理等前沿智能场景而设计。
七牛云deepseek/deepseek-v4-flash-20260731 是 DeepSeek 于 2026 年 7 月 31 日推出的 V4-Flash API 迭代版本,沿用 284B 总参数、13B 激活参数 MoE 架构,保持 1M 上下文窗口、最高 384K 输出,未改动底层权重,仅通过新一轮后训练大幅强化 Agent 智能体、工具调用与工程代码能力,原生兼容 Responses API,面向自动化、终端运维、全栈开发场景,具备高推理性价比,适配大规模线上 API 调用。