EXPLORE / 01
模型索引
基础模型、版本与能力边界
RECORDS
实体记录
28 条记录 · 1/1
- 001
Qwen3.8-27B
阿里云通义千问团队开源的 27B 参数量稠密多模态大模型。模型基于 Qwen3.5 基础架构构建,采用 48 层线性注意力与 16 层门控注意力的混合注意力设计,内置投机解码 MTP 草稿头与思考模式,原生支持 262K 上下文(可扩展至 1M Token),专为单卡本地部署与长程 Agentic 任务深度优化。
huggingface.co - 002
GLM-5.3
智谱 AI 推出的 743B 参数旗舰大模型,基于后训练强化学习扩展与 IndexShare、SAO、Slime 训练栈构建,具备出色的终端长程任务执行、代码编写与网络安全漏洞挖掘能力,支持多档位推理强度控制。
z.ai - 003
Gemini 3.7 Flash
谷歌发布的高效主力多模态大模型,具备 100 万 Token 上下文窗口与分级思考能力,针对长程编程、复杂推理与 Agent 工具调用深度优化。
blog.google - 004
Qwen3.8-Max
阿里巴巴推出的旗舰级多模态大模型,基于 2.4 万亿参数稀疏 MoE 架构,单次激活 950 亿参数,支持 100 万 Token 上下文与长程自主任务执行。
qwen.ai - 005
Seedance 2.5
字节跳动推出的新一代音视频生成模型,延续统一多模态联合生成架构,支持单次 30 秒长视频生成、50 插槽多模态参考及基于时间戳的局部精准编辑。
bytedance.com - 006
DeepSeek-V4-Flash
DeepSeek 推出的高效混合专家模型(MoE),拥有 284B 总参数和 13B 激活参数,支持 1M 上下文,专为高吞吐、低延迟及 Agent 推理场景优化。
deepseek.com - 007
Claude Opus 5
Anthropic 推出的前沿推理大模型,智力直逼旗舰 Claude Fable 5,具备 Effort 动态深度调节与默认思考功能。
anthropic.com - 008
Gemini 3.5 Flash Cyber
Google 专为网络安全垂直领域精调的专用模型,结合 CodeMender 平台实现多 Agent 协同的自动化漏洞挖掘与补丁修复。
blog.google - 009
Gemini 3.5 Flash-Lite
Google 于 2026 年 7 月发布的低延迟、高吞吐大模型,生成速度达每秒 350 个 Token,内置计算机操作(Computer Use)工具与可配置思考层级。
blog.google - 010
Gemini 3.6 Flash
Google 于 2026 年 7 月发布的高效率主力模型,相比 3.5 Flash 减少 17% 输出 Token 消耗,在 DeepSWE 编程等基准上提升高达 65%,针对 Agent 工作流与代码推理优化。
blog.google - 011
Qwen-Image-3.0
由阿里巴巴通义实验室于 2026 年 7 月发布的多模态图像生成基础模型,主打生产力实用价值,具备强大的长文本理解、复杂排版控制、细微文字渲染以及多语言和 UI 仿真能力。
qwen.ai - 012
Qwen-Audio-3.0-TTS
由阿里巴巴通义实验室于 2026 年 7 月发布的面向生产级应用的托管文本转语音(TTS)系统,提供 Plus(高保真配音)与 Flash(极速语音交互)两种商业版本,在独立语音评测榜单登顶。
bailian.console.aliyun.com - 013
Qwen3.8-Max-Preview
阿里千问推出的 2.4T 参数旗舰预览模型,首发进入 Qwen Cloud Token Plan、Qoder 和 QoderWork,面向编程、数据分析、Office 工作流及复杂长程 Agent 任务;官方已预告 Qwen3.8 将开放权重,但具体日期、许可证和完整评测尚未公布。
qwen.ai - 014
Kimi K3
Moonshot AI 于 2026 年 7 月发布的旗舰多模态推理模型,总参数为 2.8 万亿,采用 MoE、Kimi Delta Attention 与 Attention Residuals 架构,原生支持视觉理解和 100 万 token 上下文,面向长程编程、知识工作与深度推理。
kimi.com - 015
Qwen-Audio-3.0-Realtime
阿里云推出的实时语音交互大模型,支持毫秒级低延迟响应、全双工语音交互以及主动 Agent 工具调用,提供 Plus (推理优化) 和 Flash (速度优化) 两个版本。
qwen.ai - 016
Gemini 3.5 Pro
Google 预计于 2026 年 7 月发布的旗舰级大语言模型,具有 200 万 token 超长上下文窗口,针对复杂逻辑推理与代码任务进行了深度重训与优化。
deepmind.google - 017
Kimi K2.7 Code
由 Moonshot AI 推出的大语言模型。
官网待补 - 018
Gemini 3.5 Flash
由 Google 推出的大语言模型。
官网待补 - 019
GLM 5.2
由 Zhipu AI 推出的大语言模型。
官网待补 - 020
GPT-5.4
由 OpenAI 推出的大语言模型。
官网待补 - 021
GPT-5.5
由 OpenAI 推出的大语言模型。
官网待补 - 022
Claude Opus 4.8
由 Anthropic 推出的大语言模型。
官网待补 - 023
Claude Fable 5
由 Anthropic 推出的大语言模型。
官网待补 - 024
GPT-5.6 Luna
由 OpenAI 推出的大语言模型。
官网待补 - 025
GPT-5.6 Terra
由 OpenAI 推出的大语言模型。
官网待补 - 026
GPT-5.6 Sol
由 OpenAI 推出的大语言模型。
官网待补 - 027
腾讯混元 Hy3
Hy3 是由腾讯混元团队研发的快慢思考融合的混合专家模型,总参数量 295B,激活参数 21B,MTP 层参数 3.8B。4 月底发布 Hy3 Preview 后,我们在 50 多个业务中获得了广泛的反馈,修复了各种体验问题,进一步提升了后训练的质量和规模。今天,我们正式发布 Hy3。它展现出显著强于同尺寸模型的智能水平,并比肩更大尺寸旗舰模型的效果,大幅提升了在各类产品和生产力任务中的实用价值。
官网待补 - 028
Claude Sonnet 5
由 Anthropic 推出的大语言模型。
官网待补