EXPLORE / 01

模型索引

基础模型、版本与能力边界

RECORDS

实体记录

28 条记录 · 1/1

  1. 001

    Qwen3.8-27B

    阿里云通义千问团队开源的 27B 参数量稠密多模态大模型。模型基于 Qwen3.5 基础架构构建,采用 48 层线性注意力与 16 层门控注意力的混合注意力设计,内置投机解码 MTP 草稿头与思考模式,原生支持 262K 上下文(可扩展至 1M Token),专为单卡本地部署与长程 Agentic 任务深度优化。

    huggingface.co
  2. 002

    GLM-5.3

    智谱 AI 推出的 743B 参数旗舰大模型,基于后训练强化学习扩展与 IndexShare、SAO、Slime 训练栈构建,具备出色的终端长程任务执行、代码编写与网络安全漏洞挖掘能力,支持多档位推理强度控制。

    z.ai
  3. 003

    Gemini 3.7 Flash

    谷歌发布的高效主力多模态大模型,具备 100 万 Token 上下文窗口与分级思考能力,针对长程编程、复杂推理与 Agent 工具调用深度优化。

    blog.google
  4. 004

    Qwen3.8-Max

    阿里巴巴推出的旗舰级多模态大模型,基于 2.4 万亿参数稀疏 MoE 架构,单次激活 950 亿参数,支持 100 万 Token 上下文与长程自主任务执行。

    qwen.ai
  5. 005

    Seedance 2.5

    字节跳动推出的新一代音视频生成模型,延续统一多模态联合生成架构,支持单次 30 秒长视频生成、50 插槽多模态参考及基于时间戳的局部精准编辑。

    bytedance.com
  6. 006

    DeepSeek-V4-Flash

    DeepSeek 推出的高效混合专家模型(MoE),拥有 284B 总参数和 13B 激活参数,支持 1M 上下文,专为高吞吐、低延迟及 Agent 推理场景优化。

    deepseek.com
  7. 007

    Claude Opus 5

    Anthropic 推出的前沿推理大模型,智力直逼旗舰 Claude Fable 5,具备 Effort 动态深度调节与默认思考功能。

    anthropic.com
  8. 008

    Gemini 3.5 Flash Cyber

    Google 专为网络安全垂直领域精调的专用模型,结合 CodeMender 平台实现多 Agent 协同的自动化漏洞挖掘与补丁修复。

    blog.google
  9. 009

    Gemini 3.5 Flash-Lite

    Google 于 2026 年 7 月发布的低延迟、高吞吐大模型,生成速度达每秒 350 个 Token,内置计算机操作(Computer Use)工具与可配置思考层级。

    blog.google
  10. 010

    Gemini 3.6 Flash

    Google 于 2026 年 7 月发布的高效率主力模型,相比 3.5 Flash 减少 17% 输出 Token 消耗,在 DeepSWE 编程等基准上提升高达 65%,针对 Agent 工作流与代码推理优化。

    blog.google
  11. 011

    Qwen-Image-3.0

    由阿里巴巴通义实验室于 2026 年 7 月发布的多模态图像生成基础模型,主打生产力实用价值,具备强大的长文本理解、复杂排版控制、细微文字渲染以及多语言和 UI 仿真能力。

    qwen.ai
  12. 012

    Qwen-Audio-3.0-TTS

    由阿里巴巴通义实验室于 2026 年 7 月发布的面向生产级应用的托管文本转语音(TTS)系统,提供 Plus(高保真配音)与 Flash(极速语音交互)两种商业版本,在独立语音评测榜单登顶。

    bailian.console.aliyun.com
  13. 013

    Qwen3.8-Max-Preview

    阿里千问推出的 2.4T 参数旗舰预览模型,首发进入 Qwen Cloud Token Plan、Qoder 和 QoderWork,面向编程、数据分析、Office 工作流及复杂长程 Agent 任务;官方已预告 Qwen3.8 将开放权重,但具体日期、许可证和完整评测尚未公布。

    qwen.ai
  14. 014

    Kimi K3

    Moonshot AI 于 2026 年 7 月发布的旗舰多模态推理模型,总参数为 2.8 万亿,采用 MoE、Kimi Delta Attention 与 Attention Residuals 架构,原生支持视觉理解和 100 万 token 上下文,面向长程编程、知识工作与深度推理。

    kimi.com
  15. 015

    Qwen-Audio-3.0-Realtime

    阿里云推出的实时语音交互大模型,支持毫秒级低延迟响应、全双工语音交互以及主动 Agent 工具调用,提供 Plus (推理优化) 和 Flash (速度优化) 两个版本。

    qwen.ai
  16. 016

    Gemini 3.5 Pro

    Google 预计于 2026 年 7 月发布的旗舰级大语言模型,具有 200 万 token 超长上下文窗口,针对复杂逻辑推理与代码任务进行了深度重训与优化。

    deepmind.google
  17. 017

    Kimi K2.7 Code

    由 Moonshot AI 推出的大语言模型。

    官网待补
  18. 018

    Gemini 3.5 Flash

    由 Google 推出的大语言模型。

    官网待补
  19. 019

    GLM 5.2

    由 Zhipu AI 推出的大语言模型。

    官网待补
  20. 020

    GPT-5.4

    由 OpenAI 推出的大语言模型。

    官网待补
  21. 021

    GPT-5.5

    由 OpenAI 推出的大语言模型。

    官网待补
  22. 022

    Claude Opus 4.8

    由 Anthropic 推出的大语言模型。

    官网待补
  23. 023

    Claude Fable 5

    由 Anthropic 推出的大语言模型。

    官网待补
  24. 024

    GPT-5.6 Luna

    由 OpenAI 推出的大语言模型。

    官网待补
  25. 025

    GPT-5.6 Terra

    由 OpenAI 推出的大语言模型。

    官网待补
  26. 026

    GPT-5.6 Sol

    由 OpenAI 推出的大语言模型。

    官网待补
  27. 027

    腾讯混元 Hy3

    Hy3 是由腾讯混元团队研发的快慢思考融合的混合专家模型,总参数量 295B,激活参数 21B,MTP 层参数 3.8B。4 月底发布 Hy3 Preview 后,我们在 50 多个业务中获得了广泛的反馈,修复了各种体验问题,进一步提升了后训练的质量和规模。今天,我们正式发布 Hy3。它展现出显著强于同尺寸模型的智能水平,并比肩更大尺寸旗舰模型的效果,大幅提升了在各类产品和生产力任务中的实用价值。

    官网待补
  28. 028

    Claude Sonnet 5

    由 Anthropic 推出的大语言模型。

    官网待补