让模型更易用,让创作更自由
模型托管
安全托管,轻松版本化,让模型像代码一样流动





模型/数据集加速
全球分发,瞬间加载,让下载等待成为过去式,专注创新



开发者个人工作台
一站式管理与展示,让 AI 创作更有序、更出彩


模型使用
多样化体验方式,随时随地解锁 AI 能力



社区活动
活力四射的开发者社区,挑战赛、协作项目与开放交流,让创意在共创中走向世界
让模型更易用,让创作更自由
模型托管
安全托管,轻松版本化,让模型像代码一样流动





模型/数据集加速
全球分发,瞬间加载,让下载等待成为过去式,专注创新



开发者个人工作台
一站式管理与展示,让 AI 创作更有序、更出彩


模型使用
多样化体验方式,随时随地解锁 AI 能力



社区活动
活力四射的开发者社区,挑战赛、协作项目与开放交流,让创意在共创中走向世界
发现、分享、部署最先进的AI模型、数据集和应用
GLM-5.3-Flash
GLM-5.3-Flash (320B-A18B),是GLM-5系列的首个原生多模态模型。320B总参数,能力超过GLM-5.2
GLM-5.3
可用于本地部署文本生成模型,完成编码、长程智能体与网络安全研究任务。该项目为开源权重大模型,通过大规模后训练提升复杂编码与长程任务能力,支持 Transformers、vLLM、SGLang 等框架及思考预算控制。
Hy4-preview
Hy4 preview 是由腾讯混元团队研发的新一代混合专家(MoE)旗舰模型。模型总参数量 770B,每个 token 激活 49B,主干共包含78层,第一层采用标准 FFN,其余 77 层均为 MoE 结构,每层包含 256 个路由专家与 1 个共享专家,每个 token 激活 top-8 路由专家及共享专家。主干之外原生内置 1 层 MTP(总参数量 10B,激活 0.7B)以支持投机解码。
Qwen3.8-Flash-Next
可用于部署开源视觉语言模型,完成图文理解、长上下文推理和智能体任务。项目提供Transformers格式权重与配置,兼容vLLM、SGLang等,采用稀疏注意力、门控残差、N-gram嵌入和MoE,提升长上下文效率。
Qwen3.8-27B
可处理多步复杂任务,支持图像与长视频理解,提供灵活思考控制与深度可调推理,适配主流开发工具链,适用于编码、专业工作及科研场景,部署友好且支持百万级上下文。














