AI 资讯速递 (2026/1/20): GLM-4.7-Flash开源、免费

2026年1月20日 10:18

导读摘要:

智谱AI正式开源并发布GLM-4.7-Flash模型,该模型采用混合思考架构,总参数量30B,激活参数量仅3B,为轻量化部署提供高性能选择。模型在SWE-bench Verified、τ²-Bench等主流基准测试中表现优异,超越同尺寸开源模型达到SOTA水平。

资讯详情

智谱AI于1月20日宣布正式开源并发布GLM-4.7-Flash模型。该模型采用混合思考架构,总参数量为30B,但激活参数量仅为3B,显著降低了计算资源需求,同时保持了高性能。GLM-4.7-Flash在多个主流基准测试中表现出色,特别是在SWE-bench Verified和τ²-Bench等测试中超越了同尺寸的开源模型,达到了SOTA水平。


核心要点

  • 混合思考架构:GLM-4.7-Flash采用了混合思考架构,通过动态调整激活参数量来优化计算资源的使用。这种架构使得模型在保持高性能的同时,能够适应不同的硬件环境。

  • 轻量化部署:尽管总参数量达到30B,但激活参数量仅为3B,这使得GLM-4.7-Flash能够在资源有限的设备上高效运行。这对于边缘计算和移动设备的应用具有重要意义。

  • 基准测试表现:GLM-4.7-Flash在多个主流基准测试中表现出色。特别是在SWE-bench Verified和τ²-Bench等测试中,其性能超越了同尺寸的开源模型,达到了SOTA水平。


AI-ALL 深度点评

GLM-4.7-Flash的开源发布标志着AI模型在轻量化和高性能之间的平衡取得了重要进展。混合思考架构的引入不仅提高了模型的灵活性和适应性,还显著降低了部署成本。这对于推动AI技术在边缘计算和移动设备中的应用具有重要意义。此外,GLM-4.7-Flash在多个基准测试中的优异表现,进一步验证了其技术优势,有望成为开发者和研究人员的新选择。

关于AI资讯

我们使用AI技术每日自动获取和筛选全球最新的人工智能资讯,为您提供最有价值的行业动态。