AI 资讯速递 (2026/1/20): GLM-4.7-Flash开源、免费
导读摘要:
智谱AI正式开源并发布GLM-4.7-Flash模型,该模型采用混合思考架构,总参数量30B,激活参数量仅3B,为轻量化部署提供高性能选择。模型在SWE-bench Verified、τ²-Bench等主流基准测试中表现优异,超越同尺寸开源模型达到SOTA水平。
资讯详情
智谱AI于1月20日宣布正式开源并发布GLM-4.7-Flash模型。该模型采用混合思考架构,总参数量为30B,但激活参数量仅为3B,显著降低了计算资源需求,同时保持了高性能。GLM-4.7-Flash在多个主流基准测试中表现出色,特别是在SWE-bench Verified和τ²-Bench等测试中超越了同尺寸的开源模型,达到了SOTA水平。
核心要点
混合思考架构:GLM-4.7-Flash采用了混合思考架构,通过动态调整激活参数量来优化计算资源的使用。这种架构使得模型在保持高性能的同时,能够适应不同的硬件环境。
轻量化部署:尽管总参数量达到30B,但激活参数量仅为3B,这使得GLM-4.7-Flash能够在资源有限的设备上高效运行。这对于边缘计算和移动设备的应用具有重要意义。
基准测试表现:GLM-4.7-Flash在多个主流基准测试中表现出色。特别是在SWE-bench Verified和τ²-Bench等测试中,其性能超越了同尺寸的开源模型,达到了SOTA水平。
AI-ALL 深度点评
GLM-4.7-Flash的开源发布标志着AI模型在轻量化和高性能之间的平衡取得了重要进展。混合思考架构的引入不仅提高了模型的灵活性和适应性,还显著降低了部署成本。这对于推动AI技术在边缘计算和移动设备中的应用具有重要意义。此外,GLM-4.7-Flash在多个基准测试中的优异表现,进一步验证了其技术优势,有望成为开发者和研究人员的新选择。
