智谱AI发布第三代对话大模型ChatGLM3，性能和多模态能力均有显著提升

新知榜官方账号

2023-11-27 02:25:18

引言

随着人工智能技术的飞速发展，自然语言处理（NLP）已成为最具挑战性和活跃的研究领域之一。在这个领域，大型预训练模型已被证明是实现卓越性能的关键。

智谱AI最近发布的ChatGLM3，作为其第三代对话大模型，不仅在性能上有了显著提升，还在多个方面展现了其技术优势。

推理速度和成本

ChatGLM3的推理框架基于最新的高效动态推理和显存优化技术。在相同的硬件和模型条件下，与目前最佳的开源实现相比，如伯克利大学的vLLM和HuggingFaceTGI，ChatGLM3的推理速度提升了2-3倍，推理成本降低了一倍。每千tokens的处理成本仅为0.5分，这在成本效益上具有显著优势。

性能提升

在44个中英文公开数据集的测试中，ChatGLM3表现出色，在国内同尺寸模型中排名首位。在MMLU、CEval、GSM8K和BBH等基准测试中，ChatGLM3分别取得了36%、33%、179%和126%的性能提升。这一成就主要归功于其独创的多阶段增强预训练方法和更丰富的训练数据。

多模态能力

ChatGLM3引入了多模态理解能力，特别是其CogVLM功能，在多个国际标准图文评测数据集上取得了SOTA（StateoftheArt）成果。此外，ChatGLM3还包括代码增强模块和网络搜索增强功能，这些都是其技术升级的一部分。

端侧模型

ChatGLM3推出的端侧模型，如ChatGLM3-1.5B和3B，是为了满足日益增长的边缘计算需求。这些模型特别优化了算法和结构，使其能够在资源受限的设备上高效运行。例如，ChatGLM3-1.5B在标准智能手机上的响应时间减少到了仅300毫秒，而能耗降低了40%，这使得AI技术在移动设备上的应用变得更加广泛和实用。

与二代模型对比

与ChatGLM二代模型相比，ChatGLM3在多个方面都有显著的提升。例如，在处理相同的任务时，ChatGLM3的准确率提高了15%，而处理速度提高了20%。这得益于其改进的算法和更大的训练数据集，使得模型在理解和生成语言方面更加精准和高效。

与国际大模型对比

虽然直接的性能对比数据目前尚不可得，但从已公布的技术细节来看，ChatGLM3在多个方面与国际大模型如GPT-4V相媲美。例如，在多模态理解能力方面，ChatGLM3在国际标准图文评测数据集上的表现与GPT-4V相当，显示出其在图文理解和生成方面的强大能力。此外，ChatGLM3在端侧模型的优化方面也展现了其独特的技术优势，这在国际大模型中尚属罕见。

结语

ChatGLM3的发布不仅是智谱AI技术创新的一个里程碑，也是中国大模型技术发展的一个重要标志。通过不断的技术创新和优化，ChatGLM3展现了其在自然语言处理领域的强大实力和广泛的应用前景。

参考资料

HuggingFace
GitHub
AI快站免费加速模型下载

本页网址：https://www.xinzhibang.net/article_detail-21180.html

寻求报道，请

关键词

智谱AI ChatGLM3 自然语言处理多模态能力

分享至微信：

相关工具

HuggingChat

HuggingFace推出的在线聊天机器人，基于Open Assistant模型

ChatGLM

开源的、支持中英双语的1300亿参数的对话语言模型

Inworld

开发和创建AI虚拟角色并与其互动

对话写作猫

秘塔写作猫推出的AI对话聊天工具

Character.AI

创建虚拟角色并与其对话

ChatSonic

WriteSonic出品的ChatGPT竞品

2023人工智能大模型评测报告

2023人工智能大模型评测报告今天分享的是人工智能AI行业研究报告：《2023人工智能大模型评测报告》。（报告出品方：新华社研究院）研究报告内容摘要如下：2023年各大厂商纷纷布局大模型，其内在价值显露无疑大模型的发展可以提供更多的智能化应用场景，拓展更多的智能化服务，提升服务的质量和效率，实现产业

分类标签人工智能大模型评测报告

12-08 16:18

语聚AI新增对话助手、知识助手多种模型、对话背景设定、Markdown编辑器、成员可见范围、费用中心查看消费会话详情、未找到相关内容的解决方案

语聚AI新增对话助手、知识助手多种模型、对话背景设定、Markdown编辑器、成员可见范围、费用中心查看消费会话详情、未找到相关内容的解决方案语聚AI近期新增功能：1. 对话助手、知识助手新增多种模型对话助手提供了丰富的国内外大语言模型，供用户个性化配置使用。在已支持ChatGPT3.5，GPT4，

分类标签语聚AI对话助手知识助手模型背景设定Markdown编辑器成员可见范围费用中心消费会话详情未找到相关内容

11-29 12:03

国内11家备案人工智能大模型名单及发布时间

2023年8月31日，国内第一批完成备案的人工智能大模型名单出炉，共计11（8+3）家，包括文心一言（百度）、智谱清言、日日新（商汤）、云雀（字节）、百川智能、紫东太初、MiniMax、书生（上海人工智能实验室），以及通义千问（阿里巴巴）、360智脑、讯飞星火认知大模型（科大讯飞）。 2023年11

分类标签人工智能大模型备案发布时间

11-29 04:14

最受HuggingFace欢迎的AI机构有哪些？

最受HuggingFace欢迎的AI机构有哪些？15个受欢迎的AI机构榜上有名，其中包括国内唯一入选的KEG实验室，其开源模型ChatGLM-6B已在GitHub和抱抱脸上获得了广泛关注。StabilityAI、MetaAI、Runway占据排名前三，大众熟知的OpenAI、谷歌、微软也榜上有名。K

分类标签 HuggingFaceAI机构StabilityAIMetaAIRunwayOpenAI谷歌微软KEG实验室ChatGLM-6B智谱AIGLM预训练架构MoE架构GLM-10BGLM-130B

11-29 04:13

科大讯飞发布星火认知大模型V3.0，七大能力全面提升

科大讯飞发布星火认知大模型V3.0，七大能力全面提升10月24日，第六届世界声博会暨2023全球1024开发者节开幕，现场科大讯飞董事长刘庆峰、研究院院长刘聪发布讯飞星火认知大模型V3.0，七大能力持续提升，全面对标GPT3.5。主论坛上，科大讯飞重磅发布星火认知大模型V3.0，七大能力均持续提升，

分类标签科大讯飞星火认知大模型V3.0ChatGPT

11-28 02:18

星火认知大模型V3.0发布，讯飞会议耳机“VIAIMAI”功能将进一步升级

星火认知大模型V3.0发布，讯飞会议耳机“VIAIMAI”功能将进一步升级10月24日，星火认知大模型V3.0正式发布。相比2.0版本，星火3.0实现了七大能力持续提升，整体超越ChatGPT，还升级了启发式对话、AI人设功能，能够打造更个性化的AI助手。根据国务院发展研究中心国研经济研究院测评报告

分类标签星火认知大模型V3.0讯飞会议耳机AI助手

11-28 02:17

科大讯飞发布星火认知大模型V3.0，各项能力均有提升

10月24日，科大讯飞正式对外发布了星火认知大模型V3.0。据科大讯飞董事长刘庆峰介绍，相较于2.0版本，星火大模型V3.0在文本生成、语言理解、知识问答、逻辑推理、数学能力、代码能力、多模态能力等方面均有提升，分别提升了7%、6%、7%、8%、3%、9%、7%。在5月6日，科大讯飞首次提出“1+N

分类标签科大讯飞星火认知大模型V3.0

11-28 02:16

KEG实验室与智谱AI合作推出ChatGLM-6B受到AI社区欢迎

KEG实验室与智谱AI合作推出ChatGLM-6B受到AI社区欢迎近日，HuggingFace作为开源AI社区的代表，总结了社区最欢迎的前15个公司和机构，几乎囊括了全部国内外风头正盛的AI科技机构，StabilityAI、MetaAI、Runway占据排名前三，大众熟知的OpenAI、谷歌、微软也

分类标签 KEG实验室智谱AIChatGLM-6B

11-27 02:26

今年火爆全网的ChatGPT能做什么？听说过吗？

ChatGPT：实用又有趣的AI问答神器今年，ChatGPT成为全网热门话题。YY同学-AI问答神器是一款功能强大的智能机器人，可以帮助用户解决各种问题。YY同学不仅可以用来输出产品设计方案，还可以回答各种产品相关问题。此外，它还有各种有趣的玩法，例如摸鱼、写小红书爆款旅记、脱单道路上的得力军师、鸡

分类标签 ChatGPTAI问答神器面具

11-26 10:05

网上人工智能是怎么生成的？

网上人工智能是怎么生成的？在这个人工智能飞速发展的时代，越来越多的网站开始使用人工智能来回答用户的问题。那么这些所谓的人工智能是怎么生成的呢？首先，有一种生成方式是通过网上抓取。这种方式会从各种网站上抓取相关的信息，然后通过算法筛选出最合理的答案。但是这种方式存在一个问题，就是无法确定哪个答案是

分类标签人工智能网上抓取数据库

11-26 10:04

ChatGPT Midjourney 文心一言文心一格 bing新必应 Stable diffusion 稿定设计墨刀AI mastergo Adobe Firefly runway