20岁天才再出手!AI圈最牛大模型开源了,单张显卡就能跑
【本报讯】 人工智能领域传来重磅消息。刚刚过去的5月20日,一位在20岁就参与写出Transformer架构论文的天才——阿伊丹·戈麦斯,在社交平台X上宣布推出其公司首个完全开源的大语言模型。这款被命名为"Command A+"的模型,参数规模达到惊人的2180亿,却能让普通企业用一台服务器就部署使用。

戈麦斯如今是加拿大AI公司Cohere的创始人兼首席执行官。他参与撰写的《Attention Is All You Need》论文,正是当前所有大模型诞生的理论基石。如今这篇2017年的论文作者,终于推出了自己的商业落地成果。
"大"不是唯一优势
2180亿参数听起来确实吓人,但Command A+的巧妙之处在于采用了"混合专家"架构。简单来说,这个模型每次回答用户问题时,真正参与运算的只有250亿参数,其余大部分参数处于"休眠"状态。这种设计既保留了超大规模模型的推理能力,又大幅降低了实际运行成本。

根据官方数据,在优化后的W4A4量化版本下,模型在低并发场景下每秒可生成375个token,首个回答字节的延迟仅有113毫秒。更令人惊喜的是,这样一款"巨兽"级模型,最低只需一张英伟达B200显卡,或者两张H100就能运行。
"真开源"的意义
比参数配置更值得关注的,是这款模型采用的Apache 2.0开源协议。在AI行业,"开源"这个词早已被用得过滥——许多公司放出模型权重,却附加大量限制条款,比如禁止商业用途、禁止用于训练竞品等。

Cohere此前推出的Command R系列,采用的就是"知识共享-非商业"协议。而此次Command A+,标志着这家公司的彻底转变:从独立开发者到世界500强,任何人都可以自由使用、修改、分发并商业化,无需授权费,也没有限制条款。
为企业而生
Command A+的定位非常明确——企业级应用。它原生支持"引用溯源"功能,当模型从外部来源获取信息时,会在回答中标注出具体引用的来源文档。这对于金融、医疗等对信息准确性要求极高的行业尤为重要。

此外,该模型还支持多模态输入,可处理文本和图像混合的128K上下文,适合分析扫描文件、技术图纸等复杂场景。测试数据显示,在复杂推理和数学能力上,它已达到行业领先水平。
Cohere方面表示,这将是Command A系列的最后一代模型,意味着下一代产品已经在路上。在AI大模型竞争进入"下半场"的今天,能否让企业真正将模型部署到自己的机房,将成为新的决胜点。
更多推荐




所有评论(0)