Meta的Llama-3.1-405B遭泄漏，可下载，性能超GPT-4o！

添加书签

AIGC开放社区
2024-07-23

专注AIGC领域的专业社区，关注微软&OpenAI、百度文心一言、讯飞星火等大语言模型（LLM）的发展和应用落地，聚焦LLM的市场研究和AIGC开发者生态，欢迎关注！

7月23日凌晨，有人爆料，Meta的Llama 3.1-405B评测数据遭遇泄漏，明天可能会发布Llama 3系列中最大的参数模型，同时还会发布一个Llama 3.1-70B版本。

这也是在3.0版本基础之上进行了功能迭代，即便是70B的基础模型的性能也超过了GPT-4o。

就连磁力链接都流出来了，「AIGC开放社区」试了一下大约有763.84G。本来huggingface上也有的，后来库被删除了。

磁力地址：Magnet: magnet:?xt=urn:btih:c0e342ae5677582f92c52d8019cc32e1f86f1d83&dn=miqu-2&tr=udp%3A%2F%http://2Ftracker.openbittorrent.com%3A80

下载速度也还可以，每秒14M左右，看来确实是有不少人在下这个模型。

但这个模型一般的GPU肯定是跑不起来，如此大的参数在部署方面个人开发者也负担不起（如果你有一些H100也没问题），估计是给企业、政务公共部门用的。

对于Meta即将发布的模型，就有网友泼冷水。相比OpenAI最新的GPT-4o mini版本，Llama 3.1-70B推理成本提升了3倍，但编码的性能却要差很多。

从性价比、功能来看，Meta的新模型也没什么值得期待的。

还有人甚至在GitHub上看到了上述发布的模型，但很快就拿下来了，估计有一些人可能已经能使用了。

也有人表示，对于这个泄漏事件他认为是真的，因为这是从微软的Azure Github流出来的。

但是这个模型参数较大，对GPU的要求太高了，不如GPT-4o mini性价比高。

虽然模型是免费的，想运行起来还是相当费劲的，没有企业级的算力基础真的无法使用。所以，这对于企业来说是一个不错的好消息。

有人指出即便对Llama 3.1-405B模型进行大幅度优化，量化到5位数，仍然无法适用于消费级GPU，真的是对硬件要求特别高。

如果这份评测数据是真的，那么对于全球多数国家来说都是一个天大的福利。因为这是Meta的Llama 3系列的顶级模型并且是全部开放权重，也就是说人人都能用上免费的AI模型。

但是如果想开发生成式AI应用，也需要强大的AI算力基础、高质量数据以及微调技术。

由于监管机构和各种法案的原因，Meta一直在推迟405B系列模型的发布。那么，本次泄漏是否是Meta特意放出来的呢，因为这是他们的老传统了，去年的Llama模型就干过一次，

当时「AIGC开放社区」也测试过，确实就是他的原模型。期待一波明天，看看Meta还能整啥花活。

本文素材来源网络，如有侵权请联系删除

END

本篇文章来源于微信公众号: AIGC开放社区

即将举行的活动

联系我们

最新网络研讨会

推荐

AIGC开放社区

加入 AIGC开放社区

AIGCOPEN开放社区是专注于AIGC（生成式人工智能）领域的社区，关注包括微软、OpenAI ChatGPT、百度文心一言、科大讯飞星火、华为盘古等大语言模型（LLM）的发展应用和落地，以及国内LLM的发展和市场&学术研究。社区秉承共享、开放的理念，期待与大家一起共建！