当前位置:AIGC资讯 > AIGC > 正文

Meta的Llama-3.1-405B遭泄漏,可下载,性能超GPT-4o!

7月23日凌晨,有人爆料,Meta的Llama3.1-405B评测数据遭遇泄漏,明天可能会发布Llama3系列中最大的参数模型,同时还会发布一个Llama3.1-70B版本。

这也是在3.0版本基础之上进行了功能迭代,即便是70B的基础模型的性能也超过了GPT-4o。

就连磁力链接都流出来了,「AIGC开放社区」试了一下大约有763.84G。本来huggingface上也有的,后来库被删除了。

磁力地址:

Magnet: magnet:?xt=urn:btih:c0e342ae5677582f92c52d8019cc32e1f86f1d83&dn=miqu-2&tr=udp%3A%2F%https://2Ftracker.openbittorrent.com%3A80

下载速度也还可以,每秒14M左右,看来确实是有不少人在下这个模型。

但这个模型一般的GPU肯定是跑不起来,如此大的参数在部署方面个人开发者也负担不起(如果你有一些H100也没问题),估计是给企业、政务公共部门用的。

对于Meta即将发布的模型,就有网友泼冷水。相比OpenAI最新的GPT-4o mini版本,Llama3.1-70B推理成本提升了3倍,但编码的性能却要差很多。

从性价比、功能来看,Meta的新模型也没什么值得期待的。

还有人甚至在GitHub上看到了上述发布的模型,但很快就拿下来了,估计有一些人可能已经能使用了。

也有人表示,对于这个泄漏事件他认为是真的,因为这是从微软的Azure Github流出来的。

但是这个模型参数较大,对GPU的要求太高了,不如GPT-4o mini性价比高。

虽然模型是免费的,想运行起来还是相当费劲的,没有企业级的算力基础真的无法使用。所以,这对于企业来说是一个不错的好消息。

有人指出即便对Llama3.1-405B模型进行大幅度优化,量化到5位数,仍然无法适用于消费级GPU,真的是对硬件要求特别高。

如果这份评测数据是真的,那么对于全球多数国家来说都是一个天大的福利。因为这是Meta的Llama3系列的顶级模型并且是全部开放权重,也就是说人人都能用上免费的AI模型。

但是如果想开发生成式AI应用,也需要强大的AI算力基础、高质量数据以及微调技术。

由于监管机构和各种法案的原因,Meta一直在推迟405B系列模型的发布。那么,本次泄漏是否是Meta特意放出来的呢,因为这是他们的老传统了,去年的Llama模型就干过一次,

当时「AIGC开放社区」也测试过,确实就是他的原模型。期待一波明天,看看Meta还能整啥花活。

总结

**Meta Llama3.1系列模型评测数据疑似泄漏,性能超越GPT-4o**
近日,社交媒体上爆出一则重磅消息,Meta公司旗下Llama3.1系列的模型评测数据疑似提前泄漏。据悉,该系列即将发布Llama3系列中的最大参数模型,以及Llama3.1-70B版本,这些版本均在Meta的3.0版本基础上进行了功能迭代,并且其基础版本的性能已超越GPT-4o。
此次泄露的模型数据文件非常之大,达到了763.84G,并已通过磁力链接在网上流传。虽然下载速度尚可(每秒约14M),但对于大多数个人开发者而言,因模型对GPU的要求极高,部署成本将极为昂贵。因此,该模型更可能面向政府和大型企业等具备企业级算力基础的用户。
尽管Meta即将发布的模型备受关注,但一些网友也对其性能提出了质疑。与OpenAI最新的GPT-4o mini版本相比,Llama3.1-70B的推理成本提升了3倍,同时在编码性能上也显得较弱。尽管如此,该模型对于全球许多企业而言,仍是一个极具吸引力的选择,因为它的性能足以支持其开展AI应用开发。
这一泄密事件还迎来了一些议论。一些人怀疑该泄漏并非纯属偶然,而是Meta故意而为。毕竟,Meta曾经有过类似的先例,即在去年预先泄露了其Llama模型。对此,科技界和开源社区都在翘首以盼,看明天Meta将如何回应这一事件,并继续推动其在AI领域的布局。
然而,即使Meta免费提供Llama3.1系列模型,没有相应的算力基础、高质量数据集以及微调技术,开发有效的生成式AI应用仍将充满挑战。对于全球AI研究和应用领域来说,这无疑是一次仅供专业用户享用的技术盛宴。

更新时间 2024-07-23