Meta的Llama-3.1-405B遭泄漏,可下载,性能超GPT-4o!

Meta的Llama-3.1-405B遭泄漏,可下载,性能超GPT-4o!
2024年07月23日 09:16 市场资讯

安装新浪财经客户端第一时间接收最全面的市场资讯→【下载地址

  Llama 3.1-70B版本性能极强、参数巨大,普通的GPU无法带动,因此个人开发者可能无法担负。有网友“泼冷水”,认为该模型推理成本提升了3倍,但编码的性能却要差很多。

  7月23日凌晨,有人爆料,Meta的Llama 3.1-405B评测数据遭遇泄漏,明天可能会发布Llama 3系列中最大的参数模型,同时还会发布一个Llama 3.1-70B版本。

  这也是在3.0版本基础之上进行了功能迭代,即便是70B的基础模型的性能也超过了GPT-4o。

  就连磁力链接都流出来了,‘AIGC开放社区’试了一下大约有763.84G。本来huggingface上也有的,后来库被删除了。

  下载速度也还可以,每秒14M左右,看来确实是有不少人在下这个模型。

  但这个模型一般的GPU肯定是跑不起来,如此大的参数在部署方面个人开发者也负担不起(如果你有一些H100也没问题),估计是给企业、政务公共部门用的。

  对于Meta即将发布的模型,就有网友泼冷水。相比OpenAI最新的GPT-4o mini版本,Llama 3.1-70B推理成本提升了3倍,但编码的性能却要差很多。

  从性价比、功能来看,Meta的新模型也没什么值得期待的。

  还有人甚至在GitHub上看到了上述发布的模型,但很快就拿下来了,估计有一些人可能已经能使用了。

  也有人表示,对于这个泄漏事件他认为是真的,因为这是从微软的Azure Github流出来的。

  但是这个模型参数较大,对GPU的要求太高了,不如GPT-4o mini性价比高。

  虽然模型是免费的,想运行起来还是相当费劲的,没有企业级的算力基础真的无法使用。所以,这对于企业来说是一个不错的好消息。

  有人指出即便对Llama 3.1-405B模型进行大幅度优化,量化到5位数,仍然无法适用于消费级GPU,真的是对硬件要求特别高。

  如果这份评测数据是真的,那么对于全球多数国家来说都是一个天大的福利。因为这是Meta的Llama 3系列的顶级模型并且是全部开放权重,也就是说人人都能用上免费的AI模型。

  但是如果想开发生成式AI应用,也需要强大的AI算力基础、高质量数据以及微调技术。

  由于监管机构和各种法案的原因,Meta一直在推迟405B系列模型的发布。那么,本次泄漏是否是Meta特意放出来的呢,因为这是他们的老传统了,去年的Llama模型就干过一次,

  当时‘AIGC开放社区’也测试过,确实就是他的原模型。期待一波明天,看看Meta还能整啥花活。

  本文作者:AIGC开放社区,来源:AIGC开放社区,原文标题:《Meta的Llama-3.1-405B遭泄漏,可下载,性能超GPT-4o!》

  风险提示及免责条款

  市场有风险,投资需谨慎。本文不构成个人投资建议,也未考虑到个别用户特殊的投资目标、财务状况或需要。用户应考虑本文中的任何意见、观点或结论是否符合其特定状况。据此投资,责任自负。

海量资讯、精准解读,尽在新浪财经APP

责任编辑:王永生

Meta gpu

VIP课程推荐

加载中...

APP专享直播

1/10

热门推荐

收起
新浪财经公众号
新浪财经公众号

24小时滚动播报最新的财经资讯和视频,更多粉丝福利扫描二维码关注(sinafinance)

股市直播

  • 图文直播间
  • 视频直播间

7X24小时

  • 07-26 龙图光罩 688721 --
  • 07-23 博实结 301608 44.5
  • 07-22 力聚热能 603391 40
  • 07-15 绿联科技 301606 21.21
  • 07-11 科力装备 301552 30
  • 新浪首页 语音播报 相关新闻 返回顶部