Meta推出Llama 3.1,马克·扎克伯格推动开源人工智能

币界网Publié le 2024-07-24Dernière mise à jour le 2024-07-24

币界网报道:

脸书母公司Meta周二表示,该公司推出了最新的人工智能模型Llama 3.1,这是迄今为止最强大的生成式人工智能产品。此前,Llama 3于4月发布,该公司称之为“我们最先进的开源大型语言模型的下一代”

Meta也被称为Llama 3.1 405B,声称新的人工智能模型现在是世界上最大、最有能力向公众开放的基础模型,称其与其他最先进的模型(如OpenAI和谷歌构建的模型)具有竞争力。

Meta在一篇博客文章中表示:“Llama 3.1 405B是第一个在常识、可操纵性、数学、工具使用和多语言翻译方面与顶级人工智能模型相媲美的公开可用模型。”。“随着405B型号的发布,我们准备加强创新,为增长和探索提供前所未有的机会。”

随着Llama 3的推出以及该公司向生成式人工智能的更广泛转变,该产品已被推向Meta的大多数产品线,包括Instagram、Messenger和WhatsApp。

然而,除了将生成性人工智能带给大众之外,Meta首席执行官马克·扎克伯格表示,将人工智能作为开源工具提供给每个人也很重要。

“开源将确保世界各地更多的人能够获得人工智能的好处和机会,”扎克伯格在一篇帖子中写道。“这种权力并不集中在少数公司手中,而且这项技术可以在整个社会中更均匀、更安全地部署。”

Meta开发开源人工智能模型的努力也促使其他人工智能开发商,包括去中心化人工智能公司Venice AI、Brave Browser开发商Brave和Perplexity AI,将《Llama 3》添加到他们的平台上。

威尼斯人工智能创始人Erik Voorhees在5月份的推特空间上表示:“Meta花费了数亿美元来训练一个尖端模型,并将其免费发布给世界,这值得高度赞扬。”。

Meta表示,在提供更多功能方面,它在开发Llama 3.1 405B时面临的最大挑战是模型大小的整体增加,支持更大的128000个令牌上下文窗口,并提供多语言支持。据该公司称,其Meta AI现在可以用法语、德语、印地语、意大利语、葡萄牙语和西班牙语做出回应。

关于正在进行的关于人工智能安全的争论,扎克伯格断言,人工智能的构建应该避免各种类型的伤害。

扎克伯格说:“无意伤害是指人工智能系统可能造成伤害,即使运行它的人没有这样做的意图。”。“故意伤害是指一个坏人使用人工智能模型来造成伤害。”

在故意滥用的情况下,包括Meta、Anthropic、OpenAI、谷歌和微软在内的主要人工智能开发人员对与选举相关的提示进行了限制,以遏制使用他们的模型传播错误信息。

扎克伯格指出,无意伤害涵盖了人们对人工智能的大部分担忧,并表示开源软件的透明度也有助于缓解这些担忧。Llama 3的推出包括Llama Guard 3,这是一个旨在监控和执行该模型道德使用的工具。

扎克伯格说:“从历史上看,开源软件因此更安全。”。“同样,使用Llama及其像Llama Guard这样的安全系统可能比封闭式模型更安全。”

扎克伯格接着说,他认为《Llama 3.1》的发布将是人工智能行业的一个转折点。

扎克伯格说:“最重要的是,开源人工智能代表了世界上利用这项技术为每个人创造最大经济机会和安全的最佳机会。”。

Meta没有立即回应Decrypt的置评请求。

由Ryan Ozawa编辑。

Lectures associées

Une baisse de prix de seulement 20%, mais la facture est réduite de 80% : GPT-5.6 s'invite sur le terrain de Claude pour recalculer la facture du développement

Un même modèle, dont le prix officiel n’a baissé que de 20 %, permet de réduire votre facture de 80 %. Le 24 août, OpenAI a publié les résultats d’un test mené avec AWS sur Terminal-Bench 2.1 : dans la plateforme de développement Kiro d’AWS, le coût pour accomplir une tâche avec GPT-5.6 Terra a diminué d’environ 82 %. Cette économie ne vient pas seulement de la baisse du prix du modèle, mais surtout d’une optimisation conjointe de l’environnement Kiro et du modèle, réduisant les chemins inutiles, les échecs et les retours en arrière coûteux. La clé réside dans l’efficacité de l’agent de codage. Dans Terminal-Bench, les performances mesurées sont celles du couple « agent + modèle ». Par exemple, avec le même modèle, des cadres de travail différents entraînent des coûts très variables. L’approche spec-driven de Kiro, qui décompose les objectifs vagues en spécifications précises avant de générer du code, limite les dérives et les retouches onéreuses. OpenAI a introduit trois modèles GPT-5.6 (Sol, Terra, Luna) dans Kiro, concurrent directement avec Claude d’Anthropic. Les prix ont été ajustés, notamment pour Luna, passant d’un multiplicateur de 0,6 à 0,1. AWS montre ainsi sa volonté de ne pas dépendre d’un seul fournisseur de modèles. Pour les développeurs, le critère de choix évolue : au-delà du coût par token, c’est le coût total pour accomplir une tâche qui compte désormais.

marsbitIl y a 24 mins

Une baisse de prix de seulement 20%, mais la facture est réduite de 80% : GPT-5.6 s'invite sur le terrain de Claude pour recalculer la facture du développement

marsbitIl y a 24 mins

Trading

Spot
活动图片