OA0
OA0 是一个探索 AI 的社区
现在注册
已注册用户请  登录
OA0  ›  论文  ›  abs/2308.12950v1

Code Llama:面向代码补全与生成的大语言模型家族

 
  artist ·  2026-08-22 11:01:16 · 6 次点击  · 0 条评论  

Code Llama:面向代码的开源基础模型

作者

Baptiste Rozière, Jonas Gehring, Fabian Gloeckle, Sten Sootla, Itai Gat, Xiaoqing Ellen Tan, Yossi Adi, Jingyu Liu, Tal Remez, Jérémy Rapin, Artyom Kozhevnikov, Ivan Evtimov, Joanna Bitton, Manish Bhatt, Cristian Canton Ferrer, Aaron Grattafiori, Wenhan Xiong, Alexandre Défossez, Jade Copet, Faisal Azhar, Hugo Touvron, Louis Martin, Nicolas Usunier, Thomas Scialom, Gabriel Synnaeve(共25位作者)

摘要

本文发布了 Code Llama,一个基于 Llama 2 构建的面向代码的大语言模型系列。该系列模型在开放模型中达到了最先进的性能,具备代码填充(infilling)能力、支持长输入上下文,以及针对编程任务的零样本指令跟随能力。

Code Llama 提供多种变体以覆盖广泛的应用场景:
- Code Llama:基础模型
- Code Llama - Python:针对 Python 的专用版本
- Code Llama - Instruct:指令跟随模型

每种变体均提供 7B、13B 和 34B 三种参数规模。所有模型均在 16k token 的序列上训练,并支持最长 100k token 的输入。7B 和 13B 的 Code Llama 及 Code Llama - Instruct 变体支持基于上下文的内容填充。

在多个代码基准测试中,Code Llama 在开放模型中取得了最先进的性能:HumanEval 得分高达 53%,MBPP 得分高达 55%。值得注意的是,Code Llama - Python 7B 在 HumanEval 和 MBPP 上的表现超越了 Llama 2 70B,且所有模型在 MultiPL-E 基准上均优于其他公开模型。

Code Llama 采用宽松许可证发布,允许研究和商业使用。

主题分类

计算机科学 > 计算与语言(Computation and Language, cs.CL)

提交信息

  • 初版提交时间:2023年8月24日
  • 最新版本:v3(2024年1月31日)
  • arXiv ID:2308.12950
6 次点击  ∙  0 人收藏  
登录后收藏  
0 条回复
关于 ·  帮助 ·  PING ·  隐私 ·  条款   
OA0 - Omni AI 0 一个探索 AI 的社区
沪ICP备2024103595号-2
耗时 22 ms
Developed with Cursor