智源研究院开源代码生成训练数据集与评测基准TACO

站长网2023-12-25 18:52:261阅

TACO 是一个专注于算法的代码生成数据集，旨在为代码生成模型提供更具挑战性的训练数据集和评测基准。

与当前主流代码评测基准相比，TACO 在数据规模、数据质量和细粒度评测方案上具有明显优势。它包括更大规模的训练集和测试集，每个题目都具备多样化的解题答案，并提供了细粒度的标签，如任务主题、算法、编程技能和难度等级。

实验结果表明，当前流行的代码生成模型在 TACO 评测中与 GPT-4存在显著差异，说明这一领域仍有巨大的提升空间。

TACO 数据集不仅提供了一个挑战性的测试方法，还能作为研究和改进模型性能的训练数据。通过社区的共同努力，可以激发更多创新的解决方案，进一步推动代码生成领域的发展。

具体特性如下：

规模更大:TACO 包括训练集（25443道题目）和测试集(1000道题目)，是当前规模最大的代码生成数据集。

质量更高:TACO 数据集中的每个题目都尽可能匹配多样化的解题答案，答案规模高达155万条，确保训练时模型不易过拟合以及评测结果的有效性。

提供细粒度标签:TACO数据集中每个题目均包含任务主题、算法、技能及难度等细粒度标签，为代码生成模型的训练与评测更精确的参考。

TACO 开源地址：

论文:https://arxiv.org/abs/2312.14852

智源开放数据仓库:https://data.baai.ac.cn/details/BAAI-TACO

GitHub:https://github.com/FlagOpen/TACO

Hugging Face:https://huggingface.co/datasets/BAAI/TACO

新鲜AI产品点击了解：https://top.aibase.com/

智源研究院开源代码生成训练数据集与评测基准TACO

0001

评论列表

共(0)条

相关推荐

站长资讯
Canalys发布2024年全球科技行业十大趋势：预计中国将成为全球最大 AI 市场
Canalys发布了2024年全球科技行业十大趋势的预测。其中包括生成式AI的普及、AI人才短缺、企业拥有超级计算机的增加、非正式编程培训个人生成代码的增加、苹果VisionPro产品供不应求、生成式AI模型受国家管控影响、美国渠道从2024年4月开始恢复增长等。预测显示，这些趋势将对全球科技行业产生深远影响。以下为具体内容:
站长网2024-01-24 10:14:32
0002
站长资讯
Anthropic与谷歌云合作将Claude3模型引入Vertex AI
划重点:🔍Anthropic宣布在GoogleCloud的VertexAI平台上推出Claude3Haiku和Claude3Sonnet，Claude3Opus即将加入。🤝此合作提升了GoogleCloud基础设施支持的先进AI技术的可访问性，强调数据隐私和安全。
站长网2024-03-20 11:18:10
0000
站长资讯
OpenAI CEO 称苹果Vision Pro为iPhone后第二令人印象深刻的科技
OpenAI首席执行官SamAltman最近在推特上发表看法，认为苹果的VisionPro是自iPhone发布以来第二令人印象深刻的科技。据推测，他可能认为OpenAI自2007年苹果发布其移动设备以来推出的ChatGPT是最令人印象深刻的新科技。Altman还在回应一位评论者时提到，苹果的新空间计算头戴设备可能有“可能是有史以来最糟糕的名字”，并在这一过程中批评了自己的产品。
站长网2024-02-10 11:05:10
0000
站长资讯
亚马逊计划对Alexa语音助手重大升级，以保持竞争力
划重点:⭐️亚马逊计划推出重大升级的Alexa语音助手，引入生成式人工智能，以与OpenAI和谷歌等聊天机器人竞争。⭐️新版Alexa将增加月费，不再包含在Prime会员费中。⭐️亚马逊希望借助Alexa庞大的设备基数进行市场推广，但面临生成式人工智能成本和人才竞争等挑战。
站长网2024-05-24 10:09:07
0000
站长资讯
用友发布企业服务大模型YonGPT
7月27日，用友企业服务大模型YonGPT正式发布。YonGPT是用友商业创新平台-用友BIP的重要组成，能够底层适配业界主流的通用语言大模型，通过提供通用能力服务、领域服务及行业服务，实现业务运营、人机交互、知识生成及应用生成4个方面的企业智能化。
站长网2023-07-27 14:11:51
0000