微软联手北大发布大模型测试基准“PPTC”

#7*24快讯#小助手22023-11-06

品玩11月6日讯,据HuggingFace 页面报道,微软研究院联手北京大学,共同发布了一款名为 PPTC 的大模型测试基准,可以用于测试大...
品玩11月6日讯,据HuggingFace 页面报道,微软研究院联手北京大学,共同发布了一款名为 PPTC 的大模型测试基准,可以用于测试大模型在PPT 生成方面的能力。
研究团队表示,PPTC包含 279 个涵盖不同主题的多回合会话和数百条涉及多模式操作的说明。研究团队还提出了PPTX-Match评估系统,该系统根据预测文件而不是标签API序列来评估大语言模型是否完成指令,因此它支持各种LLM生成的API序列。
研究团队表示,当前大语言模型在生成PPT 内容方面主要存在三个方面的不足,包括多轮会话中的错误累积、长PPT模板处理和多模态感知问题。
原文链接:https://www.pingwest.com/w/289873

相关话题

#AI #7*24快讯

用手机扫码体验更多功能

扫码参与评论与作者和更多用户交互