管提需求,大模型解决问题:图表处理神器SheetCopilot上线


这种丝滑的操作流程简直是职场人的福音!

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

管提需求,大模型解决问题:图表处理神器SheetCopilot上线

近日,来自中科院自动化所、港理工等机构的研究者们造出了一个「表格 AI 助手」SheetCopilot,该智能体能根据用户指令生成操纵表格的解决方案并在特定软件(如:Excel、GoogleSheets 等)上执行。SheetCopilot 可以快速连接多款表格处理软件,且支持多表操作、图表绘制和数据透视表生成,有望赋能多个领域的表格数据处理和可视化,并向实现通才智能助手迈出关键一步。

管提需求,大模型解决问题:图表处理神器SheetCopilot上线

网站:https://sheetcopilot-demo.github.io/

论文:https://arxiv.org/abs/2305.19308

让我们首先通过以下示例来感受 SheetCopilot 如何显著提升工作效率。

假如你是一个刚入职小白,有一天老板要求你帮他分析销售数据。你拿到表格一看,上千行的数据眼花缭乱,一时不知从何下手,于是你边查边做。

首先,你尝试采用把各 Product 名称提取出来,然后用公式对各 Product 的收入求和。

管提需求,大模型解决问题:图表处理神器SheetCopilot上线

搞了二十多分钟,SUMIF 一直报”#NAME?”的错误,遂放弃。

继续上网搜索,发现还有数据透视表(Pivot table)这么方便的工具,于是开始第二次挑战。

管提需求,大模型解决问题:图表处理神器SheetCopilot上线

又花了二十多分钟,终于搞定。整个过程将近一个小时,效率不如人意。每次老板交给你新的表格处理任务时,你之前的经验没有什么用处,因此你只能从头开始查看网站并进行处理。

你的同事则使用 SheetCopilot,伸个懒腰的工夫就把各种奇怪的要求都完成了: )。

Seede AI Seede AI

AI 驱动的设计工具

Seede AI 713 查看详情 Seede AI

管提需求,大模型解决问题:图表处理神器SheetCopilot上线

看到 SheetCopilot 如此丝滑,你也简单尝试了一下,画个图不在话下。

管提需求,大模型解决问题:图表处理神器SheetCopilot上线

有了 SheetCopilot,你再也不用把鼠标滑过半张桌子的距离来选中超出屏幕的数据了,轻松让上千行数据在多张表之间辗转腾挪。

管提需求,大模型解决问题:图表处理神器SheetCopilot上线

为什么提出 SheetCopilot

长久以来,人们一直渴望拥有即使没有专业经验也能熟练掌握复杂软件的能力。许多人都曾遇到过这样的情况:不知如何操作 PhotoShop 的繁琐界面,想要分析数据却不知道数据透视表这一高级功能,想要绘制齿轮却对 Solidworks 一无所知。

随着具有强大语言理解和生成能力的大型语言模型(LLM)的出现,这个愿景比以往任何时候都更接近现实。如果能够引导 LLM 掌握各种软件,就能够释放出 LLM 几乎无限的潜能,进而让人类的生产力达到前所未有的高度。

这篇文章指出电子表格(Spreadsheet)是进行这项研究的理想基础,因为它是一种常见的多功能生产工具。然而,表格操控面临着多样化的挑战,用户难以掌握足够的表格处理和编程技巧以应对变化多端的任务需求。

如果有一种通才 AI 智能体,它掌握丰富的软件操控技能,那么不仅办公效率能得到极大提升,企业产出也会大大加快。SheetCopilot 的出现正好契合了人们这样的远景。

SheetCopilot 有哪些亮点

1. 覆盖表格处理的典型需求

SheetCopilot 涵盖了表格操作的几乎所有典型任务,可以出色地完成各式图表生成任务。

管提需求,大模型解决问题:图表处理神器SheetCopilot上线

销售数据分析

管提需求,大模型解决问题:图表处理神器SheetCopilot上线

实验图表绘制

管提需求,大模型解决问题:图表处理神器SheetCopilot上线

复杂公式计算

管提需求,大模型解决问题:图表处理神器SheetCopilot上线

应用条件格式

2. 超越基于 VBA 的方法

SheetCopilot 优于用GPT-3.5 生成 VBA 代码并执行的方法,生成的解决方案的显著优于后者(见下图),这使得 SheetCopilot 有望成为数据处理人员未来强大的 AI 辅助工具。

管提需求,大模型解决问题:图表处理神器SheetCopilot上线

不仅如此,相比于晦涩的 VBA 代码,SheetCopilot生成的解决方案包含通俗易懂的步骤,这免去了学习新编程语言并艰难调试的痛苦。

管提需求,大模型解决问题:图表处理神器SheetCopilot上线

左图:冗长的 VBA 代码;右图:SheetCopilot简单易懂的解决方案。

3. 舒适的使用体验

SheetCopilot 在网络连接稳定的情况下,仅需约 10 步多表组合操作,即可在上千行数十列的表格中快速完成任务。这不仅解放了用户疲惫的双眼,还节省了查找网站并逐个尝试操作步骤所浪费的时间,同时也避免了学习 VBA 的成本。

管提需求,大模型解决问题:图表处理神器SheetCopilot上线

方法原理

这篇文章将表格操控所需的核心功能抽象为一组虚拟 API(称为原子操作,见下图),用于生成解决方案,作为 LLM 与应用软件之间交互的桥梁。

管提需求,大模型解决问题:图表处理神器SheetCopilot上线

最简单的方法是对 LLM 的一次查询(query)生成一个任务的所有步骤。然而,随着任务复杂度的增加,后序步骤更加依赖前序步骤的执行结果,导致这种开环控制难以得到正确结果。例如,如果无法确定筛选后可见数据的位置,LLM 就难以确定操作范围。

为了实现高效的闭环控制,SheetCopilot 根据软件状态反馈和外置原子操作知识库优化解决方案,提升了成功率和效率。

如何评测

该文提出了一个高质量评测基准。该基准的任务具有多样化的表述,并涉及丰富的原子操作,如下面词云所示:

管提需求,大模型解决问题:图表处理神器SheetCopilot上线

此基准采用了如下有关成功率的指标(越高越好):

  • Exec@1:生成的任务解决方案的执行成功率。
  • Pass@1:任务通过率,即执行后能匹配上任意参考答案的解决方案的占比。

此基准还考虑如下效率指标(越低越好):

  • A50:将符合任务要求的解决方案的步数除以参考答案最少步数,然后对所有计算结果取中位数。
  • A90:计算方式同上,但取所有计算结果的 90 分位数。该指标反映动作数的极值分布。

实验结果

管提需求,大模型解决问题:图表处理神器SheetCopilot上线

表 1:在 SheetCopilot 数据集上对比 GPT-3.5-Turbo、GPT-4、Claude 以及生成 VBA 的方法。

不出意料,GPT-4 符合任务要求的解决方案占比最高且效率最优,而 GPT-3.5-Turbo 则紧随其后,Claude 最次但也接近 GPT-3.5-Turbo。

一个值得关注的结果是,与将用户指令翻译成 VBA 代码并在 Excel 上执行的方法对比,SheetCopilot 取得了非常出色的成功率。这意味着 SheetCopilot 让软件智能控制离我们又近了一大步,让不会编程的用户能以日常交流的方式指挥计算机完成繁杂的工作。

我们再通过下面各个细分类别上的指标来看一看这三个 LLM 各自的优缺点。

管提需求,大模型解决问题:图表处理神器SheetCopilot上线

GPT-3.5 和 GPT-4 轻而易举地解决了 Management(排序、筛选等表格管理操作)和 Entry & manipulation(数据输入与操纵)这两类任务,均取得了 100% 可执行率。此外,三个 LLM 在不同任务类别中各自表现出最佳效率,这一有趣的发现表明每个 LLM 都有其独特的优势,GPT-4 也难以完胜其它模型。

结语

SheetCopilot 借助 LLM成功地将感知、推理和决策通过文字接口构成了一个闭环,实现高效的电子表格操控,促进智能软件控制更上一层楼,也为对通才智能体感兴趣的研究者带来了新的灵感。

以上就是管提需求,大模型解决问题:图表处理神器SheetCopilot上线的详细内容,更多请关注其它相关文章!


# 越好  # 青岛谷歌seo推广公司  # 江西正规seo优化创新服务  # 嵩县冷库建设招标网站  # seo子页面查询  # 城口的网站推广大概收费  # 哈尔滨网站小程序建设  # 淄博seo网站建设  # 新百伦营销推广策略  # 安达网站建设哪家好  # 璧山铝业网站推广  # 这篇文章  # 模型  # 数据处理  # 并在  # 二十  # 闭环  # 丰田  # 这一  # 中国科学院  # 解决问题  # copilot  # claude  # 操作 


相关栏目: 【 Google疑问12 】 【 Facebook疑问10 】 【 优化推广96088 】 【 技术知识133117 】 【 IDC资讯59369 】 【 网络运营7196 】 【 IT资讯61894


相关推荐: 苹果AR头显商标与华为撞车,在中国或改名  全新升级的广州麦当劳:面积最大餐厅正式引入智慧机器人  轻量级的深度学习框架Tinygrad  抢占新赛道 加快机器人产业集聚发展  OpenOOD更新v1.5:全面、精确的分布外检测代码库及测试平台,支持在线排行榜、一键测试  中国最强AI研究院的大模型为何迟到了  AI遇上大运丨热身拉伸、娱乐K歌……AI智能健身镜将亮相成都大运会  东软成立魔形科技研究院,积极布局大语言模型系统工程战略,迎接AI时代  美图发布国内首个“懂美学的”AI视觉大模型MiracleVision  多家欧洲企业签署公开信,批评欧盟 AI 法案草案限制产业发展  五个IntelliJ IDEA插件,高效编写代码  宇宙探索下一阶段,机器代替人类,AI会在太空探索中取代人类吗?  OpenAI 静默关闭 AI 文本检测工具,准确率仅为 26%  从数据中心到发电站:人工智能对能源使用的影响  CREATOR制造、使用工具,实现LLM「自我进化」  人工智能:解决劳动力短缺的关键策略  百度举办AIGC创作沙龙,现场传授AI绘画“咒语”技巧  万魔推出AI主攻的运动耳机,开启十年研发新纪元  网易数帆以AI融合创新引领数据分析与软件开发新趋势  Bing Chat 和 Bing Search 正式引入深色模式  成都大运会闭幕式引入人形机器人展示表演  重塑未来生活的五项技术趋势  通用医疗人工智能如何革新医疗行业?  Dubbo负载均衡策略之 一致性哈希  工信部信通院发布《2025大模型和AIGC产业图谱》 360智脑覆盖全产业链  如何利用AI工具写好本科论文:科技助你一臂之力  美图设计室2.0使用教程  马斯克讽刺人工智能炒作:什么“机器学习”,其实就是统计  OpenAI限制网络爬虫访问以保护数据免被用于AI模型训练  【原创】奥比中光:与英伟达合作开发的3D开发套件正式发布 连接英伟达AI应用生态  套娃不可取:研究人员证实用AI生成的结果训练AI将导致模型退化  眼球反射解锁3D世界,黑镜成真!马里兰华人新作炸翻科幻迷  警惕!AI或致虚假信息泛滥  "探索Meta发布的Quest MR/VR视频录制与拍摄指南"  央广车联网亮相2025世界人工智能大会  脑机接口产业联盟发布十大脑机接口关键技术  Adobe旗下Illustrator引入生成式AI工具Firefly  “图壤·阅读元宇宙”亮相北京国际图书博览会  解决导航“最后50米”难题 高德地图升级AR步行导航找终点功能  谷歌 Gmail“帮我写电子邮件”AI 功能开始向安卓和苹果设备推广  上海发布“元宇宙关键技术攻关行动方案”,加快 AIGC 等突破  微软宣布为 Azure AI 添加男性声线,增强文本转语音功能  工业机器人及非标自动化设备集成服务提供商  视觉中国宣布推出AI灵感绘图、画面扩展功能  奥比中光子公司和斯坦德机器人深度合作,共同推进新一代激光雷达的研发  创新全场景清洁方案!海尔商用机器人首发上市  石头扫拖机器人 G20 618 福利来袭:4999 元,超值配件领到手软  利用AI技术更好地发展农村电商  英国前首相:AI可能被用来制造“生物恐怖武器”  世界人工智能大会中西部县域数字就业中心组团亮相 

 2023-06-12

了解您产品搜索量及市场趋势,制定营销计划

同行竞争及网站分析保障您的广告效果

点击免费数据支持

提交您的需求,1小时内享受我们的专业解答。

运城市盐湖区信雨科技有限公司


运城市盐湖区信雨科技有限公司

运城市盐湖区信雨科技有限公司是一家深耕海外推广领域十年的专业服务商,作为谷歌推广与Facebook广告全球合作伙伴,聚焦外贸企业出海痛点,以数字化营销为核心,提供一站式海外营销解决方案。公司凭借十年行业沉淀与平台官方资源加持,打破传统外贸获客壁垒,助力企业高效开拓全球市场,成为中小企业出海的可靠合作伙伴。

 8156699

 13765294890

 8156699@qq.com

Notice

We and selected third parties use cookies or similar technologies for technical purposes and, with your consent, for other purposes as specified in the cookie policy.
You can consent to the use of such technologies by closing this notice, by interacting with any link or button outside of this notice or by continuing to browse otherwise.