管提需求,大模型解决问题:图表处理神器SheetCopilot上线


这种丝滑的操作流程简直是职场人的福音!

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

管提需求,大模型解决问题:图表处理神器SheetCopilot上线

近日,来自中科院自动化所、港理工等机构的研究者们造出了一个「表格 AI 助手」SheetCopilot,该智能体能根据用户指令生成操纵表格的解决方案并在特定软件(如:Excel、GoogleSheets 等)上执行。SheetCopilot 可以快速连接多款表格处理软件,且支持多表操作、图表绘制和数据透视表生成,有望赋能多个领域的表格数据处理和可视化,并向实现通才智能助手迈出关键一步。

管提需求,大模型解决问题:图表处理神器SheetCopilot上线

网站:https://sheetcopilot-demo.github.io/

论文:https://arxiv.org/abs/2305.19308

让我们首先通过以下示例来感受 SheetCopilot 如何显著提升工作效率。

假如你是一个刚入职小白,有一天老板要求你帮他分析销售数据。你拿到表格一看,上千行的数据眼花缭乱,一时不知从何下手,于是你边查边做。

首先,你尝试采用把各 Product 名称提取出来,然后用公式对各 Product 的收入求和。

管提需求,大模型解决问题:图表处理神器SheetCopilot上线

搞了二十多分钟,SUMIF 一直报”#NAME?”的错误,遂放弃。

继续上网搜索,发现还有数据透视表(Pivot table)这么方便的工具,于是开始第二次挑战。

管提需求,大模型解决问题:图表处理神器SheetCopilot上线

又花了二十多分钟,终于搞定。整个过程将近一个小时,效率不如人意。每次老板交给你新的表格处理任务时,你之前的经验没有什么用处,因此你只能从头开始查看网站并进行处理。

你的同事则使用 SheetCopilot,伸个懒腰的工夫就把各种奇怪的要求都完成了: )。

Seede AI Seede AI

AI 驱动的设计工具

Seede AI 713 查看详情 Seede AI

管提需求,大模型解决问题:图表处理神器SheetCopilot上线

看到 SheetCopilot 如此丝滑,你也简单尝试了一下,画个图不在话下。

管提需求,大模型解决问题:图表处理神器SheetCopilot上线

有了 SheetCopilot,你再也不用把鼠标滑过半张桌子的距离来选中超出屏幕的数据了,轻松让上千行数据在多张表之间辗转腾挪。

管提需求,大模型解决问题:图表处理神器SheetCopilot上线

为什么提出 SheetCopilot

长久以来,人们一直渴望拥有即使没有专业经验也能熟练掌握复杂软件的能力。许多人都曾遇到过这样的情况:不知如何操作 PhotoShop 的繁琐界面,想要分析数据却不知道数据透视表这一高级功能,想要绘制齿轮却对 Solidworks 一无所知。

随着具有强大语言理解和生成能力的大型语言模型(LLM)的出现,这个愿景比以往任何时候都更接近现实。如果能够引导 LLM 掌握各种软件,就能够释放出 LLM 几乎无限的潜能,进而让人类的生产力达到前所未有的高度。

这篇文章指出电子表格(Spreadsheet)是进行这项研究的理想基础,因为它是一种常见的多功能生产工具。然而,表格操控面临着多样化的挑战,用户难以掌握足够的表格处理和编程技巧以应对变化多端的任务需求。

如果有一种通才 AI 智能体,它掌握丰富的软件操控技能,那么不仅办公效率能得到极大提升,企业产出也会大大加快。SheetCopilot 的出现正好契合了人们这样的远景。

SheetCopilot 有哪些亮点

1. 覆盖表格处理的典型需求

SheetCopilot 涵盖了表格操作的几乎所有典型任务,可以出色地完成各式图表生成任务。

管提需求,大模型解决问题:图表处理神器SheetCopilot上线

销售数据分析

管提需求,大模型解决问题:图表处理神器SheetCopilot上线

实验图表绘制

管提需求,大模型解决问题:图表处理神器SheetCopilot上线

复杂公式计算

管提需求,大模型解决问题:图表处理神器SheetCopilot上线

应用条件格式

2. 超越基于 VBA 的方法

SheetCopilot 优于用GPT-3.5 生成 VBA 代码并执行的方法,生成的解决方案的显著优于后者(见下图),这使得 SheetCopilot 有望成为数据处理人员未来强大的 AI 辅助工具。

管提需求,大模型解决问题:图表处理神器SheetCopilot上线

不仅如此,相比于晦涩的 VBA 代码,SheetCopilot生成的解决方案包含通俗易懂的步骤,这免去了学习新编程语言并艰难调试的痛苦。

管提需求,大模型解决问题:图表处理神器SheetCopilot上线

左图:冗长的 VBA 代码;右图:SheetCopilot简单易懂的解决方案。

3. 舒适的使用体验

SheetCopilot 在网络连接稳定的情况下,仅需约 10 步多表组合操作,即可在上千行数十列的表格中快速完成任务。这不仅解放了用户疲惫的双眼,还节省了查找网站并逐个尝试操作步骤所浪费的时间,同时也避免了学习 VBA 的成本。

管提需求,大模型解决问题:图表处理神器SheetCopilot上线

方法原理

这篇文章将表格操控所需的核心功能抽象为一组虚拟 API(称为原子操作,见下图),用于生成解决方案,作为 LLM 与应用软件之间交互的桥梁。

管提需求,大模型解决问题:图表处理神器SheetCopilot上线

最简单的方法是对 LLM 的一次查询(query)生成一个任务的所有步骤。然而,随着任务复杂度的增加,后序步骤更加依赖前序步骤的执行结果,导致这种开环控制难以得到正确结果。例如,如果无法确定筛选后可见数据的位置,LLM 就难以确定操作范围。

为了实现高效的闭环控制,SheetCopilot 根据软件状态反馈和外置原子操作知识库优化解决方案,提升了成功率和效率。

如何评测

该文提出了一个高质量评测基准。该基准的任务具有多样化的表述,并涉及丰富的原子操作,如下面词云所示:

管提需求,大模型解决问题:图表处理神器SheetCopilot上线

此基准采用了如下有关成功率的指标(越高越好):

  • Exec@1:生成的任务解决方案的执行成功率。
  • Pass@1:任务通过率,即执行后能匹配上任意参考答案的解决方案的占比。

此基准还考虑如下效率指标(越低越好):

  • A50:将符合任务要求的解决方案的步数除以参考答案最少步数,然后对所有计算结果取中位数。
  • A90:计算方式同上,但取所有计算结果的 90 分位数。该指标反映动作数的极值分布。

实验结果

管提需求,大模型解决问题:图表处理神器SheetCopilot上线

表 1:在 SheetCopilot 数据集上对比 GPT-3.5-Turbo、GPT-4、Claude 以及生成 VBA 的方法。

不出意料,GPT-4 符合任务要求的解决方案占比最高且效率最优,而 GPT-3.5-Turbo 则紧随其后,Claude 最次但也接近 GPT-3.5-Turbo。

一个值得关注的结果是,与将用户指令翻译成 VBA 代码并在 Excel 上执行的方法对比,SheetCopilot 取得了非常出色的成功率。这意味着 SheetCopilot 让软件智能控制离我们又近了一大步,让不会编程的用户能以日常交流的方式指挥计算机完成繁杂的工作。

我们再通过下面各个细分类别上的指标来看一看这三个 LLM 各自的优缺点。

管提需求,大模型解决问题:图表处理神器SheetCopilot上线

GPT-3.5 和 GPT-4 轻而易举地解决了 Management(排序、筛选等表格管理操作)和 Entry & manipulation(数据输入与操纵)这两类任务,均取得了 100% 可执行率。此外,三个 LLM 在不同任务类别中各自表现出最佳效率,这一有趣的发现表明每个 LLM 都有其独特的优势,GPT-4 也难以完胜其它模型。

结语

SheetCopilot 借助 LLM成功地将感知、推理和决策通过文字接口构成了一个闭环,实现高效的电子表格操控,促进智能软件控制更上一层楼,也为对通才智能体感兴趣的研究者带来了新的灵感。

以上就是管提需求,大模型解决问题:图表处理神器SheetCopilot上线的详细内容,更多请关注其它相关文章!


# 越好  # 青岛谷歌seo推广公司  # 江西正规seo优化创新服务  # 嵩县冷库建设招标网站  # seo子页面查询  # 城口的网站推广大概收费  # 哈尔滨网站小程序建设  # 淄博seo网站建设  # 新百伦营销推广策略  # 安达网站建设哪家好  # 璧山铝业网站推广  # 这篇文章  # 模型  # 数据处理  # 并在  # 二十  # 闭环  # 丰田  # 这一  # 中国科学院  # 解决问题  # copilot  # claude  # 操作 


相关栏目: 【 Google疑问12 】 【 Facebook疑问10 】 【 优化推广96088 】 【 技术知识133117 】 【 IDC资讯59369 】 【 网络运营7196 】 【 IT资讯61894


相关推荐: 以计算机视觉技术为基础的库存管理如何改革零售行业  人形机器人打开精密齿轮市场全新空间!受益上市公司梳理  谷歌旗下 DeepMind 开发出 RoboCat AI 模型,能控制多种机器人执行一系列任务  下一个前沿:量子机器学习和人工智能的未来  基于信息论的校准技术,CML让多模态机器学习更可靠  2025世界人工智能大会成功召开  人工智能正在弥合认知和表达之间的鸿沟  午报 | 字节跳动要造机器人;东方甄选首次启动自有APP|直播|  扎克·施奈德新片《月球叛军》曝剧照 机器人首度现身  Gartner预测:到2025年,全球对话式人工智能支出预计将达到1860亿美元  7条线路感受智慧美好生活,“2025 世界人工智能大会民营企业社会开放日”主题活动启动  统信深度deepin成立 AI SIG 社区,共同提升 Linux 下 AI 体验  洞穴探险神器?可自主导航的单旋翼自旋无人机,效率更高!  改变城市交通:智慧城市中的智能交通  数据显示:人工智能相关专业热度上升最快 考古、美术、生物医学工程等小众专业火了  WAIC 2025|云深处科技绝影Lite3与X20四足机器人亮相  遵义市首次引入手术机器人,成功实施全膝关节置换术  鸿蒙OS 4将实现AI大模型集成,余承东表示坚持AI辅助而非AI取代  在心理治疗中用VR技术,治疗成效显著提高  人工智能时代的科幻译者怎么办?“做好翻译工作的高端10%”|文化观察  字节团队提出猞猁Lynx模型:多模态LLMs理解认知生成类榜单SoTA  大疆 DJI Mini 4 Pro 无人机曝光:流线设计,有望迎来功能性提升  微软最新推出的NaturalSpeech2语音合成模型:提供更准确的语音重构,避免棒读效果  AI绘画,还需要懂数学?  AI进军债券交易,BondGPT来了!  史玉柱谈AI:国内最缺是计算数学人才,曾给浙大数学系捐五千万  2025 WAIC|美团无人机发布第四代新机型  美版贴吧8000小组自爆停摆!拒绝数据被谷歌OpenAI白嫖,CEO被网友骂翻:背刺第三方应用  不到2S创作AI图像!Snap发布图像生成器SnapFusion  V社回应拒绝上架含 AI 生成内容的游戏:审核政策正在调整中  消息称字节机器人团队已有约50人,计划年底扩充到上百人  农业产业升级:AI驱动的“崃·见田”开启农田未来展望  AI取代人工先拿教育行业开刀?美版“作业帮”启动裁员  人形机器人概念大热!这些产业链标的或受提振  科普:什么是AI大模型  人手一部「*」!视频版Midjourney免费可用,一句话秒生酷炫大片惊呆网友  标小智LOGO推出AI公司起名生成器“Name.GPT”  北交大推出国内首个开源交通大模型TransGPT,可免费商用  首部国内AI辅助动画片《魔游纪:人工智能辅助篇》预告发布  周鸿祎:用超级AI实现室温超导和核聚变,实现能源自由  国内通用人形机器人将发布、产业加速突破  研究发现AI聊天机器人ChatGPT不会讲笑话,只会重复25个老梗  陈根:ChatGPT和人类合作开发机器人  高质量数据推动AI场景化应用快速发展及落地  尼康尼克尔Z 180-600mm f/5.6-6.3 VR镜头发布:12499元 拍鸟神器  聚焦WAIC|AI技术支撑大模型探索未来  OpenOOD更新v1.5:全面、精确的分布外检测代码库及测试平台,支持在线排行榜、一键测试  腾讯AI首次模拟拼接三星堆文物,工作取得阶段性的成果  可按用户语气自动回复消息,Zoom 推出基于生成式 AI 的新功能  百川智能发布Baichuan-13B AI模型,号称“130亿参数开源可商用” 

 2023-06-12

了解您产品搜索量及市场趋势,制定营销计划

同行竞争及网站分析保障您的广告效果

点击免费数据支持

提交您的需求,1小时内享受我们的专业解答。

运城市盐湖区信雨科技有限公司


运城市盐湖区信雨科技有限公司

运城市盐湖区信雨科技有限公司是一家深耕海外推广领域十年的专业服务商,作为谷歌推广与Facebook广告全球合作伙伴,聚焦外贸企业出海痛点,以数字化营销为核心,提供一站式海外营销解决方案。公司凭借十年行业沉淀与平台官方资源加持,打破传统外贸获客壁垒,助力企业高效开拓全球市场,成为中小企业出海的可靠合作伙伴。

 8156699

 13765294890

 8156699@qq.com

Notice

We and selected third parties use cookies or similar technologies for technical purposes and, with your consent, for other purposes as specified in the cookie policy.
You can consent to the use of such technologies by closing this notice, by interacting with any link or button outside of this notice or by continuing to browse otherwise.