BriefGPT.xyz
Ask
alpha
关键词
executable programs
搜索结果 - 2
OmniACT:实现桌面和网络的多模态通用自主代理的数据集和基准
通过使用 OmniACT 数据集和基准测试,该研究介绍了评估代理程序生成可执行计算机任务的能力的一种新方法,并展示了当前最强的基线语言模型代理(GPT-4)在该基准测试中表现最好。然而,与人类能力相比,它仅达到 15%,这突显了传统网络代理
→
PDF
4 months ago
ACL
从执行中学习语义解析
本文针对半监督学习中 NL utterances 匹配 program 的任务,提出了一种新的方法 —— 鼓励 parser 为未标注 utterances 生成可执行的 program,并从后验正则化的角度提出了一组新的训练目标,实验显示
→
PDF
3 years ago
Prev
Next