本地LLM智能体数据工程基准评测
热点事件持续更新
本地LLM智能体数据工程基准评测
1 篇报道1 个报道来源4 小时前更新
先了解这件事
AI 综述
一项针对本地开源权重 LLM 智能体的实证研究提出包含 15 项移动性工作流任务的基准,覆盖数据发现、连接器、交通数据流处理、语义增强、特征工程、验证、可视化与报告,用确定性检查器评估生成脚本、表格、图表与报告等完整工件。 研究在消费级 GPU 上评测 10 种本地配置,分别采用一次性与闭环两种模式,每种模型、模式、任务重复 5 次,共 1500 次评分尝试。作者称最强配置达到 85.3% 的工件级成功率,一个量化后的 90 亿参数模型在约 6.5 GB 显存占用下达到 69.3%。
AI 根据报道生成 · 1 小时前更新
最新进展10月9日 12:00
本地 LLM 智能体能否产出可复现的数据工程工件?一项针对移动性工作流的实证研究报道时间线
沿着报道,了解事件的不同侧面。
10月9日
- arXiv cs.SE本地 LLM 智能体能否产出可复现的数据工程工件?一项针对移动性工作流的实证研究
一项针对本地开源 LLM 智能体的实证研究提出包含 15 项移动性工作流任务的基准,用确定性检查器评估生成脚本、表格、图表与报告等完整工件。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。