第一百二十八章 算我借你的 (2/6)
AI生成:标准排班日历,拖拽功能加班次模板。
用户实际行为:删掉整个排班UI,只保留数据导出功能,手动添加法定节假日高亮和加班时长自动累计,修改五次。
第四列:用户是HR,正在做年终结算。她要的不是排班工具,是加班费合规计算器,需要用实际出勤数据交叉法定假日定义来计算加班倍率。
赵文渊停了一下。
他重新看了看第三列,修改五次、删掉整个UI,这些是系统日志里白纸黑字记下来的行为数据。第四列的标注是在解释这些行为背後的“为什麽”。
他随手又翻了几条。
一个用户输入“做一个会议纪要模板”,实际行为是把生成的模板删到只剩一个表格框架,然後手动加了“待办跟进人”和“下次检查日期”两个字段。第四列标注:用户不是要做会议纪要,是要做项目进度追踪看板,因为公司没有项目管理工具,她在用会议纪要当替代品。
赵文渊挑了这条做验证。用户删掉模板只留表格,行为数据对得上。手动加跟进人和检查日期,操作记录里有。标注的结论:用会议纪要替代项目管理工具。
他想了想,觉得说得通。甚至不只是说得通,如果真的是在做项目管理,那用户接下来的需求大概率是甘特图或者看板视图,而不是更好的会议纪要模板。
这个标注精度已经不是“标得准”了。
是标注者理解了用户的工作场景。
赵文渊抬起头看韩路一。
“这是深加工标注?”赵文渊问,“用来继续提升天工的?”
“不是用来做天工的,算是示例。”
赵文渊皱了下眉,不是做天工,那做什麽?天工是代码专项模型,这些开物数据的标注跟天工很贴合啊“如果用户行为的公开数据集也能有这个精度的标注呢?”韩路一说。
赵文渊直接摇头。
“不可能,你这个精度是因为有开物的行为闭环,用户怎麽改的、重新生成了几次、最终保留了什麽,这些全是客观信号。公开数据集没有这些,光靠人工标注就是在纯猜。”
韩路一没争辩。
他做不到,视界能做到。
他转了个方向:“做一个原型要多少数据?”
章节报错
请简要描述您遇到的问题(如:内容缺失、章节错乱、文字乱码等)