今年 4 月,微信推出了 " 方言采集 " 返红包的活动。参与者按照小程序给出的文本朗读方言就能获取收益,每日最多录制 200 句,单日最高收益约 40 元。
这项活动初衷是收集方言语料,补齐平台方言服务短板,优化方言语音识别技术,解决不少用户反馈的方言功能缺失问题。

小程序内大部分语句都是生活场景内容,像家庭闲聊、问路买菜等生活化对话。但在活动开展过程中,不少参与用户发现,系统偶尔会生成一批逻辑怪异、脱离现实的文本,引发大量网友吐槽与质疑。不少用户就此向平台反馈问题,提出批评意见。
近日,微信官方账号 " 微信小安 " 发布公开说明对此事作出回应。官方解释,小程序里的句子依靠算法结合中文文库与日常语义自动生成,但算法合成有时候很蠢,会出现很多不合常理的内容。
针对这一问题,微信表示已经完成文本库的全面梳理,清理掉所有有问题的语句。
同时平台着重说明数据安全方面的安排,会严格遵守相关法规,获取用户单独授权,采集到的方言数据只会用来改良方言识别模型,不会挪作其他用途,也不会向第三方泄露相关数据。



