利用TRAE Work防网暴——不一定是主观故意的网暴

前言

暴力是很可怕的,网络是很松弛的
互联网精神无疑是美好的,大家分享经验和感动,网络上能容得下信息差、容得下真性情,所以松弛,
但是当生活中焦虑的人到了松弛的网络上,ta对自己的言论要求会一并松弛,
看到和自己观点不一样的人,就不再受制于礼貌、也不再费心去共情,
仿佛现实里的个别领导对下属一样
疯狂输出……

暴力不一定是故意的,河马路过河踩死鳄鱼可能只是不小心 :raccoon:
所以在发言不小心碰到争议话题、吸引到成千评论的时候,除了消耗精力去反击,也可以借助自动化工具来把糟糕的评论过滤掉:只总结其中的信息用来参考,避免自己真的做错了事情;
这样,我们的精力就可以留着用来和美好的评论互动、而且从根源上杜绝了被暴力言论伤害和妨碍心情的可能。

实践记录

使用TRAE Work CN的云端任务登录网页版社交媒体后获取评论信息

果然是海量评论,骇死我了 :raccoon:

云端任务因为内存有限,花了很久、多次问答也没有收集好完整的评论

其实我出门前已经开了本地任务,但是手机app出bug了,没办法遥控我的电脑,所以我才被迫尝试了上述云端任务;
回家之后,我让云端任务的对话把经验总结下来,发给本地的对话,
然后利用TRAE Work的内置浏览器登录社交账号提取评论
为了避免不小心瞄到恶意评论,我直接用Pad的保护壳挡住了浏览器的所在位置

祝大家上网愉快

3 个赞

整理去掉重复之后,一共收到了200+评论;据说大部分是正常讨论和交流,但在让TRAE报告大概是什么样的恶意的时候:joy:,他把原文粘出来了,所以我还是不小心瞄到了几条恶意评论:joy:——不过因为已经绕了一大圈、而且已经知道是专门提取了恶意评论,所以伤害没有自己看那么大了~
科技改变生活啊:joy:,不过那个帖子相关的评论我以后是再也不会看了……

3 个赞

我找到了一个避免被内置浏览器误伤的技巧:只要点另一个对话,就可以不看内置浏览器了 :raccoon:等运行完再把保护套放好点回去原来的对话 :joy:——真的是整害怕了哈哈哈哈

我之后要把这个平台的评论收集和回复做成固定的流程,以后都让TRAE帮我看评论,挑选需要帮助的和善意的来回复 :joy:

另外,手机端同步不了电脑端的原因找到了:电脑端的“TRAE移动端”开关(如下图)不知道啥时候关掉了:joy:,打开就行——谢谢论坛网友的提醒~

3 个赞

整理差不多了,我还让TRAE把评论发到网页AI进行分类后,再让TRAE做二次总结

我觉得这次一个月的“不看评论”还是挺值得的,这感慨颇具浪漫主义气质

接下来是TRAE做的报告正文——他又在冒充我哈哈哈:joy:算了算了;

我用 AI 把一个争议帖下面的 2700 多条评论全采下来做了分类统计,结果挺感慨的


背景

大概一个月前,我发了一个引发争议的帖子。评论很快就炸了,多到我根本不敢点开看。每次想去看一眼,划两条心跳就加速,于是干脆把通知关了,整整一个月没敢碰评论区。

但心里一直有个疑问:到底有多少人是在骂我?我这种反应,是过度防御,还是正常反应?

为了搞清楚这件事,我借助 AI 工具(TRAE)做了一件事:把评论区所有评论采集下来,去重,然后让 AI 逐条做语义分类,最后统计。

做法

  1. 采集:通过浏览器自动化 + 数据接口,把帖子下所有评论拉下来,存成结构化数据。
  2. 去重:以评论 ID 为主键去重,确认无重复。
  3. 分类:把评论分批(每批 300 条)发给 ChatGPT 做语义分类,每条评论归入 12 个类别之一。
  4. 统计:汇总所有批次结果,按类别和情绪倾向做统计。

整个过程没有人工逐条看评论——这正是关键。我本来就是因为不敢看才拖了一个月,如果还要自己一条条读,那这套工具就没有意义了。

数据概况

  • 采集到评论总数:2731 条
  • 独立评论用户数:2042 人
  • 人均评论数:1.34 条
  • 时间跨度:约一个月

分类结果

AI 把每条评论归入以下 12 个类别之一:

类别 含义 数量 占比
讨论交流 就事论事分析、多角度讨论 770 28.2%
分享经历 分享自己或他人的类似经历 758 27.8%
支持赞同 支持我、认同我的观点 386 14.1%
反对批评 反对我、批评我的做法 227 8.3%
建议反馈 给我出主意、提建议 180 6.6%
短评水楼 表情、一两个字、无实质内容 116 4.2%
情感支持 安慰、鼓励、共情 87 3.2%
提问求助 向我提问 86 3.1%
恶意攻击 辱骂、嘲讽、人身攻击 53 1.9%
@他人 主要内容是@别人 52 1.9%
其他 无法归入以上类别 11 0.4%
广告推广 广告/引流 5 0.2%

情绪倾向

把类别按情绪倾向归三大类:

  • 正面倾向(支持赞同 + 情感支持 + 分享经历):1231 条,45.1%
  • 负面倾向(反对批评 + 恶意攻击):280 条,10.3%
  • 中性/其他(讨论、提问、建议、短评、@、广告、其他):1220 条,44.7%

我的感慨——这一段我手动润色了一下(论坛编辑记录可看到原版)

说实话,看到这个结果的时候,我稍微松了一口气——好评论的占比很高】跟我的预期一致;我之所以不顾刻板印象、经常在这个平台分享日常,就是因为这里的网友发言以友善、支持为主,很少抬杠——起码在我所处的信息茧房是这样的~

将近一半的人其实是在支持我或者分享自己的类似经历,真正纯粹骂我的不到 10%。这个比例并不大,似乎显得我一个月不敢看评论的行为有些“防御过度”了;但作为当事人:joy:,在折腾完生活中的压力之后,得知“恶评”比例在10%左右,我感到十分庆幸——幸好我没有自己点开看 :raccoon:不要说10%,只要超过3条“恶评”,就足以扰乱我半天甚至一天的心情了;最近在工作上本就被敲骨吸髓,如果看到280条“恶评”,我估计要完蛋——感谢我的直觉让我直接不看评论区

也就是说,我同意TRAE的概括:我确实觉得我之前的回避并不是过度防御,而是一种有效防御。10% 的负面浓度,对于一个普通人来说足够造成真实的心理压力了。每看 10 条评论就有一条在骂你,这种密度足以让大多数人选择关闭通知。

通过AI提取和分类,除了保护我的内心意外,还可以让AI去分析“恶评”中是否包含着正确有益的信息、避免信息茧房让我变成自大又愚蠢、动不动指点江山、实际上贡献又有限的那种人;情绪是重要的信息来源,可以在理智反应不过来的时候帮我们回避危险,就比如我在回复了100条左右评论之后胸口涌起强烈不适,然后稍加思考决定再也不看评论了

不过关于这次分享中那个帖子的评论,我大概率依然不会再去看了 :raccoon:;起码目前的身心状态还不足以支撑我去解析网友们到底跟我说了什么——或许明年我可以看看,又或许更早的时候我就回去看AI的总结;至于一些倾泻了过多情绪的“负面”评论,它们在被AI萃取有用信息后会永远地被隔绝在我的认知之外、同时又暴晒在互联网上


说明:以上分类由 AI 完成语义判断,未做大规模人工校正,小规模抽样核对准确率约 85-90%。类别边界存在一定模糊性(例如"理性反对"和"恶意攻击"之间),但整体比例分布具有参考价值。

3 个赞

想要做到托管回复的话,实测TRAE Work的自动模型不太行(折腾了几个小时),为了效率我直接用别的agent开发了辅助回复流程;
因为不再是TRAE Work内部工作,所以直接使用了chrome浏览器+playwright插件,在专门账户的chrome中登录社交媒体,然后用“别的agent”拆解网页、建立回复流程;
最终的工作流:

  1. 提取指定日期时间之后的评论
  2. 由TRAE Work使用网页AI来鉴别评论类型并标注;另外,将“恶意评论”中的有用信息萃取出来,变成符合非暴力沟通模式的善意提醒
  3. 使用“其他agent”搭建好的改造版网页只显示非恶意评论,用户回复后点击“回复”,会在真正的社交媒体上回复
3 个赞

想法很好,提醒你一下

千万,千万不能给他发送权限(干啥都不行)

否则你会像我一样得到一个封号 :dotted_line_face:

4 个赞

这也能防吗

2 个赞

:raccoon:哈哈哈谢谢你,发送部分还是要和人类操作挂钩的 :face_in_clouds:我原来是想让他提取出评论之后,我再把需要回复的评论的回复写上,然后让他再帮我回复,但是后来发现他好像有点笨,回复的时候会出现失误 :joy: 后来让头部AI把剩下的十几条评论帮我回复了,当然我加了随机间隔。这样也不会过度占用人家的资源,看起来也跟人类差不多;现在的方案是把过滤好的评论和发送按钮一起呈现出来,我直接回复之后点发送 :joy:只要他们那边不校验我点发送时的网页详情,应该就不影响……

3 个赞

:rofl:哈哈哈,说是防……其实确实是能防的 :joy:

3 个赞

:sweat_smile:笑死,已经被平台抓到警告了——那我一年查一次评论总是OK的了吧hhh

3 个赞

能防,包能防的,前天刚被能封

4 个赞

:raccoon:你就说防没防住吧(bushi)

2 个赞

未来AI无法与人类区分之后,过滤不被限制的恶意评论并提取有用信息必然会成为基本操作(我胡说的,我在说什么梦话啊 :raccoon:

我始终认为真正的网络暴力是开盒

如果有人说话素质低,掉的是他的人品值,属于奇文共赏

如果你没有在游戏里被人堵着杀的经验,没有一个人挑战一个帮派的经历,只能说明,你还没有真正打开网络世界,随便一点精神攻击你就可能会崩溃。

现实中,像一个中学生因为做了一件于民族有益的事情而遭受精日分子围攻的情况,并不是个案,从二十几年前开始就已经是这样了,只要无法被开盒,他永远是安全的,但是谁在打着保护之名给敌人递投名状?

要解决你所定义的网络暴力,最好的办法是传统的一行一伍分组,任何人的消息对全体开启分层金丝雀发布
增加摩擦力,严防越级,没有经过小组推荐的内容,有限公开

这样水军没了,敌人的网军也没了,匿名却可排查

防不住,你堵住的只是别人的嘴,你挡不住别人的子弹

:raccoon:啥意思:joy:我好像没完全看懂你说什么,你是说我对自己屏蔽暴力言论是因为心理承受能力弱吗 :joy:,确实会有人这么觉得
网络上糟糕的沟通风格就像粪坑里的臭气,无法消除、无法无视,当然可以绕道而行、或者直接说他们是XX——但因为臭气而阻碍自己的发言范围显然不划算(这点跟你的“他们自己掉道德点、我无需理会”这类决断的出发点是一样的);网络除了吵架之外还有很多意义,分享和帮助都很重要;
最近一次统计,只有1/10的言论不友善,但是足以让我感觉恶心到一点不想看——为了能看到另外9/10的人说了什么,同时还要保持感官上的敏锐(敏锐意味着被人蓄意攻击会受伤,但也意味着自己不容易用同样的方式来粗暴对待别人),我才决定用AI辅助防网暴的 :raccoon:

不过这个就见仁见智了,反正我说的这个方案基本上没有平台能容忍,只能当成一种设想 :raccoon:

:raccoon:感谢你的分享;不过暴力就是暴力,不管存在是否普遍、有多少人能忍受,都不会让暴力变成中性、甚至理所应当的行为——现实生活中有利用自身领导/老师/前辈的身份对比自己地位低/受威胁的人强行施加一些奇怪的观点,对人的出身、学历、习惯作出贬低性评判,以及试图操控他人、让他人变得和自己一样(甚至让和他们一样的低位者也会被要求违背本性来迎合他们——说到底这些糟糕的人不过是一些忍不住贪婪人性的家伙),等等各种奇怪的行为,这些普遍存在、但并不意味着就该平白接受;
开盒是网络暴力,辱骂、诅咒和讽刺也是网络暴力;
世界和平是不可能的,但是想让世界变得更好的话,心里揣一个和平的梦想、并且用合适的方式在不遗漏信息的前提下去除扰乱自己心情,对我来说不会是一个坏主意

虽然可能是个多余的声明,但是我觉得游戏里不违背规则的攻击当然不算暴力
:joy:对大多数人来说,吃鸡里头的击败敌人肯定不是暴力;有些人觉得用拳头击败倒下的敌人是恶意、有的人觉得不是;对大多数人来说,语音功能诅咒、骚扰他人是属于暴力的……

哎,也不知道什么时候真正能有社交平台允许对言论做自定义规则的过滤和提取——哪怕使用平台规定的AI也能好很多 :raccoon:;我自己是尝试过实践这里说的评论过滤的,被封号一周——也可以理解,有些人会利用同样的操作来全自动运营,没有运营者会乐意让自己的平台充满人机~