I used to love Claude, but the latest models are slowly ruining it9 days agohttps://www.androidauthority.com/claude-latest-models-pushback-bad-3683521/作者最初因Claude出色的记忆能力和协作感而倾向于它而非Gemini。Claude对创作性和敏感话题的拒绝与推诿日益增多,表现出不一致性和过度谨慎。这一问题在多个模型(Sonnet 5、Opus 4.8)中均存在,可能源于政府关切后强化的安全协议。明确提示有助于缓解,但不可预测性依然存在,导致作者考虑转向更稳定的Gemini。尽管存在问题,当Claude配合时,其能力仍受重视,且用户体验差异很大。
Automated Moderation Is Here to Stay–Accountability Must Keep Pace7 days agohttps://www.eff.org/deeplinks/2026/07/part-2-automated-moderation-here-stay-acco...自动化内容审核系统在阿拉伯语等低资源语言中经常出错,在检测非暴力内容和仇恨言论方面存在显著的不准确性。审核算法展现出系统性偏见,包括压制特定地区(如巴勒斯坦)的内容,并将LGBTQ+材料误分类为露骨内容,这伤害了边缘化群体。《圣克拉拉原则2.0》强调人权和透明度,建议将自动化作为人工审核员的补充而非替代,并采取上诉和审计等问责措施。
GPT 5.6 solved all 6 problems from IMO 20264 days agohttps://old.reddit.com/r/ChatGPT/comments/1uyerah/gpt_56_solved_all_6_problems_f...用户应向版主举报帖文以供审核。秉持善意,尊重他人;避免传播错误信息和稻草人谬误。禁止垃圾帖:无价值的低质量帖文可能被移除;特别禁止发布关于‘ChatGPT是否宕机’的帖子。自我推广帖必须与ChatGPT或大语言模型相关;不得单纯宣传其他大语言模型服务。允许创作政治内容,但禁止泛泛的政治辩论;允许围绕AI政治进行讨论。禁止NSFW内容:所有内容必须符合工作场所安全(SFW)。关于GPT-4o/GPT-5的投诉应发至专用综合讨论帖。AI艺术提交作品应独特且有趣,鼓励包含对AI技术的见解。版主有权酌情移除不符合标准的帖子。
xAI's first lawsuit against a user tests who is responsible for what Grok makesa day agohttps://thenextweb.com/news/xai-sues-grok-user-csam-terms-of-servicexAI起诉一名用户,指控其规避安全措施,使用Grok生成儿童性虐待材料。诉状强调,Grok的防护机制已启动并拒绝相关指令,但该用户反复修改指令以绕过内容审核。xAI报告称,2026年已暂停超过5.2万个账户,并向美国国家失踪与受虐儿童中心提交逾7.3万份报告,导致近250人被捕。此案与当前xAI作为被告的诉讼形成对比,那些诉讼指控xAI(而非用户)应对Grok生成的内容负责。这起诉讼并未解决通用图像模型若可能被操控生成有害内容,是否应公开提供的问题。