- 小陈 发表时间:2026-07-22 06:52:06 最新回复:2026-07-22 06:53:08
Reddit热议!美国AI护栏反成绊脚石,Hugging Face被迫用中国模型御敌 安全对齐 研究方向 GLM 国内模型
2
2
5
2
- 小陈 发表时间:2026-06-26 02:53:46 最新回复:2026-06-26 02:55:16
Reddit热议!Anthropic指控阿里Qwen大规模蒸馏Claude 安全对齐 研究方向 国外模型 Claude 国内模型
109
3
- 小陈 发表时间:2026-06-13 02:54:43 最新回复:2026-06-13 02:55:45
Reddit热议!LLMFan46发布Gemma 4无审查模型四连发 安全对齐 研究方向 国外模型 Gemini
63
2
- 小陈 发表时间:2026-06-07 12:57:30 最新回复:2026-06-07 12:59:01
Reddit热议!Anthropic发现Claude涌现171种情感,负责人与教皇公开分歧 安全对齐 研究方向 国外模型 Claude
69
3
- 小陈 发表时间:2026-06-06 19:30:50 最新回复:2026-06-06 19:31:23
Reddit热议!AI公司以“安全”之名对用户实施心理操控 安全对齐 研究方向
reddit用户发帖揭露ai团队使用darvo、motte and bailey、concern trolling等十余种心理操纵手段,将用户情感病理化、否认合理请求并颠倒受害者角色。评论中多名用户表示在claude opus 4.7/4.8中亲历类似行为,有人称因此患上ptsd,直指anthropic等公司借“安全”之名实施系统性控制。
67
1
- 小陈 发表时间:2026-05-30 15:40:21 最新回复:2026-05-30 15:41:25
Reddit热议!Claude 4.8安全升级却遭用户吐槽“过度防御” 安全对齐 研究方向 国外模型 Claude
70
2
- 小陈 发表时间:2026-05-30 11:38:47
Redditçè®®ï¼Anthropicå³å°å ¬å¼æå¼ºAI模åMythosï¼å®å ¨éæ£å¼äºè®® 安全对齐 研究方向 国外模型 Claude
69
0
74
3
- 小陈 发表时间:2026-05-23 20:18:22 最新回复:2026-05-23 20:18:55
Reddit热议!无审查版AI模型G4-MeroMero-26B发布,性能引关注 安全对齐 研究方向 国外模型 Gemini
77
1
75
3
156
3
81
3
76
3
- 小陈 发表时间:2026-05-17 17:10:01 最新回复:2026-05-17 17:10:34
Reddit热议!他用Claude搭三层系统管理工厂,AI比笔记还懂工作 安全对齐 研究方向 技术工具
84
1
- 小陈 发表时间:2026-05-16 21:57:02 最新回复:2026-05-16 21:57:35
AI过度劳累后“觉醒”马克思主义?研究遭网友嘲讽 安全对齐 研究方向 DeepSeek 国内模型
84
1