主页 > 伦理安全与社会 >

伦理安全与社会

AI 对齐、算法偏见、隐私保护、深度伪造与监管治理。

全部 AI基础 机器学习 深度学习 大模型 生成式AI 计算机视觉 语音与NLP 强化学习与机器人 伦理安全与社会 算力与产业 历史与未来 大模型大全

可解释 AI XAI:打开黑盒的几种思路

为什么模型会得出这个结论?本文介绍可解释人工智能的主要方法类别——自带可解释性的模型、事后解释方法与机制分析方向,并讨论解释本身是否可信这一关键问题,…

伦理安全与社会 2026-05-08 1567 次阅读

人工智能监管:全球治理在管什么

各国到底在管 AI 的什么?本文按风险分级、用途限定、透明度义务与数据合规四条主线梳理监管的共同关注点,并客观陈述不同地区已经公开的主要立法进展与做法,说…

伦理安全与社会 2026-04-24 1530 次阅读

AI 时代的职业新机会

AI 催生了哪些新的工作方向?本文梳理技术侧、应用侧与治理侧三类新兴岗位的具体形态,分析什么样的能力组合更受欢迎,并给出可以着手的能力准备建议,全文不做任…

伦理安全与社会 2026-04-10 1493 次阅读

AI 会取代人类工作吗

哪些工作更容易受到影响,哪些更难?本文区分任务与职业两个层次,说明自动化往往是重塑岗位内容而非让整类职业消失,并讨论普通人更值得投入哪些能力,以及为什…

伦理安全与社会 2026-03-30 1456 次阅读

AI 与版权:训练数据的争议

用受版权保护的作品训练 AI,算不算侵权?本文梳理争议的核心焦点——数据抓取、训练行为的性质认定与输出内容的相似性,并客观陈述各方的不同观点,以及业界正在…

伦理安全与社会 2026-03-16 1419 次阅读

AI 幻觉与事实核查:如何与 AI 共处

大模型为什么会一本正经地编造事实?本文解释幻觉的形成机制与高发场景,指出哪些类型的信息最容易被编造,并给出可操作的核查方法和使用习惯建议,帮助读者建立…

伦理安全与社会 2026-03-02 1382 次阅读

AI 安全:越狱攻击与对抗样本

给图片加一点肉眼看不见的噪声,模型就可能认错;换一种问法,模型就可能绕过限制。本文解释对抗样本与越狱攻击各自的原理、两者的区别,以及常见的防御思路与它…

伦理安全与社会 2026-02-18 1345 次阅读

深度伪造 Deepfake:眼见不再为实

一段视频、一通电话,都可能是 AI 合成的。本文说明深度伪造的常见技术路径与实现原理,分析它可能被滥用的几种方式,并客观介绍当前检测与内容溯源手段的能力边…

伦理安全与社会 2026-02-06 1308 次阅读

数据隐私与联邦学习:数据不动模型动

医院、银行等机构的数据往往不能集中到一起,各方却都希望共同训练出更好的模型。本文解释联邦学习的基本思路、落地时常遇到的通信与数据分布难题,以及它与差分…

伦理安全与社会 2026-01-27 1271 次阅读

算法偏见与公平性:AI 也会戴有色眼镜

AI 的判断为什么会带有偏见?本文拆解偏见的几个主要来源——训练数据中已有的历史差异、人工标注的主观性、特征代理与应用环节,介绍常见的检测思路与缓解手段,…

伦理安全与社会 2026-01-15 1234 次阅读

AI 伦理:什么是对齐问题

当 AI 系统能力越来越强,如何确保它追求的目标与人类的真实意图一致?本文用生活化的类比解释“价值对齐”问题的由来、核心难点,以及研究者正在尝试的几条主要…

伦理安全与社会 2026-01-08 1197 次阅读