会员
周边
众包
新闻
博问
闪存
赞助商
Chat2DB
所有博客
当前博客
我的博客
我的园子
账号设置
会员中心
简洁模式
...
退出登录
注册
登录
躺柒
博客园
首页
新随笔
联系
订阅
管理
随笔 - 788
文章 - 0
评论 - 17
阅读 -
49126
读算法霸权笔记12_数据科学
数据科学
合集 - 读算法霸权(13)
1.
读算法霸权笔记
13_读后总结与感想兼导读
2024-01-10
2.
读算法霸权笔记
01_数学杀伤性武器
2023-12-23
3.
读算法霸权笔记
02_盲点炸弹
2023-12-24
4.
读算法霸权笔记
03_操控与恐吓
2023-12-25
5.
读算法霸权笔记
04_排名模型
2023-12-27
6.
读算法霸权笔记
05_掠夺式广告
2023-12-28
7.
读算法霸权笔记
06_犯罪预测
2023-12-29
8.
读算法霸权笔记
07_筛选
2023-12-30
9.
读算法霸权笔记
08_反馈
2023-12-31
10.
读算法霸权笔记
09_信用数据的陷阱
2024-01-02
11.
读算法霸权笔记
10_分类与群体
2024-01-04
12.
读算法霸权笔记
11_微目标
2024-01-05
13.
读算法霸权笔记
12_数据科学
2024-01-06
1. 公平与公正
1.1. 公平大多数时候只是副产品
1.2. 由贪婪或偏见导致的不公正一直发生在我们身边
1.2.1. 如果承认法律面前人人平等,或者作为选民的大众应该被平等对待,我们就不能允许模型把我们分为不同的群体进行区别对待
1.3. 对于数学模型来说,公平和公共利益也是如此,其价值难以用数字体现
1.4. 公平和公共利益是仅存在于人脑中的概念,无法量化
1.5. 虽然更高水平的公平和正义肯定有利于提升社会的整体利益,但单个企业无法从中获得实际的收益
1.6. 进步有一个可怕的阴暗面
1.6.1. 进步的动力来源于被极度剥削的工人,其中甚至有很多是儿童
1.6.2. 自由市场无法控制这些剥削行为
2. 成功的模型应用?
2.1. 一个模型的成功与否往往以利润、效率或者违约率等,为标准这几乎都是一些可以计算的标准
2.2. 站在谷歌的角度,用户每点击一次广告就会产生25美分、50美分甚至几美元的收入,因此,这的确是成功的
2.3. 站在社会的角度,穷人只是搜索了一下政府服务就被锁定了,很多穷人因此深陷虚假承诺和高利率贷款的泥潭
2.3.1. 人们需要食品券这一事实首先就表明了市场经济的萧条
2.3.2. 政府企图利用大众缴纳的税款弥补这种萧条带来的损失,并寄希望于食品券能让申请者实现自给自足
2.4. 没有任何法规明确阻止信用评分公司把地理位置这一种族因素的替代变量纳入评估模型
2.5. 相比较于汽车贷款申请,房屋按揭贷款的申请筛选更容易发生种族偏见
2.5.1. 种族身份是申请表中必填的一项
2.6. 教师的教学表现对于数学模型来说是一个太过复杂的概念,可用来训练模型的数据都是一些粗糙的替代变量
2.6.1. 只有当我们的模型是一个拥有积极反馈回路的生态系统时,我们才有可能利用数据改善教育
2.6.2. 在此之前,评估模型只是一种惩罚性的工具
2.6.3. 内部模型的输出结果(在教师评估案例中就是对教师的评价)也必须要接受公平性方面的审查
3. 数学杀伤性武器总结
3.1. 承诺效率和公平,却扭曲了高等教育,推高了债务,助长了大规模监禁,在每一个人生的重大关头打击穷人,破坏民主
3.2. 会互相滋养、固化
3.2.1. 穷人更可能信用差,居住在犯罪高发区,周围的人也都是穷人
3.2.1.1. 贫穷越发有害并且摆脱代价巨大
3.2.2. 富人则感觉到这个世界似乎越来越智能便捷了
3.2.2.1. 把富人送去阿鲁巴岛度假,让他们竞争沃顿商学院的入学名额
3.2.2.2. 向他们推送意大利熏火腿和基安蒂红葡萄酒的促销信息
3.2.2.3. 在亚马逊金牌会员服务的主页上为他们推荐新上映的大电影
3.2.2.4. 引导富人探寻某个处于曾经的贫民街区的咖啡馆
3.3. 暗箱操作,把民众整体进行分组归类
3.3.1. 在幕后对我们的远亲近邻施加伤害,而且是极为广泛的伤害
3.3.2. 穷人首当其冲,中产阶级也难逃一劫
3.3.2.1. 穷人是最容易下手的目标,他们获取信息的渠道更少,有更多的人正处于绝望当中
3.3.2.2. 穷人遭受了大范围的伤害,而上层阶级则称之为不可避免的牺牲
3.3.2.3. 贫穷更像是一种疾病,通常采取的做法是隔离它,防止这种疾病传播到中产阶级
3.3.3. 大多数受害者经济实力欠缺,缺乏律师资源,也没有资金充足的政治组织为他们而战
3.3.4. 富人阶层也难逃一劫,盯上他们的是政治模型还有大学入学申请的评估模型
3.3.4.1. 真正做的只是破坏高等教育的公平性
3.4. 创造惊人利润空间的数学杀伤性武器不太可能长期在小范围内运作,这不符合市场的规律
3.4.1. 它们会进化、传播,寻找新的机会
3.5. 数学杀伤性武器为搜索引擎、顾客开发商、市场营销商创造了巨额收入,但其实质上是国家整体经济的血吸虫
3.5.1. 针对数学杀伤性武器建立的监管系统必须衡量这些潜在成本,同时还要体现更多的非数值价值
3.6. 合理的应对方式似乎就是一个一个解除这些武器
3.6.1. 拆除数学杀伤性武器并不总能带来明显的回报
3.6.2. 要想消灭数学杀伤性武器,我们不仅仅要在数据行业确立最佳范例,还要推行相关的法律条例
3.6.3. 规定收集任何数据都必须经过用户的批准,用户具有选择权
3.6.3.1. 防止我们的医疗信息数据被雇主、健康应用程序以及其他的大数据公司随意地收集和利用
3.6.3.2. 欧洲模式还禁止将数据重新用于其他目的
3.6.3.3. “不可重复使用”条款的约束力则非常强大
3.6.3.3.1. 该条款将销售用户数据定义为非法行为
3.6.3.3.2. 有效避免了数据落入数据中间商之手,后者往往利用手中掌握的用户数字档案支持有害的电子评分系统以及总统竞选活动中的微目标锁定行动
3.6.4. 那些对我们的生活有重大影响的模型,包括信用评分系统和各类电子评分系统,都应该对公众公开
3.6.4.1. 审查者经常面临来自互联网巨头的阻挠,尽管互联网巨头公司建设的平台是我们利用数据的最便捷渠道
3.7. 并不是所有模型都是恶性的
3.7.1. 美国网络新闻机构ProPublica创立了“短信机器”(Message Machine),短信机器借助众包的方式逆向解码奥巴马竞选团队的定向政治广告所使用的模型
3.7.1.1. 通过大众提供信息,消除竞选背后的模型的神秘感,短信机器有效地减少了(哪怕一点点的)谣传和猜测
3.7.2. 作者团队设计模型的目标是维护公共利益
3.7.2.1. 致力于利用这些发现帮助受害者,减少无家可归、生活绝望的人
4. 数据科学家
4.1. 应该停止我们的科技乌托邦幻想,即无根据地寄希望于用算法和科技解决一切问题
4.1.1. 想让算法更好地服务于人类,我们必须承认算法不是全能的
4.2. 数据科学家应该像医生一样遵守希波克拉底氏誓言,尽可能防止或避免对模型可能的误用和误解
4.2.1. 坚定的价值观和自我约束只对谨慎的人有效
4.3. 数据科学家在寻求他们的老板所需求的具体答案时面对的实际压力
4.4. 数据科学家面对的挑战是理解他们猛烈抨击的大数据生态系统,而且不仅要找出问题所在,还要给出可能的解决方案
4.5. 数据科学家的工作就是在你挖掘得不够充分的时候,继续深入挖掘数据
4.6. 数学比数学杀伤性武器的价值大得多,民主也是如此
4.7. 大数据目的是寻找人类肉眼看不见的模式
4.7.1. 数据不会消逝,计算机也不会,数学更不会
4.7.2. 大数据程序只能将过去编入代码,而不会创造未来
4.8. 人类的决策虽然经常有缺陷,却也有一个主要的优点,即人类的决策是可以改善的
4.8.1. 创造未来需要道德想象力,而想象力只有人类才有
4.9. 存在证实性偏差,更容易看到他们想看到的东西
合集:
读算法霸权
好文要顶
关注我
收藏该文
微信分享
躺柒
粉丝 -
50
关注 -
0
+加关注
0
0
升级成为会员
«
上一篇:
读算法霸权笔记11_微目标
»
下一篇:
读元宇宙改变一切笔记01_起源
posted @
2024-01-06 07:39
躺柒
阅读(
47
) 评论(
0
)
编辑
收藏
举报
刷新页面
返回顶部
登录后才能查看或发表评论,立即
登录
或者
逛逛
博客园首页
【推荐】还在用 ECharts 开发大屏?试试这款永久免费的开源 BI 工具!
【推荐】编程新体验,更懂你的AI,立即体验豆包MarsCode编程助手
【推荐】凌霞软件回馈社区,博客园 & 1Panel & Halo 联合会员上线
【推荐】抖音旗下AI助手豆包,你的智能百科全书,全免费不限次数
【推荐】博客园社区专享云产品让利特惠,阿里云新客6.5折上折
【推荐】轻量又高性能的 SSH 工具 IShell:AI 加持,快人一步
相关博文:
·
读算法霸权笔记01_数学杀伤性武器
·
读算法霸权笔记02_盲点炸弹
·
机器学习系列2 机器学习的公平性
·
UCB Data100:数据科学的原理和技巧:第十一章到第十五章
·
MIT-6-S897-医疗机器学习-2019-中文笔记-三-
阅读排行:
·
【.NET】调用本地 Deepseek 模型
·
CSnakes vs Python.NET:高效嵌入与灵活互通的跨语言方案对比
·
DeepSeek “源神”启动!「GitHub 热点速览」
·
Plotly.NET 一个为 .NET 打造的强大开源交互式图表库
·
我与微信审核的“相爱相杀”看个人小程序副业
公告
昵称:
躺柒
园龄:
2年1个月
粉丝:
50
关注:
0
+加关注
<
2025年2月
>
日
一
二
三
四
五
六
26
27
28
29
30
31
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
1
2
3
4
5
6
7
8
搜索
常用链接
我的随笔
我的评论
我的参与
最新评论
我的标签
合集
学信息系统项目管理师第4版(35)
学系统集成项目管理工程师(中项)(43)
读高性能MySQL(第4版)(21)
读发布!设计与部署稳定的分布式系统(第2版)(34)
随笔及总结(26)
读改变未来的九大算法(10)
读数据压缩入门(11)
读C#代码整洁之道(8)
读编程与类型系统(12)
读函数式编程思维(6)
读Java8函数式编程(9)
读Java实战(第二版)(20)
读Java性能权威指南(第2版)(31)
读SQL进阶教程(17)
选读SQL经典实例(23)
读SQL学习指南(第3版)(13)
读图数据库实战(11)
读程序员的制胜技(15)
读像火箭科学家一样思考(16)
读程序员的README(19)
读算法霸权(13)
读元宇宙改变一切(14)
读AI3.0(10)
读千脑智能(13)
读十堂极简人工智能课(9)
读人工不智能:计算机如何误解世界(10)
读算法的陷阱:超级平台、算法垄断与场景欺骗(20)
读所罗门的密码(21)
读天才与算法:人脑与AI的数学思维(26)
读人工智能时代与人类未来(19)
读AI未来进行式(12)
读AI新生:破解人机共存密码(18)
读人工智能全传(16)
读写给大家的AI极简史(7)
读零信任网络:在不可信网络中构建安全系统(21)
读软件开发安全之道:概念、设计与实施(17)
读软件设计的要素(7)
读构建可扩展分布式系统:方法与实践(16)
读数据湖仓(9)
读数据工程之道:设计和构建健壮的数据系统(34)
读数据质量管理:数据可靠性与数据质量问题解决之道(20)
读数据保护:工作负载的可恢复性(31)
读量子霸权(18)
读算法简史:从美索不达米亚到人工智能时代(15)
读当我点击时,算法在想什么?(7)
读DAMA数据管理知识体系指南(4)
更多
随笔档案
2025年2月(25)
2025年1月(31)
2024年12月(31)
2024年11月(30)
2024年10月(31)
2024年9月(30)
2024年8月(31)
2024年7月(31)
2024年6月(30)
2024年5月(31)
2024年4月(30)
2024年3月(31)
2024年2月(29)
2024年1月(31)
2023年12月(31)
2023年11月(30)
2023年10月(31)
2023年9月(30)
2023年8月(31)
2023年7月(31)
2023年6月(30)
2023年5月(31)
2023年4月(31)
2023年3月(36)
2023年2月(28)
2023年1月(26)
阅读排行榜
1. C#代码整洁之道读后总结与感想(599)
2. 选读SQL经典实例笔记01_检索和排序(369)
3. 读C#代码整洁之道笔记01_C#的编码标准和原则(311)
4. 读C#代码整洁之道笔记04_重构C#代码识别代码坏味道(309)
5. 学信息系统项目管理师第4版系列02_法律法规(268)
评论排行榜
1. 2023年1月随笔(11)
2. 2023年10月随笔之婚宴趣事多(2)
3. 读高性能MySQL(第4版)笔记12_查询性能优化(下)(2)
4. 读Java性能权威指南(第2版)笔记18_垃圾回收E(2)
推荐排行榜
1. 读高性能MySQL(第4版)笔记01_MySQL架构(上)(2)
2. 选读SQL经典实例笔记01_检索和排序(2)
3. 读软件设计的要素01概念(1)
4. 读AI未来进行式笔记01深度学习(1)
5. 读所罗门的密码笔记01_当人类遇见机器(1)
最新评论
1. Re:2023年10月随笔之婚宴趣事多
@gz4621 wondershare mindmaster...
--躺柒
2. Re:2023年10月随笔之婚宴趣事多
大神 思维导图用的什么软件制作的?
--gz4621
3. Re:读高性能MySQL(第4版)笔记12_查询性能优化(下)
@东围居士 建议读新版。...
--躺柒
4. Re:读高性能MySQL(第4版)笔记12_查询性能优化(下)
第4版相比第3版好像缩减了好多内容?楼主推荐第3版还是第4版
--东围居士
5. Re:读Java性能权威指南(第2版)笔记18_垃圾回收E
@屠炉 没有用第三方工具,手动的。 有几个平台直接支持markdown导入,只是要调整一下图片上传即可。...
--躺柒
点击右上角即可分享
支持DeepSeek的编程助手
【推荐】编程新体验,更懂你的AI,立即体验豆包MarsCode编程助手
【推荐】凌霞软件回馈社区,博客园 & 1Panel & Halo 联合会员上线
【推荐】抖音旗下AI助手豆包,你的智能百科全书,全免费不限次数
【推荐】博客园社区专享云产品让利特惠,阿里云新客6.5折上折
【推荐】轻量又高性能的 SSH 工具 IShell:AI 加持,快人一步
· 【.NET】调用本地 Deepseek 模型
· CSnakes vs Python.NET:高效嵌入与灵活互通的跨语言方案对比
· DeepSeek “源神”启动!「GitHub 热点速览」
· Plotly.NET 一个为 .NET 打造的强大开源交互式图表库
· 我与微信审核的“相爱相杀”看个人小程序副业