上一页 1 ··· 78 79 80 81 82 83 84 85 86 ··· 109 下一页
摘要: “自举”(翻译自bootstrap)这个词汇在多个领域可能见到,它字面意思是提着靴子上的带子把自己提起来,这当然是不可能的,在机器学习领域可以理解为原样本自身的数据再抽样得出新的样本及统计量,也有被翻译为自助法的。 Bayesian Bootstrap是一个强大的方法,它比其他的自举法更快,并且可以 阅读全文
posted @ 2022-08-16 11:35 deephub 阅读(131) 评论(0) 推荐(0) 编辑
摘要: 通过矢量相似性搜索,可以在〜50ms内响应〜640K论文上的语义搜索查询 Arxiv.org大家一定都不陌生,学习数据科学的最佳方法之一是阅读Arxiv.org上的开源研究论文。但是即使对于经验丰富的研究人员来说,从大量的研究论文中找出想读的内容也是非常不容易的。Connected等论文之类的工具可 阅读全文
posted @ 2022-08-15 11:34 deephub 阅读(129) 评论(0) 推荐(0) 编辑
摘要: 时间序列数据是随着时间的推移反复捕获的变量值,随着时间的推移可以产生一系列的按时间顺序索引的数据点。在时间序列中,数据具有自然的时间顺序,即一个变量在特定时间的值依赖于过去的值。 传统的机器学习算法不能捕捉时间序列数据的时间顺序。数据科学家需要执行相关的特征工程,将数据的重要特征捕获到几个指标中。生 阅读全文
posted @ 2022-08-14 08:50 deephub 阅读(239) 评论(0) 推荐(0) 编辑
摘要: 要处理文本数据,需要比数字类型的数据更多的清理步骤。为了从文本数据中提取有用和信息,通常需要执行几个预处理和过滤步骤。 Pandas 库有许多可以轻松简单地处理文本数据函数和方法。在本文中,我介绍将学习 5 种可用于过滤文本数据(即字符串)的不同方法: 是否包含一系列字符 求字符串的长度 判断以特定 阅读全文
posted @ 2022-08-13 09:11 deephub 阅读(81) 评论(0) 推荐(0) 编辑
摘要: 人脸识别是AI研究的一个重要的方向,CVPR 2022也有很多相关的论文,本篇文章将针对不同的应用分类进行整理,希望对你有帮助 人脸识别 人脸识是一个热门话题,在当前的基准测试中要以相当大的提升击败 现有的SOTA模型变得越来越困难。 越来越多的开放数据可以用于训练,在百万级规模的数据上进行训练的一 阅读全文
posted @ 2022-08-12 10:57 deephub 阅读(300) 评论(0) 推荐(0) 编辑
摘要: kaggle比赛里经常会发生shake up的现象,说的直接点就是在有切榜或多榜单的比赛中,可能存在榜单排名激烈震动的情况,例如下面这个例子:Data Science Bowl 2017 我们看到,第一名是从公榜上升了130多名,而第5名则上升了349. 公榜结果就是好的模型私榜不一定就好,因为Ka 阅读全文
posted @ 2022-08-11 11:08 deephub 阅读(48) 评论(0) 推荐(0) 编辑
摘要: 很久没有推荐论文了,但是在推荐新论文之前,首先推荐一个新闻: 谷歌分享了公司内部如何使用代码生成案例,3%的新代码是由语言模型(Language Model)、DeepSpeed (DeepSpeed)编写的,通过语言模型生成代码的智能建议,建议接受率约为25%,减少了6%的编码迭代时间,平均每个接 阅读全文
posted @ 2022-08-10 11:16 deephub 阅读(229) 评论(0) 推荐(0) 编辑
摘要: DALL·E-2可以通过自然语言的描述创建现实的图像。 Openai发布了dall·e-2的Beta版。 在本文中,我们将仔细研究DALL·E-2的原始研究论文,并了解其确切的工作方式。由于并没有开放源代码, Boris Dayma等人根据论文创建了一个迷你但是开源的模型Dall·E Mini(命名 阅读全文
posted @ 2022-08-09 13:39 deephub 阅读(586) 评论(0) 推荐(0) 编辑
摘要: AdaBoost 是集成学习中的一个常见的算法,它模仿“群体智慧”的原理:将单独表现不佳的模型组合起来可以形成一个强大的模型。 麻省理工学院(MIT) 2021年发表的一项研究[Diz21]描述了人们如何识别假新闻。如果没有背景知识或事实的核查,人们往往很难识别假新闻。但是根据不同人的经验,通常可以 阅读全文
posted @ 2022-08-08 11:30 deephub 阅读(259) 评论(0) 推荐(0) 编辑
摘要: MAE发布以来,各种使用掩码技术的自监督掩码模型在其基础之上有了更进一步的研究。在本文中我们将探索一篇和MAE同期的工作:SimMIM: A Simple Framework for Masked Image Modeling,研究团队是微软亚研院,并在PyTorch中编写它,最后我们也会提供相关的 阅读全文
posted @ 2022-08-07 10:16 deephub 阅读(160) 评论(0) 推荐(0) 编辑
上一页 1 ··· 78 79 80 81 82 83 84 85 86 ··· 109 下一页