首页
机器学习
文章归档
关于页面
水熊虫
不认命,就拼命!
263
文章
52
分类
标签
人工智能
2022年4月9日
自然语言处理
自然语言处理之标签提取
标签提取在评论挖掘中经常被使用到,如何快速的挖掘众多评论中一些关键词,包括积极地或者消极的。本文将要介绍标签提取一些常用方法,从而丰富我们的技术场景。在介绍新的方法之前,这类问题最朴素的想法应该是通过TF-ID算法对评论进行词频等特征的统计,获取那些重要度高的词语。接下来咱们来介绍两个解决这类问题的方法。TextRankTextRank是通过pagerank衍生出来的一类无监督算法,对于pager
阅读更多
2022年4月9日
机器学习
机器学习之特征选择
特征选择也是机器学习一个比较大的话题,一个好的特征选择,可以简化模型,改善性能减少计算开销,改善通用性减低过拟合分享,接下来就来介绍一些特征选择的方法。过滤方法
阅读更多
2022年3月28日
强化学习
深度强化学习
深度强化学习(二)-- Dueling DQN深度强化学习
Dueling DQNDueling DQN(竞争强化网络)的思路是将原始的Q值,拆成两个部分,一部分是动作无关的值函数V,另一个是在这个状态下各个动作的优势函数a。下图让我们看下一个Dueling DQN和传统DQN网络的区别,这个也是唯一的区别。主要的区别是在末尾出的特征拆解,上路用于预测V,表示静态状态空间的本身具有的价值,一部分用于预测a,表示选择动作以后获得的额外价值。然后汇聚到一起预测
阅读更多
2022年3月14日
迁移学习
迁移学习(三)--基于几何特征变换的迁移学习
本章其实在元学习系列已经进行一个大部分的讲解,所谓的基于模型的迁移是说如果在已有的模型中抽取出对当前学习有效的知识,而这里所谓的知识就是权重。下面就轻量级的讲点之前没有提到的东西基于贝叶斯的迁移学习基于贝叶斯的迁移学习目前应用在一些自然语言处理的任务中。使用在文本分类任务,一般如下两个步骤。以概率分布的形式对先验的知识进行迁移。利用朴素贝叶斯在源域的数据中建立模型。该算法使用EM算法求解目标域模型
阅读更多
2022年3月13日
迁移学习
迁移学习(一)--迁移学习概述
本节讲解基于样本的迁移学习,这个时候你可能会有疑问,基于样本如何迁移呢?难到是直接把源数据直接做学习吗? 当然这种方法已经被证明效果方差较大,很难真正使用。其实基于样本的迁移学习主要要解决两个问题。如何筛选源域中的目标数据具有”相似分布”的有标签数据如何利用这个“相似”的数据进行学习通过上节的学习我们知道一个域分为两部分$D=\{X, P^{x}\}$, 其中X是特征空间,$P^{x}$表示边缘分
阅读更多
2022年3月11日
迁移学习
迁移学习(零)--迁移学习基础
迁移学习在很多场景获得越来越多的应用。例如在图像识别中,例如同一个实体在不同的光照条件写拍摄的照片,模型识别的性能会下降,从而需要我们从一个场景迁移到另一个场景的情况。例如在医疗领域,一些罕见病的天然样本就是短缺的,那么如果利用现有的数据学习到这些新的知识呢?这些都是迁移学习需要解决的问题。以下的场景也同样有迁移学习的身影出没。数据量小机器学习需要鲁棒性个性化定制问题用户隐私数据安全定义给定源域$
阅读更多
2022年2月19日
搜索推荐
推荐搜索之指标体系
这章来介绍一下如何评估你搜索以后的结果好坏呢?从而定义算法优化的方向。对于比较粗糙的评估方法如下。$$P=\frac{检索出相关文档数}{检索所有文档数} \\R=\frac{检出相关文档数}{数据库中相关文档数}$$看着形式是不是很熟悉,就是经常看到的准确率和召回率。下面形式化的表达出来。a表示被检索出的与查询相关的 文献数量;b表示被检索出的与查询无关的文献数量;c表示与查询相 关,但是没有被
阅读更多
2022年2月18日
搜索推荐
推荐搜索之排序学习
排序学习是搜索、推荐、广告的核心方法。排序结果的好坏很大 程度上影响到用户体验,甚至会影响到广告收益。常规的排序模型存 在一些问题,如调整参数困难,通过给定的一个测试集合来比较模型 是否过拟合很困难等。而机器学习解决了这些问题,因为其可以自动 调整参数。更重要的是,它可以通过规范化来避免数据过拟合。传统的检索模型靠人工来拟合排序公式,并通过不断地实验确定 最佳的参数组合,以此构成相关性打分函数。机
阅读更多
2022年2月16日
自然语言处理
自然语言处理之命名实体识别
本文将介绍命名实体识别的一些方法,在自然语言中使用十分广泛。条件随机场(CRF)首先我们就介绍CRF的方式进行命名实体识别,CRF与HMM模型十分相似,如果不了解HMM模型的可以看自然语言处理之分词看我之前的一个讲分词的文章。
阅读更多
2022年1月25日
元学习
元学习(六)--孪生神经网络
今天我们来介绍一种比较特殊的网络,孪生神经网络。这也是实现元学习的一种常见的方式。我们先来抛出一个问题,目前市面上人脸识别的应用十分多,那么它们是怎么做到的呢?如果让你来做一个人脸识别的应用,你怎么来实现这个算法呢?第一时间你的的想法是不是老子搞它每个人N多的数据集,然后弄个M分类,这样每次就变成一个图片识别的任务,easy。想想其实也是可以的,但是似乎不太符合时间,哪里弄来这么多的人的样本呢?话
阅读更多
上一页
下一页
7
8
9
Your browser is out-of-date!
Update your browser to view this website correctly.
Update my browser now
×