首页
机器学习
文章归档
关于页面
水熊虫
不认命,就拼命!
256
文章
52
分类
全部
智能供应链
营销补贴
控制论
广告算法
运筹规划
Mon Oct 12
强化学习
基础强化学习
强化学习(四)--学习策略(蒙特卡洛)
咱们第三节介绍了基于模型的强化学习方法,动态规划计算值函数的公式。$$V_{π}(s)=\sum_{a\inA}π(a|s)(R_+\gamma\sum_{s'\inS}P_{ss'}V_{π}(s'))\tag{3.1}$$
阅读更多
Wed Oct 7
强化学习
基础强化学习
强化学习(三) -- 策略迭代
动态规划动态规划相信大家都是了解的,这是一个运筹学的分支,其核心的思想是将一个大的问题分解成n个小问题,而要解决这个大问题,往往需要这些小问题的解,一般通过某些方式存储起来,从而节省大量时间。而马尔可夫就具有这样的特性,所有动态规划经常被用作解决强化学习问题的方法。策略评估我们在做强化学习的同时往往
阅读更多
Tue Oct 6
强化学习
基础强化学习
强化学习(二) -- 最优策略(贝尔曼方程)
马尔可夫决策过程提供了基本的理论框架,几乎所有的马尔可夫学习问题都可以使用MDP的决策过程建模。而本节讲的贝尔曼方程是马尔可夫决策过程用到最基础的方程。贝尔曼方程方程也被成为动态规划方程,贝尔曼方程表达了当前值函数(或行为值函数)和它后继值函数的关系,以及值函数与行为函数之间的关系。而贝尔曼最优方程
阅读更多
Tue Oct 6
强化学习
基础强化学习
强化学习(一) -- 马尔可夫过程
强化学习简介首先我们来说下深度学习或者机器学习这个范畴,众所周知,深度学习此类学习方式是典型的端到端的学习方式,什么是端到端呢?就是我直接给你结果,你根据输入来告诉学习中间的过程,而中间的过程一般就是矩阵参数。对比而言呢,强化学习其实一个序列决策,一听到这里第一个不同就是我们是在一个序列过程中做决策
阅读更多
Thu Sep 3
地图
经典算法
计算机基础
轨迹挖掘(四)--基于geohash的临近搜索
引言在地理信息中,我们经常要做一个范围搜索,这个往往也是性能的瓶颈,今天我们就来介绍基于geohash的临近搜索。geohash首先我们来介绍什么是geohash,geohash简单来说是一种地理编码,就是你给我输入一个经纬度,我给你一个字符串编码。我们可以简单思考一下,如果让你做范围搜索,你怎么来
阅读更多
Sun Jun 28
地图
轨迹挖掘(零)--基于HMM的地图匹配算法(map match)
背景地图匹配算法,在地图领域还是十分重要的算法,那么我们先来普及一下地图匹配算法究竟是做一个什么样的事情呢?看上面这个图,我们看到三个黑的gps点,和地图一些路网,那么mapmatch解决的就是这三个点究竟在哪条路上?至于为什么我们要知道这三个点在哪条路上呢?我们可以这样理解一种业务场景,在轨迹挖掘
阅读更多
Tue Jun 23
计算机基础
linux下升级python版本
大家可能都会遇到这样的问题,python版本升级的问题,这个问题也是比较头疼,对于我这种深度强迫症患者,在不知情的情况下安装了n多版本,也不知道怎么清理,简直让人不能容忍。下面我们来介绍如何升级你服务器上的python呢?下载相应版本的pythonwgethttps://www.python.org
阅读更多
Thu Jun 18
自然语言处理
自然语言处理之word2vec
Word2vec将文本转化成向量是nlp中一个比较重要的任务,也是链接nlp和机器学习和深度学习的桥梁,单纯的中文文字,我们是无法直接放到模型中训练的,所以将文本转化为一个向量是我们必须要过的一关。词袋模型(bagofword)词袋模型的思路十分简单,是文本向量化的最简单方法。我们直接举一个例子来了
阅读更多
Thu Jun 18
自然语言处理
自然语言处理之Seq2Seq模型
Seq2Seq模型对于一些自然语言处理任务,比如聊天机器人,机器翻译,自动文摘等,传统的方法都是从候选集中选出答案,这对素材的完善程度要求很高,随着最近几年深度学习的兴起,国外学者将深度学习技术应用与自然语言的生成和自然语言的理解的方面的研究,并取得了一些突破性的成果,比如,Sequence-to-
阅读更多
Thu Jun 18
自然语言处理
自然语言处理之seq2seq+attention
seq2seq处理人工翻译的时候会有一个问题,就是当句子特别长的时候问你会发现翻译的效果并不是特别好,至于原因呢就是seq2seq学习的时候对信息遗忘严重,为了解决这个问题,就有研究者提出了加入Attention的机制来解决这个问题,核心就是我们在解决一个问题的时候只关注某些关键信息就够了,并不要全
阅读更多
Thu Jun 18
深度学习
数据库应用
可视化
RNN代码拆解
rnn对于一些初学者来说被当成直接跳过的内容,因为如果需要使用RNN,那还不如直接用LSTM,好吧这个思路貌似也没什么问题,但是对于学习这件事情来讲的话,其实RNN是一个新型的网络结构,跳出神经网络的那个固定模式的开始,对大家学习还是有百利而无一害的。拆了的RNN[RNN]的经典过程本站也做过讲解,可以跳转过去看看完全的RNN样子,本节就是要将这一结构拆开来看的。上图就是其中一个RNN结构,初始化
阅读更多
Thu Jun 18
自然语言处理
自然语言处理之NGram模型
NativeBayes我们首先考虑在原始的数学模型中,我们怎么分析一句话的语义信息呢?我们来举个例子澳门赌场日赚百万这是垃圾短信的其中一句话,如果我们想训练一个模型来识别所有的垃圾短信,会是怎么样的抽象呢?由条件独立性假设:$$p(澳门赌场日赚百万∣J)=p(澳,门,赌,场,日,赚,百,万∣J)=p
阅读更多
上一页
下一页
14
15
16
Your browser is out-of-date!
Update your browser to view this website correctly.
Update my browser now
×
分类
智能供应链
营销补贴
控制论
广告算法
运筹规划
概率图模型
人工智能
感悟
哲学
经典算法
工程应用
计算机基础
因果推断
金融科技
数学
技术概述
经典问题
供应链规划
供应链计划
供应链执行
配送策略
大模型
定价策略
机器学习
目标检测
搜索推荐
自然语言处理
深度学习
地图
强化学习
元学习
持续学习
迁移学习
异常检测
管理
战略
做事
数据库应用
可视化
概率论
高等数学
线性代数
统计学
信息论
多任务学习
多模态学习
对抗学习
图像基础
时间序列
图神经网络
基础强化学习
深度强化学习
标签