1. 目标
我们正在进行利用强化学习提供跟踪式服务。在将强化学习应用到本项目过程中,需要将现实环境映射到程序中,也就是强化学习所依赖的数据,需要结合项目清晰的表示出来。同时,为了下一步强化学习的训练,需要结合项目设计一些规则(反馈机制),生成训练数据,即一个白盒函数,输入上一步构建好的 state、action 得到 reward。(此处不需要强化学习的相关代码,仅仅是强化学习应用初期的特征设计,以及伪造训练集)
1.1. 沟通与文档
- 在完成数学模型搭建之后,进行讨论,并商讨下一步工作
- 在设计白盒函数前,需要先设计一些规则,在规则讨论清楚无异议之后,再设计白盒函数。
1.2. 工作要求
- 结合项目以及强化学习,进行数学建模。同时 state 需要至少25维,要清晰的定义每一个维度的含义、数据类型
- 结合项目,设计反馈机制
- 白盒函数(输入上一步构建好的 state、action 得到 reward)
1.3. 提交物
- 数学模型的代码,以及合适的说明
- 反馈机制说明文档(markdown格式)
- 白盒函数代码
- 根据白盒函数伪造的数据
报名人员可到
github.com//issues/33
留言和参与需求讨论(写下联系方式和个人基本情况介绍)
2. 时间
2.1. 阶段划分
预计周期:10 天(明确需求后,以开发者承诺为准)
- 建立数学模型
- 建立反馈机制
- 建立白盒函数
- 质保维护
2.2. 调整和处罚(码市)
- 阶段划分制定和确认后,调整需提前说明;
- 阶段划分调整 2 次以上或延期 1 次以上,每延期一天,当期费用扣除 10%;
- 延期 3 次以上,需求方有权取消发包;
- 需求方原因造成的延误不包含在内;
3. 人员要求
- 证明自己有能力胜任此项工作,有强化学习经验
- 通过沟通与思考明确需求
- 明确需求后,在承诺的时间完成提交
- 熟悉 github, github 账号时间大于半年(在报名中给出 github 账号)
4. 费用
1500 (设计)+ (设计确定后,根据工作量评估,补充阶段)(实现)
5. 协作工具
zoom: https://zoom.us/
石墨文档: https://shimo.im/
github: https://github.com/
微信
1. 目标
我们正在进行利用强化学习提供跟踪式服务。在将强化学习应用到本项目过程中,需要将现实环境映射到程序中,也就是强化学习所依赖的数据,需要结合项目清晰的表示出来。同时,为了下一步强化学习的训练,需要结合项目设计一些规则(反馈机制),生成训练数据,即一个白盒函数,输入上一步构建好的 state、action 得到 reward。(此处不需要强化学习的相关代码,仅仅是强化学习应用初期的特征设计,以及伪造训练集)
1.1. 沟通与文档
1.2. 工作要求
1.3. 提交物
报名人员可到
github.com//issues/33
留言和参与需求讨论(写下联系方式和个人基本情况介绍)
2. 时间
2.1. 阶段划分
预计周期:10 天(明确需求后,以开发者承诺为准)
2.2. 调整和处罚(码市)
3. 人员要求
4. 费用
1500 (设计)+ (设计确定后,根据工作量评估,补充阶段)(实现)
5. 协作工具
zoom: https://zoom.us/
石墨文档: https://shimo.im/
github: https://github.com/
微信