Skip to content

社会化创新:强化学习模型搭建 #33

Description

@doomooo

1. 目标

我们正在进行利用强化学习提供跟踪式服务。在将强化学习应用到本项目过程中,需要将现实环境映射到程序中,也就是强化学习所依赖的数据,需要结合项目清晰的表示出来。同时,为了下一步强化学习的训练,需要结合项目设计一些规则(反馈机制),生成训练数据,即一个白盒函数,输入上一步构建好的 state、action 得到 reward。(此处不需要强化学习的相关代码,仅仅是强化学习应用初期的特征设计,以及伪造训练集)

1.1. 沟通与文档

  • 在完成数学模型搭建之后,进行讨论,并商讨下一步工作
  • 在设计白盒函数前,需要先设计一些规则,在规则讨论清楚无异议之后,再设计白盒函数。

1.2. 工作要求

  • 结合项目以及强化学习,进行数学建模。同时 state 需要至少25维,要清晰的定义每一个维度的含义、数据类型
  • 结合项目,设计反馈机制
  • 白盒函数(输入上一步构建好的 state、action 得到 reward)

1.3. 提交物

  • 数学模型的代码,以及合适的说明
  • 反馈机制说明文档(markdown格式)
  • 白盒函数代码
  • 根据白盒函数伪造的数据

报名人员可到
github.com//issues/33
留言和参与需求讨论(写下联系方式和个人基本情况介绍)

2. 时间

2.1. 阶段划分

预计周期:10 天(明确需求后,以开发者承诺为准)

  • 建立数学模型
  • 建立反馈机制
  • 建立白盒函数
  • 质保维护

2.2. 调整和处罚(码市)

  • 阶段划分制定和确认后,调整需提前说明;
  • 阶段划分调整 2 次以上或延期 1 次以上,每延期一天,当期费用扣除 10%;
  • 延期 3 次以上,需求方有权取消发包;
  • 需求方原因造成的延误不包含在内;

3. 人员要求

  • 证明自己有能力胜任此项工作,有强化学习经验
  • 通过沟通与思考明确需求
  • 明确需求后,在承诺的时间完成提交
  • 熟悉 github, github 账号时间大于半年(在报名中给出 github 账号)

4. 费用

1500 (设计)+ (设计确定后,根据工作量评估,补充阶段)(实现)

5. 协作工具

zoom: https://zoom.us/
石墨文档: https://shimo.im/
github: https://github.com/
微信

Metadata

Metadata

Assignees

No one assigned

    Labels

    No labels
    No labels

    Type

    No type

    Projects

    No projects

    Milestone

    No milestone

    Relationships

    None yet

    Development

    No branches or pull requests

    Issue actions