文明6吧 关注:529,394贴子:4,765,537
  • 8回复贴,共1

讨论强化学习ai学会玩文明6的可能性

只看楼主收藏回复

文明的状态空间和动作空间都很具体,尤其动作空间还是离散的
而且所有的产出,建筑,收益,战斗,胜利条件等等都是ai很好理解的数值
且ai在理解了地图数据之后,由于算力远超人类应该也能提出独到的理解
那能不能训练ai成为顶级文明玩家呢?


IP属地:北京来自iPhone客户端1楼2026-04-25 15:49回复
    我听说文明6的ai封装导致创意工坊做不出aimod 但是我们可以拿热座模式训练基础的种田和策略 然后搬到局域网上训练战斗


    IP属地:北京来自iPhone客户端2楼2026-04-25 15:51
    回复
      2026-07-23 15:52:49
      广告
      不感兴趣
      开通SVIP免广告
      按理来说ai对军操的理解也应该可以很好


      IP属地:北京来自iPhone客户端3楼2026-04-25 15:51
      回复
        自然是可以的,但是这里有大佬吗


        IP属地:广东来自Android客户端5楼2026-04-25 18:39
        回复
          手机ai都能直接操作app 电脑上训练ai玩文明6应该也不成问题 唯一的瓶颈是ai需要大量训练才能得出最优策略 但文明六过回合太慢 除非有技术把文明六的图形化界面去掉 让ai直接玩数据


          IP属地:浙江来自Android客户端6楼2026-04-25 18:48
          收起回复
            iclr24有人做过类似的,去年年底好像也有人用GLM-4.6做的agent玩文明5,总体上也是能打过AI了。拿LLM训一训rlvr原则上可以做。
            但是能支持RL训练的环境并不容易做。文明的动作空间比较大(每个回合中,所有单位都可以进行移动,攻击或生产,训LLM就是很复杂的工具输出,训传统模型就是很大的动作空间),会涉及多agent交互。而且本身游戏的CPU开销也比较大(按照c6的情况,即便是headless的游戏,一局CPU占用8核心20分钟左右肯定是有的)。


            IP属地:广东来自Android客户端9楼2026-04-26 00:50
            收起回复