游戏王masterduel吧 关注:202,040贴子:9,348,151

回复:核弹爆炸震惊瘫坐,原来LLM打牌已经强大了这等程度

只看楼主收藏回复

窝趣


IP属地:四川34楼2026-09-11 09:31
回复
    请问有没有仓库链接,我最近也在搞ygoagent的强化学习。你们强化学习的训练对手是用windbot的?


    IP属地:上海来自iPhone客户端35楼2026-09-11 09:32
    收起回复
      2026-09-15 22:37:57
      广告
      不感兴趣
      开通SVIP免广告
      隔壁杀戮尖塔出了ai打牌,还挺好用,这个模型能做到无论对手是什么卡组都能打么,还是需要知道双方牌表


      IP属地:内蒙古来自Android客户端36楼2026-09-11 12:25
      收起回复
        人机打牌没有灵魂,我不觉得人机能驾驭得了游戏王,怎么突破,怎么妥协,可以说高手都是千锤百炼的,手工游戏王的含金量一直都不是ai能碰瓷的,只能说,这种人机对于顶尖游戏王没有任何影响


        IP属地:江苏来自Android客户端37楼2026-09-11 13:23
        收起回复
          所以能推演出在所有情况下加权平均胜率最高的最强卡组了吗


          IP属地:北京来自iPhone客户端38楼2026-09-11 13:40
          回复
            应该是游戏王文本进数据集了 astra的训练数据集可能真的很大


            IP属地:上海来自Android客户端39楼2026-09-11 14:13
            回复
              本地用h20部署glm5.3 flash试了下,发现效果也还行,看来有思维链的模型基本都能基于规则书+卡牌信息+模拟器就能打牌


              IP属地:北京40楼2026-09-11 14:39
              回复
                以后dc杯一群AI打牌的盛况要来了吗换个角度想,竞技牌手和先进的模型为基底的agent对练,效果可能已经好过打很多唐人来实战了,并且还能帮你深度复盘


                IP属地:广东来自iPhone客户端41楼2026-09-11 16:00
                收起回复
                  2026-09-15 22:31:57
                  广告
                  不感兴趣
                  开通SVIP免广告
                  与其说是llm比rl路线更好,看下来更可能是模型规模上去了,性能自然更强了?可以先看看小一点的llm打牌怎么样。


                  IP属地:四川来自Android客户端42楼2026-09-11 19:45
                  收起回复