LLM

什么? LLM 能玩转《王者荣耀》,却在 ARC-AGI-3 全军覆没?

5 分钟阅读

在大模型与通用人工智能(AGI)的研究中,存在一个极其反直觉的“能力倒挂”现象: 在《王者荣耀》(Honor of Kings)中: 结合腾讯提出的 TiG(Think-In-Games)决策框架,大语言模型(LLM)在宏观决策、出装策略、兵线运营上的准确率可以达到 90% 以上,展现出卓越的战略规划能力。...

LLM 微调避坑指南:从训练动态到显存账本的深度解剖

5 分钟阅读

在单卡(如 Tesla P100 16GB)上对大语言模型进行微调时,往往会遇到 Loss 不降、无限复读或显存溢出(OOM)等诡异问题。这篇博客将从底层逻辑出发,拆解 LLM 微调中的核心概念与显存消耗真相。