《背包乱斗》机制拆解:异步对战、资源分配、构筑取舍,以及它给 AI 时代的启发
把 Backpack Battles 拆开看:异步对战如何把 PvP 变成一道离线优化题,金币/格子/回合/血量四种资源的真实兑换关系,构筑取舍背后的协同图与成长曲线,以及这套机制映射回 AI 时代能给我们什么启发。

GPT-6 Astra 换上来之后,我把 skill 删到只剩一个
GPT-6 Astra 的文档里点了一句:新模型对 skill 和 AGENTS.md 里的指令更敏感,建议审计模型能读到的所有指令文件。我照这句话把两边的 skill 目录过了一遍,最后只留下 grill-me。
强化学习通关马里奥 · Day 2:从奖励设计踩坑,到发现「站桩」陷阱
Day 2 把 Day 1 的强化学习概念落到代码:搭好了能跑的 RL 环境,开始调奖励、加观测、训 PPO。但真正收获不是模型学会通关,而是踩了一路奖励设计的坑,最后撞见一个更根本的问题——为什么 PPO 会学会「站桩不动」。
强化学习通关马里奥 · Day 1:定义动作与奖励拆分
强化学习第一天:定的目标是学会用 RL 通关马里奥。从最核心的两件事入手——定义动作空间、拆分奖励,让原本模糊的「通关」变成可量化的进步指标。
Claude Code 的 1M Context 怎么用:一篇官方文章的读后整理
结合 Anthropic 官方文章,整理 Claude Code 里 continue、/rewind、/compact、/clear 和 subagent 的适用场景,尽量讲清什么情况下该延续会话,什么情况下该及时重开。
个人大模型后端基础设施:CLI Proxy + New API 搭建指南
记录如何通过 CLI Proxy API 聚合第三方公益站资源,并结合 New API 实现企业级的多渠道分发与额度管理,构建稳健的 AI 中转后端。

macOS 终极开发环境配置指南 (2026 版)
记录基于 Zsh、Oh My Zsh、Mise 与 Starship 构建 macOS 开发环境的完整思路,重点放在工具现代化、路径去重、环境隔离与启动提速。

基线对齐:让文字和图标“看起来齐”的那门细节功夫
拆解 UI 里常见的视觉错位问题,解释什么是基线对齐、为什么它比单纯居中更自然,以及在 CSS 中该如何正确处理文字与图标的对齐。

面试复盘:0.1 + 0.2 === 0.3 结果是 ?附精准解决办法
从 IEEE 754 的底层存储方式出发,复盘 JavaScript 浮点数精度问题,解释为什么 `0.1 + 0.2 !== 0.3`,以及工程上如何规避。

大文件分片上传实战:Vue3 + NestJS 实现秒传、断点续传、并发与失败重试(附完整代码)
基于 Vue 3 与 NestJS 复盘大文件分片上传方案,覆盖哈希秒传、断点续传、并发控制、指数退避重试与服务端安全合并。


