年度归档: 2026 年
NOR Flash 与 HBM 技术发展:从启动存储到 AI 高带宽内存
在存储半导体里,NOR Flash 和 HBM 是两个非常有代表性的方向。 NOR Flash 代表的是 高可 … 阅读更多
从直觉理解雅可比矩阵、Trace 与 Determinant
在学习 VAE、Normalizing Flow、扩散模型、SLAM、优化算法或者神经网络可解释性时,经常会遇 … 阅读更多
MiniMind-O 学习笔记 19:三阶段训练,T2A、A2A audio_proj 与 A2A full
前面几篇已经看过: 最后回到训练脚本。 MiniMind-O 的训练入口主要是: README 推荐 mini … 阅读更多
MiniMind-O 学习笔记 18:Talker 如何把回答变成语音
上一篇从 forward 看到了 Thinker-Talker 的整体协作。 这一篇专门看 … 阅读更多
MiniMind-O 学习笔记 17:从 forward 看懂 Thinker-Talker 如何协作
前面已经看过 Dataset 如何产出 9 路输入。现在进入模型本体: 核心入口是: 这篇只抓主线:一次 fo … 阅读更多
MiniMind-O 学习笔记 16:OmniDataset,文本、语音和语音监督如何进入模型
理解训练,最好的入口是 Dataset。 MiniMind-O 的 Dataset 不只是把文本变成  … 阅读更多
MiniMind-O 学习笔记 15:音频如何变成 Token,Mimi 与 8 路 Codebook
理解 MiniMind-O 的 Talker,先要理解一个问题: 文本模型生成的是 token id。Mini … 阅读更多
MiniMind-O 学习笔记 14:从 LLM 到 Omni,先看懂整体架构
前面我们已经看过 MiniMind 语言模型和 MiniMind-V 视觉模型。MiniMind-O 是这个系 … 阅读更多
128G Mac 本地大模型选型:长上下文、多模态 Coding Agent 与本地推理模型怎么选
资料更新时间:2026-05-31目标机器:128G Apple Silicon Mac,重点讨论本地部署、本 … 阅读更多
MiniMind 学习笔记 12:从 MiniMind-V 看懂 VLM,SigLIP、Projector 与图像 Token 注入
前面已经看过 MiniMind 的 tokenizer、dataset、训练循环、模型结构和推理生成。现在可以 … 阅读更多
从概率论到信息论:由浅入深理解 KL 散度和交叉熵
在机器学习里,我们经常会遇到两个非常重要的概念: 它们经常出现在分类任务、知识蒸馏、VAE、语言模型训练、强化 … 阅读更多
WSL工作站配置02:独立物理硬盘挂载
1. 目标 将一块独立物理 SSD 直接挂载给 WSL2 使用,格式化为 Linux 原生 ext4 … 阅读更多
WSL工作站配置01:网络SSH和GPU
1. 目标架构 最终目标是把 Windows 主机作为一台远程 Linux GPU 工作站使用,Mac 只负责 … 阅读更多
MiniMind 学习笔记 11:LoRA 微调,从低秩增量到权重合并
前面几篇文章已经从 tokenizer、dataset、训练循环、模型结构、Attention、RoPE、Mo … 阅读更多
MiniMind 学习笔记 10:Multi-Latent Attention,从 KV Cache 压缩到 MiniMind 改造思路
前面几篇已经看过 MiniMind 的 Attention、RoPE 和推理生成。 这篇继续沿着同一条线看一个 … 阅读更多
MiniMind 学习笔记 09:LLM 推理生成,KV Cache、temperature、top-k 与 top-p
训练时,模型可以并行预测一个序列中的很多位置。 推理时,情况不同。 LLM 生成文本通常是自回归的: Mini … 阅读更多