tech 66
- 从 Transformer 到 KV Cache:注意力、推理阶段与前缀复用
- 大模型量化可视化指南:从 FP32、INT8 到 GPTQ、GGUF 与 BitNet
- IEEE 754 二进制浮点数:FP16 编码、指数偏置与小数误差
- 2026 年 8 月 AI/LLM 趋势图表解读
- 从 8B 到 8GB:LLM 参数量与权重空间的心算法
- 从输入表示到文本生成:Transformer 三类架构与多模态 Token
- Multica 自托管:它是什么,如何部署与运行
- 本地大模型推理入门:推理引擎生态、GGUF 量化与镜像加速下载
- 女娲与本竹 Skill 结构分析:人物蒸馏、证据检索与去语料化改造
- 机械硬盘、SSD 与内存:三种存储介质的原理与取舍
- GPU 与显存体系(二):HBM 的硅中介层、TSV 与 3D 堆叠
- GPU 与显存体系(一):CPU、GPU 与 DDR/GDDR 的架构取舍
- 2026 年 7 月 AI/LLM 趋势图表解读
- OpenAI、Anthropic 与国产旗舰模型 API 价格对比
- 工作区优先的 Agent Harness 设计
- Ctrl+J 为什么是换行:从 ASCII 控制字符到终端快捷键
- SSH 免密登录到底在免什么:从一次配置排查说起
- Thinking Effort:模型到底在少算什么
- Playwright 与 Headless 浏览器:从前端验收到爬虫实战
- Transformer 推理系列(四):QwQ-32B 部署显存与低精度计算
- Transformer 推理系列(三):从 PagedAttention 到 Prefix Caching
- Transformer 推理系列(二):从 Prefill 到 Decode
- 如何安全地把 GitHub Token 告诉 AI
- Softmax:把分数变成概率分布
- 用 tmux-resurrect 和 tmux-continuum 持久化 Tmux 工作区
- Transformer 推理系列(一):从 Attention 到 KV Cache
- 统一 Agent 文档与 Skill 维护入口
- Git Worktree 实践指南:并行开发、PR 与本地合并
- Spring Data
- Spring Data Elasticsearch 5.x
- SpringBoot3.2:虚线程支持
- Spring - Async
- SpringBoot - 开发、部署、诊断
- Spring Security - Test
- Spring Security - CSRF
- Spring Security - Authorization
- Spring Security - Authentication
- Spring Security - 架构
- Spring Security - 密码
- SpringBoot MVC
- Spring Web MVC
- SpringBoot Test
- Spring Mvc Test - MockMvc
- Spring Test - Spring TestContext Framework
- 汇总:Spring Test with Jupiter
- Spring Data - Elasticsearch
- Spring - JDBC & ORM
- Spring - Data Access & Transaction
- Spring - 用AspectJ定义切面
- Spring - run
- SpringBoot - run
- SpringMVC:HTTP请求处理全流程
- Spring - AOP
- Spring - bean的容器
- Spring - bean的生命周期
- redis与linux fork
- 零拷贝:read/write、mmap 与 sendfile 的数据路径
- Redis - 分布式锁 vs. zookeeper
- Redis - misc
- Redis - cluster
- Redis - Sentinel
- Redis - Client & Server
- Redis - 模型架构
- Redis - 数据库功能和持久化
- Redis - 对象及底层数据结构实现
- SpringBoot - 自动配置