ai 56
- Multica 实战:把 Codex、Kimi、Cursor 编排成多 Agent 流水线
- Claude Tag:AI 如何从个人工具变成团队里的数字同事
- CubeSandbox 原理:从 Docker、MicroVM 到 Agent Runtime
- AI 编码不等于组织提效:快手万人研发范式升级复盘
- 机器学习框架:计算图、自动微分与大模型优化
- GPT 参数量从哪里来:结构拆解、估算公式与显存下限
- Hello-Agents:从大语言模型到可执行的智能体系统
- 从矩阵乘法到神经网络:线性变换、非线性与归一化
- 看懂 PyTorch Tensor:从 dim、形状变换到批量矩阵乘法
- 从 Transformer 到 KV Cache:注意力、推理阶段与前缀复用
- 从词向量到 ChatGPT:预训练语言模型如何把 NLP 变成通用能力
- 算法理论框架
- 从 GeForce 256 到 Rubin:NVIDIA GPU 架构演进全景
- Graph Engineering:用节点、边和状态编排复杂 Agent
- 从 Harness 到 Loop Engineering:把 Agent 接成自动闭环
- 从 8B 到 8GB:LLM 参数量与权重空间的心算法
- Agent 与 AI 搜索服务:能力边界与评测方法
- 从输入表示到文本生成:Transformer 三类架构与多模态 Token
- OpenAI、Anthropic 与国产旗舰模型 API 价格对比
- 树莓派 AI 是怎么回事:从 Hailo NPU 到本地 LLM 的能力边界
- 把搜索当代码来写:AI Agent 的搜索范式重构
- 大模型公司的收入幻觉:产品收入还是项目收入?
- SAG:用 SQL 动态激活超边的检索增强生成
- Loop Engineering:从 prompt 到 loop 的瓶颈迁移
- Transformer 推理系列(四):QwQ-32B 部署显存与低精度计算
- AI Coding CLI 为什么全面倒向 TypeScript
- GraphRAG vs LightRAG:从传统 RAG 的痛点到图增强检索的选型权衡
- RAG 的工程深度:切分、检索、排序、评估与幻觉防护
- Transformer 推理系列(三):从 PagedAttention 到 Prefix Caching
- Transformer 推理系列(二):从 Prefill 到 Decode
- Softmax:把分数变成概率分布
- Transformer 推理系列(一):从 Attention 到 KV Cache
- 为 Jekyll 博客搭建 Docker 开发环境:从跨平台问题到多阶段构建优化
- Claude 的 200K 是 token 不是 KB
- LSP 能力演示与原理解析:Claude Code + jdtls 实战
- 【Anthropic】Claude Code 中的 Skills:从内部实践中汲取的经验
- 【Anthropic】Claude Code 在大型代码库中的工作原理:Harness 架构与部署模式
- Kimi Agent 集群模式实战:无线 Mesh 方案调研完整执行记录(超详细版)
- Kimi Agent 集群模式实战:无线 Mesh 方案调研完整执行记录
- 【Anthropic】Claude Code 自动模式:在自主性与安全间的平衡
- 【Anthropic】Context Engineering 框架:从原则到工具维度实践
- 【Anthropic】Claude 代理工具高级特性:工具搜索、编程调用、使用示例
- 【Anthropic】构建长期自主 Agent 的三重挑战与解法
- 【Anthropic】长期自主编程的 Harness 架构设计
- 【Anthropic】长期运行 Agent 的有效容器架构
- 【OpenAI】Harness Engineering:百万行 Agent 代码背后的工程闭环
- 【Anthropic】AI Agent 的上下文工程:让有限的 token 更高效
- Harness Engineering:AI Agent 从能跑到跑稳的第三道关
- Claude Code 多 Agent 机制:隔离、通信与并发的源码解析
- Claude Code 源码里的 Harness Engineering
- Claude Code /powerup 教程速览
- grep vs RAG:Claude Code 检索之争
- Claude Context:给 Claude Code 加向量检索
- Claude Code 为什么用 grep 而不是 RAG
- LLM工作原理
- Manus