1

Part 1 — Mem0 Intro Part 1 — 全景架構 — 為什麼 Agent 需要一個記憶層而不是更長的上下文

Mem0 原始碼導讀系列第一篇:用一張全景圖說清楚這個 6.5 萬星的 AI Agent 記憶層由哪些子系統組成、寫入與讀取兩條路徑各自經過哪些階段、記憶的作用域模型怎麼設計,以及為什麼「把歷史全部塞進 context」在生產環境會失效。

·24 min aiengineeringarchitecture
1

Part 1 — vLLM Intro Part 1 — 全景架構 — 從一次 model.generate() 到一個推論引擎

vLLM 原始碼與架構導讀系列第一篇:用一張全景圖說清楚這個 9 萬星的 LLM 推論引擎由哪些子系統組成、一個請求進來之後經過哪些階段、GPU 記憶體到底被誰吃掉,以及 V1 重寫改變了什麼。

·24 min aiengineeringinfrastructure
1

Part 1 — RAGFlow Intro Part 1 — 全景架構 — 從一份 PDF 到一句帶引用的答案

RAGFlow 原始碼導讀系列第一篇:用一張全景圖與兩條資料路徑,說清楚這個 9 萬星的開源 RAG 引擎由哪些子系統組成、一份 PDF 進來之後經過哪些階段、以及它在架構上做了哪些與眾不同的取捨。

·24 min aiengineering
1

Part 1 — Hugging Face 實戰(一):它到底是什麼,以及如何開始

從零認識 Hugging Face:Hub、Transformers、Datasets、Spaces 五大支柱的關係,帳號與 Token 設定、CLI 安裝、快取機制,以及三行程式碼跑起第一個模型。含完整可執行範例。

·22 min aiengineering
1

Part 1 — QM 深度解析(一):多人協作 Agent 平台的架構全景

拆解 yc-software/qm — 一個為公司而非個人設計的開源 Agent 平台。從「每個人一個隔離工作區」的核心命題出發,看懂它的無頭核心 + 外掛式介面架構、76K 行 TypeScript 的目錄分工,以及一次 Slack 對話如何走完整條路徑。

·25 min aiengineering
1

Part 1 — OpenWorker 深度解析(一):架構全景 — 一個能交付成果的桌面 AI 同事

從零拆解 Andrew Ng 團隊的開源專案 OpenWorker:它為什麼強調「交付成果而非聊天」、三層本地優先架構如何組成、37000 行 Python 後端的目錄職責分工,以及一次任務從輸入到產出的完整生命週期。

·24 min aiengineering
1

Part 1 — AIO / GEO - Part 1 - 概念篇:當搜尋結果不再是十條藍色連結

AIO(AI Overview)與 GEO(Generative Engine Optimization)到底在優化什麼?本篇釐清 SEO / AEO / GEO / LLMO 的定義邊界,拆解生成式引擎產生答案的內部流程,並提出一套從 Ranking 思維轉向 Citation Share 思維的可見度指標與成熟度模型。

·24 min aibusiness
1

Part 1 — 購物車系統的高並發改造(一):Virtual Threads、HikariCP 與 Redis 快取三管齊下

深入剖析一個真實 Spring Boot 購物車系統如何從「默認設定」升級到能承受 C10K 的生產級高並發架構:JDK 21 Virtual Threads、HikariCP 連線池調校、Redis 分層快取設計,以及升級到 Spring Boot 3.2 過程中的關鍵踩坑。

·30 min engineeringarchitecture
1

Part 1 — CrewAI 完全指南(一):入門與核心概念——用多 Agent 協作解決複雜問題

從零開始學 CrewAI:什麼是多 Agent 協作框架、為什麼需要它、核心四大元件(Agent、Task、Crew、Tool)的詳細說明,以及你的第一個 CrewAI 應用程式。

·20 min aiengineering
1

Part 1 — 如何衡量 AI 的準確度(一):分類與回歸任務的基礎評估指標

AI 準確度不是一個數字就能說清楚的。本文從分類與回歸任務出發,介紹 Precision、Recall、F1-Score、RMSE 等核心指標,幫助你建立客觀評估 AI 模型的基礎框架。

·12 min aiengineering
1

Part 1 — RAG 完全指南(一):基礎概念與你的第一個 RAG 系統

從零開始理解 RAG(Retrieval-Augmented Generation):為什麼 LLM 需要外部知識、RAG 的核心架構是什麼,以及如何用 Python 實作一個最基本的 RAG pipeline。

·20 min aiengineering
1

Part 1 — 用 AI Bot 打造顧問團隊(一):策略與技術路線選擇

想用純 AI Bot 建立一支 AI 顧問團隊?本文從商業角度出發,分析三條技術路線(Claude Code + agent.md、Gemini CLI、LangGraph + LLM),比較優缺點與適用場景,幫助你在動手之前先想清楚架構。

·15 min aibusiness
2

Part 2 — Mem0 Intro Part 2 — 寫入路徑 — ADD-only 萃取管線與那次自我否定

Mem0 原始碼導讀系列第二篇:逐行拆解 _add_to_vector_store() 的八個階段、為什麼 v3 放棄了論文裡的 ADD/UPDATE/DELETE/NOOP 四動作模型、UUID 映射成整數的防幻覺技巧、md5 去重的邊界,以及一次 add() 到底花多少錢。

·26 min aiengineering
2

Part 2 — vLLM Intro Part 2 — PagedAttention 與 KV Cache — 把作業系統的分頁搬進 GPU

vLLM 原始碼導讀系列第二篇:拆解 PagedAttention 的分頁機制與 kernel 記憶體佈局、Copy-on-Write 共享、自動前綴快取的 hash 鏈與 LRU 淘汰、KV cache 量化與多層卸載,以及一份能讓你算出併發上限的記憶體規劃手冊。

·26 min aiengineering
2

Part 2 — RAGFlow Intro Part 2 — 資料進場 — DeepDoc 解析、Chunking 策略與 14 種模板

RAGFlow 原始碼導讀系列第二篇:拆解 DeepDoc 的 OCR/版面辨識/表格結構辨識三層視覺管線、五條解析後端路線、14 種 chunk 模板各自的結構假設,以及 naive_merge 的切分契約與 chunk 加值管線的真實成本。

·26 min aiengineering
2

Part 2 — Hugging Face 實戰(二):用模型、跑 App、推送自己的模型

如何從兩百萬個 repo 中挑對模型、用四個抽象層載入它、用 Gradio 與 FastAPI + vLLM 把它變成服務,並把自己的模型完整推上 Hub。含量化、Spaces 部署與 Model Card 撰寫範例。

·26 min aiengineering
2

Part 2 — QM 深度解析(二):Scope 與 Resolution — 一次對話如何解析出身分、權限與工作區

拆解 QM 多人隔離的核心:五種 ScopeId、workspace 分層掛載、soul 指令的不可覆寫疊層、audience floor 如何用「受眾交集」防止頻道洩漏、ACL grant 變成 shared/ handle,以及 session 租約與 tape 雙軌記錄。

·27 min aiengineering
2

Part 2 — OpenWorker 深度解析(二):TurnEngine — Agent 迴圈的完整解剖

逐行拆解 OpenWorker 的 1192 行 agent 迴圈:訊息的真實形狀、blocking provider 如何橋接到 async loop、工具呼叫的授權與併發分流、四種中斷狀態下的「不留孤兒 tool_call」不變式,以及 canonical history 與 outbound view 的分離設計。

·28 min aiengineering
2

Part 2 — AIO / GEO - Part 2 - 原理篇:AI 引擎如何檢索、選擇與引用你的內容

拆解生成式引擎的檢索管線:AI crawler 名單與行為差異、內容如何被切成 chunk、rerank 階段淘汰了什麼、grounding 如何決定引用誰。附 8 個讓頁面永遠不被引用的技術死因與逐項診斷方法。

·26 min aiengineeringbusiness
2

Part 2 — 購物車系統的高並發改造(二):Redisson 分散式鎖、讀寫分離路由與 Docker HA 水平擴展

高並發購物車系列第二篇:深入剖析 Redisson 分散式鎖如何防止超賣與重複下單、AbstractRoutingDataSource + LazyConnectionDataSourceProxy 的讀寫分離路由設計細節(含 @Transactional 的坑),以及 Nginx + MySQL 主從複製的 Docker HA 生產架構。

·32 min engineeringarchitecture
2

Part 2 — CrewAI 完全指南(二):三個真實場景實戰——競情分析、程式碼審查、客服自動化

CrewAI 不只是玩具:用三個完整的生產級範例說明如何建立競爭對手情報分析系統、自動化程式碼審查流程、以及智慧客服分類與回覆系統,包含工具整合與 Hierarchical Process 實作。

·35 min aiengineering
2

Part 2 — 如何衡量 AI 的準確度(二):大型語言模型(LLM)的評估方法

LLM 的輸出沒有唯一標準答案,該怎麼客觀評估?本文介紹 BLEU、ROUGE、Perplexity、BERTScore 及 LLM-as-a-Judge 等方法,幫助你從多個維度評估語言模型的真實能力。

·15 min aiengineering
2

Part 2 — RAG 完全指南(二):Chunking 策略與向量資料庫選型

深入探討 RAG 系統的兩個核心基礎:如何切塊才能保留語意完整性,以及如何選擇適合的向量資料庫。包含五種 Chunking 策略比較與主流向量 DB 的實測比較。

·25 min aiengineering
2

Part 2 — 用 AI Bot 打造顧問團隊(二):三條路線的實作步驟與範例程式碼

深入實作:分別用 Claude Code + AGENTS.md、Gemini CLI 與 LangGraph 建立 AI 顧問 Agent 團隊。包含完整設定步驟、System Prompt 設計、範例程式碼與關鍵注意事項。

·30 min aiengineering
3

Part 3 — Mem0 Intro Part 3 — 讀取路徑 — 語意、關鍵字與實體的三訊號融合

Mem0 原始碼導讀系列第三篇:逐行拆解 _search_vector_store() 的九個步驟、BM25 的 sigmoid 正規化與查詢長度自適應參數、實體加權的完整公式與那個反懲罰項、score_and_rank 的自適應分母,以及 explain=True 怎麼用來診斷召回問題。

·26 min aiengineering