Ai 自動化

知識庫新革命:從 RAG 走向 Andrej Karpathy 的 LLM Wiki
理解 Karpathy LLM Wiki 如何把原始資料增量整理成持久化 Markdown 知識庫,並比較它與原子卡片筆記法的適用情境。
閱讀全文
RTX 4090 本地部署:Gemma 4 與 Qwen 3.6 的效能測試
以 RTX 4090 24GB VRAM 為基準,拆解 Gemma 4 與 Qwen 3.6 的量化選型、KV Cache、Flash Attention、Docker llama.cpp 部署與 OOM 排障方法。
閱讀全文