<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>Open Models on YennJ12 Engineering Blog</title><link>https://yennj12.js.org/yennj12_blog_V4/tags/open-models/</link><description>Recent content in Open Models on YennJ12 Engineering Blog</description><generator>Hugo -- gohugo.io</generator><language>en-us</language><lastBuildDate>Thu, 16 Jul 2026 09:00:00 +0800</lastBuildDate><atom:link href="https://yennj12.js.org/yennj12_blog_V4/tags/open-models/feed.xml" rel="self" type="application/rss+xml"/><item><title>ollama on mac - part 2 - 公開模型全覽與選型指南</title><link>https://yennj12.js.org/yennj12_blog_V4/posts/ollama-on-mac-part2-public-models-zh/</link><pubDate>Thu, 16 Jul 2026 09:00:00 +0800</pubDate><guid>https://yennj12.js.org/yennj12_blog_V4/posts/ollama-on-mac-part2-public-models-zh/</guid><description>大多數人第一次用 Ollama:直接 ollama pull 最大的那個模型,結果風扇狂轉、記憶體爆掉、每個 token 都要等半天。
資深工程師的做法:先看硬體能承受多大、再看任務需要什麼能力、最後用量化把尺寸壓進記憶體。
選對「尺寸 + 量化 + 任務」的 8B 模型,體感往往勝過硬撐一個跑不動的 70B。
Part 1 我們裝好了 Ollama,也跑起了第一個本地模型。這一篇要解決的是所有人接下來立刻會撞到的問題:模型這麼多,到底該選哪一個?
Ollama 官方模型庫裡有數十個家族、上百個 tag,尺寸從 1B 到 70B+、量化從 Q4 到 fp16、能力從純文字到多模態、從對話到推理。如果沒有一套選型框架,你只會反覆下載、反覆刪除,浪費頻寬也浪費時間。
這篇文章的目標,是給你一套可重複使用的選型心智模型,讓你面對任何新模型都能三秒鐘判斷「這個能不能在我的 Mac 上跑、值不值得跑」。
一、選型心智模型:硬體 → 任務 → 量化 在打開 ollama.com/search 之前,先在腦中建立一個三層漏斗。順序不能顛倒:硬體決定你的「上限」,任務決定你的「方向」,量化幫你在上限內「塞進最大的模型」。
┌──────────────────────────────┐ 第一層 │ 1. 硬體 (Hardware) │ 決定「上限」 │ 你的 Mac 有多少 RAM? │ │ → 決定模型參數量的天花板 │ └───────────────┬──────────────┘ │ 篩掉所有跑不動的尺寸 ▼ ┌──────────────────────────────┐ 第二層 │ 2. 任務 (Task) │ 決定「方向」 │ 對話?</description></item></channel></rss>