Skip to content

建立 2026-09-15 更新 2026-09-15

第一次執行

安裝完成後,目標只有一件事:跟模型說上話。官方 Quickstart 的路徑是開選單、選模型、開始聊天。

開啟選單

在終端機執行:

ollama

選單可以:

  • 執行模型,進入互動聊天
  • 啟動整合工具(Claude Code、OpenClaw、VS Code、OpenCode 等)

也可以跳過選單,直接指定模型。

跑第一個模型

官方目前常用的入門指令是:

ollama run gemma4

第一次會先下載權重,再進入 REPL(讀取—求值—印出的迴圈)。問一句即可:

用一段話解釋天空為什麼是藍色的。

離開聊天:

/bye

模型名稱會隨官方圖書館更新。若 gemma4 不可用,到 ollama.com/library 複製該頁提供的 ollama run ... 指令。

對話裡常用指令

在 REPL 打 /? 可看完整清單。最常用的是:

指令 作用
/bye 結束這次對話
/? 說明
/set parameter num_ctx 8192 改這次工作階段的上下文長度
/show info 看目前模型資訊
多行輸入 """ 包起來再送出

多模態(看圖)模型可以把圖檔路徑放在提示裡,例如:

ollama run gemma4 "這張圖裡有什麼? /Users/you/Desktop/photo.png"

實際支援哪些模型,以圖書館該頁說明為準。

本機模型與雲端模型

同樣語法也可以跑雲端模型:

ollama run gemma4:cloud

雲端模型不必把完整權重下載到本機,但提示詞會送到 ollama.com 做推論。第一次通常要 ollama signin。若你要的是「資料留在這台電腦」,請用沒有 :cloud 的本機標籤,並可在 ~/.ollama/server.jsondisable_ollama_cloud,細節見 FAQ

對話結束後模型還在嗎

預設模型會在記憶體裡停留約五分鐘,方便連續提問。用 ollama ps 看目前載入了什麼、是 GPU 還是 CPU。要立刻釋放記憶體:

ollama stop gemma4

下一步:學會 選模型CLI 管理

從零跑起來

Matt Williams 的 The Ollama Course 第一課:安裝後如何從圖書館挑模型、看量化標籤、進入 REPL 提問。對應本頁與 模型庫