第一次執行
安裝完成後,目標只有一件事:跟模型說上話。官方 Quickstart 的路徑是開選單、選模型、開始聊天。
開啟選單
在終端機執行:
選單可以:
- 執行模型,進入互動聊天
- 啟動整合工具(Claude Code、OpenClaw、VS Code、OpenCode 等)
也可以跳過選單,直接指定模型。
跑第一個模型
官方目前常用的入門指令是:
第一次會先下載權重,再進入 REPL(讀取—求值—印出的迴圈)。問一句即可:
離開聊天:
模型名稱會隨官方圖書館更新。若 gemma4 不可用,到 ollama.com/library 複製該頁提供的 ollama run ... 指令。
對話裡常用指令
在 REPL 打 /? 可看完整清單。最常用的是:
| 指令 | 作用 |
|---|---|
/bye |
結束這次對話 |
/? |
說明 |
/set parameter num_ctx 8192 |
改這次工作階段的上下文長度 |
/show info |
看目前模型資訊 |
| 多行輸入 | 用 """ 包起來再送出 |
多模態(看圖)模型可以把圖檔路徑放在提示裡,例如:
實際支援哪些模型,以圖書館該頁說明為準。
本機模型與雲端模型
同樣語法也可以跑雲端模型:
雲端模型不必把完整權重下載到本機,但提示詞會送到 ollama.com 做推論。第一次通常要 ollama signin。若你要的是「資料留在這台電腦」,請用沒有 :cloud 的本機標籤,並可在 ~/.ollama/server.json 設 disable_ollama_cloud,細節見 FAQ。
對話結束後模型還在嗎
預設模型會在記憶體裡停留約五分鐘,方便連續提問。用 ollama ps 看目前載入了什麼、是 GPU 還是 CPU。要立刻釋放記憶體:
從零跑起來
Matt Williams 的 The Ollama Course 第一課:安裝後如何從圖書館挑模型、看量化標籤、進入 REPL 提問。對應本頁與 模型庫。