Skip to content

Commit 2483201

Browse files
committed
v1.0.43: モデル常駐時間を10分→60分に延長(再ロード待ちによる応答遅延を防止)
1 parent 6928c3f commit 2483201

2 files changed

Lines changed: 2 additions & 2 deletions

File tree

installer/installer.iss

Lines changed: 1 addition & 1 deletion
Original file line numberDiff line numberDiff line change
@@ -9,7 +9,7 @@
99
; ============================================================================
1010

1111
#define MyAppName "社内知恵袋"
12-
#define MyAppVersion "1.0.42"
12+
#define MyAppVersion "1.0.43"
1313
#define MyAppPublisher "Shineos Inc."
1414
#define MyAppURL "https://shineos.com"
1515
#define MyAppExeName "open-webui.exe"

scripts/setup_ollama.ps1

Lines changed: 1 addition & 1 deletion
Original file line numberDiff line numberDiff line change
@@ -167,7 +167,7 @@ function Set-OllamaTuning {
167167
'OLLAMA_MAX_LOADED_MODELS' = '1' # LLM/埋め込みモデルの同時常駐を防ぎRAMを節約
168168
'OLLAMA_KV_CACHE_TYPE' = 'q8_0' # KVキャッシュ量子化でメモリ約半減(品質影響ほぼなし)
169169
'OLLAMA_FLASH_ATTENTION' = '1' # 長文コンテキストの高速化(KV量子化の前提条件)
170-
'OLLAMA_KEEP_ALIVE' = '10m' # モデルを10分常駐させ連続利用の応答を高速化
170+
'OLLAMA_KEEP_ALIVE' = '60m' # モデルを1時間常駐させ、再ロード待ちによる応答遅延を防止
171171
'OLLAMA_NUM_PARALLEL' = '1' # 単一ユーザー用途。並列数を抑えてメモリを節約
172172
}
173173
Log 'applying Ollama performance tuning (env vars)'

0 commit comments

Comments
 (0)