haylan
|
9767261a96
|
Merge pull request 'feat: remove llama-server-fast (Qwen3-4B classifier model)' (#51) from remove-fast-model into main
Reviewed-on: #51
|
2026-09-07 17:56:27 +00:00 |
|
haylan
|
5b7548dc7c
|
Merge pull request 'Fix llama-server-fast context-size exhaustion breaking Auto Mode' (#49) from fix-fastmodel-context-size into main
Reviewed-on: #49
|
2026-09-06 20:21:53 +00:00 |
|
haylan
|
63938e95c9
|
Merge pull request 'Run git pull first in update.sh, not mid-script' (#48) from fix-update-sh-pull-order into main
Reviewed-on: #48
|
2026-09-06 19:40:10 +00:00 |
|
haylan
|
386a41200f
|
Merge pull request 'Fix GPU pinned at 100% with two containers, flaky render group' (#47) from fix-gpu-pin-and-render-group into main
Reviewed-on: #47
|
2026-09-06 19:35:31 +00:00 |
|
haylan
|
1ee2e76033
|
Merge pull request 'Downloader for Qwen-Image weights, switch-model.sh' (#46) from comfyui-model-and-switch-script into main
Reviewed-on: #46
|
2026-09-06 19:01:02 +00:00 |
|
haylan
|
1932981f09
|
Merge pull request 'Add llama-server-fast: small non-thinking classifier/fast model' (#45) from add-fast-model into main
Reviewed-on: #45
|
2026-09-06 18:39:30 +00:00 |
|
haylan
|
6b06d6001f
|
Merge pull request 'feat(llama.cpp): raise default context to 128K, document RAM/SSD offload knobs' (#30) from ctx-size-128k into main
Reviewed-on: #30
|
2026-09-03 04:44:34 +00:00 |
|
haylan
|
949802fb2b
|
Merge pull request 'fix(litellm): default max_tokens=4096 for the reasoning model' (#20) from fix/litellm-reasoning-max-tokens into main
|
2026-09-02 18:58:11 +00:00 |
|
haylan
|
7609da7dad
|
Merge pull request 'feat(litellm): add UI_USERNAME/UI_PASSWORD for the admin UI login' (#19) from fix/litellm-ui-admin-creds into main
|
2026-09-02 18:29:30 +00:00 |
|
haylan
|
64243c65d7
|
Merge pull request 'fix(downloader): run as root to fix permission denied on models volume' (#18) from fix/downloader-permission-denied into main
Reviewed-on: #18
|
2026-09-02 18:03:59 +00:00 |
|