test : fix multi-GPU server tests (#27614)

* tests : fix tests for multi-gpu environment

* cont : not needed
This commit is contained in:
Georgi Gerganov
2026-08-23 19:59:42 +03:00
committed by GitHub
parent 4a08fa2970
commit 8d9af25633
3 changed files with 22 additions and 3 deletions
+20 -1
View File
@@ -319,7 +319,6 @@ def test_slot_save_restore_with_two_images(mmproj_server):
"prompt": prompt, "prompt": prompt,
}) })
assert res.status_code == 200 assert res.status_code == 200
content = res.body["content"]
prompt_n_full = res.body["timings"]["prompt_n"] prompt_n_full = res.body["timings"]["prompt_n"]
assert prompt_n_full > 64 assert prompt_n_full > 64
@@ -345,6 +344,26 @@ def test_slot_save_restore_with_two_images(mmproj_server):
assert res.status_code == 200 assert res.status_code == 200
assert res.body["timings"]["cache_n"] == prompt_n_full - 1 assert res.body["timings"]["cache_n"] == prompt_n_full - 1
assert res.body["timings"]["prompt_n"] == 1 assert res.body["timings"]["prompt_n"] == 1
content = res.body["content"]
res = server.make_request("POST", "/slots/1?action=restore", data={
"filename": "mm_slot_two_images.bin",
})
assert res.status_code == 200
assert res.body["n_restored"] == n_saved
res = server.make_request("POST", "/completions", data={
"temperature": 0.0,
"top_k": 1,
"id_slot": 0,
"cache_prompt": True,
"prompt": prompt,
})
assert res.status_code == 200
assert res.body["timings"]["cache_n"] == prompt_n_full - 1
assert res.body["timings"]["prompt_n"] == 1
content = res.body["content"]
assert res.body["content"] == content assert res.body["content"] == content
+1 -1
View File
@@ -121,7 +121,7 @@ def test_vision_chat_completion_token_count():
"prompt, image_data, success, re_content", "prompt, image_data, success, re_content",
[ [
# test model is trained on CIFAR-10, but it's quite dumb due to small size # test model is trained on CIFAR-10, but it's quite dumb due to small size
("What is this: <__media__>\n", "IMG_BASE64_0", True, "(cat)+"), ("What is this: <__media__>\n", "IMG_BASE64_0", True, "(cat)+|(automobile)+"),
("What is this: <__media__>\n", "IMG_BASE64_1", True, "(frog)+"), ("What is this: <__media__>\n", "IMG_BASE64_1", True, "(frog)+"),
("What is this: <__media__>\n", "malformed", False, None), # non-image data ("What is this: <__media__>\n", "malformed", False, None), # non-image data
("What is this:\n", "", False, None), # empty string ("What is this:\n", "", False, None), # empty string
+1 -1
View File
@@ -623,7 +623,7 @@ class ServerPreset:
server.model_hf_repo = "ggml-org/tinygemma3-GGUF:Q8_0" server.model_hf_repo = "ggml-org/tinygemma3-GGUF:Q8_0"
server.model_alias = "tinygemma3" server.model_alias = "tinygemma3"
server.n_ctx = 1024 server.n_ctx = 1024
server.n_batch = 32 server.n_batch = 512
server.n_slots = 2 server.n_slots = 2
server.n_predict = 4 server.n_predict = 4
server.seed = 42 server.seed = 42