Files
openclaw/extensions/litellm/image-generation-provider.test.ts
Sukhdeep a7396255d0 fix(litellm): send image edits as multipart/form-data (#118562)
The litellm image provider built edit requests as a JSON body with
`images: [{image_url}]`, but LiteLLM's POST /v1/images/edits is a multipart
endpoint following OpenAI's edits schema: the reference image must be an
uploaded file part named `image` (or `image[]`). LiteLLM never finds an `image`
key in a JSON body and fails before contacting the upstream provider:

  HTTP 500 aimage_edit() missing 1 required positional argument: 'image'

so every image edit through this provider fails. Plain generation is unaffected.

No JSON variant works. Verified against LiteLLM v1.82.3 with a real 512x512 PNG:
plural `images` 500s as above; singular `image` as a data URL or bare base64,
string or array, returns HTTP 400 "Invalid image file or mode". Only multipart
succeeds. Note that singular `image` clears the 500 and reaches the provider,
which looks like progress but never delivers usable bytes.

Switch buildEditRequest to return { kind: "multipart", form }, which
createOpenAiCompatibleImageGenerationProvider already routes to
postMultipartRequest — matching the built-in openai and deepinfra providers.
A single reference uses the `image` part name and multiple use repeated
`image[]` parts; LiteLLM accepts either as List[UploadFile] and merges them,
erroring only when both appear in one request.

Also drops the now-unused imageToDataUrl helper and its imports.

Tests: the existing edit test asserted the buggy JSON shape, so it now asserts
a multipart request, that postJsonRequest is not called, and the single-image
part name; a new test covers repeated image[] parts for multiple references.

Verified end-to-end against LiteLLM v1.82.3 with a live agent: single-reference
and multi-image edits both return real images; both failed with the 500 before.
2026-08-03 02:59:08 -07:00

370 lines
12 KiB
TypeScript

// Litellm tests cover image generation provider plugin behavior.
import {
getProviderHttpMocks,
installProviderHttpMockCleanup,
} from "openclaw/plugin-sdk/provider-http-test-mocks";
import { afterEach, beforeEach, describe, expect, it, vi } from "vitest";
import { buildLitellmImageGenerationProvider } from "./image-generation-provider.js";
const {
resolveApiKeyForProviderMock,
postJsonRequestMock,
postMultipartRequestMock,
resolveProviderHttpRequestConfigMock,
} = getProviderHttpMocks();
installProviderHttpMockCleanup();
function jsonResponse(payload: unknown): Response {
return new Response(JSON.stringify(payload), {
status: 200,
headers: { "Content-Type": "application/json" },
});
}
function mockGeneratedPngResponse() {
postJsonRequestMock.mockResolvedValue({
response: jsonResponse({
data: [{ b64_json: Buffer.from("png-bytes").toString("base64") }],
}),
release: vi.fn(async () => {}),
});
}
function mockEditedPngResponse() {
postMultipartRequestMock.mockResolvedValue({
response: jsonResponse({
data: [{ b64_json: Buffer.from("png-bytes").toString("base64") }],
}),
release: vi.fn(async () => {}),
});
}
function mockObjectArg(mock: unknown, index = -1): Record<string, unknown> {
const calls = (mock as { mock?: { calls?: Array<Array<unknown>> } }).mock?.calls ?? [];
const call = index < 0 ? calls.at(index) : calls[index];
const [arg] = call ?? [];
if (!arg || typeof arg !== "object") {
throw new Error(`expected mock object argument ${index}`);
}
return arg as Record<string, unknown>;
}
function expectFields(value: unknown, expected: Record<string, unknown>): void {
if (!value || typeof value !== "object") {
throw new Error("expected fields object");
}
const record = value as Record<string, unknown>;
for (const [key, expectedValue] of Object.entries(expected)) {
expect(record[key], key).toEqual(expectedValue);
}
}
describe("litellm image generation provider", () => {
beforeEach(() => {
resolveApiKeyForProviderMock.mockResolvedValue({ apiKey: "litellm-key" });
});
afterEach(() => {
postMultipartRequestMock.mockReset();
});
it("declares litellm id and OpenAI-compatible size hints", () => {
const provider = buildLitellmImageGenerationProvider();
expect(provider.id).toBe("litellm");
expect(provider.label).toBe("LiteLLM");
expect(provider.defaultModel).toBe("gpt-image-2");
expect(provider.capabilities.geometry?.sizes).toContain("1024x1024");
expect(provider.capabilities.geometry?.sizes).toContain("2048x2048");
expect(provider.capabilities.geometry?.sizes).toContain("3840x2160");
expect(provider.capabilities.edit?.enabled).toBe(true);
});
it("defaults to the loopback proxy and allows private network for localhost", async () => {
mockGeneratedPngResponse();
const provider = buildLitellmImageGenerationProvider();
await provider.generateImage({
provider: "litellm",
model: "gpt-image-2",
prompt: "Draw a QA lighthouse",
cfg: {},
});
expectFields(mockObjectArg(resolveProviderHttpRequestConfigMock), {
baseUrl: "http://localhost:4000",
allowPrivateNetwork: true,
});
expectFields(mockObjectArg(postJsonRequestMock), {
url: "http://localhost:4000/images/generations",
allowPrivateNetwork: true,
});
});
it("honors configured baseUrl and keeps private-network off for public endpoints", async () => {
mockGeneratedPngResponse();
const provider = buildLitellmImageGenerationProvider();
await provider.generateImage({
provider: "litellm",
model: "gpt-image-2",
prompt: "campaign hero",
cfg: {
models: {
providers: {
litellm: {
baseUrl: "https://proxy.example.com/v1",
models: [],
},
},
},
},
});
expectFields(mockObjectArg(resolveProviderHttpRequestConfigMock), {
baseUrl: "https://proxy.example.com/v1",
allowPrivateNetwork: undefined,
});
expectFields(mockObjectArg(postJsonRequestMock), {
url: "https://proxy.example.com/v1/images/generations",
allowPrivateNetwork: false,
});
});
it("forwards count and size overrides on generation requests", async () => {
mockGeneratedPngResponse();
const provider = buildLitellmImageGenerationProvider();
await provider.generateImage({
provider: "litellm",
model: "dall-e-3",
prompt: "two landscape variants",
cfg: {},
count: 2,
size: "3840x2160",
});
expectFields(mockObjectArg(postJsonRequestMock), {
url: "http://localhost:4000/images/generations",
body: {
model: "dall-e-3",
prompt: "two landscape variants",
n: 2,
size: "3840x2160",
},
});
});
it("routes to the edit endpoint as multipart when input images are provided", async () => {
mockEditedPngResponse();
const provider = buildLitellmImageGenerationProvider();
await provider.generateImage({
provider: "litellm",
model: "gpt-image-2",
prompt: "refine the hero",
cfg: {},
inputImages: [
{
buffer: Buffer.from("fake-input"),
mimeType: "image/png",
},
],
});
// Edits must be multipart, never JSON: LiteLLM's /images/edits maps onto
// `aimage_edit(image=...)` and rejects a JSON body outright.
expect(postJsonRequestMock).not.toHaveBeenCalled();
expect(mockObjectArg(postMultipartRequestMock).url).toBe("http://localhost:4000/images/edits");
const form = mockObjectArg(postMultipartRequestMock).body as FormData;
expect(form.get("model")).toBe("gpt-image-2");
expect(form.get("prompt")).toBe("refine the hero");
// A single reference uses the singular `image` part name.
expect(form.getAll("image")).toHaveLength(1);
expect(form.getAll("image[]")).toHaveLength(0);
expect(form.get("image")).toBeInstanceOf(Blob);
});
it("sends multiple reference images as repeated image[] parts", async () => {
mockEditedPngResponse();
const provider = buildLitellmImageGenerationProvider();
await provider.generateImage({
provider: "litellm",
model: "gpt-image-2",
prompt: "merge these",
cfg: {},
inputImages: [
{ buffer: Buffer.from("first"), mimeType: "image/png" },
{ buffer: Buffer.from("second"), mimeType: "image/jpeg" },
],
});
const form = mockObjectArg(postMultipartRequestMock).body as FormData;
// Both names are accepted by OpenAI-compatible edit endpoints, but only one
// may be present per request — sending both is an error.
expect(form.getAll("image[]")).toHaveLength(2);
expect(form.getAll("image")).toHaveLength(0);
});
it("throws a clear error when the API key is missing", async () => {
resolveApiKeyForProviderMock.mockResolvedValueOnce({ apiKey: "" });
const provider = buildLitellmImageGenerationProvider();
await expect(
provider.generateImage({
provider: "litellm",
model: "gpt-image-2",
prompt: "x",
cfg: {},
}),
).rejects.toThrow("LiteLLM API key missing");
});
it("forwards dispatcherPolicy from resolveProviderHttpRequestConfig to postJsonRequest", async () => {
const dispatcherPolicy = {
mode: "explicit-proxy",
proxyUrl: "http://corp-proxy:3128",
} as const;
resolveProviderHttpRequestConfigMock.mockReturnValueOnce({
baseUrl: "https://proxy.example.com/v1",
allowPrivateNetwork: false,
headers: new Headers({ Authorization: "Bearer litellm-key" }),
dispatcherPolicy,
});
mockGeneratedPngResponse();
const provider = buildLitellmImageGenerationProvider();
await provider.generateImage({
provider: "litellm",
model: "gpt-image-2",
prompt: "hi",
cfg: {
models: {
providers: {
litellm: { baseUrl: "https://proxy.example.com/v1", models: [] },
},
},
},
});
expect(mockObjectArg(postJsonRequestMock).dispatcherPolicy).toBe(dispatcherPolicy);
});
it("auto-allows private network for loopback-style baseUrls", async () => {
const cases = [
"http://localhost:4000",
"http://127.0.0.1:4000",
"http://127.255.255.254:4000",
"http://[::1]:4000",
"http://[0:0:0:0:0:0:0:1]:4000",
"http://host.docker.internal:4000",
"https://localhost:4000",
] as const;
for (const baseUrl of cases) {
resolveProviderHttpRequestConfigMock.mockClear();
mockGeneratedPngResponse();
const provider = buildLitellmImageGenerationProvider();
await provider.generateImage({
provider: "litellm",
model: "gpt-image-2",
prompt: "x",
cfg: { models: { providers: { litellm: { baseUrl, models: [] } } } },
});
expect(
mockObjectArg(resolveProviderHttpRequestConfigMock),
`expected allowPrivateNetwork=true for ${baseUrl}`,
).toHaveProperty("allowPrivateNetwork", true);
}
});
it("requires explicit private-network opt-in for LAN and internal baseUrls", async () => {
const cases = [
"http://10.0.0.42:4000",
"http://192.168.5.10:4000",
"http://172.16.0.5:4000",
"https://192.168.5.10:4000",
"http://printer.local:4000",
"http://proxy.internal:4000",
"http://127.evil.com:4000",
"https://metadata.google.internal",
] as const;
for (const baseUrl of cases) {
resolveProviderHttpRequestConfigMock.mockClear();
mockGeneratedPngResponse();
const provider = buildLitellmImageGenerationProvider();
await provider.generateImage({
provider: "litellm",
model: "gpt-image-2",
prompt: "x",
cfg: { models: { providers: { litellm: { baseUrl, models: [] } } } },
});
expect(
mockObjectArg(resolveProviderHttpRequestConfigMock),
`expected no automatic allowPrivateNetwork for ${baseUrl}`,
).toHaveProperty("allowPrivateNetwork", undefined);
expect(mockObjectArg(postJsonRequestMock).allowPrivateNetwork).toBe(false);
}
});
it.each(["http://192.168.5.10:4000", "http://127.evil.com:4000"])(
"honors explicit private-network opt-in for %s",
async (baseUrl) => {
mockGeneratedPngResponse();
const provider = buildLitellmImageGenerationProvider();
await provider.generateImage({
provider: "litellm",
model: "gpt-image-2",
prompt: "x",
cfg: {
models: {
providers: {
litellm: {
baseUrl,
request: { allowPrivateNetwork: true },
models: [],
},
},
},
},
});
expectFields(mockObjectArg(resolveProviderHttpRequestConfigMock), {
allowPrivateNetwork: undefined,
request: { allowPrivateNetwork: true },
});
expect(mockObjectArg(postJsonRequestMock).allowPrivateNetwork).toBe(true);
},
);
it("does not allow private network for public hosts that embed private strings in the URL", async () => {
// Must not be fooled by an attacker-controlled URL that mentions
// "host.docker.internal" (or any private-looking literal) in the path,
// query string, or fragment. Only the parsed hostname should count.
const cases = [
"https://evil.example.com/?target=host.docker.internal",
"https://evil.example.com/host.docker.internal/foo",
"https://evil.example.com/redirect?to=127.0.0.1",
"https://public-api.openai.com/v1",
] as const;
for (const baseUrl of cases) {
resolveProviderHttpRequestConfigMock.mockClear();
mockGeneratedPngResponse();
const provider = buildLitellmImageGenerationProvider();
await provider.generateImage({
provider: "litellm",
model: "gpt-image-2",
prompt: "x",
cfg: { models: { providers: { litellm: { baseUrl, models: [] } } } },
});
expect(
mockObjectArg(resolveProviderHttpRequestConfigMock),
`expected allowPrivateNetwork=false for ${baseUrl}`,
).toHaveProperty("allowPrivateNetwork", undefined);
}
});
});