mirror of
https://github.com/openclaw/openclaw.git
synced 2026-08-21 01:51:39 -06:00
a7396255d0
The litellm image provider built edit requests as a JSON body with
`images: [{image_url}]`, but LiteLLM's POST /v1/images/edits is a multipart
endpoint following OpenAI's edits schema: the reference image must be an
uploaded file part named `image` (or `image[]`). LiteLLM never finds an `image`
key in a JSON body and fails before contacting the upstream provider:
HTTP 500 aimage_edit() missing 1 required positional argument: 'image'
so every image edit through this provider fails. Plain generation is unaffected.
No JSON variant works. Verified against LiteLLM v1.82.3 with a real 512x512 PNG:
plural `images` 500s as above; singular `image` as a data URL or bare base64,
string or array, returns HTTP 400 "Invalid image file or mode". Only multipart
succeeds. Note that singular `image` clears the 500 and reaches the provider,
which looks like progress but never delivers usable bytes.
Switch buildEditRequest to return { kind: "multipart", form }, which
createOpenAiCompatibleImageGenerationProvider already routes to
postMultipartRequest — matching the built-in openai and deepinfra providers.
A single reference uses the `image` part name and multiple use repeated
`image[]` parts; LiteLLM accepts either as List[UploadFile] and merges them,
erroring only when both appear in one request.
Also drops the now-unused imageToDataUrl helper and its imports.
Tests: the existing edit test asserted the buggy JSON shape, so it now asserts
a multipart request, that postJsonRequest is not called, and the single-image
part name; a new test covers repeated image[] parts for multiple references.
Verified end-to-end against LiteLLM v1.82.3 with a live agent: single-reference
and multi-image edits both return real images; both failed with the 500 before.
370 lines
12 KiB
TypeScript
370 lines
12 KiB
TypeScript
// Litellm tests cover image generation provider plugin behavior.
|
|
import {
|
|
getProviderHttpMocks,
|
|
installProviderHttpMockCleanup,
|
|
} from "openclaw/plugin-sdk/provider-http-test-mocks";
|
|
import { afterEach, beforeEach, describe, expect, it, vi } from "vitest";
|
|
import { buildLitellmImageGenerationProvider } from "./image-generation-provider.js";
|
|
|
|
const {
|
|
resolveApiKeyForProviderMock,
|
|
postJsonRequestMock,
|
|
postMultipartRequestMock,
|
|
resolveProviderHttpRequestConfigMock,
|
|
} = getProviderHttpMocks();
|
|
|
|
installProviderHttpMockCleanup();
|
|
|
|
function jsonResponse(payload: unknown): Response {
|
|
return new Response(JSON.stringify(payload), {
|
|
status: 200,
|
|
headers: { "Content-Type": "application/json" },
|
|
});
|
|
}
|
|
|
|
function mockGeneratedPngResponse() {
|
|
postJsonRequestMock.mockResolvedValue({
|
|
response: jsonResponse({
|
|
data: [{ b64_json: Buffer.from("png-bytes").toString("base64") }],
|
|
}),
|
|
release: vi.fn(async () => {}),
|
|
});
|
|
}
|
|
|
|
function mockEditedPngResponse() {
|
|
postMultipartRequestMock.mockResolvedValue({
|
|
response: jsonResponse({
|
|
data: [{ b64_json: Buffer.from("png-bytes").toString("base64") }],
|
|
}),
|
|
release: vi.fn(async () => {}),
|
|
});
|
|
}
|
|
|
|
function mockObjectArg(mock: unknown, index = -1): Record<string, unknown> {
|
|
const calls = (mock as { mock?: { calls?: Array<Array<unknown>> } }).mock?.calls ?? [];
|
|
const call = index < 0 ? calls.at(index) : calls[index];
|
|
const [arg] = call ?? [];
|
|
if (!arg || typeof arg !== "object") {
|
|
throw new Error(`expected mock object argument ${index}`);
|
|
}
|
|
return arg as Record<string, unknown>;
|
|
}
|
|
|
|
function expectFields(value: unknown, expected: Record<string, unknown>): void {
|
|
if (!value || typeof value !== "object") {
|
|
throw new Error("expected fields object");
|
|
}
|
|
const record = value as Record<string, unknown>;
|
|
for (const [key, expectedValue] of Object.entries(expected)) {
|
|
expect(record[key], key).toEqual(expectedValue);
|
|
}
|
|
}
|
|
|
|
describe("litellm image generation provider", () => {
|
|
beforeEach(() => {
|
|
resolveApiKeyForProviderMock.mockResolvedValue({ apiKey: "litellm-key" });
|
|
});
|
|
|
|
afterEach(() => {
|
|
postMultipartRequestMock.mockReset();
|
|
});
|
|
|
|
it("declares litellm id and OpenAI-compatible size hints", () => {
|
|
const provider = buildLitellmImageGenerationProvider();
|
|
|
|
expect(provider.id).toBe("litellm");
|
|
expect(provider.label).toBe("LiteLLM");
|
|
expect(provider.defaultModel).toBe("gpt-image-2");
|
|
expect(provider.capabilities.geometry?.sizes).toContain("1024x1024");
|
|
expect(provider.capabilities.geometry?.sizes).toContain("2048x2048");
|
|
expect(provider.capabilities.geometry?.sizes).toContain("3840x2160");
|
|
expect(provider.capabilities.edit?.enabled).toBe(true);
|
|
});
|
|
|
|
it("defaults to the loopback proxy and allows private network for localhost", async () => {
|
|
mockGeneratedPngResponse();
|
|
|
|
const provider = buildLitellmImageGenerationProvider();
|
|
await provider.generateImage({
|
|
provider: "litellm",
|
|
model: "gpt-image-2",
|
|
prompt: "Draw a QA lighthouse",
|
|
cfg: {},
|
|
});
|
|
|
|
expectFields(mockObjectArg(resolveProviderHttpRequestConfigMock), {
|
|
baseUrl: "http://localhost:4000",
|
|
allowPrivateNetwork: true,
|
|
});
|
|
expectFields(mockObjectArg(postJsonRequestMock), {
|
|
url: "http://localhost:4000/images/generations",
|
|
allowPrivateNetwork: true,
|
|
});
|
|
});
|
|
|
|
it("honors configured baseUrl and keeps private-network off for public endpoints", async () => {
|
|
mockGeneratedPngResponse();
|
|
|
|
const provider = buildLitellmImageGenerationProvider();
|
|
await provider.generateImage({
|
|
provider: "litellm",
|
|
model: "gpt-image-2",
|
|
prompt: "campaign hero",
|
|
cfg: {
|
|
models: {
|
|
providers: {
|
|
litellm: {
|
|
baseUrl: "https://proxy.example.com/v1",
|
|
models: [],
|
|
},
|
|
},
|
|
},
|
|
},
|
|
});
|
|
|
|
expectFields(mockObjectArg(resolveProviderHttpRequestConfigMock), {
|
|
baseUrl: "https://proxy.example.com/v1",
|
|
allowPrivateNetwork: undefined,
|
|
});
|
|
expectFields(mockObjectArg(postJsonRequestMock), {
|
|
url: "https://proxy.example.com/v1/images/generations",
|
|
allowPrivateNetwork: false,
|
|
});
|
|
});
|
|
|
|
it("forwards count and size overrides on generation requests", async () => {
|
|
mockGeneratedPngResponse();
|
|
|
|
const provider = buildLitellmImageGenerationProvider();
|
|
await provider.generateImage({
|
|
provider: "litellm",
|
|
model: "dall-e-3",
|
|
prompt: "two landscape variants",
|
|
cfg: {},
|
|
count: 2,
|
|
size: "3840x2160",
|
|
});
|
|
|
|
expectFields(mockObjectArg(postJsonRequestMock), {
|
|
url: "http://localhost:4000/images/generations",
|
|
body: {
|
|
model: "dall-e-3",
|
|
prompt: "two landscape variants",
|
|
n: 2,
|
|
size: "3840x2160",
|
|
},
|
|
});
|
|
});
|
|
|
|
it("routes to the edit endpoint as multipart when input images are provided", async () => {
|
|
mockEditedPngResponse();
|
|
|
|
const provider = buildLitellmImageGenerationProvider();
|
|
await provider.generateImage({
|
|
provider: "litellm",
|
|
model: "gpt-image-2",
|
|
prompt: "refine the hero",
|
|
cfg: {},
|
|
inputImages: [
|
|
{
|
|
buffer: Buffer.from("fake-input"),
|
|
mimeType: "image/png",
|
|
},
|
|
],
|
|
});
|
|
|
|
// Edits must be multipart, never JSON: LiteLLM's /images/edits maps onto
|
|
// `aimage_edit(image=...)` and rejects a JSON body outright.
|
|
expect(postJsonRequestMock).not.toHaveBeenCalled();
|
|
expect(mockObjectArg(postMultipartRequestMock).url).toBe("http://localhost:4000/images/edits");
|
|
|
|
const form = mockObjectArg(postMultipartRequestMock).body as FormData;
|
|
expect(form.get("model")).toBe("gpt-image-2");
|
|
expect(form.get("prompt")).toBe("refine the hero");
|
|
// A single reference uses the singular `image` part name.
|
|
expect(form.getAll("image")).toHaveLength(1);
|
|
expect(form.getAll("image[]")).toHaveLength(0);
|
|
expect(form.get("image")).toBeInstanceOf(Blob);
|
|
});
|
|
|
|
it("sends multiple reference images as repeated image[] parts", async () => {
|
|
mockEditedPngResponse();
|
|
|
|
const provider = buildLitellmImageGenerationProvider();
|
|
await provider.generateImage({
|
|
provider: "litellm",
|
|
model: "gpt-image-2",
|
|
prompt: "merge these",
|
|
cfg: {},
|
|
inputImages: [
|
|
{ buffer: Buffer.from("first"), mimeType: "image/png" },
|
|
{ buffer: Buffer.from("second"), mimeType: "image/jpeg" },
|
|
],
|
|
});
|
|
|
|
const form = mockObjectArg(postMultipartRequestMock).body as FormData;
|
|
// Both names are accepted by OpenAI-compatible edit endpoints, but only one
|
|
// may be present per request — sending both is an error.
|
|
expect(form.getAll("image[]")).toHaveLength(2);
|
|
expect(form.getAll("image")).toHaveLength(0);
|
|
});
|
|
|
|
it("throws a clear error when the API key is missing", async () => {
|
|
resolveApiKeyForProviderMock.mockResolvedValueOnce({ apiKey: "" });
|
|
|
|
const provider = buildLitellmImageGenerationProvider();
|
|
await expect(
|
|
provider.generateImage({
|
|
provider: "litellm",
|
|
model: "gpt-image-2",
|
|
prompt: "x",
|
|
cfg: {},
|
|
}),
|
|
).rejects.toThrow("LiteLLM API key missing");
|
|
});
|
|
|
|
it("forwards dispatcherPolicy from resolveProviderHttpRequestConfig to postJsonRequest", async () => {
|
|
const dispatcherPolicy = {
|
|
mode: "explicit-proxy",
|
|
proxyUrl: "http://corp-proxy:3128",
|
|
} as const;
|
|
resolveProviderHttpRequestConfigMock.mockReturnValueOnce({
|
|
baseUrl: "https://proxy.example.com/v1",
|
|
allowPrivateNetwork: false,
|
|
headers: new Headers({ Authorization: "Bearer litellm-key" }),
|
|
dispatcherPolicy,
|
|
});
|
|
mockGeneratedPngResponse();
|
|
|
|
const provider = buildLitellmImageGenerationProvider();
|
|
await provider.generateImage({
|
|
provider: "litellm",
|
|
model: "gpt-image-2",
|
|
prompt: "hi",
|
|
cfg: {
|
|
models: {
|
|
providers: {
|
|
litellm: { baseUrl: "https://proxy.example.com/v1", models: [] },
|
|
},
|
|
},
|
|
},
|
|
});
|
|
|
|
expect(mockObjectArg(postJsonRequestMock).dispatcherPolicy).toBe(dispatcherPolicy);
|
|
});
|
|
|
|
it("auto-allows private network for loopback-style baseUrls", async () => {
|
|
const cases = [
|
|
"http://localhost:4000",
|
|
"http://127.0.0.1:4000",
|
|
"http://127.255.255.254:4000",
|
|
"http://[::1]:4000",
|
|
"http://[0:0:0:0:0:0:0:1]:4000",
|
|
"http://host.docker.internal:4000",
|
|
"https://localhost:4000",
|
|
] as const;
|
|
for (const baseUrl of cases) {
|
|
resolveProviderHttpRequestConfigMock.mockClear();
|
|
mockGeneratedPngResponse();
|
|
const provider = buildLitellmImageGenerationProvider();
|
|
await provider.generateImage({
|
|
provider: "litellm",
|
|
model: "gpt-image-2",
|
|
prompt: "x",
|
|
cfg: { models: { providers: { litellm: { baseUrl, models: [] } } } },
|
|
});
|
|
expect(
|
|
mockObjectArg(resolveProviderHttpRequestConfigMock),
|
|
`expected allowPrivateNetwork=true for ${baseUrl}`,
|
|
).toHaveProperty("allowPrivateNetwork", true);
|
|
}
|
|
});
|
|
|
|
it("requires explicit private-network opt-in for LAN and internal baseUrls", async () => {
|
|
const cases = [
|
|
"http://10.0.0.42:4000",
|
|
"http://192.168.5.10:4000",
|
|
"http://172.16.0.5:4000",
|
|
"https://192.168.5.10:4000",
|
|
"http://printer.local:4000",
|
|
"http://proxy.internal:4000",
|
|
"http://127.evil.com:4000",
|
|
"https://metadata.google.internal",
|
|
] as const;
|
|
for (const baseUrl of cases) {
|
|
resolveProviderHttpRequestConfigMock.mockClear();
|
|
mockGeneratedPngResponse();
|
|
const provider = buildLitellmImageGenerationProvider();
|
|
await provider.generateImage({
|
|
provider: "litellm",
|
|
model: "gpt-image-2",
|
|
prompt: "x",
|
|
cfg: { models: { providers: { litellm: { baseUrl, models: [] } } } },
|
|
});
|
|
expect(
|
|
mockObjectArg(resolveProviderHttpRequestConfigMock),
|
|
`expected no automatic allowPrivateNetwork for ${baseUrl}`,
|
|
).toHaveProperty("allowPrivateNetwork", undefined);
|
|
expect(mockObjectArg(postJsonRequestMock).allowPrivateNetwork).toBe(false);
|
|
}
|
|
});
|
|
|
|
it.each(["http://192.168.5.10:4000", "http://127.evil.com:4000"])(
|
|
"honors explicit private-network opt-in for %s",
|
|
async (baseUrl) => {
|
|
mockGeneratedPngResponse();
|
|
|
|
const provider = buildLitellmImageGenerationProvider();
|
|
await provider.generateImage({
|
|
provider: "litellm",
|
|
model: "gpt-image-2",
|
|
prompt: "x",
|
|
cfg: {
|
|
models: {
|
|
providers: {
|
|
litellm: {
|
|
baseUrl,
|
|
request: { allowPrivateNetwork: true },
|
|
models: [],
|
|
},
|
|
},
|
|
},
|
|
},
|
|
});
|
|
|
|
expectFields(mockObjectArg(resolveProviderHttpRequestConfigMock), {
|
|
allowPrivateNetwork: undefined,
|
|
request: { allowPrivateNetwork: true },
|
|
});
|
|
expect(mockObjectArg(postJsonRequestMock).allowPrivateNetwork).toBe(true);
|
|
},
|
|
);
|
|
|
|
it("does not allow private network for public hosts that embed private strings in the URL", async () => {
|
|
// Must not be fooled by an attacker-controlled URL that mentions
|
|
// "host.docker.internal" (or any private-looking literal) in the path,
|
|
// query string, or fragment. Only the parsed hostname should count.
|
|
const cases = [
|
|
"https://evil.example.com/?target=host.docker.internal",
|
|
"https://evil.example.com/host.docker.internal/foo",
|
|
"https://evil.example.com/redirect?to=127.0.0.1",
|
|
"https://public-api.openai.com/v1",
|
|
] as const;
|
|
for (const baseUrl of cases) {
|
|
resolveProviderHttpRequestConfigMock.mockClear();
|
|
mockGeneratedPngResponse();
|
|
const provider = buildLitellmImageGenerationProvider();
|
|
await provider.generateImage({
|
|
provider: "litellm",
|
|
model: "gpt-image-2",
|
|
prompt: "x",
|
|
cfg: { models: { providers: { litellm: { baseUrl, models: [] } } } },
|
|
});
|
|
expect(
|
|
mockObjectArg(resolveProviderHttpRequestConfigMock),
|
|
`expected allowPrivateNetwork=false for ${baseUrl}`,
|
|
).toHaveProperty("allowPrivateNetwork", undefined);
|
|
}
|
|
});
|
|
});
|