| 123456789101112131415161718192021222324252627282930313233343536373839404142434445464748495051525354555657585960616263646566676869707172737475767778798081828384858687888990919293949596979899100101102103104105106107108109110111112113114115116117118119120121122123124125126127128129130131132133134135136137138139140141142143144145146147148149150151152153154155156157158159160161162163164165166167168169170171172173174175176177178179180181182183184185186187188189190191192193194195196197198199200201202203204205206207208209210211212213214215216217218219220221222223224225226227228229230231232233234235236237238239240241242243244245246247248249250251252253254255256257258259260261262263264265266267268269270271272273274275276277278279280281282283284285286287288289290291292293294295296297298299300301302303304305306307308309310311312313314315316317318319320321322323324325326327328329330331332333334335336337338339340341342343344345346347348349350351352353354355356357358359360361362363364365366367368369370371372373374375376377378379380381382383384385386387388389390391392393394395396397398399400401402403404405406407408409410411412413414415416417418419420421422423424425426427428429430431432433434435436437438439440441442443444445446447448449450451452453454455456457458459460461462463464465466467468469470471472473474475476477478479480481482483484485486487488489490491492493494495496497498499500501502503504505506507508509510511512513514515516517518519520521522523524525526527528529530531532533534535536537538539540541542543544545546547548549550551552553554555556557558559560561562563564565566567568569570571572573574575576577578579580581582583584585586587588589590591592593594595596597598599600601602603604605606607608609610 |
- import { describe, expect } from "bun:test"
- import { ConfigProvider, Effect, Layer, Stream } from "effect"
- import { Headers, HttpClientRequest } from "effect/unstable/http"
- import { LLM, LLMError, Message, Model, ToolCallPart, Usage } from "../../src"
- import { Auth, LLMClient, RequestExecutor, WebSocketExecutor } from "../../src/route"
- import * as Azure from "../../src/providers/azure"
- import * as OpenAI from "../../src/providers/openai"
- import * as OpenAIResponses from "../../src/protocols/openai-responses"
- import * as ProviderShared from "../../src/protocols/shared"
- import { it } from "../lib/effect"
- import { dynamicResponse, fixedResponse } from "../lib/http"
- import { sseEvents } from "../lib/sse"
- const model = OpenAIResponses.route
- .with({ endpoint: { baseURL: "https://api.openai.test/v1/" }, auth: Auth.bearer("test") })
- .model({ id: "gpt-4.1-mini" })
- const request = LLM.request({
- id: "req_1",
- model,
- system: "You are concise.",
- prompt: "Say hello.",
- generation: { maxTokens: 20, temperature: 0 },
- })
- const configEnv = (env: Record<string, string>) => Effect.provide(ConfigProvider.layer(ConfigProvider.fromEnv({ env })))
- describe("OpenAI Responses route", () => {
- it.effect("prepares OpenAI Responses target", () =>
- Effect.gen(function* () {
- const prepared = yield* LLMClient.prepare(request)
- expect(prepared.body).toEqual({
- model: "gpt-4.1-mini",
- input: [
- { role: "system", content: "You are concise." },
- { role: "user", content: [{ type: "input_text", text: "Say hello." }] },
- ],
- stream: true,
- max_output_tokens: 20,
- temperature: 0,
- })
- }),
- )
- it.effect("prepares OpenAI Responses WebSocket target", () =>
- Effect.gen(function* () {
- const prepared = yield* LLMClient.prepare(
- LLM.updateRequest(request, {
- model: OpenAI.configure({ baseURL: "https://api.openai.test/v1/", apiKey: "test" }).responsesWebSocket(
- "gpt-4.1-mini",
- ),
- }),
- )
- expect(prepared.route).toBe("openai-responses-websocket")
- expect(prepared.protocol).toBe("openai-responses")
- expect(prepared.metadata).toEqual({ transport: "websocket-json" })
- expect(prepared.body).toMatchObject({ model: "gpt-4.1-mini", stream: true })
- }),
- )
- it.effect("streams OpenAI Responses over WebSocket", () =>
- Effect.gen(function* () {
- const sent: string[] = []
- const opened: Array<{ readonly url: string; readonly authorization: string | undefined }> = []
- let closed = false
- const deps = Layer.mergeAll(
- Layer.succeed(
- RequestExecutor.Service,
- RequestExecutor.Service.of({
- execute: () => Effect.die("unexpected HTTP request"),
- }),
- ),
- Layer.succeed(
- WebSocketExecutor.Service,
- WebSocketExecutor.Service.of({
- open: (input) =>
- Effect.succeed({
- sendText: (message) =>
- Effect.sync(() => {
- opened.push({ url: input.url, authorization: input.headers.authorization })
- sent.push(message)
- }),
- messages: Stream.fromArray([
- ProviderShared.encodeJson({ type: "response.output_text.delta", item_id: "msg_1", delta: "Hi" }),
- ProviderShared.encodeJson({ type: "response.completed", response: { id: "resp_ws" } }),
- ]),
- close: Effect.sync(() => {
- closed = true
- }),
- }),
- }),
- ),
- )
- const response = yield* LLMClient.generate(
- LLM.request({
- model: OpenAI.configure({ baseURL: "https://api.openai.test/v1/", apiKey: "test" }).responsesWebSocket(
- "gpt-4.1-mini",
- ),
- prompt: "Say hello.",
- }),
- ).pipe(Effect.provide(LLMClient.layer.pipe(Layer.provide(deps))))
- expect(response.text).toBe("Hi")
- expect(opened).toEqual([{ url: "wss://api.openai.test/v1/responses", authorization: "Bearer test" }])
- expect(closed).toBe(true)
- expect(sent).toHaveLength(1)
- expect(JSON.parse(sent[0])).toEqual({
- type: "response.create",
- model: "gpt-4.1-mini",
- input: [{ role: "user", content: [{ type: "input_text", text: "Say hello." }] }],
- store: false,
- })
- }),
- )
- it.effect("fails immediately when WebSocket is already closed", () =>
- Effect.gen(function* () {
- const error = yield* WebSocketExecutor.fromWebSocket(
- // oxlint-disable-next-line typescript-eslint/no-unsafe-type-assertion -- fromWebSocket reads readyState before touching WebSocket methods on this branch.
- { readyState: globalThis.WebSocket.CLOSED } as globalThis.WebSocket,
- { url: "wss://api.openai.test/v1/responses", headers: Headers.empty },
- ).pipe(Effect.flip)
- expect(error.message).toContain("closed before opening")
- }),
- )
- it.effect("adds native query params to the Responses URL", () =>
- Effect.gen(function* () {
- yield* LLMClient.generate(
- LLM.updateRequest(request, {
- model: Model.update(model, { route: model.route.with({ endpoint: { query: { "api-version": "v1" } } }) }),
- }),
- ).pipe(
- Effect.provide(
- dynamicResponse((input) =>
- Effect.gen(function* () {
- const web = yield* HttpClientRequest.toWeb(input.request).pipe(Effect.orDie)
- expect(web.url).toBe("https://api.openai.test/v1/responses?api-version=v1")
- return input.respond(sseEvents({ type: "response.completed", response: {} }), {
- headers: { "content-type": "text/event-stream" },
- })
- }),
- ),
- ),
- )
- }),
- )
- it.effect("uses Azure api-key header for static OpenAI Responses keys", () =>
- Effect.gen(function* () {
- yield* LLMClient.generate(
- LLM.updateRequest(request, {
- model: Azure.configure({
- baseURL: "https://opencode-test.openai.azure.com/openai/v1/",
- apiKey: "azure-key",
- headers: { authorization: "Bearer stale" },
- }).responses("gpt-4.1-mini"),
- }),
- ).pipe(
- Effect.provide(
- dynamicResponse((input) =>
- Effect.gen(function* () {
- const web = yield* HttpClientRequest.toWeb(input.request).pipe(Effect.orDie)
- expect(web.url).toBe("https://opencode-test.openai.azure.com/openai/v1/responses?api-version=v1")
- expect(web.headers.get("api-key")).toBe("azure-key")
- expect(web.headers.get("authorization")).toBeNull()
- return input.respond(sseEvents({ type: "response.completed", response: {} }), {
- headers: { "content-type": "text/event-stream" },
- })
- }),
- ),
- ),
- )
- }),
- )
- it.effect("loads OpenAI default auth from Effect Config", () =>
- LLMClient.generate(
- LLM.updateRequest(request, {
- model: OpenAI.configure({ baseURL: "https://api.openai.test/v1/" }).responses("gpt-4.1-mini"),
- }),
- ).pipe(
- configEnv({ OPENAI_API_KEY: "env-key" }),
- Effect.provide(
- dynamicResponse((input) =>
- Effect.gen(function* () {
- const web = yield* HttpClientRequest.toWeb(input.request).pipe(Effect.orDie)
- expect(web.headers.get("authorization")).toBe("Bearer env-key")
- return input.respond(sseEvents({ type: "response.completed", response: {} }), {
- headers: { "content-type": "text/event-stream" },
- })
- }),
- ),
- ),
- ),
- )
- it.effect("lets explicit auth override OpenAI default API key auth", () =>
- LLMClient.generate(
- LLM.updateRequest(request, {
- model: OpenAI.configure({
- baseURL: "https://api.openai.test/v1/",
- auth: Auth.bearer("oauth-token"),
- }).responses("gpt-4.1-mini"),
- }),
- ).pipe(
- Effect.provide(
- dynamicResponse((input) =>
- Effect.gen(function* () {
- const web = yield* HttpClientRequest.toWeb(input.request).pipe(Effect.orDie)
- expect(web.headers.get("authorization")).toBe("Bearer oauth-token")
- return input.respond(sseEvents({ type: "response.completed", response: {} }), {
- headers: { "content-type": "text/event-stream" },
- })
- }),
- ),
- ),
- ),
- )
- it.effect("prepares function call and function output input items", () =>
- Effect.gen(function* () {
- const prepared = yield* LLMClient.prepare(
- LLM.request({
- id: "req_tool_result",
- model,
- messages: [
- Message.user("What is the weather?"),
- Message.assistant([ToolCallPart.make({ id: "call_1", name: "lookup", input: { query: "weather" } })]),
- Message.tool({ id: "call_1", name: "lookup", result: { forecast: "sunny" } }),
- ],
- }),
- )
- expect(prepared.body).toEqual({
- model: "gpt-4.1-mini",
- input: [
- { role: "user", content: [{ type: "input_text", text: "What is the weather?" }] },
- { type: "function_call", call_id: "call_1", name: "lookup", arguments: '{"query":"weather"}' },
- { type: "function_call_output", call_id: "call_1", output: '{"forecast":"sunny"}' },
- ],
- stream: true,
- })
- }),
- )
- it.effect("maps OpenAI provider options to Responses options", () =>
- Effect.gen(function* () {
- const prepared = yield* LLMClient.prepare<OpenAIResponses.OpenAIResponsesBody>(
- LLM.request({
- model: OpenAI.configure({ baseURL: "https://api.openai.test/v1/", apiKey: "test" }).model("gpt-5.2"),
- prompt: "think",
- providerOptions: {
- openai: {
- promptCacheKey: "session_123",
- reasoningEffort: "high",
- reasoningSummary: "auto",
- includeEncryptedReasoning: true,
- },
- },
- }),
- )
- expect(prepared.body.store).toBe(false)
- expect(prepared.body.prompt_cache_key).toBe("session_123")
- expect(prepared.body.include).toEqual(["reasoning.encrypted_content"])
- expect(prepared.body.reasoning).toEqual({ effort: "high", summary: "auto" })
- expect(prepared.body.text).toEqual({ verbosity: "low" })
- }),
- )
- it.effect("request OpenAI provider options override route defaults", () =>
- Effect.gen(function* () {
- const prepared = yield* LLMClient.prepare<OpenAIResponses.OpenAIResponsesBody>(
- LLM.request({
- model: OpenAI.configure({
- baseURL: "https://api.openai.test/v1/",
- apiKey: "test",
- providerOptions: { openai: { promptCacheKey: "model_cache" } },
- }).model("gpt-4.1-mini"),
- prompt: "no cache",
- providerOptions: { openai: { promptCacheKey: "request_cache" } },
- }),
- )
- expect(prepared.body.prompt_cache_key).toBe("request_cache")
- }),
- )
- it.effect("parses text and usage stream fixtures", () =>
- Effect.gen(function* () {
- const body = sseEvents(
- { type: "response.output_text.delta", item_id: "msg_1", delta: "Hello" },
- { type: "response.output_text.delta", item_id: "msg_1", delta: "!" },
- {
- type: "response.completed",
- response: {
- id: "resp_1",
- service_tier: "default",
- usage: {
- input_tokens: 5,
- output_tokens: 2,
- total_tokens: 7,
- input_tokens_details: { cached_tokens: 1 },
- output_tokens_details: { reasoning_tokens: 0 },
- },
- },
- },
- )
- const response = yield* LLMClient.generate(request).pipe(Effect.provide(fixedResponse(body)))
- const usage = new Usage({
- inputTokens: 5,
- outputTokens: 2,
- nonCachedInputTokens: 4,
- cacheReadInputTokens: 1,
- reasoningTokens: 0,
- totalTokens: 7,
- providerMetadata: {
- openai: {
- input_tokens: 5,
- output_tokens: 2,
- total_tokens: 7,
- input_tokens_details: { cached_tokens: 1 },
- output_tokens_details: { reasoning_tokens: 0 },
- },
- },
- })
- expect(response.text).toBe("Hello!")
- expect(response.events).toEqual([
- { type: "step-start", index: 0 },
- { type: "text-start", id: "msg_1" },
- { type: "text-delta", id: "msg_1", text: "Hello" },
- { type: "text-delta", id: "msg_1", text: "!" },
- { type: "text-end", id: "msg_1" },
- {
- type: "step-finish",
- index: 0,
- reason: "stop",
- providerMetadata: { openai: { responseId: "resp_1", serviceTier: "default" } },
- usage,
- },
- {
- type: "finish",
- reason: "stop",
- providerMetadata: { openai: { responseId: "resp_1", serviceTier: "default" } },
- usage,
- },
- ])
- }),
- )
- it.effect("parses reasoning summary stream fixtures", () =>
- Effect.gen(function* () {
- const body = sseEvents(
- { type: "response.reasoning_summary_text.delta", item_id: "rs_1", delta: "thinking" },
- { type: "response.output_text.delta", item_id: "msg_1", delta: "Hello" },
- { type: "response.reasoning_summary_text.done", item_id: "rs_1" },
- { type: "response.completed", response: { id: "resp_1" } },
- )
- const response = yield* LLMClient.generate(request).pipe(Effect.provide(fixedResponse(body)))
- expect(response.reasoning).toBe("thinking")
- expect(response.text).toBe("Hello")
- expect(response.events).toMatchObject([
- { type: "step-start", index: 0 },
- { type: "reasoning-start", id: "rs_1" },
- { type: "reasoning-delta", id: "rs_1", text: "thinking" },
- { type: "text-start", id: "msg_1" },
- { type: "text-delta", id: "msg_1", text: "Hello" },
- { type: "reasoning-end", id: "rs_1" },
- { type: "text-end", id: "msg_1" },
- { type: "step-finish", index: 0, reason: "stop" },
- { type: "finish", reason: "stop" },
- ])
- }),
- )
- it.effect("assembles streamed function call input", () =>
- Effect.gen(function* () {
- const body = sseEvents(
- {
- type: "response.output_item.added",
- item: { type: "function_call", id: "item_1", call_id: "call_1", name: "lookup", arguments: "" },
- },
- { type: "response.function_call_arguments.delta", item_id: "item_1", delta: '{"query"' },
- { type: "response.function_call_arguments.delta", item_id: "item_1", delta: ':"weather"}' },
- {
- type: "response.output_item.done",
- item: {
- type: "function_call",
- id: "item_1",
- call_id: "call_1",
- name: "lookup",
- arguments: '{"query":"weather"}',
- },
- },
- { type: "response.completed", response: { usage: { input_tokens: 5, output_tokens: 1 } } },
- )
- const response = yield* LLMClient.generate(
- LLM.updateRequest(request, {
- tools: [{ name: "lookup", description: "Lookup data", inputSchema: { type: "object" } }],
- }),
- ).pipe(Effect.provide(fixedResponse(body)))
- const usage = new Usage({
- inputTokens: 5,
- outputTokens: 1,
- nonCachedInputTokens: 5,
- cacheReadInputTokens: undefined,
- reasoningTokens: undefined,
- totalTokens: 6,
- providerMetadata: { openai: { input_tokens: 5, output_tokens: 1 } },
- })
- expect(response.events).toEqual([
- { type: "step-start", index: 0 },
- {
- type: "tool-input-start",
- id: "call_1",
- name: "lookup",
- providerMetadata: { openai: { itemId: "item_1" } },
- },
- {
- type: "tool-input-delta",
- id: "call_1",
- name: "lookup",
- text: '{"query"',
- },
- {
- type: "tool-input-delta",
- id: "call_1",
- name: "lookup",
- text: ':"weather"}',
- },
- {
- type: "tool-input-end",
- id: "call_1",
- name: "lookup",
- providerMetadata: { openai: { itemId: "item_1" } },
- },
- {
- type: "tool-call",
- id: "call_1",
- name: "lookup",
- input: { query: "weather" },
- providerExecuted: undefined,
- providerMetadata: { openai: { itemId: "item_1" } },
- },
- { type: "step-finish", index: 0, reason: "tool-calls", usage, providerMetadata: undefined },
- {
- type: "finish",
- reason: "tool-calls",
- providerMetadata: undefined,
- usage,
- },
- ])
- }),
- )
- it.effect("decodes web_search_call as provider-executed tool-call + tool-result", () =>
- Effect.gen(function* () {
- const item = {
- type: "web_search_call",
- id: "ws_1",
- status: "completed",
- action: { type: "search", query: "effect 4" },
- }
- const body = sseEvents(
- { type: "response.output_item.added", item },
- { type: "response.output_item.done", item },
- { type: "response.completed", response: { usage: { input_tokens: 5, output_tokens: 1 } } },
- )
- const response = yield* LLMClient.generate(request).pipe(Effect.provide(fixedResponse(body)))
- const callsAndResults = response.events.filter(
- (event) => event.type === "tool-call" || event.type === "tool-result",
- )
- expect(callsAndResults).toEqual([
- {
- type: "tool-call",
- id: "ws_1",
- name: "web_search",
- input: { type: "search", query: "effect 4" },
- providerExecuted: true,
- providerMetadata: { openai: { itemId: "ws_1" } },
- },
- {
- type: "tool-result",
- id: "ws_1",
- name: "web_search",
- result: { type: "json", value: item },
- providerExecuted: true,
- providerMetadata: { openai: { itemId: "ws_1" } },
- },
- ])
- }),
- )
- it.effect("decodes code_interpreter_call as provider-executed events with code input", () =>
- Effect.gen(function* () {
- const item = {
- type: "code_interpreter_call",
- id: "ci_1",
- status: "completed",
- code: "print(1+1)",
- container_id: "cnt_xyz",
- outputs: [{ type: "logs", logs: "2\n" }],
- }
- const body = sseEvents(
- { type: "response.output_item.done", item },
- { type: "response.completed", response: { usage: { input_tokens: 5, output_tokens: 1 } } },
- )
- const response = yield* LLMClient.generate(request).pipe(Effect.provide(fixedResponse(body)))
- const toolCall = response.events.find((event) => event.type === "tool-call")
- expect(toolCall).toEqual({
- type: "tool-call",
- id: "ci_1",
- name: "code_interpreter",
- input: { code: "print(1+1)", container_id: "cnt_xyz" },
- providerExecuted: true,
- providerMetadata: { openai: { itemId: "ci_1" } },
- })
- const toolResult = response.events.find((event) => event.type === "tool-result")
- expect(toolResult).toEqual({
- type: "tool-result",
- id: "ci_1",
- name: "code_interpreter",
- result: { type: "json", value: item },
- providerExecuted: true,
- providerMetadata: { openai: { itemId: "ci_1" } },
- })
- }),
- )
- it.effect("lowers user image content", () =>
- Effect.gen(function* () {
- const prepared = yield* LLMClient.prepare<OpenAIResponses.OpenAIResponsesBody>(
- LLM.request({
- id: "req_media",
- model,
- messages: [Message.user({ type: "media", mediaType: "image/png", data: "AAECAw==" })],
- }),
- )
- expect(prepared.body.input).toEqual([
- {
- role: "user",
- content: [{ type: "input_image", image_url: "data:image/png;base64,AAECAw==" }],
- },
- ])
- }),
- )
- it.effect("rejects unsupported user media content", () =>
- Effect.gen(function* () {
- const error = yield* LLMClient.prepare(
- LLM.request({
- id: "req_media",
- model,
- messages: [Message.user({ type: "media", mediaType: "application/pdf", data: "AAECAw==" })],
- }),
- ).pipe(Effect.flip)
- expect(error.message).toContain("OpenAI Responses user media content only supports images")
- }),
- )
- it.effect("emits provider-error events for mid-stream provider errors", () =>
- Effect.gen(function* () {
- const response = yield* LLMClient.generate(request).pipe(
- Effect.provide(fixedResponse(sseEvents({ type: "error", code: "rate_limit_exceeded", message: "Slow down" }))),
- )
- expect(response.events).toEqual([{ type: "provider-error", message: "Slow down" }])
- }),
- )
- it.effect("falls back to error code when no message is present", () =>
- Effect.gen(function* () {
- const response = yield* LLMClient.generate(request).pipe(
- Effect.provide(fixedResponse(sseEvents({ type: "error", code: "internal_error" }))),
- )
- expect(response.events).toEqual([{ type: "provider-error", message: "internal_error" }])
- }),
- )
- it.effect("fails HTTP provider errors before stream parsing", () =>
- Effect.gen(function* () {
- const error = yield* LLMClient.generate(request).pipe(
- Effect.provide(
- fixedResponse('{"error":{"type":"invalid_request_error","message":"Bad request"}}', {
- status: 400,
- headers: { "content-type": "application/json" },
- }),
- ),
- Effect.flip,
- )
- expect(error).toBeInstanceOf(LLMError)
- expect(error.reason).toMatchObject({ _tag: "InvalidRequest" })
- expect(error.message).toContain("HTTP 400")
- }),
- )
- })
|