|
| 1 | +import unittest |
| 2 | +from types import ModuleType |
| 3 | +from types import SimpleNamespace |
| 4 | +from typing import Any |
| 5 | +from unittest.mock import patch |
| 6 | + |
| 7 | +from ferry.ai.client import LLMClient |
| 8 | + |
| 9 | + |
| 10 | +class RecordingCompletions: |
| 11 | + def __init__(self, *, content: str | None = "Summary") -> None: |
| 12 | + super().__init__() |
| 13 | + self.request: dict[str, Any] | None = None |
| 14 | + self.content = content |
| 15 | + |
| 16 | + async def create(self, **kwargs: Any) -> SimpleNamespace: |
| 17 | + self.request = kwargs |
| 18 | + return SimpleNamespace( |
| 19 | + choices=[SimpleNamespace(message=SimpleNamespace(content=self.content))] |
| 20 | + ) |
| 21 | + |
| 22 | + |
| 23 | +class LLMClientTests(unittest.IsolatedAsyncioTestCase): |
| 24 | + messages = [{"role": "user", "content": "Summarize this"}] |
| 25 | + |
| 26 | + async def _complete( |
| 27 | + self, |
| 28 | + model: str, |
| 29 | + *, |
| 30 | + content: str | None = "Summary", |
| 31 | + request_model: str | None = None, |
| 32 | + ) -> tuple[str, dict[str, Any]]: |
| 33 | + openai = ModuleType("openai") |
| 34 | + setattr(openai, "RateLimitError", type("RateLimitError", (Exception,), {})) |
| 35 | + completions = RecordingCompletions(content=content) |
| 36 | + client = object.__new__(LLMClient) |
| 37 | + client._client = SimpleNamespace( |
| 38 | + chat=SimpleNamespace(completions=completions) |
| 39 | + ) |
| 40 | + client.model = model |
| 41 | + |
| 42 | + with patch.dict("sys.modules", {"openai": openai}): |
| 43 | + result = await client.complete( |
| 44 | + self.messages, |
| 45 | + model=request_model, |
| 46 | + temperature=0.7, |
| 47 | + max_tokens=900, |
| 48 | + ) |
| 49 | + |
| 50 | + assert completions.request is not None |
| 51 | + return result, completions.request |
| 52 | + |
| 53 | + async def test_reasoning_models_use_reasoning_parameters(self) -> None: |
| 54 | + for model in ( |
| 55 | + "gpt-5.6-luna", |
| 56 | + "openai/gpt-5.6-luna", |
| 57 | + "o3", |
| 58 | + "openai/o3", |
| 59 | + ): |
| 60 | + with self.subTest(model=model): |
| 61 | + result, request = await self._complete(model) |
| 62 | + |
| 63 | + self.assertEqual(result, "Summary") |
| 64 | + self.assertEqual( |
| 65 | + request, |
| 66 | + { |
| 67 | + "model": model, |
| 68 | + "messages": self.messages, |
| 69 | + "max_completion_tokens": 900, |
| 70 | + "reasoning_effort": "low", |
| 71 | + }, |
| 72 | + ) |
| 73 | + |
| 74 | + async def test_legacy_models_use_legacy_parameters(self) -> None: |
| 75 | + for model in ( |
| 76 | + "gpt-4.1-mini", |
| 77 | + "openai/gpt-4.1-mini", |
| 78 | + "notgpt-5", |
| 79 | + "foo-o3", |
| 80 | + ): |
| 81 | + with self.subTest(model=model): |
| 82 | + result, request = await self._complete(model) |
| 83 | + |
| 84 | + self.assertEqual(result, "Summary") |
| 85 | + self.assertEqual( |
| 86 | + request, |
| 87 | + { |
| 88 | + "model": model, |
| 89 | + "messages": self.messages, |
| 90 | + "temperature": 0.7, |
| 91 | + "max_tokens": 900, |
| 92 | + }, |
| 93 | + ) |
| 94 | + |
| 95 | + async def test_request_model_override_controls_parameters(self) -> None: |
| 96 | + _, request = await self._complete( |
| 97 | + "gpt-4.1-mini", request_model="openai/gpt-5.6-luna" |
| 98 | + ) |
| 99 | + |
| 100 | + self.assertEqual(request["model"], "openai/gpt-5.6-luna") |
| 101 | + self.assertEqual(request["reasoning_effort"], "low") |
| 102 | + self.assertEqual(request["max_completion_tokens"], 900) |
| 103 | + self.assertNotIn("temperature", request) |
| 104 | + self.assertNotIn("max_tokens", request) |
| 105 | + |
| 106 | + async def test_blank_content_is_rejected(self) -> None: |
| 107 | + with self.assertRaisesRegex(ValueError, "empty content"): |
| 108 | + await self._complete("gpt-5.6-luna", content=" \n") |
0 commit comments