Codex CLI op Muapi

Configuratie

~/.codex/config.toml (macOS/Linux) of %USERPROFILE%\.codex\config.toml (Windows):

model = "gpt-5-6-sol"
model_provider = "muapi"

[model_providers.muapi]
name = "Muapi"
base_url = "https://api.muapi.ai/openai/v1"
env_key = "MUAPI_API_KEY"
wire_api = "responses"

API-sleutel

macOS/Linux:

export MUAPI_API_KEY=your_key

Windows PowerShell:

$env:MUAPI_API_KEY = "your_key"
setx MUAPI_API_KEY "your_key"

Belangrijke details

  • base_url is de root; Codex voegt /responses toe.
  • env_key is de naam van de variabele die de sleutel bevat, niet de sleutel zelf.
  • Stel model expliciet in op een id van het modellen-endpoint, niet op de ingebouwde standaardwaarde van Codex.
  • De provider-id's openai, ollama en lmstudio zijn gereserveerd; gebruik muapi.
  • Bewaar de providerconfiguratie in het bestand op gebruikersniveau, niet in projectbestanden.

Modellen

curl -s -H "Authorization: Bearer $MUAPI_API_KEY" https://api.muapi.ai/openai/v1/models

Ongecensureerde (abliterated) modellen

Het modellen-endpoint toont ook de ongecensureerde modellen van Muapi die tools ondersteunen (bijvoorbeeld qwen-3-8-27b-obliterated, mimo-v2-6-flash-abliterated). Zet model = "<id>" in config.toml om er een te gebruiken; Muapi vertaalt voor je tussen het protocol van Codex en de chat-API van het model.

  • Experimenteel: de kwaliteit verschilt per model en kleinere modellen kunnen stappen overslaan bij taken met meerdere bestanden.
  • Er is geen prompt caching, dus elke beurt wordt gefactureerd voor het hele gesprek tot dan toe.
  • De uitvoer per antwoord is beperkt tot 16,384 tokens en de contextvensters zijn kleiner dan bij GPT.
  • Codex moet elke beurt het volledige gesprek meesturen (de standaard voor aangepaste providers). Verzoeken die afhankelijk zijn van previous_response_id worden geweigerd met een duidelijke foutmelding.
  • Ingebouwde Codex-tools anders dan function-tools in shell-stijl en apply_patch (bijvoorbeeld webzoeken) zijn bij deze modellen niet beschikbaar.

Redeneerinspanning (optioneel)

model_reasoning_effort = "high"

Verifiëren

codex doctor