From 5400a76280a933d8198151cd819311ab8e897a66 Mon Sep 17 00:00:00 2001 From: Divy Date: Tue, 4 Aug 2026 00:43:05 -0700 Subject: [PATCH 1/6] provider: add CoralBricks (OpenAI-compatible gateway) Adds CoralBricks (https://inference.coralbricks.ai/v1) with four hosted models referencing existing lab entries: zhipuai/glm-5.2 (as glm-5.2-fp4, 1M ctx), moonshotai/kimi-k2.6, moonshotai/kimi-k3, openai/gpt-oss-120b. Reasoning toggle verified against the live endpoint. bun validate passes. --- providers/coralbricks/logo.svg | 16 ++++++++++++++++ providers/coralbricks/models/glm-5.2-fp4.toml | 11 +++++++++++ providers/coralbricks/models/gpt-oss-120b.toml | 7 +++++++ providers/coralbricks/models/kimi-k2.6.toml | 7 +++++++ providers/coralbricks/models/kimi-k3.toml | 7 +++++++ providers/coralbricks/provider.toml | 13 +++++++++++++ 6 files changed, 61 insertions(+) create mode 100644 providers/coralbricks/logo.svg create mode 100644 providers/coralbricks/models/glm-5.2-fp4.toml create mode 100644 providers/coralbricks/models/gpt-oss-120b.toml create mode 100644 providers/coralbricks/models/kimi-k2.6.toml create mode 100644 providers/coralbricks/models/kimi-k3.toml create mode 100644 providers/coralbricks/provider.toml diff --git a/providers/coralbricks/logo.svg b/providers/coralbricks/logo.svg new file mode 100644 index 0000000000..a09042df67 --- /dev/null +++ b/providers/coralbricks/logo.svg @@ -0,0 +1,16 @@ + + + + + + + + + + + + \ No newline at end of file diff --git a/providers/coralbricks/models/glm-5.2-fp4.toml b/providers/coralbricks/models/glm-5.2-fp4.toml new file mode 100644 index 0000000000..39cfd9b3a4 --- /dev/null +++ b/providers/coralbricks/models/glm-5.2-fp4.toml @@ -0,0 +1,11 @@ +base_model = "zhipuai/glm-5.2" + +reasoning_options = [{ type = "toggle" }] + +[cost] +input = 1.40 +output = 4.40 + +[limit] +context = 1_048_576 +output = 131_072 diff --git a/providers/coralbricks/models/gpt-oss-120b.toml b/providers/coralbricks/models/gpt-oss-120b.toml new file mode 100644 index 0000000000..e61027477c --- /dev/null +++ b/providers/coralbricks/models/gpt-oss-120b.toml @@ -0,0 +1,7 @@ +base_model = "openai/gpt-oss-120b" + +reasoning_options = [{ type = "toggle" }] + +[cost] +input = 0.15 +output = 0.60 diff --git a/providers/coralbricks/models/kimi-k2.6.toml b/providers/coralbricks/models/kimi-k2.6.toml new file mode 100644 index 0000000000..90608eb8f7 --- /dev/null +++ b/providers/coralbricks/models/kimi-k2.6.toml @@ -0,0 +1,7 @@ +base_model = "moonshotai/kimi-k2.6" + +reasoning_options = [{ type = "toggle" }] + +[cost] +input = 0.76 +output = 4.00 diff --git a/providers/coralbricks/models/kimi-k3.toml b/providers/coralbricks/models/kimi-k3.toml new file mode 100644 index 0000000000..e8182c193b --- /dev/null +++ b/providers/coralbricks/models/kimi-k3.toml @@ -0,0 +1,7 @@ +base_model = "moonshotai/kimi-k3" + +reasoning_options = [{ type = "toggle" }] + +[cost] +input = 3.00 +output = 15.00 diff --git a/providers/coralbricks/provider.toml b/providers/coralbricks/provider.toml new file mode 100644 index 0000000000..0e0bb8ae23 --- /dev/null +++ b/providers/coralbricks/provider.toml @@ -0,0 +1,13 @@ +# Reasoning HTTP format (accessed 2026-08-04): +# OpenAI Chat: POST https://inference.coralbricks.ai/v1/chat/completions. +# Reasoning models stream interleaved thinking via a `reasoning` delta field +# (OpenRouter-style). Toggle: reasoning.enabled = true|false (verified 2026-08-04: +# enabled=false yields reasoning_tokens=0). Effort and token budget: not +# documented. Streaming always returns usage in the final chunk. +# Sources: +# https://www.coralbricks.ai/docs +name = "CoralBricks" +env = ["CORAL_API_KEY"] +npm = "@ai-sdk/openai-compatible" +doc = "https://www.coralbricks.ai/docs" +api = "https://inference.coralbricks.ai/v1" From f156afb7398fd6fa48ae637922bdddb0bfa51d6c Mon Sep 17 00:00:00 2001 From: Divy Date: Tue, 4 Aug 2026 01:06:13 -0700 Subject: [PATCH 2/6] review: currentColor logo, interleaved=true, affirmative reasoning audit MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit - logo.svg rebuilt from brand source: currentColor, square viewBox, no fixed size or hardcoded colors - interleaved = true on all four reasoning models (side channel streams via a 'reasoning' delta field, name not in the field enum) - reasoning_options = []: live-tested reasoning.effort low/high — honored on the gateway's vendor-relay path (e.g. gpt-oss 68 vs 248 reasoning tokens) but rejected with 400 by its local-serving path, so no request-side control is declared until the gateway normalizes it --- providers/coralbricks/logo.svg | 20 +++++-------------- providers/coralbricks/models/glm-5.2-fp4.toml | 3 ++- .../coralbricks/models/gpt-oss-120b.toml | 3 ++- providers/coralbricks/models/kimi-k2.6.toml | 3 ++- providers/coralbricks/models/kimi-k3.toml | 3 ++- providers/coralbricks/provider.toml | 10 +++++++--- 6 files changed, 20 insertions(+), 22 deletions(-) diff --git a/providers/coralbricks/logo.svg b/providers/coralbricks/logo.svg index a09042df67..4677066155 100644 --- a/providers/coralbricks/logo.svg +++ b/providers/coralbricks/logo.svg @@ -1,16 +1,6 @@ - - - - - - - - - - + + + + - \ No newline at end of file + diff --git a/providers/coralbricks/models/glm-5.2-fp4.toml b/providers/coralbricks/models/glm-5.2-fp4.toml index 39cfd9b3a4..046ed3b826 100644 --- a/providers/coralbricks/models/glm-5.2-fp4.toml +++ b/providers/coralbricks/models/glm-5.2-fp4.toml @@ -1,6 +1,7 @@ base_model = "zhipuai/glm-5.2" -reasoning_options = [{ type = "toggle" }] +reasoning_options = [] +interleaved = true [cost] input = 1.40 diff --git a/providers/coralbricks/models/gpt-oss-120b.toml b/providers/coralbricks/models/gpt-oss-120b.toml index e61027477c..883bf82dc8 100644 --- a/providers/coralbricks/models/gpt-oss-120b.toml +++ b/providers/coralbricks/models/gpt-oss-120b.toml @@ -1,6 +1,7 @@ base_model = "openai/gpt-oss-120b" -reasoning_options = [{ type = "toggle" }] +reasoning_options = [] +interleaved = true [cost] input = 0.15 diff --git a/providers/coralbricks/models/kimi-k2.6.toml b/providers/coralbricks/models/kimi-k2.6.toml index 90608eb8f7..29f46f8fd8 100644 --- a/providers/coralbricks/models/kimi-k2.6.toml +++ b/providers/coralbricks/models/kimi-k2.6.toml @@ -1,6 +1,7 @@ base_model = "moonshotai/kimi-k2.6" -reasoning_options = [{ type = "toggle" }] +reasoning_options = [] +interleaved = true [cost] input = 0.76 diff --git a/providers/coralbricks/models/kimi-k3.toml b/providers/coralbricks/models/kimi-k3.toml index e8182c193b..a8c0051362 100644 --- a/providers/coralbricks/models/kimi-k3.toml +++ b/providers/coralbricks/models/kimi-k3.toml @@ -1,6 +1,7 @@ base_model = "moonshotai/kimi-k3" -reasoning_options = [{ type = "toggle" }] +reasoning_options = [] +interleaved = true [cost] input = 3.00 diff --git a/providers/coralbricks/provider.toml b/providers/coralbricks/provider.toml index 0e0bb8ae23..bcd1d1f321 100644 --- a/providers/coralbricks/provider.toml +++ b/providers/coralbricks/provider.toml @@ -1,9 +1,13 @@ # Reasoning HTTP format (accessed 2026-08-04): # OpenAI Chat: POST https://inference.coralbricks.ai/v1/chat/completions. # Reasoning models stream interleaved thinking via a `reasoning` delta field -# (OpenRouter-style). Toggle: reasoning.enabled = true|false (verified 2026-08-04: -# enabled=false yields reasoning_tokens=0). Effort and token budget: not -# documented. Streaming always returns usage in the final chunk. +# (OpenRouter-style). Request-side reasoning control is NOT declared: the +# gateway serves each request from local capacity or a vendor relay, and the +# `reasoning` request field (enabled/effort) is honored only on the relay path +# while local serving rejects it (400 "Extra inputs are not permitted"; +# verified 2026-08-04 against both paths). No toggle/effort until the gateway +# normalizes this. Token budget: not documented. Streaming always returns +# usage in the final chunk. # Sources: # https://www.coralbricks.ai/docs name = "CoralBricks" From e639f2b5a6a5f45620c66177df762d80ec6ed199 Mon Sep 17 00:00:00 2001 From: Divy Date: Tue, 4 Aug 2026 01:14:45 -0700 Subject: [PATCH 3/6] review: omit cost during design-partner phase; name GLM FP4 variant Costs are deliberately omitted while pricing is in a design-partner phase and subject to change; a follow-up PR adds [cost] at GA (schema allows omission). glm-5.2-fp4 gets a display-name override so UIs show the FP4 serving variant. --- providers/coralbricks/models/glm-5.2-fp4.toml | 5 +---- providers/coralbricks/models/gpt-oss-120b.toml | 3 --- providers/coralbricks/models/kimi-k2.6.toml | 3 --- providers/coralbricks/models/kimi-k3.toml | 3 --- 4 files changed, 1 insertion(+), 13 deletions(-) diff --git a/providers/coralbricks/models/glm-5.2-fp4.toml b/providers/coralbricks/models/glm-5.2-fp4.toml index 046ed3b826..891656de63 100644 --- a/providers/coralbricks/models/glm-5.2-fp4.toml +++ b/providers/coralbricks/models/glm-5.2-fp4.toml @@ -1,12 +1,9 @@ base_model = "zhipuai/glm-5.2" +name = "GLM 5.2 FP4" reasoning_options = [] interleaved = true -[cost] -input = 1.40 -output = 4.40 - [limit] context = 1_048_576 output = 131_072 diff --git a/providers/coralbricks/models/gpt-oss-120b.toml b/providers/coralbricks/models/gpt-oss-120b.toml index 883bf82dc8..086a3cfde5 100644 --- a/providers/coralbricks/models/gpt-oss-120b.toml +++ b/providers/coralbricks/models/gpt-oss-120b.toml @@ -3,6 +3,3 @@ base_model = "openai/gpt-oss-120b" reasoning_options = [] interleaved = true -[cost] -input = 0.15 -output = 0.60 diff --git a/providers/coralbricks/models/kimi-k2.6.toml b/providers/coralbricks/models/kimi-k2.6.toml index 29f46f8fd8..4190baf751 100644 --- a/providers/coralbricks/models/kimi-k2.6.toml +++ b/providers/coralbricks/models/kimi-k2.6.toml @@ -3,6 +3,3 @@ base_model = "moonshotai/kimi-k2.6" reasoning_options = [] interleaved = true -[cost] -input = 0.76 -output = 4.00 diff --git a/providers/coralbricks/models/kimi-k3.toml b/providers/coralbricks/models/kimi-k3.toml index a8c0051362..382c027ee0 100644 --- a/providers/coralbricks/models/kimi-k3.toml +++ b/providers/coralbricks/models/kimi-k3.toml @@ -3,6 +3,3 @@ base_model = "moonshotai/kimi-k3" reasoning_options = [] interleaved = true -[cost] -input = 3.00 -output = 15.00 From 713568eba52a4feaa01933846719fe0b3b462e04 Mon Sep 17 00:00:00 2001 From: Divy Date: Tue, 4 Aug 2026 10:40:18 -0700 Subject: [PATCH 4/6] review: restore [cost] with published rates; cache_read = 0 Maintainer asked for cost to always be authored. Real published rates rather than zeroes (zeroed costs render as free in consumers). cache_read = 0 is accurate: cached input tokens are not billed. --- providers/coralbricks/models/glm-5.2-fp4.toml | 5 +++++ providers/coralbricks/models/gpt-oss-120b.toml | 4 ++++ providers/coralbricks/models/kimi-k2.6.toml | 4 ++++ providers/coralbricks/models/kimi-k3.toml | 4 ++++ 4 files changed, 17 insertions(+) diff --git a/providers/coralbricks/models/glm-5.2-fp4.toml b/providers/coralbricks/models/glm-5.2-fp4.toml index 891656de63..6024dea830 100644 --- a/providers/coralbricks/models/glm-5.2-fp4.toml +++ b/providers/coralbricks/models/glm-5.2-fp4.toml @@ -7,3 +7,8 @@ interleaved = true [limit] context = 1_048_576 output = 131_072 + +[cost] +input = 1.4 +output = 4.4 +cache_read = 0 diff --git a/providers/coralbricks/models/gpt-oss-120b.toml b/providers/coralbricks/models/gpt-oss-120b.toml index 086a3cfde5..99a54c6b86 100644 --- a/providers/coralbricks/models/gpt-oss-120b.toml +++ b/providers/coralbricks/models/gpt-oss-120b.toml @@ -3,3 +3,7 @@ base_model = "openai/gpt-oss-120b" reasoning_options = [] interleaved = true +[cost] +input = 0.15 +output = 0.6 +cache_read = 0 diff --git a/providers/coralbricks/models/kimi-k2.6.toml b/providers/coralbricks/models/kimi-k2.6.toml index 4190baf751..586d19cbe3 100644 --- a/providers/coralbricks/models/kimi-k2.6.toml +++ b/providers/coralbricks/models/kimi-k2.6.toml @@ -3,3 +3,7 @@ base_model = "moonshotai/kimi-k2.6" reasoning_options = [] interleaved = true +[cost] +input = 0.76 +output = 4.0 +cache_read = 0 diff --git a/providers/coralbricks/models/kimi-k3.toml b/providers/coralbricks/models/kimi-k3.toml index 382c027ee0..3bc0fc3063 100644 --- a/providers/coralbricks/models/kimi-k3.toml +++ b/providers/coralbricks/models/kimi-k3.toml @@ -3,3 +3,7 @@ base_model = "moonshotai/kimi-k3" reasoning_options = [] interleaved = true +[cost] +input = 3.0 +output = 15.0 +cache_read = 0 From d472ebc9f21ec9c071e6903d039b2dad1d38d828 Mon Sep 17 00:00:00 2001 From: Divy Date: Thu, 6 Aug 2026 00:32:51 -0700 Subject: [PATCH 5/6] chore: drop kimi-k2.6 (model deprecated on CoralBricks) --- providers/coralbricks/models/kimi-k2.6.toml | 9 --------- 1 file changed, 9 deletions(-) delete mode 100644 providers/coralbricks/models/kimi-k2.6.toml diff --git a/providers/coralbricks/models/kimi-k2.6.toml b/providers/coralbricks/models/kimi-k2.6.toml deleted file mode 100644 index 586d19cbe3..0000000000 --- a/providers/coralbricks/models/kimi-k2.6.toml +++ /dev/null @@ -1,9 +0,0 @@ -base_model = "moonshotai/kimi-k2.6" - -reasoning_options = [] -interleaved = true - -[cost] -input = 0.76 -output = 4.0 -cache_read = 0 From 338fd077765b843ebda251d75f5b8df8be002c3c Mon Sep 17 00:00:00 2001 From: Divy Date: Thu, 6 Aug 2026 17:12:32 -0700 Subject: [PATCH 6/6] coralbricks: update published input rates (GLM $1.12, GPT-OSS $0.12) --- providers/coralbricks/models/glm-5.2-fp4.toml | 2 +- providers/coralbricks/models/gpt-oss-120b.toml | 2 +- 2 files changed, 2 insertions(+), 2 deletions(-) diff --git a/providers/coralbricks/models/glm-5.2-fp4.toml b/providers/coralbricks/models/glm-5.2-fp4.toml index 6024dea830..0ef1e241db 100644 --- a/providers/coralbricks/models/glm-5.2-fp4.toml +++ b/providers/coralbricks/models/glm-5.2-fp4.toml @@ -9,6 +9,6 @@ context = 1_048_576 output = 131_072 [cost] -input = 1.4 +input = 1.12 output = 4.4 cache_read = 0 diff --git a/providers/coralbricks/models/gpt-oss-120b.toml b/providers/coralbricks/models/gpt-oss-120b.toml index 99a54c6b86..ae4e47fc62 100644 --- a/providers/coralbricks/models/gpt-oss-120b.toml +++ b/providers/coralbricks/models/gpt-oss-120b.toml @@ -4,6 +4,6 @@ reasoning_options = [] interleaved = true [cost] -input = 0.15 +input = 0.12 output = 0.6 cache_read = 0