长上下文任务
262K tokens 的窗口适合大型代码库、长文档,以及多轮智能体对话记录。
Union Alpha 在 TokenRa 上的模型 ID 为 union-alpha,支持文本和图像输入、文本输出,标示的上下文窗口为 262,144 tokens,最大输出 131,072 tokens。提供方身份未公开,在平台上标示为 Stealth。
262K tokens 的窗口适合大型代码库、长文档,以及多轮智能体对话记录。
支持兼容 OpenAI 的函数调用和 response_format。建议在应用层校验输出。
在当前已启用的集成范围内,Union Alpha 支持文本和图像输入。
以下数值来自该模型公布的规格说明。在依赖这些数值之前,请在 TokenRa 控制台确认你账户的实时限制和可用性。
union-alpha;提供方标示为 Stealth,独立于 TokenRa 运营。tools 和 tool_choice 进行工具调用;支持通过 response_format 获取结构化输出,JSON schema 可传入但不做强制校验。Union Alpha 更偏向深度和上下文长度,而非响应速度,这决定了它的适用范围。
注册 TokenRa 账户,进入控制台创建 API 密钥,确认 Union Alpha 已为你的账户启用,然后从服务端发送兼容 OpenAI 的请求。请将密钥保存在服务端,并在投入生产前核对实际的模型标识。
注册后进入 TokenRa 控制台。
在密钥或令牌页面创建密钥,并保存在服务端。
确认已启用的模型 ID,使用代表性负载测试,再加入生产控制。
curl https://tokenra.io/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"union-alpha","messages":[{"role":"user","content":"YOUR_TEST_PROMPT"}]}'任何兼容 OpenAI 的客户端用法相同:将 API 地址指向 https://tokenra.io/v1,模型 ID 设为 union-alpha。
import openai
client = openai.OpenAI(
base_url="https://tokenra.io/v1",
api_key="YOUR_API_KEY",
)
response = client.chat.completions.create(
model="union-alpha",
messages=[{"role": "user", "content": "YOUR_TEST_PROMPT"}],
)
print(response.choices[0].message.content)Union Alpha 通过 TokenRa 使用时,输入和输出当前均标示为零 token 费用,开始使用无需绑定信用卡。免费为阶段性策略,可能随时调整;访问权限同时受账户资格、提供方可用性和适用速率限制约束。请在投入生产前核对 TokenRa 控制台的实时信息。
Union Alpha 当前未标示输入费用。
Union Alpha 当前未标示输出费用。
请在 TokenRa 控制台查看当前 RPM 和额度限制。
Union Alpha 由未公开身份的第三方提供方开发和运营,在平台上标示为 Stealth,未公布公司名称或研究论文。TokenRa 以路由网关的形式提供 API 访问,不是该模型的开发者或所有者。
免费不代表没有取舍。在生产中依赖 Union Alpha 之前,请了解以下几点。
response_format。Union Alpha 是 TokenRa 上的一款多模态大语言模型,模型 ID 为 union-alpha,面向研究、编程和智能体工作流。支持文本和图像输入、文本输出,上下文窗口为 262,144 tokens。
Union Alpha 目前在 TokenRa 上标示为零 token 费用。免费为阶段性策略,可能随时调整;请在投入生产前于 TokenRa 控制台确认当前价格和账户限制。
标示的上下文窗口为 262,144 tokens,最大输出为 131,072 tokens。请在 TokenRa 控制台确认你账户的实际限制。
支持。可通过 tools 和 tool_choice 使用兼容 OpenAI 的函数调用,并通过 response_format 获取结构化输出。JSON schema 可以传入但不做强制校验,请在应用层验证输出。
该模型由未公开身份的第三方提供方开发和运营,在 TokenRa 上标示为 Stealth,未公布公司名称或研究论文。TokenRa 以路由网关的形式提供 API 访问,不是该模型的开发者或所有者。
公布的 P50 延迟约 17.6 秒,吞吐约每秒 14 tokens。它更适合批处理、长文本生成和异步任务,不适合实时对话或低延迟智能体。
Union Alpha 由未公开身份的第三方提供方开发和运营,在平台上标示为 Stealth。本页的规格和性能数据来自提供方公布的信息,可能发生变化。提供方及相关名称属于其各自权利人;TokenRa 以路由网关的形式提供 API 访问,不应被视为该模型的开发者或所有者。