TokenRa模型广场
Union Alpha · 通过 TokenRa 免费使用

Union Alpha

Union Alpha 是 TokenRa 上目前免费的多模态模型,面向研究、编程和智能体工作流。上下文窗口 262K tokens,支持文本和图像输入,兼容 OpenAI 接口,模型 ID 为 union-alpha

面向研究与智能体的免费多模态模型

Union Alpha 在 TokenRa 上的模型 ID 为 union-alpha,支持文本和图像输入、文本输出,标示的上下文窗口为 262,144 tokens,最大输出 131,072 tokens。提供方身份未公开,在平台上标示为 Stealth。

01

长上下文任务

262K tokens 的窗口适合大型代码库、长文档,以及多轮智能体对话记录。

02

工具调用与结构化输出

支持兼容 OpenAI 的函数调用和 response_format。建议在应用层校验输出。

03

多模态输入

在当前已启用的集成范围内,Union Alpha 支持文本和图像输入。

Union Alpha 规格

以下数值来自该模型公布的规格说明。在依赖这些数值之前,请在 TokenRa 控制台确认你账户的实时限制和可用性。

  • 模型 ID:union-alpha;提供方标示为 Stealth,独立于 TokenRa 运营。
  • 发布时间 2026 年 9 月 16 日;当前标示为零 token 费用。
  • 上下文窗口 262,144 tokens;最大输出 131,072 tokens。
  • 输入与输出:文本 + 图像输入,文本输出。
  • 支持通过 toolstool_choice 进行工具调用;支持通过 response_format 获取结构化输出,JSON schema 可传入但不做强制校验。
  • 公布的性能数据:P50 延迟约 17.6 秒,吞吐约每秒 14 tokens,三日可用性约 98%。

适用场景

Union Alpha 更偏向深度和上下文长度,而非响应速度,这决定了它的适用范围。

  • 批处理和异步任务,延迟不直接暴露给终端用户。
  • 长文本生成,可利用较高的输出上限。
  • 在单个上下文内完成仓库级代码阅读与分析。
  • 包含工具调用、明确结束条件和应用级验证的智能体工作流。
  • 探索性研究和原型开发,零 token 成本比速度更重要的场景。

如何接入 Union Alpha API

注册 TokenRa 账户,进入控制台创建 API 密钥,确认 Union Alpha 已为你的账户启用,然后从服务端发送兼容 OpenAI 的请求。请将密钥保存在服务端,并在投入生产前核对实际的模型标识。

1

创建 TokenRa 账户

注册后进入 TokenRa 控制台。

2

创建 API 密钥

在密钥或令牌页面创建密钥,并保存在服务端。

3

发送测试请求

确认已启用的模型 ID,使用代表性负载测试,再加入生产控制。

curl https://tokenra.io/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"union-alpha","messages":[{"role":"user","content":"YOUR_TEST_PROMPT"}]}'

任何兼容 OpenAI 的客户端用法相同:将 API 地址指向 https://tokenra.io/v1,模型 ID 设为 union-alpha

import openai

client = openai.OpenAI(
    base_url="https://tokenra.io/v1",
    api_key="YOUR_API_KEY",
)
response = client.chat.completions.create(
    model="union-alpha",
    messages=[{"role": "user", "content": "YOUR_TEST_PROMPT"}],
)
print(response.choices[0].message.content)

价格:当前免费

Union Alpha 通过 TokenRa 使用时,输入和输出当前均标示为零 token 费用,开始使用无需绑定信用卡。免费为阶段性策略,可能随时调整;访问权限同时受账户资格、提供方可用性和适用速率限制约束。请在投入生产前核对 TokenRa 控制台的实时信息。

输入

¥0 / 100 万 tokens

Union Alpha 当前未标示输入费用。

输出

¥0 / 100 万 tokens

Union Alpha 当前未标示输出费用。

速率限制

按账户区分

请在 TokenRa 控制台查看当前 RPM 和额度限制。

提供方未公开(Stealth)

Union Alpha 由未公开身份的第三方提供方开发和运营,在平台上标示为 Stealth,未公布公司名称或研究论文。TokenRa 以路由网关的形式提供 API 访问,不是该模型的开发者或所有者。

使用前需要注意

免费不代表没有取舍。在生产中依赖 Union Alpha 之前,请了解以下几点。

  • 延迟偏高:P50 约 17.6 秒,不适合实时对话和低延迟智能体。
  • 吞吐有限:约每秒 14 tokens,流式输出的响应体感会偏慢。
  • 可用性:三日窗口内约 98%,且该数据来自一个刚上线的免费模型。
  • 提供方未公开:没有可供评估的公司信息、模型卡或研究论文。
  • 结构化输出不做 schema 强制校验,需要在应用层校验并修复 JSON。
  • 免费为阶段性策略,可能调整,建议预留备用模型。

生产接入清单

  • 将 API 密钥保存在服务端,并按环境隔离凭据。
  • 在依赖之前,核对 262K tokens 上下文和支持的输入模态是否与实际集成一致。
  • 按公布的 P50 延迟设置足够宽松的超时,并配置有限重试和请求追踪。
  • 用自己的 schema 校验结构化输出,不要完全依赖 response_format
  • 为可用性波动和免费策略调整配置备用模型。
  • 结合自身场景审查数据处理方式、提供方条款、隐私要求和输出权利。

常见问题

Union Alpha 是什么?

Union Alpha 是 TokenRa 上的一款多模态大语言模型,模型 ID 为 union-alpha,面向研究、编程和智能体工作流。支持文本和图像输入、文本输出,上下文窗口为 262,144 tokens。

Union Alpha 是免费的吗?

Union Alpha 目前在 TokenRa 上标示为零 token 费用。免费为阶段性策略,可能随时调整;请在投入生产前于 TokenRa 控制台确认当前价格和账户限制。

上下文长度是多少?

标示的上下文窗口为 262,144 tokens,最大输出为 131,072 tokens。请在 TokenRa 控制台确认你账户的实际限制。

支持工具调用吗?

支持。可通过 toolstool_choice 使用兼容 OpenAI 的函数调用,并通过 response_format 获取结构化输出。JSON schema 可以传入但不做强制校验,请在应用层验证输出。

谁开发 Union Alpha?

该模型由未公开身份的第三方提供方开发和运营,在 TokenRa 上标示为 Stealth,未公布公司名称或研究论文。TokenRa 以路由网关的形式提供 API 访问,不是该模型的开发者或所有者。

Union Alpha 为什么比较慢?

公布的 P50 延迟约 17.6 秒,吞吐约每秒 14 tokens。它更适合批处理、长文本生成和异步任务,不适合实时对话或低延迟智能体。

Union Alpha 由未公开身份的第三方提供方开发和运营,在平台上标示为 Stealth。本页的规格和性能数据来自提供方公布的信息,可能发生变化。提供方及相关名称属于其各自权利人;TokenRa 以路由网关的形式提供 API 访问,不应被视为该模型的开发者或所有者。