象信一号 · xiangxin-1.0.0

系统一模型:
给软件的决策,
不是给人看的文字

把一段内容作为 state,再附上一组带类型的问题(Choice / Score / Noul)。象信一号一次前向就给出每个问题的结构化答案和校准过的概率——没有长篇回复,没有 JSON 解析失败,你的代码拿到就能用。

$ curl -X POST https://api.xiangxinai.cn/v1/systemone \
  -H "Authorization: Bearer $XIANGXIN_API_KEY" \
  -H "Content-Type: application/json" \
  -d @- <<'EOF'
  {
    "state": "下单三天了还没发货,客服也不回,明天就要用!",
    "model": "xiangxin-latest",
    "questions": {
      "team": {
        "type": "choice",
        "instructions": "应该转给哪个组?",
        "criteria": {
          "售后": "退换货、维修、投诉",
          "物流": "发货、配送、快递进度",
          "售前": "商品咨询、下单前的问题"
        }
      },
      "urgent": {
        "type": "noul",
        "instructions": "用户是否表达了紧急?"
      },
      "anger": {
        "type": "score",
        "instructions": "用户情绪有多激动?",
        "criteria": ["平静", "不满", "愤怒"]
      }
    }
  }
EOF

把 $XIANGXIN_API_KEY 换成你在控制台创建的密钥 · 响应为真实调用结果

01为什么是系统一

类型化决策

答案只会落在你给出的选项或档位里。模型不会“发挥”,也不存在输出格式跑偏——每个结果都是可以直接 if、排序、入库的值。

answers["team"].choice  # "物流"

校准置信度

每个答案都带概率分布。概率经过校准训练:模型说 0.9 时,大体上就是十次对九次。低置信度的样本交给人工或更强的模型。

if ans.confidence < 0.6: 转人工()

像代码一样可靠

同样的输入给出几乎相同的输出。问题之间相互隔离、并行评估,加一个问题不会干扰其它问题的答案,也几乎不增加延迟。

questions = {q1, q2, … q50}  # 一次调用

02三个原语,覆盖大多数判断

Choice
从一组选项里选一个。这张工单该给售后、物流还是售前?返回选中项、每个选项的概率和置信度。
Score
按你定义的档位打分。这份简历的 Python 经验在“没接触过 / 了解 / 日常使用 / 精通”哪一档?返回期望分值与各档概率。
Noul
判断一句话是真是假。这条评论是否包含手机号?返回“是”的概率,0 到 1 之间。

03价格

¥42 / 十亿输入 token

即 ¥0.042 / 百万 token · 输出免费 · 每月赠送 ¥5 · 充值额度 12 个月有效

每月赠送的 ¥5 大约够处理一亿个输入 token。按量预付,没有月费,没有最低消费。

一次象信调用 vs 通用大模型

象信一号通用大模型
成本 / 1,000 次工单分类≈ ¥0.025≈ ¥2 – ¥5
延迟百毫秒级秒级
输出格式结构化,必然合法文本,需解析与重试
置信度每个答案附校准概率通常没有,或靠模型自述

示意数据,基于典型用法估算,非基准测试结果。假设每次调用约 600 个输入 token;大模型一侧按常见商用定价、含输出 token 估算。

05常见问题

象信一号和大模型有什么区别?

大模型擅长写东西给人看;象信一号只做判断。你事先定义好答案的形状(选项、档位或真假),它直接返回概率分布,不经过逐字生成,所以更快、更便宜,结果也不需要解析。两者常常搭配使用:象信负责分流和把关,大模型负责真正需要写作或多步推理的部分。

它能生成文字或写代码吗?

不能,这是设计上的取舍。象信一号的输出只有 Choice、Score、Noul 三种类型化答案。需要抽取某段文字时,常见做法是先用正则或规则找出候选,再让象信从候选中选出正确的那个。

支持中文吗?

支持。中文和英文都在训练数据中,状态和问题都可以直接用中文书写,也可以中英混排。不过任何模型在具体业务上的表现都需要实测:建议先用几十条自己的数据跑一遍,并结合置信度决定哪些结果自动处理。

怎么计费?

只按输入 token 计费:¥0.042 / 百万 token(即 ¥42 / 十亿 token),输出免费。每个账号每月赠送 ¥5 额度;充值为预付费,最低 ¥10,充值额度自购买起 12 个月内有效。用量和账单可在控制台实时查看。

我的数据会被用来训练模型吗?

不会。我们不使用你通过 API 或在线调试(Playground)发送的请求、返回的答案或账户数据来训练或改进模型。请求内容最多保存 30 天,仅用于故障排查、滥用与安全调查和计费争议处理,到期自动删除;token 数、时间和费用等用量数据按法律要求保存用于计费。企业组织可以在控制台 设置 → 组织 开启零内容留存。所有服务与数据都在中国大陆。详见隐私政策。

置信度可信吗?

模型的概率经过校准训练,这是在大量样本上成立的统计性质:在所有给出 0.8 的答案里,大约八成是对的。它不保证某一个具体答案一定正确。上线前请用你自己的标注数据检查阈值,再据此设置自动处理与人工复核的分界线。

有速率限制吗?

有。每个组织默认 1,000 token/秒、300 请求/分钟,单请求上下文 64k token。超出限制会返回 429 并附带 retry-after,官方 Python SDK 会自动退避重试。需要更高额度请联系我们。

如何开始?

用邮箱和验证码登录控制台(首次登录填写手机号),领取每月 ¥5 额度,先在 Playground 里粘贴一段文本试几个问题;满意后创建 API 密钥,pip install xiangxin-sdk,几行代码即可接入。文档里有 8 篇以上可直接运行的中文实战手册。

06社区与支持

把下一个 if 交给象信一号。

加入微信交流群

与象信 AI 团队和其他开发者交流

加载中…