跳转到内容

产品路线图

本页集中列出 codingas.com 已规划但当前版本尚未实现的能力。下列内容均处于设计或规划阶段,不代表最终交付承诺与时间表。已实现能力请参阅各功能文档。

若某项能力对你至关重要,欢迎通过 联系我们 反馈,帮助调整优先级。

基于向量相似度匹配相似请求并返回缓存结果,目标降低成本 30%+。

  • 请求向量化后在缓存库按余弦相似度检索,命中则直接返回缓存响应
  • 设计参数:相似度阈值 0.95(可配置 0.80–0.99)、TTL 1 小时、容量 10000 条、向量维度 1536
  • 依赖 PostgreSQL + pgvector 0.5+ 与 Embedding 模型

当前状态:设计规格阶段,源码尚未实现,未引入 pgvector 依赖。

为模型提供标准化上下文与工具接入,支持 Claude / Cursor / Dify 等 MCP 客户端。

  • Resources:提供上下文数据(可用模型列表、用量统计)
  • Prompts:提供预定义提示模板
  • Tools:提供可调用工具函数(查询 Provider 健康、估算 Token)

设计端点:/mcp/v1/resources/mcp/v1/prompts/mcp/v1/tools

当前状态:设计端点阶段,源码尚未实现。

Provider 出站流量经 HTTP/S 或 SOCKS5 代理,满足合规与网络隔离需求。

当前状态:规划中,尚未实现。

  • Grafana 预置仪表盘(延迟 / QPS / Token / 费用)
  • Jaeger 分布式追踪

当前状态:已暴露 Prometheus 指标与 OpenTelemetry Trace,Grafana 仪表盘与 Jaeger 集成为规划项。

  • 用户 × 渠道限额、请求次数配额
  • 国密算法(SM2/SM3/SM4)、完整审计链(WORM)
  • 企业 OAuth(飞书、钉钉、GitHub Enterprise)

下列端点在设计文档中出现,但当前版本尚未实现

端点说明
/v1/completionsLegacy 文本补全
/v1/embeddings向量嵌入
/v1/images/generations /edits /variations图像生成 / 编辑 / 变体
/v1/audio/speech语音合成(TTS)
/v1/audio/transcriptions /translations语音识别 / 翻译
/v1/moderations内容审核
/v1/models/{model}模型详情

当前已实现的调用端点仅:/v1/chat/completions/anthropic/v1/messages/v1/models。详见 API 参考

  • 模型级智能降级:额度不足或模型不可用时自动切换备选模型(L2 降级层曾实现后删除,待重新设计)
  • 场景路由:按 CODE / CREATIVE / SUMMARY 等场景选路
  • 模型别名映射:一个别名指向多个实际模型
  • 成本 / 延迟优化策略COST_OPTIMIZEDLATENCY_OPTIMIZED 路由策略

当前实现:路由策略硬编码为 WEIGHTED(加权),详见 路由设计

  • PII 脱敏执行接入:脱敏规则已定义,但尚未接入请求链路(配后暂不生效)
  • IP 白名单UA 过滤内容审核Prompt 注入防护

当前实现:IP 黑名单(经控制台配置)、密钥 AES-256-GCM 加密存储、审计日志。详见 安全与风控

  • 官方 SDK(v2.0 规划):当前通过 OpenAI / Anthropic 官方 SDK 兼容接入,详见 SDK 与集成
  • LangChain4j 集成:当前未引入该依赖
  • OAuth 登录:GitHub / Gitee / QQ / 企业微信

当前实现:用户名密码登录(Sa-Token 会话)+ 调用方 API Key 鉴权。详见 用户与认证

Token 配额的管理 API 已实现(可设置限额),但配额扣减尚未接入请求链路,设置后暂不生效。详见 Token 计量与配额