Skip to content

Latest commit

 

History

History
24 lines (18 loc) · 1.75 KB

File metadata and controls

24 lines (18 loc) · 1.75 KB

设计决策说明

答辩前自读一遍。每个核心决策3句话:选了什么、为什么、反过来会怎样。

模型选型

  • 选了什么:双轨并行——Doubao做意图识别(primary),Qwen-Plus做生成(primary)
  • 为什么:意图识别不需要很强但需要免费额度(Doubao),生成需要JSON schema强约束(Qwen-Plus更稳定)
  • 反过来会怎样:如果全用Doubao,购买标准生成的JSON格式稳定性下降;如果全用Qwen,无法展示"使用了官方提供的模型资源"

混合检索架构

  • 选了什么:硬过滤(SQL)→向量召回(pgvector)→Rerank(gte)
  • 为什么:刚性约束(预算/肤质/价格区间)不能依赖向量检索的模糊匹配,必须先SQL框定安全子集
  • 反过来会怎样:如果先向量再硬过滤,可能召回大量超预算/不匹配肤质的商品,浪费检索资源且推荐结果不可控

购物车只做⭐入门

  • 选了什么:对话式加购(cart_items表+add_to_cart意图+cart_action事件),不做下单确认
  • 为什么:⭐入门档2天工作量,证明Agent能通过对话操作结构化数据;⭐⭐⭐下单需要地址/订单状态机,3周不可控
  • 反过来会怎样:如果做⭐⭐⭐下单确认,购物车模块会从2天膨胀到4天,挤占多模态和对话智能的打磨时间

SSE协议设计

  • 选了什么:每种能力有独立事件类型(thinking/clarification/criteria_card/text_delta/product_card/cart_action/final_decision)
  • 为什么:前端不需要从文本里做正则匹配判断操作类型,直接按事件类型渲染对应卡片
  • 反过来会怎样:如果用单一text_delta承载所有内容,前端解析复杂度飙升,卡片渲染变成字符串匹配赌博