节制计算
可预测互动由确定性代码处理;轻量模型解决歧义;只有错误成本高于令牌成本的任务才使用高精度推理。
工程透明度
这是Maison Apéro平衡葡萄酒专业性、速度、成本与隐私的公开版本化说明。生产组件与仍在验证的目标架构会明确区分。
本页由一个目录生成。只有通过生产验证的组件才标记为已上线。
客户端不能选择服务商;任务分类、模型策略、计费与回退由服务器负责。
| 层级 | 技术或模型 | 用途 | 状态 |
|---|---|---|---|
| 客户端 | Flutter 3.47 / Dart 3.13 | 为Android、iOS、Web和PWA提供统一UI基础。 | 已上线 |
| 身份验证与API保护 | Firebase Auth / App Check | 仅接受已验证用户和正版应用实例的请求。 | 已上线 |
| 评测编排器 | Cloud Functions / Node.js 22 | 分类评测与学习任务、选择模型、控制票券、安全重试并验证输出。 | 部分上线 |
| 验证缓存 | Server-owned 8-language templates | Wine Library存在验证结果时,不运行新模型即可返回。 | 部分上线 |
| 输入规范化 | ministral-8b-2512256k上下文・结构化输出 | 从酒标、酒单片段或文字中规范酒款身份并判断信息是否充分。 | 验证中 |
| 评测生成验证 | mistral-small-2603256k上下文・结构化输出・可调推理 | 在投入生产前验证评测草稿与学习题目元数据路径。 | 验证中 |
| 轻量Gemini | gemini-3.5-flash-lite1M输入上下文・结构化输出・Thinking | 计划用于翻译、酒标提取与轻量结构化。 | 计划中 |
| 高精度Gemini | gemini-3.7-flash1M输入上下文・结构化输出・低/中/高Thinking | 用于结构化品鉴评测、题目生成、书面评分、Grand分析与关键裁定。 | 已上线 |
| 数据 | Firestore / Wine Library | 保存已验证酒款事实、评测与语言缓存。 | 已上线 |
| 机密知识 | Server-only reference layer | 把高级资料和评测/题目生成指令限制在服务器。 | 部分上线 |
| 密钥 | Google Secret Manager | 使服务商凭据与源码和客户端构建分离。 | 已上线 |
| 可观测性 | Cloud Logging / aggregate metrics | 不记录输入正文,只测量模型、任务、延迟、令牌和成功率。 | 已上线 |
从Wine Library匹配开始,仅在必要时运行模型,并在显示前验证结果。
我们遵循四项工程原则,而不是把每条消息当作同一种AI问题。
可预测互动由确定性代码处理;轻量模型解决歧义;只有错误成本高于令牌成本的任务才使用高精度推理。
可用时先检索已验证Wine Library,并分开事实与建议。
高精度评估失败时不会静默降级,而是退款并提示重试。
一个任务只有一个服务器请求键,重试与回退不能重复扣费。
推理强度由任务风险决定;私有提示词、精确阈值和思维轨迹仅在服务器。
| 任务 | 模型 | 强度 |
|---|---|---|
| 酒款身份规范化 | Ministral 3 8B | 最小 |
| 评测生成验证 | Mistral Small 4 | 低 |
| 学习题目生成 | Mistral Small 4 | 中 |
| 翻译与提取 | Gemini 3.5 Flash-Lite | 最小 |
| 结构化品鉴与书面评分 | Gemini 3.7 Flash | 中 |
| 重大差异裁定 | Gemini 3.7 Flash | 高 |
票券按任务目的扣除,而不是按后台所选服务商。
模型目录、八种语言页面、结构化数据、站点地图和AI摘要同步生成;发布测试会拒绝语言缺失、虚假上线状态和运行版本漂移。
不会。已验证服务器应用版本化策略。
不会。重试共享同一幂等请求。
没有;仍在多语言葡萄酒领域验证中。
不会。架构公开,但指令、私有资料、阈值与思维轨迹保密。