登录社区云,与社区用户共同成长
邀请您加入社区
1、测试策略
A、通过违规,安全等case场景自动化测试固定的问答结果
B、人工抽检(人工核对pdf,知识库,AI接口返回)
C、兼容性测试(不同端APP,IOS, 安卓,ipad)
D、通过裁判promot命令判定(设置LLM大模型,temporature,top-k等指标),对比知识库md文档和AI接口返回结果相似度
汇聚全球AI编程工具,助力开发者即刻编程。
更多推荐
初识智能体
在过去两年中,几乎所有人都体验过大语言模型(如 ChatGPT、Claude、DeepSeek)的强大能力:写周报、润色邮件、解答编程疑难。被动响应:你问一句,它答一句。如果你的 Prompt 没有写清楚约束条件,它无法主动追问或修正目标。知行脱节:大模型能用流畅的文字告诉你“如何部署一个高可用 K8s 集群”,但它无法替你登录服务器敲下命令、查看报错日志并自动回滚。信息孤岛:大模型的知识止步于预
Agent 敢开写权限吗?Python 文件写入沙箱守卫实战
Windows 下部署 New API 中转站全过程实录(含 6 个真实踩坑)
扫一扫分享内容
为遵守国家网络实名制规定,未绑定将限制内容发布与互动
所有评论(0)