Skip to content

[作业03-Agent] SX2516050 王雅文 - 记忆增强型文本交互智能体系统 - #63

Open
ya-wenooo wants to merge 1 commit into
wuhuanga:mainfrom
ya-wenooo:main
Open

[作业03-Agent] SX2516050 王雅文 - 记忆增强型文本交互智能体系统#63
ya-wenooo wants to merge 1 commit into
wuhuanga:mainfrom
ya-wenooo:main

Conversation

@ya-wenooo

@ya-wenooo ya-wenooo commented May 24, 2026

Copy link
Copy Markdown

代码仓库链接:https://github.com/ya-wenooo/LLM-Safety-Course

🚀 主要成果与创新点

  1. 实现了完整的记忆增强型文本交互智能体系统
  • 基于ReAct(Reasoning + Acting)框架构建智能体
  • 集成语义记忆存储环境知识,支持RAG检索
  • 集成情景记忆记录历史轨迹,从失败中学习
  1. 核心技术创新
  • 语义记忆模块:存储物品知识和动作知识,通过RAG检索相关记忆辅助决策
  • 情景记忆模块:记录执行步骤和错误,避免重复失败
  • 智能动作验证:自动转换和匹配LLM生成的动作,提高执行成功率
  • 错误恢复机制:从失败动作中学习,优先避免重复错误
  1. 实现ReAct推理循环
  • 思考-行动循环结构
  • 动态检索相关记忆
  • 环境状态感知和响应

🤖 实验中使用的模型

  • LLM模型:阿里云千问(Qwen-max)大语言模型
  • 嵌入模型:千问文本嵌入模型(qwen-text-embedding-v2)
  • 环境:ScienceWorld文本交互环境
  • 向量数据库:ChromaDB

💡 简要思路说明

  1. 多步规划:智能体通过ReAct框架持续与环境交互,根据观察结果动态调整行动策略
  2. 记忆增强:将语义记忆(环境知识)和情景记忆(历史经验)集成到推理过程,提高决策质量
  3. 动作验证:使用ActionValidator对LLM生成的动作进行智能转换和匹配,处理模糊或无效的动作指令
  4. 错误恢复:通过情景记忆记录失败动作,在后续决策中避免重复错误

📊 实验任务

在ScienceWorld环境中测试了4个任务:

  • boil(沸腾水)
  • freeze(冷冻)
  • use-thermometer(使用温度计)
  • measure-melting-point-known-substance(测量熔点)

📚 技术栈

  • Python 3.9+
  • ScienceWorld环境
  • 阿里云千问API
  • ChromaDB向量数据库
  • PyTorch

Sign up for free to join this conversation on GitHub. Already have an account? Sign in to comment

Labels

None yet

Projects

None yet

Development

Successfully merging this pull request may close these issues.

1 participant