大模型与 Agent
探索任务规划、工具调用、执行状态和可观测 Agent 工作流。
RESEARCH INDEX / THREADS & OUTPUT
以问题定义、协同机制和可量化评估为线索,记录研究方向、论文工作与竞赛实践。
探索任务规划、工具调用、执行状态和可观测 Agent 工作流。
研究知识获取、检索优化、重排序和答案可信度评估。
将模型能力转化为稳定、可部署和可维护的应用系统。
Publications
记录研究主题、方法路径、作者角色与阶段性进展。
提出面向舰载机起降特情的多智能体诱因生成框架,结合检索增强、样本筛选与偏好优化,提升复杂场景生成结果的真实性与合理性。
设计面向应急决策的复杂特情事件推演框架,通过多轮状态生成、策略筛选和结果分析,实现特情案例的完整推演与辅助决策。
构建多智能体驱动的任务规划与高保真评测系统,实现从方案生成、对抗仿真到量化反馈的闭环验证。
Competition
围绕复杂场景图像理解与多模态交错指令理解的团队成果。
复杂场景图像理解
面向复杂场景图像理解任务,设计动态数据训练流程和基于置信度与思维链的多智能体交互框架。
CCF-A 会议相关挑战赛
多模态交错指令理解
构建多模型集成与多任务推理框架,完成多个优势模型的结果融合。
CCF-B 会议相关挑战赛