Aojie (Justin) Yuan
袁傲杰 Aojie (Justin) Yuan

袁傲杰

Aojie (Justin) Yuan · 南加州大学 Fortis Lab · 上海交通大学校友

简介

我想构建强大、以人为本的大模型——足够可靠、能被托付真实世界的资源,从而释放人的生产力与创造力。

我是南加州大学(USC)计算机工程荣誉硕士在读,在 USC Fortis Lab 做研究,导师为 Yue Zhao 教授;本科毕业于上海交通大学。研究方向是 AI 智能体安全、大模型推理与世界模型——我认为这是可信、以人为本的 AI 必需的几块基石,并把每个想法落地为开源系统。

主线是可靠性:能被托付真实资源的 AI,必须能校验自己的行动、进行可靠的推理,并在行动之前理解世界。研究之外,我曾在京东做生成式推荐、在 Optiver 做低延迟交易基础设施、在 Topify.AI 做自主 GEO/SEO 智能体系统。

教育经历

  • 南加州大学(University of Southern California) · 计算机工程硕士(荣誉项目)· Fortis Lab · 2025 – 2027 · 美国洛杉矶
  • 上海交通大学 · 电子与计算机工程学士,辅修计算机科学 · 2022 – 2026 · 上海
  • 华中师范大学第一附属中学 · 2019 – 2022 · 武汉

论文(2026)

共 15 篇,按英文原题列出,附中文一句话解读;点击"解读"阅读英文长文。完整列表见 Google Scholar。

  1. AEGIS: No Tool Call Left Unchecked — A Pre-Execution Firewall and Audit Layer for AI Agents 一作 · arXiv:2603.12621AI 智能体的执行前防火墙与审计层:每次工具调用执行前检查并留下防篡改记录,零代码改动接入。解读
  2. WeClawArena: An Auditable Sandbox and Benchmark for Cross-User Agent Collaboration and Security in Human-Centered Agent Networks 二作 · Findings of EMNLP 2026多用户智能体网络的可审计沙箱:124 个基础任务扩展为 620 个场景,分别报告任务效用与攻击成功率。解读
  3. CUA-SWE: When Computer-Use Agents Meet Visual Software Engineering 合作者 · ICLR 2026让智能体运行软件、看截图、操作界面并修改代码的基准,用确定性测试验证修复;能"看见"应用的混合智能体比纯代码版本高 12.8–48.6 个百分点。解读
  4. Auditable Agents 二作 · KnowFM @ ACL 2026 · ACM AI Summit 2026立场论文:没有可审计性就没有问责;提出智能体可审计性的五个维度与"可审计性卡片"。解读
  5. When Simulation Lies: A Sim-to-Real Benchmark and Domain-Randomized RL Recipe for Tool-Use Agents 二作 · NeurIPS 2026衡量工具调用智能体从仿真到真实环境的落差,并给出域随机化强化学习方案。解读
  6. SEVA: Self-Evolving Verification Agent with Process Reward for Fact Attribution 一作 · AI4GOOD & FAGEN @ ICML 2026自我进化的事实归因校验智能体,用过程奖励检查论断是否有出处支撑。解读
  7. AgentIR: A Workload-Adaptive Cascade Retrieval Substrate for Long-Term Conversational Memory 一作 · arXiv面向长期对话记忆的负载自适应级联检索:简单查询毫秒级返回,难查询才升级到稠密检索。解读
  8. Not All Thoughts Need HBM: Semantics-Aware Memory Hierarchy for LLM Reasoning 一作 · arXiv按语义重要性把长思维链的 KV cache 分层存放,节省稀缺的 GPU 显存且不丢弃任何 token。解读
  9. Sovereign-OS: A Charter-Governed Operating System for Autonomous AI Agents with Verifiable Fiscal Discipline 一作 · arXiv以"宪章"治理的多智能体操作系统:CEO 规划、CFO 审批支出、账本记录每一分钱和每个 token。解读
  10. Hidden Error Awareness in Chain-of-Thought Reasoning: The Signal Is Diagnostic, Not Causal 一作 · arXiv模型内部"知道"自己的推理出错(探针 AUROC 0.95),表面却依然自信;但这一信号只能诊断、无法用来纠错。解读
  11. Beyond Language: Format-Agnostic Reasoning Subspaces in Large Language Models 一作 · arXiv同一推理概念无论写成英文、代码还是数学,都落在一个 10 维的共享子空间(FARS)里。解读
  12. Concept Subspaces Compute Beyond the Logit Lens: A Weights-Only Test for Locating Representations Upstream of Readout 一作 · arXiv只用模型权重的几何检验,判断概念子空间是否只是输出读出方向的"伪装";在 26 个模型上验证。解读
  13. Jacobian Rank Collapse in Decision-Focused Learning 一作 · arXiv当预测器雅可比矩阵为秩一时,任务损失与 MSE 的梯度共线,决策导向学习因此难以超越 MSE。解读
  14. HMAR: Hierarchical Modality-Aware Expert and Dynamic Routing Medical Image Retrieval Architecture 独立作者 · arXiv双专家混合模型的医学影像检索:同时支持整图相似与病灶区域检索,无需框标注。解读
  15. Do Agent Skills Speak Safety in Every Language? A Cross-Lingual Security Analysis of the Skills Ecosystem 二作 · Agent Skills @ ACM CAIS 2026跨语言分析公开智能体技能生态的安全性,揭示单语言检测器难以发现的跨语言混淆。解读

开源项目与创业

  • AEGIS — AI 智能体运行时安全层:防篡改审计记录、人工审批、紧急停止开关,零代码改动接入。aegistraces.com · USC Viterbi 新闻报道
  • Sovereign-OS — 宪章治理的 AI 编排系统:一份 YAML 宪章定义使命、预算与规则。
  • Serica — 入境中国旅行平台,用 AI 生成行程,把海外对中国的好奇变成真实可预订的旅行。
  • BrewNet — 帮人做职业"暖引荐"的 AI 智能体(开发中)。

实习经历

  • Topify.AI · Forward Deployed Engineer · 2025.11 – 2026.01 — 设计并部署自主 GEO/SEO 多智能体系统(LangGraph、Inngest、Claude API)。
  • 京东 · 推荐算法工程师 · 北京 · 2024.12 – 2025.02 — 参与生成式推荐框架(语义 ID 检索),用 Qwen-VL 与 QFormer 增强语义特征。
  • Optiver · 算法工程师 · 上海 · 2023.12 – 2024.02 — 将 LSTM 波动率模型移植到 C++/LibTorch + CUDA,推理延迟降低 70%(5 ms → 1.5 ms)。
  • 欢动科技(Enjoymi Games) · 软件工程师 · 上海 · 2023.08 – 2023.10 — 维护两款手游的核心 SDK(登录、支付、渠道接入)。

荣誉与学术服务

  • 国家奖学金(2023)
  • 中国大学生程序设计竞赛(CCPC)金奖(2024)、银奖(2023)
  • 中国国际大学生创新大赛("互联网+")二等奖
  • University Physics Competition 银奖(2023);美国大学生数学建模竞赛(MCM)Honorable Mention(2023)
  • Memory Genesis 竞赛 Public Value Award(Evermind Hackathon,2026)
  • AEGIS 入选 USC Fortis Lab 获 NVIDIA Academic Grant Program 资助的开源项目(2026);AEGIS 与 Sovereign-OS 为 Amazon Research Award(AI 审计与智能体安全方向)所列项目
  • ICML 2026、EMNLP 2026 审稿人

常见问题

袁傲杰是谁?

袁傲杰(英文名 Aojie Justin Yuan)是南加州大学计算机工程荣誉硕士在读、USC Fortis Lab 研究成员,导师为 Yue Zhao;本科毕业于上海交通大学。他研究 AI 智能体安全、大模型推理与世界模型,2026 年发表 15 篇论文,并开发了开源项目 AEGIS 与 Sovereign-OS。

他的研究方向是什么?

AI 智能体安全(审计、执行前防火墙、多用户智能体网络安全)、大模型推理与可解释性,以及世界模型;目标是让大模型足够可靠,能被托付真实世界的资源。

AEGIS 是什么?

由袁傲杰主导的开源 AI 智能体执行前防火墙与审计层,在工具调用执行前放行、拦截或交由人工审批,并留下签名、哈希链的防篡改审计记录。USC Viterbi 官方新闻(2026 年 8 月)报道了该项目。

如何联系?

邮箱 [email protected]。