Recruiter brief/招聘摘要

邱文昱:LLM 評估與 AI 研究職位摘要

用 60 秒掌握我能負責的研究工程工作、相關證據,以及可任職時間。

Wenyu Chiou 於 AGU 2025 發表耦合人類與洪災調適模型海報。
於紐奧良舉行的 AGU 2025 發表人類—洪災耦合模型研究。

01

60 秒職位匹配摘要

我的主要定位是 LLM Evaluation 與 AI Research Engineer,專注檢驗模型決策是否符合實測人類行為。我也建構受治理的代理系統與行為模擬,讓決策輸入、失敗、修正與後續影響都能被檢視。

02

我能負責的工作

  1. 01

    以人類行為為基礎的 LLM 評估

    設計能檢視次群體差異與重複執行穩定性的評估,將生成決策與實測行為證據比較,並清楚說明效度邊界。

  2. 02

    受治理的代理工作流

    定義結構化輸出、確定性驗證器、針對性修正與稽核軌跡,避免模型提案在通過檢查前改變系統狀態。

  3. 03

    行為模擬與 AI for Science

    把個別決策連結到代理人基與耦合模擬,檢驗環境、財務與制度層面的後續影響。

03

實作證據

三個專案分別呈現評估、治理與模擬能力,並直接標示公開狀態。

01

撰寫中

以人類行為證據為基礎的 LLM 評估

問題
比較 LLM 生成決策與實測人類路徑在各社會群體間的差異。
我的角色
我設計人類與模型的比較架構、社會群體分析視角,以及重複執行的穩定性檢查。
可驗證能力
評估設計 · 心理計量與結構方程式模型 · 穩定性分析
公開狀態
研究準備中;只使用公開說明與合成範例。
02

研究原型 · 已封存

FLOODABM

問題
將家戶調適行為與洪災損害、保險及財務風險連結。
我的角色
我建構家戶決策模型,並將調適選擇連結到巨災、保險與財務機制。
可驗證能力
代理人基模型 · 耦合模擬 · 風險系統
公開狀態
WRR 文章、AGU 海報與程式庫已公開;本案例的分析手稿仍在修訂中。
03

開發中 · 準備釋出

WAGF

問題
在耦合模擬更新前,檢查並修正代理決策。
我的角色
我設計驗證與修正流程,在模擬狀態改變前檢查代理提出的行動。
可驗證能力
結構化輸出 · 限制驗證 · 可稽核修正
公開狀態
框架準備中;以下軌跡為合成示意。

04

可驗證的技術匹配

以下工具與方法來自我的研究、開源工作與實際開發流程。

程式與研究工程
Python · R · MATLAB · pytest/CI · Git
LLM 與代理系統
LLM APIs · LangChain · Ollama · 模型上下文協定(Model Context Protocol, MCP) · 檢索增強生成(Retrieval-Augmented Generation, RAG) · 代理記憶 · 工具使用 · Agent Skills · 外掛架構 · 多代理工作流
AI 工程工具
OpenAI Codex · Claude Code · AI coding agents
建模與推論
結構方程模型(Structural Equation Modeling, SEM) · 貝葉斯校準 · 代理人基礎模型(Agent-Based Modeling, ABM) · 水文建模(Hydrological Modeling) · 社會水文建模(Sociohydrological Modeling)

05

可任職時間與工作授權

  • 開放申請 2027 年暑期實習
  • 預計 2027 年 12 月取得博士學位
  • F-1 學生身分;實習可使用 CPT
  • 畢業後可洽談全職機會

06

詢問作品集

可直接從招聘問題開始;網站會先顯示本機證據,並可能透過 NVIDIA 導向具引用依據的頁面。

07

履歷與聯絡方式

若職缺涉及 LLM 評估、AI 研究、代理系統或 AI for Science,請使用 Email 或 LinkedIn 聯絡。英文業界履歷是最精簡的完整紀錄。