HELLO, I’M BINYTWO

这里是 BinyTwo 的
个人数字实验室。

我主要使用 Python 和 Vue 3 / TypeScript 做全栈开发,负责过真实项目中的数据采集子系统与业务前端交付。我持续完善采集系统的业务模型、任务调度与执行机制,并在此基础上探索 Agent 编排与可追溯知识问答。

这里记录我的项目、技术选择,以及在实现与迭代中逐渐形成的理解。

THREE PROJECTS. ONE JOURNEY.
B.BINYTWO
01 / COLLECTION / PLATFORM

将任务创建、调度与结果回看,组织成完整的采集过程。

从真实问题出发,在实践中持续生长。BUILD. UNDERSTAND. ITERATE.看看项目如何演进 ↓

01 / EVOLUTION & CAPABILITIES

我的技术,
如何在项目中长出来。

从城市积水信息采集出发,逐步解决多平台执行、任务管理与结果追踪的问题,再向反馈驱动的调查和有依据的问答延伸。

NEXT / 后续规划连接调查与知识

让 Agent 检索已有知识与历史记录,为下一步调查提供依据;新结果保留来源,供后续检索与复用。

规划中 · 尚未联合接入
01 / IN PRACTICE

多源采集工作台

独立负责多源采集系统的设计与持续演进,与 AI 协作完成实现、联调和改进。围绕微博与抖音的采集需求,提炼跨平台流程并划分服务职责。

Vue 3 / TypeScript
将手动任务、调度计划与采集内容组织为可操作页面,连接参数选择、状态反馈和结果回看,让用户在统一工作台中完成采集与追溯。
Python / FastAPI
承接任务创建、状态查询与调度管理,通过明确的接口连接控制中心、采集引擎、来源网关和凭据服务,协调任务受理与异步执行。
Scrapy / Twisted
在独立 Worker 中推进搜索、分页与必要补全,通过平台适配处理请求和解析差异,经 Pipeline 保存内容,并记录处理进度与结束原因。
PostgreSQL / SQLAlchemy
各服务维护自己的数据与事务边界,持久保存任务、内容、任务观察关系和运行记录,为页面刷新、结果回看与来源追溯提供依据。
DDD / 服务边界
用领域模型表达任务与内容的业务规则,在服务内部区分应用编排与数据访问,并明确控制调度、采集执行、来源访问和凭据管理的职责。
Outbox / Inbox
将命令或执行事实与业务变更在同一事务中保存,由接收端去重确认,支持有界重投和投递状态追踪,为服务间的异常交接保留排查依据。
HTTP / WebSocket
通过 HTTP 完成来源访问、服务间交接与页面查询;WebSocket 通知任务数据变化,页面再读取最新记录,刷新后也可重新取得已保存结果。
贯穿项目的工程基础
LinuxDockerGit测试与联调

02 / PROJECTS / SELECTED WORK

让采集有反馈,
让回答有来源。

从真实业务的数据采集出发,向两个方向延伸:让 Agent 根据反馈提出下一步,让知识与运行问答给出可核对的来源。这里展示它们如何工作,以及目前推进到了哪里。

01

COLLECTION / PLATFORM

多源采集工作台

从一次关键词搜索,到可管理、可追溯的采集过程。

起源于城市积水信息获取需求,现已整理为独立工作台。使用者可以按关键词采集微博、抖音内容,创建单次任务或设置调度计划,再集中检索内容、回看执行与关联记录。

我的工作

独立负责多源采集系统的设计与持续演进,与 AI 协作完成实现、联调和改进。围绕微博与抖音的采集需求,提炼跨平台流程并划分服务职责。

01

跨平台采集抽象

复用采集与保存流程,将平台请求、解析和补全差异留在适配层。

02

领域建模与服务边界

约束任务生命周期,分开调度、执行、来源访问和凭据管理。

03

异步执行与可靠交接

持久记录命令与执行事实,中途失败时仍保留已保存的成果。

ABOUT / A WORK IN PROGRESS

在实践中理解,
在迭代中走得更远。

我从真实业务中的数据采集与前端交付出发,逐渐把关注点扩展到系统运行、Agent 编排 与可追溯知识问答。

这些项目由我主导,与 AI 深度协作完成。我持续通过源码追踪、修改和验证,把项目经验转化为自己的能力。

CONTACT

联系方式

B.
吴易佳 · BinyTwo
发送邮件