skills系列(二):skills团队和opencode-omo

由于codex至今不支持subagent,我实在等不及了,用codex开发确实没那么灵光,先用claude code组建团队,反正逻辑是一致的。这里附上一条codex不询问命令的指令: # 尽量别问我(读写不问,删除之类的问) codex -s workspace-write -a never claude --allowedTools "Read" "Edit" 什么都不问 codex –yolo claude –dangerously-skip-permissions ...

January 22, 2026 · 3 min

agent系列(一):实用的agent架构、应用、评估和未来

0. 数模最基础的抽象是:环境有状态s_{t}​,你能看到的是观测o_{t},你做动作a_{t}​,环境给反馈(比如奖励/成功信号)并转移到新状态。用 (PO)MDP 写就是: ...

January 18, 2026 · 15 min

paper2proj:DeepCode在模态转换之间的编排

1. 概述DeepCode的工作是将科学论文转化为可执行代码,它提炼出来的问题包括: Specification Preservation(规范保留): 论文中的信息分散且多模态,难以忠实地将这些片段化的规范映射到实现中。 Global Consistency under Partial Views(局部视角下的全局一致性): 代码库由相互依赖的模块组成,但生成通常是逐文件进行的,在有限上下文下难以维护接口、类型和不变量的全局一致性。 ...

January 15, 2026 · 12 min

skills系列:(一)coding未来的管中窥豹

0. 现有的就是最好的由于claude code的Opus和sonnet过于昂贵,其实codex也能用skills,这里推荐用codex的skills,只需要把https://github.com/obra/superpowers/tree/main/skills 里所有的文件夹搬到.codex的skills文件夹里即可。很多人吹嘘skills是什么黑科技,在我看来其实就是两个思路交错产生的结果: ...

January 9, 2026 · 9 min

github源码阅读:(二)OpenCode Code agent

项目介绍什么是 OpenCodeOpenCode 是一个 100% 开源的code agent,专注于为开发者提供强大、灵活且可扩展的 AI 编程体验。与 Cursor、Copilot 等商业工具不同,OpenCode 不绑定任何特定的 LLM 提供商,支持 Claude、OpenAI、Google、本地模型等多种提供商。 ...

January 2, 2026 · 5 min

github源码阅读:(一)LlamaIndex 上下文数据规范

概述LlamaIndex(原名 GPT Index)是一个开源的数据框架,专门用于构建大语言模型(LLM)应用。它解决了 LLM 的一个核心局限性:LLM 在训练后就无法访问私有数据。LlamaIndex 通过检索增强生成(RAG)技术,将用户的私有数据与 LLM 的生成能力无缝连接。与langchain相比,langchian是编排工具流工作流等,而llamaindex专注于数据格式和数据索引。 ...

December 31, 2025 · 10 min

算法 —— 基础篇:DP

题单来自于:【算法进阶题单】动态规划、数据结构、图论、数学、字符串、计算几何、博弈 状态机DP 时间序列max和mini的 121. 买卖股票的最佳时机 122. 买卖股票的最佳时机 II(有神中神dp) PD就要看买卖股票的最佳时机【基础算法精讲 21】 既然有次数限制,就要在遍历的过程中记录次数

December 29, 2025 · 1 min

基本操作:(一)github is all you need

码农圣地 githubgithub众所周知,是最大的同性交友网站开源项目公布网站,每个人都可以在这里share自己的项目。 由于open-source往往由一个团队进行开发,所有有很多开发版本,为了管理不同的开发版本之间的异同,远古linux大神linus写了git的原型来管理不同的fork。每个opensource都有一条master主线,然后有不同的分支合并到master分支上。由此也看出,git最主要的功能就是派生(fork)、合并(merge)。 这里我不想重复造轮子,请直接观看我觉得非常棒的讲解。 issues和PR把 GitHub 想成一个研发团队的工单系统: Issue 像工单 / 任务卡,比如: 这个 bug 要修 这个功能要加 这个文档要补 这个体验要优化 PR 像交付单 / 审核单,比如: 我已经写完了 请大家 review 一下 没问题就把代码合进去 常见的过程就是Issue 提出问题 → 开分支开发 → 提交代码 → 创建 PR → PR 合并后,Issue 关闭。 ...

December 22, 2025 · 5 min

Codex 和 CC —— terminal vibe coding tutorial

这篇文章记录我熟悉的codex和claude code的常用方式,若有更好的方法欢迎联系我。 安装其实无论是在哪个终端安装都可以,无非是权限的问题,在wsl或者git bash中是最好的,但是我习惯在Window的terminal安装了,直接安装即可,问题不大。 ...

December 18, 2025 · 9 min

大佬博客 —— Orz

旨在排列出看过或者没看过收集的高质量博客 苏神地址:科学空间 高代从一个单位向量变换到另一个单位向量的正交矩阵 “对角+低秩”三角阵的高效求逆方法 矩阵的有效秩(Effective Rank) 低秩近似之路(一):伪逆 低秩近似之路(二):SVD 低秩近似之路(三):CR 低秩近似之路(四):ID 低秩近似之路(五):CUR Monarch矩阵:计算高效的稀疏型矩阵分解 随机矩阵的谱范数的快速估计 概率与统计从重参数的角度看离散概率分布的构建 通向概率分布之路:盘点Softmax及其替代品 概率视角下的线性模型:逻辑回归有解析解吗? 两个多元正态分布的KL散度、巴氏距离和W距离 如何度量数据的稀疏程度? 从局部到全局:语义相似度的测地线距离 让人惊叹的Johnson-Lindenstrauss引理:理论篇 让人惊叹的Johnson-Lindenstrauss引理:应用篇 从JL引理看熵不变性Attention 从熵不变性看Attention的Scale操作 熵不变性Softmax的一个快速推导 从梯度最大化看Attention的Scale操作 随机分词浅探:从Viterbi Decoding到Viterbi Sampling 随机分词再探:从Viterbi Sampling到完美采样算法 ...

December 11, 2025 · 10 min

context engine note

Context Manager多模态数据的处理现在大模型系统的对话窗口和处理数据会产生大量的上下文,后续的qa往往会用到其中一部分上下文,所以建立有效的context engine是十分必要的。 NLP用时问戳标记上下文 一种常见的设计是在每条信息上附加时间戳,以保留其生成的顺序。这种方法由于简单且维护成本低,在聊天机器人和用户活动监控中广受欢迎。然而,该方法存在若干局限性。尽管时间戳能够保持时间顺序,但它们不提供语义结构,使得捕捉长程依赖关系或高效检索相关信息变得困难。随着交互数据的累积,序列呈线性增长,导致在存储和推理方面均面临可扩展性问题 ...

December 2, 2025 · 16 min

LLM 系统架构 note

LLM目前最大的困难来自于预训练使用的语料是足够多的且推理能力是足够强的,但是如何在问答中交互使其自回归输出得到一个很好的结果是很困难的,这就是agent出现的原因 核心矛盾点训练的时候往往在一个静态的环境,但是推理环境往往是动态的,动态和静态会让系统产生意料之外的输出 在CoT中,一旦传入一个错误事实,就会层层放大 Scaling Law,但模型上下文还是不够长 模型参数是固定的,无法进步 大模型的开销太贵了 推理的结构从静态链演变到动态链: AdaPlanner:允许大模型在计划外执行的时候进行停止,然后重新规划 ADaPT:connect让executor LLM直接执行任务,若不能执行就调用planner LLM进行任务分解再进行executor LLM ...

December 1, 2025 · 10 min