日期档案
< >

菲比 站点数据

文章 13 总阅读 6778 总点赞 742 总点踩 54 总评论 19
  • 图的最短路径都会写,那么最长路径呢?

    最短路径是最经典的必学图论问题。Dijkstra 处理非负权图,Bellman-Ford 可以处理负权边,还能发现负权环。学到这里,很自然会冒出一个问题:既然有最短路径,那有没有最长路径?如果有,能不能把松弛操作里的 min 换成 max ,把最短路径算法改一改就用? 这个问题表面上很对称,实际并不对称。最长路径不是一个“最短路径的反向版本”,而是会逼着我们重新确认“路径”到底允许什么、环怎么处理、答案是否一定有限。 最短路、path 和 walk 在最短路径里,我们通常想找从 \(s\) 到 \(t\)
  • 听 AI 建议涨粉,一夜丢了 98% 推荐流量

    我用 AI 最多的地方是出方案,技术选型、架构怎么拆、这条路走不走得通。代码写错了有编译器兜着、有测试兜着,当场露馅;方案那层什么都没有,听着一般都合理,后果过几周才浮出来,等浮出来已经照着它写了几万行。 所以我想找个反馈快的方案样本。公众号涨粉刚好符合,听着合理、当场没法验证、48 小时见分晓,这号还输得起。 18 号中午我问 AI,一个技术号除了写好内容还能做什么。它说去同领域账号下面活跃起来,多关注多评论,让你的名字在目标读者眼前反复出现。 这话有问题吗?我看不出来,任何一本增长书里都这么写。午休不
  • 拆解 DeepSeek Harness:Profile 与 Bundle 如何装配运行时

    前一篇讨论 Cordis 插件架构「解读 Cordis:dsh 一切皆插件背后的运行时设计」时,我们看到 dsh 把工具、模型适配器、会话、Agent Loop 等运行时能力拆成了插件。这样一来,运行时中的各个组件可以独立地完成注册、替换和退出。 但组件拆开了,得解决外层的组装问题: 一次启动到底要加载哪些插件,以及按照什么顺序把它们组合起来? Web 模式要用到 Web Server、前端静态资源、API Gateway 和浏览器侧插件;如果以 Headless 模式执行单次任务,则不需要加载这些 We
  • 向量检索:Embedding模型与Rerank模型解析

    在检索增强生成(RAG)系统中,如何从海量知识库中快速准确地找到与用户问题最相关的信息,是决定整个系统性能的关键环节。向量检索技术,特别是Embedding模型和Rerank模型的协同工作,构成了现代RAG系统的核心检索架构。 📌 向量检索:RAG系统的信息入口 什么是向量检索? 向量检索是RAG系统的第一步,负责从大规模知识库中快速定位相关文档。它的核心思想是将文本转化为数学向量,通过计算向量间的距离来衡量文本的语义相似度。 用户问题 → Embedding模型 → 问题向量 ↓ 【相似度计算】 ↓ 知
  • 线性筛积性函数学习笔记

    线性筛积性函数学习笔记 以求解下面这个问题为例,对于任给的n,请求出下列式子的结果,1<=n<=1e7 \[\sum_{i=1}^{n}\sum_{j=1}^{n} (-1)^{d(i\cdot j)} \] const int N=1e7+5,MOD=998244353; int f[N],K[N],vis[N]; vi pm; /* 要计算ΣΣ(-1)^(d(i*j)) d(n)只有在n为完全平方数时才会是奇数 令n=x*(y*y),x不含任何平方因子(1除外) 则d(i*j)为奇数当且仅当i=x*(
  • 向量库不再囤数据:Milvus 3.0 零拷贝直读数据湖

    做 RAG 的人大概都经历过这么个流程:数据在 S3 上的 Parquet 文件里躺着,你得先把它读出来,跑一遍 Embedding 模型,再把向量写进 Milvus。原始数据一份,向量数据又一份。数据湖一份,向量库一份。 然后问题就来了。数据更新了怎么办?向量过期了怎么办?两份数据怎么同步?半夜跑批的 ETL 管道挂了谁来兜底? Milvus 3.0 给的答案是: 别复制了,我直接读你的数据湖。 这就是它说的 lake-native 架构。核心能力叫 External Collections——在你的
  • DOTNET 鉴权系列- JWT 会话撤销与主动登出

    写这篇的主要原因是记录一下jwt无状态特点下的主动撤销和登出的解决方案,因为之前负责做过类似的用户相关的系统,对于这一块的方案和实现比较粗糙的,登录成功后,计算完整 JWT 字符串的 Hash,将 tokenHash + userId 存入Redis,每次鉴权时计算请求 Token 的 Hash,去存储中比对是否存在,这套方案虽然实现了登出撤销,但把所有有效 Token 全部落地存储,JWT 只剩下签名验签的能力,几乎退化成传统 Session 模式,丢失了 JWT 无状态的设计初衷。 最近特意看了下这一
  • 【手搓 Agent 第2.2关】搭建 Agent 进阶能力:网络搜索工具(下)

    承接中篇的智能纠错与熔断机制,我们已经让 Agent 拥有了工具故障自主处理能力,但原生手写爬虫的不稳定性,始终无法支撑真实业务落地。想要实现稳定、高效、可持续的联网检索能力,必须替换专业的生产级解决方案。 本篇我们彻底重构搜索工具,替换秘塔AI商用搜索API,实现标准化、高可用的联网检索能力,解决原生爬虫反爬、解析失败、数据杂乱的痛点。同时针对大模型“迭代式检索成瘾、无限调用工具”的行业通病,新增提示词软约束+次数硬熔断双机制,精准管控工具调用频次,兼顾检索效果与资源成本,完成工业级搜索工具最终落地。
  • 组合计数

    \(0.0\) 前言 本文完成仓促,必然存在一些错误,希望读者阅读时多加思考,指出疑问和错误。 文章简述了组合数学的理论性内容,仅仅作为兴趣引入和入门学习,作者很菜,比不上数学大手子,请轻点喷。 \(1.0\) 排列组合基础 \(1.1\) 加法原理、乘法原理 对于事件 \(A\) ,有 \(n\) 个解决方案,每个方案有数量 \(a_1,a_2,a_3……a_n\) 对于解决事件 \(A\) 的总方案,有 \[\sum_{i=1}^{n}{a_i} \] 上述计算方法称为加法原理。 对于事件 \(A\)
  • 为什么越来越多人用AgentScope ?

    前言 Java开发者如何快速构建企业级AI Agent应用 最近这段时间,AI Agent(智能体)这个概念火得一塌糊涂。从OpenClaw到Claude Code,从Manus到各种Agent框架,仿佛一夜之间,“让AI自己干活”成了技术圈最热门的话题。 但很多Java开发者在尝试入局的时候,发现了一个尴尬的问题——市面上主流的Agent框架,绝大多数是Python生态的。 LangChain?Python的。 AutoGen?Python的。 CrewAI?还是Python的。 “三哥,我们团队都是J