codedump的电报频道
описание
发布个人博客(主页 codedump.info)、想法、推荐等。RSS订阅地址:https://rsshub.app/telegram/channel/codedump_notes,过往汇总搜索可以到:https://app.shokichan.com/c/tg/codedump_notes。
5 410
подписчиков
Охват к подписчикам
38,5%
ERR
Реакции к просмотрам
0,33%
163 на 23 постов
Пересылки к просмотрам
1,00%
498
Постов в день
0,4
всего 24
Где отзываются чаще
доля реакций к просмотрам- 14 авг.我非常遗憾现在的出版业成了量产这类垃圾内容的助推者。 反观我认真写作一年多的作品,问了好几个原先认为还有些品味的出版社,无人问津。1,82%
- 13 июл.#投资 #人工智能 十年过去了,更新了知乎问题“2016 年你买过的最物有所值的东西是什么?”的回答。1,44%
- 11 авг.#开源项目 #人工智能 我正在做的一个开源项目docq:一个基于本地文档的问答引擎。 考虑这样的场景:在本地目录积累了很多私人文档,突然想起来某个问题,又不知道具体在哪个文件(甚至可能是需要结合多个文件)和答案。这时候就可以利用这个本地文档问答引擎来提问。也就是说,这个本地问答引擎,可以基于本地的一大堆文件,提出问题并且得到回答。 市面上有类似的产品吗?比如anythingLLM,它是将一个特定的文档拖到它的UI界面再进行提问,也就是说,此时要求用户清楚知道答案在哪个文档里面再进行提问;再比如开源的 qmd,它更像是一个“语义搜索版本的 grep”,提供的是搜索功能,而不是回答。 除此以外,这个产品是完全离线的,第一次使用时会把需要用到的embedding、reranker、推理模型下载下来,绝不上传用户的文档到云端,保证安全和隐私。默认采用的几类模型是:embedding(Xenova/bge-small-zh-v1.5)、reranker(BAAI/bge-reranker-base)、LLM(Qwen/Qwen2.5-3B-Instruct-GGUF)。 现在我的第一步的 poc 已经跑通,我将我博客上的共识算法和系统模型这两个章节的 markdown 文档放在同一个目录(加起来一共几万字),然后提出了一个问题:“multi paxos 相比 paxos 有哪些改进点”,回答的质量还不错,耗时有点多,花了将近 40 秒才完成回答(不过,里面有相当时间耗费在了加载模型上),我的机器配置是 Mac M1 Max 的 CPU、64GB 内存。0,82%
- 24 июл.#人工智能 《Clean Code for AI Agents》 这篇文章讨论了在2026年,当代码的主要读者从人类程序员转变为AI代理(如Claude Code、Cursor等)时,《Clean Code》原则需要如何重新排序和调整。 AI代理有独特的技术约束——上下文窗口有限、文件截断、依赖grep导航、每次工具调用都消耗token和延迟。因此,传统的代码整洁原则需要按新的优先级重新整理: 最重要的原则:小函数和小文件(适配代理的一次性读取)、单一职责(方便隔离推理)、独特有意义的命名(grep友好)、带原因和背景的注释(代理爱读注释,且不应被删掉)、显式类型(避免类型推断错误)、DRY(防止代理漏改重复代码)、可无头运行的测试(TDD成为技术义务)。0,69%
- 28 июл.#人工智能 传统的软件行业,是有“边际效益”的:成本主要集中在软件开发期内,开发完毕之后,同一份软件给一个人用和给一万个人用,成本差不多。当然,如果是互联网行业的软件,多一个用户会多一些带宽和存储成本,但是总体而言,多出来用户之后的成本可以认为是满足边际效应的。 但是如今大模型领域则不是这样。姑且把大模型领域分为训练和推理两个阶段,前期花费大量成本训练模型完毕了还不算,模型部署上线后,推理的成本是实打实的:多一个用户的请求,就多一份不能被忽略的推理成本。 从这个意义上来说,就现阶段而言,模型推理服务(Model As A Service,MAAS)其实更像是制造业。区别在于:传统制造业,原材料和产出物,都是实体;而模型服务,输入和输出,是虚拟的数字物件token。0,60%
- 27 июл.#数据库 PGSimCity - PostgreSQL 工作原理可视化解析 PGSimCity 是一个 PostgreSQL 数据库引擎的 3D 可视化模拟工具,将数据库内部机制映射为一座虚拟城市,便于用户理解。它展示如 TPS、缓存命中率、WAL 流量等关键指标,并允许用户自定义事务频率、读写比例等参数,模拟数据库性能变化。用户可通过回放控制、交互建筑和预设场景(如检查点风暴、缓存激冷等)深入观察 PostgreSQL 的内部运作,包括缓冲池、检查点进程、自动清理与复制机制。该项目主要用于教学与原理展示,参考了大量权威资源,包含一个 4 分钟的引导教程,目前仍为早期原型。0,49%
- 10 июл.#杂 《长10乙回收成功:美国人做了和没做的事,我们都要做》,光看视频就觉得很帅了。0,44%
- 27 июл.#数学 周末看了两个科普挂谷猜想的视频:李永乐老师的《挂谷猜想究竟是什么》,《一口气看懂王虹获菲尔茨奖》,个人觉得后者更好,有动画解释。勉强看懂了一些二维空间下的解释。 另外,也是从这个视频里,知道了豪斯多夫维数 。我们经常说的二维空间、三维空间指的是拓扑维度或者几何维度,这些维度都是自然数。而拓扑维度在描述分形的时候就遇到了困难,于是引入了这个豪斯多夫维数,它并不像拓扑维度一样总是自然数,而可能是非整数的有理数或者无理数。具体可以看上面第二个视频的解释。0,33%
- 23 июл.#数学 《菲尔兹奖没有意外!两位中国籍数学家创造历史》 中国籍数学家邓煜、王虹同时获得2026年菲尔茨奖。(以前在频道里提到过王虹,履历不算是一个数学天才型选手,非数学竞赛生出身) 和丘成桐、陶哲轩两位曾经获得菲尔茨奖的数学家不同的是,这两位一直到本科阶段,接受的都是中国大陆的教育。某种程度上,我认为他们的得奖是大陆基础教育的胜利。0,32%
- 3 авг.#分布式 #图解分布式系统原理 《图解分布式系统原理》在小报童上线,本系列的完整初稿全部在本人博客公开。 付费专栏提供的是排版后的精美pdf版本的下载,在pdf版本中:润色了文字,对比博客初稿多出了前言、目录、参考文献。 选择小报童的原因是因为跟微信强绑定,对国内的读者而言相对友好。附件提供了pdf版本的样章,有兴趣的读者可以看看。0,23%
- 1 авг.#播客 #人工智能 #AIInfra 《对游凯超3小时访谈》 《深度对谈 vLLM 团队:如何从零搭建一个成功的开源生态》 这两个播客质量不一,前者更好更专业,后者由于出自真格基金,主持人的提问和思考跟不上。时间如果有限,听第一个即可。0,23%
- 30 июл.#分布式 #数据库 《Bigtable 二十年:架构的不变与变》0,19%