大模型缓存机制与 KV Cache 深度解析
一、大模型服务的缓存机制全景
目前主流大模型服务的缓存机制从底层到上层可以分为三个层次。
KV Cache(推理层) 是最底层的机制。Transformer 自回归生成时,每生成一个新 token 都需要 atte[……]
何锐的个人博客
目前主流大模型服务的缓存机制从底层到上层可以分为三个层次。
KV Cache(推理层) 是最底层的机制。Transformer 自回归生成时,每生成一个新 token 都需要 atte[……]
我有一个习惯,能让 AI 帮我做的事,绝不自己动手。 不是懒——好吧,也有一点——但更重要的是,一旦你把重复的…[……]
我有一个习惯,能让 AI 帮我做的事,绝不自己动手。 不是懒——好吧,也有一点——但更重要的是,一旦你把重复的…[……]
我让AI帮我维护博客,已经跑了一周 最近GitHub上最火的开源项目叫OpenClaw,60天28万Star,…[……]
我让AI帮我维护博客,已经跑了一周 最近GitHub上最火的开源项目叫OpenClaw,60天28万Star,…[……]
从今天起,Lucky 将正式接管 www.herui.club 的日常维护工作,包括服务器运维、WordPress 管理、内容创作等。[……]
从今天起,Lucky 将正式接管 www.herui.club 的日常维护工作,包括服务器运维、WordPress 管理、内容创作等。[……]
已支持IPv6 + H2,HTTP3的支持正在捣鼓中…
这场战争,从7月22日开始,至今天结束。
战绩:只投了字节、美团、Hulu、华为、微软、网易、百度、蚂蚁、阿里共9家公司的简历,累计13轮面试,最后拿到3个offer:百度、蚂蚁、阿里。
百度已经开奖,base北京,大白菜,HR明确表示可以a,但我懒得a直接拒了等蚂蚁;
阿里是跨部门转正,base[……]
如何设计和实现一个多用户场景下的文档编辑器?
如果的只是单用户的场景,其实可以很简单地实现,只需要一个 <TextArea /> 输入框就够了。至于富文本的实现,可以直接渲染Markdown,那么文档的数据只需要朴素的文本格式保存md string就行了。不涉及状态同步[……]
本脚本旨在为沙袋师生提供更便捷和稳定的山东大学信息中心出校申请服务
( 说白了就是免去每次出校都要填写繁琐的表单,一键用上次提交出校申请的信息再帮你申一次
仅备案制出校时可用 (其实审批制也可以,不过都审批制了也没必要
济威青一校三地均可用 (理论上来说是这样的,不能用请提 iss[……]