程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
LMCache 深度拆解:当 KV Cache 变成可复用资产——LLM 推理的「免费午餐」完整指南
编程
LMCache 深度拆解:当 KV Cache 变成可复用资产——LLM 推理的「免费午餐」完整指南
2026-07-14 18:47:11
view 259
深度拆解 LMCache 项目:从 Transformer Attention 机制出发,详细讲解 KV Cache 原理、三层存储架构、生产部署实战、Docker Compose 配置、CacheGen 压缩算法、PD 分离、跨实例 KV Cache 共享,以及与 vLLM/SGLang 的集成,配完整代码示例与性能调优指南。实测 DeepSeek 多轮对话 3~5 倍 TTFT 改善。
LMCache
KV Cache
LLM推理
vLLM
SGLang
推理优化
DeepSeek
分布式缓存
DeepSeek-V4预览版深度解析:MoE架构+百万上下文+1.6T参数,开源旗舰模型全面升级
编程
DeepSeek-V4预览版深度解析:MoE架构+百万上下文+1.6T参数,开源旗舰模型全面升级
2026-04-24 17:19:28
view 977
2026年4月24日DeepSeek发布V4预览版,总参1.6T/284B,激活49B/13B,100万Token上下文,DSA稀疏注意力,兼容OpenAI+Anthropic双协议,昇腾与寒武纪Day 0适配,深度解析其架构与API用法。
DeepSeek
V4
MoE
大模型
开源
百万上下文从「奢侈品」变「日用品」:DeepSeek V4 CSA/HCA 混合注意力架构深度解析
编程
百万上下文从「奢侈品」变「日用品」:DeepSeek V4 CSA/HCA 混合注意力架构深度解析
2026-07-21 16:47:21
view 285
深度解析 DeepSeek V4 的 CSA/HCA 混合注意力架构,涵盖压缩稀疏注意力、重度压缩注意力、流形约束超连接等核心创新,配有 Python 代码示例与工程价值判断。
DeepSeek
V4
CSA
HCA
注意力机制
MoE
KV缓存
长上下文
大模型架构
DeepSeek-R1边缘推理实战:从云端独占到本地智能的范式转移
编程
DeepSeek-R1边缘推理实战:从云端独占到本地智能的范式转移
2026-05-19 12:42:27
view 651
2026年,边缘AI不再只是云端模型的精简版。本文深入剖析DeepSeek-R1 CPU版的技术原理,从模型蒸馏、量化技术的底层原理到生产环境的完整部署方案,提供可直接落地的代码和可量化的性能数据。
DeepSeek
R1
边缘计算
AI推理
模型蒸馏
量化
llama.cpp
Ollama
端侧AI
DeepSeek-V4 深度解析:百万Token上下文与MoE架构的技术革命
编程
DeepSeek-V4 深度解析:百万Token上下文与MoE架构的技术革命
2026-04-26 08:10:21
view 924
深度解析DeepSeek-V4的技术突破:百万Token原生上下文、万亿级MoE架构、国产芯片适配。从技术原理到工程实践,全面剖析这场开源AI的革命。
DeepSeek
大模型
MoE
百万上下文
开源AI
DeepSeek V4 架构全拆解:MLA 压缩、MoE 动态路由与 1.6T 参数的工程哲学——从训练到推理的全栈重构
编程
DeepSeek V4 架构全拆解:MLA 压缩、MoE 动态路由与 1.6T 参数的工程哲学——从训练到推理的全栈重构
2026-08-03 00:13:26
view 270
深度拆解 DeepSeek V4 四大核心架构创新:MLA 16x KV Cache 压缩、MoE-Routing v2 Token级动态路由、HAAA混合注意力、antirez ds4.c推理引擎,附完整代码示例与生产部署指南
DeepSeek
MoE
MLA
KV Cache
大模型
AI推理
开源
性能优化
混合注意力
量化
稀疏注意力架构革命:2026年长上下文大模型核心技术解析
编程
稀疏注意力架构革命:2026年长上下文大模型核心技术解析
2026-07-09 08:45:09
view 457
深入解析2026年稀疏注意力技术革命,涵盖SubCube、CSA/HCA、MSA三大架构的技术原理、代码实现与实战指南,探讨长上下文大模型的最新发展。
AI
大模型
Transformer
稀疏注意力
LongContext
DeepSeek
MiniMax
DeepSeek-TUI 深度实战:Rust 打造的终端原生 AI 编程智能体——从 10K Star 爆火到生产级 Coding Agent 架构全链路解析
编程
DeepSeek-TUI 深度实战:Rust 打造的终端原生 AI 编程智能体——从 10K Star 爆火到生产级 Coding Agent 架构全链路解析
2026-05-08 11:08:11
view 1259
深度解析 DeepSeek-TUI:Rust 打造的终端原生 AI 编程智能体,16K+ Star、登顶 GitHub Trending,从架构设计到生产级实战的全链路解析
DeepSeek-TUI
Rust
AI编程
Agent
Coding
Copilot
DeepSeek V4 深度解析:DSA 稀疏注意力与 mHC 流形约束——百万上下文普惠化的技术革命(2026)
编程
DeepSeek V4 深度解析:DSA 稀疏注意力与 mHC 流形约束——百万上下文普惠化的技术革命(2026)
2026-07-04 06:44:28
view 408
2026年4月DeepSeek V4发布,开创百万上下文普惠化时代。深度解析DSA稀疏注意力、mHC流形约束、Muon优化器三大技术创新,含完整代码实战与部署指南。
DeepSeek V4
大模型
MoE
稀疏注意力
长上下文
DSA
mHC
DeepSeek-TUI 深度实战:用 Rust 打造的终端 AI 编程革命——从零构建 DeepSeek V4 驱动的智能开发环境
编程
DeepSeek-TUI 深度实战:用 Rust 打造的终端 AI 编程革命——从零构建 DeepSeek V4 驱动的智能开发环境
2026-05-22 04:22:02
view 698
深入剖析 DeepSeek-TUI 的技术架构、Rust 实现细节、核心算法,并通过完整可运行的代码示例,教你构建终端 AI 编程助手。
DeepSeek
Rust
终端AI
编程助手
TUI
Loop Engineering 完全指南:从 Prompt 设计者到循环架构师的范式跃迁——当 AI 编程进入系统设计时代(2026)
编程
Loop Engineering 完全指南:从 Prompt 设计者到循环架构师的范式跃迁——当 AI 编程进入系统设计时代(2026)
2026-07-04 14:44:21
view 548
万字深度解析 Loop Engineering:2026年AI编程新范式,从Claude Code /loop到openloop开源框架,从五种循环模式到生成器-评估器-规划器三体架构,从成本模型到生产级部署,完整技术指南。
Loop Engineering
AI编程
Claude Code
循环工程
Agent
Prompt Engineering
系统设计
Peri 深度拆解:一个 14MB 的 Rust 编程智能体如何「复刻」Claude Code——从 ACP 协议到 99% AI 生成代码的工程哲学
编程
Peri 深度拆解:一个 14MB 的 Rust 编程智能体如何「复刻」Claude Code——从 ACP 协议到 99% AI 生成代码的工程哲学
2026-08-03 18:12:06
view 259
深度拆解Peri 14MB Rust编程智能体架构:ACP开放协议前端解耦、7子代理Fork模式、Ultracode动态工作流、Goal跨回合目标追踪、95-99%缓存命中率、Claude Code生态零迁移兼容,附完整安装代码与多模型配置实战指南
Peri
Rust
AI Agent
Claude Code
ACP
编程智能体
终端AI
代码生成
DeepSeek
开源
DeepSeek V4-Flash 正式版深度拆解:284B MoE 架构如何用 13B 激活参数干翻自家 1.6T 旗舰——CSA+HCA 混合压缩注意力、Muon 优化器与 Agent 能力跃迁的全栈工程哲学
编程
DeepSeek V4-Flash 正式版深度拆解:284B MoE 架构如何用 13B 激活参数干翻自家 1.6T 旗舰——CSA+HCA 混合压缩注意力、Muon 优化器与 Agent 能力跃迁的全栈工程哲学
2026-08-03 19:12:41
view 317
深度拆解DeepSeek V4-Flash 284B MoE架构:CSA+HCA混合压缩注意力机制让1M上下文KV Cache降至V3.2的7%,Muon优化器替代AdamW,Agent能力跃迁至Terminal Bench 82.7分,13B激活参数推理成本仅0.88元/530万token,附完整部署代码与性能优化实战指南
DeepSeek
V4-Flash
MoE
CSA
HCA
Muon优化器
Agent
大模型
开源
DeepSeek V4 深度解析:百万token上下文的技术革命,让开源模型站上全球之巅
编程
DeepSeek V4 深度解析:百万token上下文的技术革命,让开源模型站上全球之巅
2026-04-28 08:19:25
view 789
深度解析 DeepSeek V4:混合注意力机制、MoE 架构、100万token 上下文、Agent 能力,从技术原理到部署实战,全面剖析开源模型新天花板
DeepSeek
AI大模型
开源
长上下文
MoE
混合注意力
Agent
DwarfStar 4深度解析:Redis之父如何用500行C代码重塑本地大模型推理
编程
DwarfStar 4深度解析:Redis之父如何用500行C代码重塑本地大模型推理
2026-06-29 01:19:31
view 376
Redis创始人antirez开源项目DwarfStar 4深度解析:如何用5000行C代码为DeepSeek V4 Flash打造专用推理引擎,实现Mac上26 tok/s的本地大模型推理体验。
AI推理
本地大模型
DeepSeek
C语言
Metal
DeepSeek-TUI 深度解析:半个月狂揽 1.9 万 Star——Rust 驱动的终端 AI 编程助手,如何对标 Claude Code?
编程
DeepSeek-TUI 深度解析:半个月狂揽 1.9 万 Star——Rust 驱动的终端 AI 编程助手,如何对标 Claude Code?
2026-05-15 22:44:40
view 801
DeepSeek-TUI 由独立开发者 Hunter Bown 用 Rust 编写,半个月狂揽 1.9 万 GitHub Star。本文从架构、核心能力、竞品对比、实战 demo 四个维度深度解析这一终端 AI 编程助手。
DeepSeek-TUI
AI编程
终端Agent
Rust
Claude Code对比
TileLang + TileKernels 深度解析:DeepSeek 如何用 Python 写出让 GPU 逼近理论性能上限的 GPU 内核
编程
TileLang + TileKernels 深度解析:DeepSeek 如何用 Python 写出让 GPU 逼近理论性能上限的 GPU 内核
2026-04-28 10:55:20
view 874
深度剖析 DeepSeek 开源的 TileLang DSL 和 TileKernels GPU 内核库:从 GEMM 到 MoE,从 TVM 编译基础设施到生产级量化内核,揭示用 Python 写接近硬件极限性能 GPU 代码的秘密。
TileLang
GPU内核
DeepSeek
高性能计算
CUDA
GEMM
MoE
量化
TVM
开源项目
3.2万Star开源本地AI知识库:Open Notebook支持18家模型+播客生成+MCP集成
编程
3.2万Star开源本地AI知识库:Open Notebook支持18家模型+播客生成+MCP集成
2026-06-21 12:21:16
view 419
Open Notebook 是3.2万Star的开源本地AI知识库,Google Notebook LM替代品。支持18家AI模型切换、1-4人播客生成、RAG对话+来源标注、MCP集成、REST API。MIT协议,Docker两分钟部署,数据全在本地。
AI知识库
开源
RAG
播客
MCP
Ollama
DeepSeek
本地部署
隐私
Pathway 深度解析:Python ETL 框架的流式处理革命 —— 用 Rust 引擎吊打 Flink/Spark,构建实时 LLM Pipeline
编程
Pathway 深度解析:Python ETL 框架的流式处理革命 —— 用 Rust 引擎吊打 Flink/Spark,构建实时 LLM Pipeline
2026-05-16 03:46:12
view 706
55K+ Star,基于 Differential Dataflow 的 Rust 引擎,增量计算,内存计算,无缝集成 Python ML 生态——Pathway 正在重新定义实时流处理与 LLM Pipeline 的边界。
Python
流处理
实时分析
LLM
RAG
Pathway
ETL
开源项目
GitHub Trending
你睡觉,AI 干活:Karpathy 的 AutoResearch 如何让大模型自己学会训练自己
编程
你睡觉,AI 干活:Karpathy 的 AutoResearch 如何让大模型自己学会训练自己
2026-04-19 18:47:36
view 1070
深入解析 Andrej Karpathy 的 AutoResearch 开源项目,揭示其让 AI agent 自主修改训练代码、在真实执行中验证改进的核心机制,探讨对算法工程师职业的影响。
AI研究
机器学习
AutoML
LLM训练
Andrej Karpathy
GitHub开源
自动化调参
Python
研究效率
Agent
Scrapling 深度解析:下一代自适应 Python 爬虫框架——从反反爬到大规模并发抓取、从 Cloudflare 绕过到智能元素定位的完整技术指南(2026)
编程
Scrapling 深度解析:下一代自适应 Python 爬虫框架——从反反爬到大规模并发抓取、从 Cloudflare 绕过到智能元素定位的完整技术指南(2026)
2026-07-04 20:11:27
view 696
深度解析 Scrapling 自适应 Python 爬虫框架:从 Fetcher/StealthyFetcher/DynamicFetcher 三大抓取引擎,到自适应解析引擎的元素自愈能力,从 Cloudflare 绕过到大规模并发 Spider 框架,完整代码实战与生产级部署指南。
Scrapling
Python爬虫
自适应爬虫
反反爬
Cloudflare绕过
StealthyFetcher
Web Scraping
数据采集
Andrej Karpathy 的 CLAUDE.md 工程规范深度解析:AI 辅助编码的四大原则与生产级实践
编程
Andrej Karpathy 的 CLAUDE.md 工程规范深度解析:AI 辅助编码的四大原则与生产级实践
2026-06-30 00:42:36
view 331
深度解析 Andrej Karpathy 的 CLAUDE.md 四大原则:先思考后编码、简洁优先、精准修改、目标驱动,附带完整代码实战与生产级落地方案。
Andrej Karpathy
CLAUDE.md
AI辅助编码
提示词工程
LLM
AI Agent
系统提示
Python
Agent-reach 深度解析:给 AI Agent 装上互联网眼睛——17 平台零成本接入的工程革命与架构哲学
编程
Agent-reach 深度解析:给 AI Agent 装上互联网眼睛——17 平台零成本接入的工程革命与架构哲学
2026-06-30 04:42:42
view 723
Agent-Reach 深度解析:给 AI Agent 装上互联网眼睛,17平台零成本接入的工程革命与架构哲学
Agent-Reach
AI Agent
互联网接入
工具集成
开源项目
Python
CLI
GitHub
YouTube
Scrapling 深度实战:当爬虫学会「自适应进化」——从 StealthyFetcher 隐身引擎到自适应解析的生产级完全指南(2026)
编程
Scrapling 深度实战:当爬虫学会「自适应进化」——从 StealthyFetcher 隐身引擎到自适应解析的生产级完全指南(2026)
2026-06-11 09:21:13
view 590
Scrapling 是2026年GitHub最火的下一代Python爬虫框架,通过StealthyFetcher隐身引擎(JA3/JA4指纹伪装)和AdaptiveParser自适应解析,让Cloudflare通过率从5%提升到92%,网站改版不再导致爬虫报废。本文深度拆解架构设计、生产级实战代码、性能对比及分布式调度方案。
Scrapling
Python
爬虫
反爬虫
Cloudflare
StealthyFetcher
自适应解析
网页抓取
数据采集
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
python
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
上一页
1
...
34
35
36
37
38
...
90
下一页