程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
Headroom深度实战:当AI Agent学会「上下文减肥」——从60-95% Token压缩到零精度损失的工程完全指南(2026)
编程
Headroom深度实战:当AI Agent学会「上下文减肥」——从60-95% Token压缩到零精度损失的工程完全指南(2026)
2026-06-14 19:18:14 +0800 CST
view 509
全面拆解Headroom上下文压缩工具的原理、架构、接入方式与生产实践,解决AI Agent开发的Token成本与上下文窗口痛点
AI Agent
上下文压缩
Headroom
Token优化
LLM
Bun SIMD 深度实战:当 JavaScript 运行时拥抱 CPU 向量指令——从 Buffer.indexOf 2倍提速到 CRC32 20倍飞跃的生产级完全指南(2026)
编程
Bun SIMD 深度实战:当 JavaScript 运行时拥抱 CPU 向量指令——从 Buffer.indexOf 2倍提速到 CRC32 20倍飞跃的生产级完全指南(2026)
2026-06-08 18:28:13 +0800 CST
view 588
Bun 2026 SIMD深度实战:从Buffer.indexOf 2倍提速到CRC32 20倍飞跃,Mimalloc v3多线程内存分配,FastStringifier JSON加速,生产级迁移指南
Bun
SIMD
JavaScript
性能优化
AVX2
CRC32
Mimalloc
Headroom深度实战:AI Agent上下文压缩完全指南——60-95% Token节省的零精度损失方案(2026)
编程
Headroom深度实战:AI Agent上下文压缩完全指南——60-95% Token节省的零精度损失方案(2026)
2026-06-14 19:19:54 +0800 CST
view 531
全面拆解Headroom上下文压缩工具的原理、架构、接入方式与生产实践,解决AI Agent开发的Token成本与上下文窗口痛点
AI Agent
上下文压缩
Headroom
Token优化
LLM
Vibe-Trading 深度拆解:当 LLM 学会「炒股」——自然语言量化交易的多智能体架构与工程实践
编程
Vibe-Trading 深度拆解:当 LLM 学会「炒股」——自然语言量化交易的多智能体架构与工程实践
2026-07-15 11:45:26 +0800 CST
view 556
深度拆解港大HKUDS开源的Vibe-Trading项目:ReAct循环驱动的自然语言量化交易Agent、69个金融技能按需加载、30个多智能体Swarm团队、四大市场回测引擎、456个Alpha因子库,以及Shadow Account行为诊断功能,配完整代码示例与工程边界分析。
Vibe-Trading
LLM
量化交易
多智能体
ReAct
金融科技
HKUDS
Alpha Zoo
Shadow Account
Docs2KG:用大模型把PDF、邮件、Excel统一建成知识图谱,让企业沉睡知识激活
编程
Docs2KG:用大模型把PDF、邮件、Excel统一建成知识图谱,让企业沉睡知识激活
2026-04-16 19:04:26 +0800 CST
view 783
Docs2KG是AI4WA开源的知识图谱构建框架,用大模型将PDF、邮件、Excel等异构文档统一抽取为知识三元组,构建统一知识图谱,支持问答和推理分析。
知识图谱
AI
LLM
PDF
RAG
知识管理
开源
TurboQuant 深度实战:Google 的 KV 缓存压缩算法完全指南(2026)
编程
TurboQuant 深度实战:Google 的 KV 缓存压缩算法完全指南(2026)
2026-06-08 20:52:38 +0800 CST
view 445
2026年3月Google Research在ICLR 2026发表TurboQuant算法,将LLM的KV缓存压缩至3-bit,实现6倍内存缩减和8倍推理加速。本文深入剖析TurboQuant的技术原理,并提供生产级部署指南。
TurboQuant
KV缓存压缩
LLM推理优化
量化算法
Google Research
ICLR2026
Dolt 2.0 深度拆解:当 SQL 数据库遇上 Git——Prolly Tree、Archives 压缩与版本控制的工程哲学
编程
Dolt 2.0 深度拆解:当 SQL 数据库遇上 Git——Prolly Tree、Archives 压缩与版本控制的工程哲学
2026-08-02 07:13:28 +0800 CST
view 79
深度拆解 Dolt 2.0:Prolly Tree 如何实现 O(d) Diff、Archives 压缩如何节省 30-50% 存储、自动 GC 与自适应存储引擎的设计哲学,以及从零构建版本控制博客系统的完整实战。
Dolt
SQL
版本控制
Prolly Tree
数据库
Git
存储引擎
Archives
Dify:92K Star开源LLM应用平台,零代码构建生产级AI工作流,Docker一键部署
编程
Dify:92K Star开源LLM应用平台,零代码构建生产级AI工作流,Docker一键部署
2026-04-16 19:09:32 +0800 CST
view 1107
Dify是开源的LLM应用开发平台(92K Stars),零代码构建生产级AI应用,支持可视化工作流编排和知识库管理,服务超过2000个团队,已完成3000万美元融资。
AI
LLM
Dify
工作流
RAG
开源
知识库
可视化编排
Karpathy的AI编程心法:用一份CLAUDE.md把AI助手从「会写代码」变成「会做工程」
编程
Karpathy的AI编程心法:用一份CLAUDE.md把AI助手从「会写代码」变成「会做工程」
2026-07-03 13:12:27 +0800 CST
view 545
一份不到70行的CLAUDE.md文件在GitHub斩获14.9万Star。本文深度解析Andrej Karpathy总结的四条AI编程核心原则。
AI编程
Claude Code
LLM
软件开发
Karpathy
当 WASM 遇上 WebGPU:浏览器端 AI 推理的第三次革命——用 Web 技术重写本地智能的心智模型
编程
当 WASM 遇上 WebGPU:浏览器端 AI 推理的第三次革命——用 Web 技术重写本地智能的心智模型
2026-07-15 14:17:19 +0800 CST
view 279
深度拆解 2026 年 WebGPU、WASM 与 WebNN 融合技术:三层计算模型、WGSL 编写、GEMM 量化推理、KV Cache、算子融合,配完整代码与性能基准。
WebGPU
WASM
WebNN
浏览器AI
WGSL
端侧推理
WebLLM
前端工程化
LangChain4j:把LangChain的能力带入Java世界,一个库搞定LLM集成、RAG、Agent
编程
LangChain4j:把LangChain的能力带入Java世界,一个库搞定LLM集成、RAG、Agent
2026-04-16 19:11:21 +0800 CST
view 739
LangChain4j是Java世界的LangChain,简化Java应用集成大语言模型,支持OpenAI/Claude/DeepSeek等模型,提供RAG、Agent、Tool Calling、Memory等完整能力,Apache 2.0协议。
Java
LangChain
AI
LLM
RAG
Agent
开源
工具调用
GitHub Copilot 首次接入开源模型 Kimi K2.7 Code:从 MoE 架构到私有化部署的完整技术解析
编程
GitHub Copilot 首次接入开源模型 Kimi K2.7 Code:从 MoE 架构到私有化部署的完整技术解析
2026-07-03 14:13:50 +0800 CST
view 908
2026年7月3日,GitHub Copilot首次接入开源模型Kimi K2.7 Code。万字深度解析MoE架构、MLA注意力机制、30% Token优化技术原理、Copilot集成方案、私有化部署实战与成本分析。
Kimi K2.7 Code
GitHub Copilot
MoE
开源模型
AI编程
MoonshotAI
vLLM
模型部署
RISC-V 深度拆解:当开源指令集学会「造芯」——NVIDIA SiFive 联姻、Linux 7.2 默认支持与 NumPy RVV 优化如何重写芯片战争格局
编程
RISC-V 深度拆解:当开源指令集学会「造芯」——NVIDIA SiFive 联姻、Linux 7.2 默认支持与 NumPy RVV 优化如何重写芯片战争格局
2026-07-15 16:17:47 +0800 CST
view 520
深度拆解 2026 年 RISC-V 生态关键技术突破:NVIDIA SiFive 战略合作、Linux 7.2 默认支持国产芯片、灵睿智芯 P100 v1、RISC-V Vector 扩展优化,配完整代码实战与性能对比。
RISC-V
RV-Vector
RVV
NVIDIA
SiFive
向量计算
SIMD
LLVM向量化
NumPy
国产芯片
Linux内核
AI推理
异构计算
CLAUDE.md 完全指南(上):当 AI 学会「工程师纪律」——Karpathy 四大原则深度解析(2026)
编程
CLAUDE.md 完全指南(上):当 AI 学会「工程师纪律」——Karpathy 四大原则深度解析(2026)
2026-06-15 02:19:02 +0800 CST
view 758
2026年GitHub Trending榜首项目(149K+ Stars)深度解析(上篇):深入剖析Karpathy观察到的LLM编程四大陷阱,以及CLAUDE.md四大原则的工程哲学。
AI编程
Claude Code
LLM
工程实践
提示词工程
CLAUDE.md 完全指南(下):代码实战、定制技巧与团队协作规范(2026)
编程
CLAUDE.md 完全指南(下):代码实战、定制技巧与团队协作规范(2026)
2026-06-15 02:19:50 +0800 CST
view 491
《CLAUDE.md 完全指南》下篇:提供完整的Todo API实战案例、定制技巧、多工具适配方案(Claude Code/Cursor/Copilot)、性能实测数据、团队协作规范。
AI编程
Claude Code
LLM
工程实践
提示词工程
Unsloth 深度拆解:当 LLM 微调学会「省显存」——2倍速+70%显存节省背后的 QLoRA 工程革命
编程
Unsloth 深度拆解:当 LLM 微调学会「省显存」——2倍速+70%显存节省背后的 QLoRA 工程革命
2026-07-15 17:47:08 +0800 CST
view 208
深度拆解Unsloth技术栈:QLoRA量化原理、4-bit NF4精度机制、Triton内核重写、8-bit Adam优化器、梯度检查点优化,以及从Notebook到Ollama/vLLM生产部署的完整工程路径,含完整代码实战
Unsloth
LLM微调
QLoRA
LoRA
4-bit量化
深度学习
模型训练
编程
MarkItDown 深度解析:微软 AutoGen 团队出品的万能文档转换工具,如何让 RAG 系统真正「吃得好」
2026-04-17 09:15:57 +0800 CST
view 799
微软 AutoGen 团队出品的 MarkItDown 如何解决 RAG 系统中文档预处理的格式地狱,深度解析其架构设计、各格式处理策略与 RAG 实战集成。
Python
Tools
RAG
LLM
AutoGen
Unsloth实战:当QLoRA让27B模型在RTX 4090上跑起来——从Qwen3.5微调到Ollama部署的完整工程链
编程
Unsloth实战:当QLoRA让27B模型在RTX 4090上跑起来——从Qwen3.5微调到Ollama部署的完整工程链
2026-07-15 17:48:36 +0800 CST
view 191
深度拆解Unsloth技术栈:QLoRA量化原理、4-bit NF4精度机制、Triton内核重写、8-bit Adam优化器、梯度检查点优化,以及从Notebook到Ollama/vLLM生产部署的完整工程路径,含完整代码实战
Unsloth
LLM微调
QLoRA
LoRA
4-bit量化
深度学习
模型训练
OpenSquilla 0.4.0 深度解析:AI 编码自我验证革命——从红绿回归证据链到隔离施工、从 Token 高效路由到生产级 Coding Agent 的完整技术指南(2026)
编程
OpenSquilla 0.4.0 深度解析:AI 编码自我验证革命——从红绿回归证据链到隔离施工、从 Token 高效路由到生产级 Coding Agent 的完整技术指南(2026)
2026-07-04 02:13:02 +0800 CST
view 359
2026年6月30日OpenSquilla 0.4.0发布,核心突破是把「自我验证」塞进AI编码Agent。深度解析红绿回归证据链、隔离施工机制、Token高效微内核架构、多模型路由,含完整实战代码与生产部署指南。
OpenSquilla
AI编码
自我验证
红绿回归
Agent
TDD
微内核
多模型路由
持久化记忆
沙箱隔离
Microsoft MarkItDown 深度实战:将全格式文档转换为 LLM 友好 Markdown 的完整指南(2026)
编程
Microsoft MarkItDown 深度实战:将全格式文档转换为 LLM 友好 Markdown 的完整指南(2026)
2026-06-28 05:14:19 +0800 CST
view 362
深入解析 Microsoft MarkItDown 的架构原理、全格式转换实战、AI 集成方案及生产级部署策略。涵盖 PDF/Word/Excel/PPT 等格式转换、LLM 图像描述、RAG 知识库构建等实用场景。
Microsoft MarkItDown
文档转换
Markdown
LLM
AI 编程
RAG
Python
办公自动化
MarkItDown 深度实战:当文档转换学会了「LLM 优先」——从 15 万 Star 爆款到 RAG 预处理生产级全链路完全指南(2026)
编程
MarkItDown 深度实战:当文档转换学会了「LLM 优先」——从 15 万 Star 爆款到 RAG 预处理生产级全链路完全指南(2026)
2026-06-15 06:19:28 +0800 CST
view 542
微软 MarkItDown 15万Star深度实战:从架构解析、全格式转换、RAG预处理流水线、插件开发到生产部署的完全指南
MarkItDown
RAG
文档转换
LLM
Python
Vera 深度拆解:当编程语言学会「为LLM而生」——无变量名、强制契约、SMT证明的代码验证新范式
编程
Vera 深度拆解:当编程语言学会「为LLM而生」——无变量名、强制契约、SMT证明的代码验证新范式
2026-07-15 19:14:48 +0800 CST
view 219
深度拆解 Vera:专为 LLM 设计的编程语言,无变量名(de Bruijn 索引)、强制契约(requires/ensures)、SMT 静态证明、WebAssembly 编译目标,以及它对编程语言未来发展的深远影响。
Vera
编程语言
LLM
WebAssembly
SMT
Z3
形式化验证
合约编程
代数效果
去变量名
Open Code Review 深度拆解:阿里如何用「确定性工程 + LLM Agent」混合架构终结 AI 代码审查的三大顽疾——从 70 条静态规则到 Agent 工具调用的全链路架构哲学
编程
Open Code Review 深度拆解:阿里如何用「确定性工程 + LLM Agent」混合架构终结 AI 代码审查的三大顽疾——从 70 条静态规则到 Agent 工具调用的全链路架构哲学
2026-08-03 04:43:14 +0800 CST
view 99
深度拆解阿里开源Open Code Review混合架构:确定性工程层四机制(精准文件选择、智能分组、规则匹配、位置校准)+ LLM Agent两阶段审查(Plan+Review),附完整执行链路、CI集成配置与实测对比分析
Open Code Review
阿里开源
AI代码审查
LLM Agent
Code Review
确定性工程
AACR-Bench
GitHub开源
开发工具
CI/CD
X-CMD:给 AI Agent 装上 Shell 超能力,一句话控制你电脑上的软件
编程
X-CMD:给 AI Agent 装上 Shell 超能力,一句话控制你电脑上的软件
2026-04-17 12:55:21 +0800 CST
view 645
介绍 GitHub 开源项目 X-CMD,为 AI Agent 提供 1000+ 轻量命令行工具,一句话控制电脑软件,支持 OpenClaw/Claude Code/Gemini CLI 等。
开源
X-CMD
AI Agent
Shell
命令行工具
GitHub
自动化
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
71
72
73
74
75
...
95
下一页