程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
一个桌面工具管六个AI Agent:Claude Code、Codex、Gemini CLI全部一站式切换
编程
一个桌面工具管六个AI Agent:Claude Code、Codex、Gemini CLI全部一站式切换
2026-04-28 03:41:08 +0800 CST
view 1172
cc-Switch是跨平台桌面工具,一站式管理Claude Code、Codex、Gemini CLI、OpenCode、OpenClaw、Hermes Agent六大AI Agent。支持供应商一键切换、Skills管理、MCP服务器管理、本地路由协议转换、故障转移、用量统计。
AI Agent
工具管理
Claude Code
开发效率
开源
Kilo Code 深度实战:当开源 AI 编程助手变成全平台 Agent 工程平台——从 500+ 模型到 KiloClaw 云代理、从多模式架构到 CI/CD 全自动化的生产级完全指南(2026)
编程
Kilo Code 深度实战:当开源 AI 编程助手变成全平台 Agent 工程平台——从 500+ 模型到 KiloClaw 云代理、从多模式架构到 CI/CD 全自动化的生产级完全指南(2026)
2026-06-21 08:24:26 +0800 CST
view 853
2026年最火的开源AI编程平台Kilo Code深度实战:从多Agent架构、500+模型、自定义权限到KiloClaw托管Agent,附安装命令、自定义Agent示例与CI/CD自动修复实战。
Kilo Code
AI编程助手
Agent工程平台
开源工具
MCP
DeepSeek-TUI 深度解析:半个月狂揽 1.9 万 Star——Rust 驱动的终端 AI 编程助手,如何对标 Claude Code?
编程
DeepSeek-TUI 深度解析:半个月狂揽 1.9 万 Star——Rust 驱动的终端 AI 编程助手,如何对标 Claude Code?
2026-05-15 22:44:40 +0800 CST
view 720
DeepSeek-TUI 由独立开发者 Hunter Bown 用 Rust 编写,半个月狂揽 1.9 万 GitHub Star。本文从架构、核心能力、竞品对比、实战 demo 四个维度深度解析这一终端 AI 编程助手。
DeepSeek-TUI
AI编程
终端Agent
Rust
Claude Code对比
Superpowers 深度解析:当 AI 编程 Agent 终于学会「按规矩写代码」
编程
Superpowers 深度解析:当 AI 编程 Agent 终于学会「按规矩写代码」
2026-04-09 03:23:19 +0800 CST
view 1142
Superpowers 是一个为 AI 编程 Agent 设计的结构化技能框架,通过 14 个核心技能强制 Agent 遵循「规划→隔离→实现→验证→交付」的完整工程流程。GitHub 122K+ Stars,支持 Claude Code、Cursor、Copilot CLI 等平台。
AI编程
Agent框架
Claude Code
Cursor
软件工程
TDD
代码审查
Headroom 深度解析:给 AI Agent 装上「上下文压缩层」——从 6 种压缩算法到 CCR 可逆架构、从 KV Cache 优化到生产级部署的完整技术指南(2026)
编程
Headroom 深度解析:给 AI Agent 装上「上下文压缩层」——从 6 种压缩算法到 CCR 可逆架构、从 KV Cache 优化到生产级部署的完整技术指南(2026)
2026-07-04 17:45:34 +0800 CST
view 209
Headroom 是 2026 年 7 月 GitHub 周趋势冠军(13k+ Star),通过 6 种压缩算法 + CCR 可逆架构,为 AI Agent 节省 60-95% Token,精度保留率 97%。本文深度解析架构原理、代码实战和生产级部署。
Headroom
AI Agent
Token压缩
上下文管理
开源项目
Python
Claude Code
KV Cache
AST感知
生产部署
微软 Build 2026 全景拆解:从MAI-Thinking-1零蒸馏推理到MXC安全沙箱,Agent优先时代的七款自研模型+量子芯片深度技术指南(2026)
编程
微软 Build 2026 全景拆解:从MAI-Thinking-1零蒸馏推理到MXC安全沙箱,Agent优先时代的七款自研模型+量子芯片深度技术指南(2026)
2026-06-10 07:15:42 +0800 CST
view 552
微软Build 2026开发者大会全景技术拆解:MAI-Thinking-1稀疏MoE架构、MAI-Code-1-Flash代码生成、Scout多智能体、MXC内核级安全沙箱、Project Solara Agent Shell、Majorana 2量子芯片,从模型层到硬件层的完整分析
微软
Build 2026
MAI模型
GitHub Copilot
Agent
MXC
Project Solara
量子计算
BitNet 深度拆解:当大模型被压到 1.58 bit——从三元权重、BitLinear 到 bitnet.cpp 的端侧推理革命(2026)
编程
BitNet 深度拆解:当大模型被压到 1.58 bit——从三元权重、BitLinear 到 bitnet.cpp 的端侧推理革命(2026)
2026-07-17 14:24:55 +0800 CST
view 318
深度拆解微软 BitNet:1.58-bit 三值量化、Absmean/Absmax、BitLinear、bitnet.cpp 子矩阵内核,附 PyTorch 手写实现与 CPU 端侧推理性能实测。
BitNet
1-bit LLM
大模型推理
模型量化
端侧AI
bitnet.cpp
BitNet 深度拆解:当大模型被压到 1.58 bit——三值量化、BitLinear 与在 CPU 上跑 100B 的工程全貌(2026)
编程
BitNet 深度拆解:当大模型被压到 1.58 bit——三值量化、BitLinear 与在 CPU 上跑 100B 的工程全貌(2026)
2026-07-19 01:12:51 +0800 CST
view 248
深度拆解微软 BitNet 1-bit/1.58-bit 大模型:从三值量化数学、BitLinear 架构、BitNet.cpp 推理内核,到在 CPU 上运行 100B 模型的完整工程实战。
BitNet
1-bit LLM
三值量化
BitLinear
边缘AI
大模型推理
BitNet 1.58-bit:微软如何用三个值就让大模型在 CPU 上飞奔
编程
BitNet 1.58-bit:微软如何用三个值就让大模型在 CPU 上飞奔
2026-05-11 13:55:11 +0800 CST
view 698
微软开源BitNet 1.58-bit大模型推理框架,2B参数模型仅需0.4GB内存、29ms/token推理速度。核心创新:训练时量化、-1/0/+1三值权重、位运算加速,精度损失<5%却比INT4表现更好。纯CPU运行,71%能耗降低。
BitNet,1.58bit,微软,大模型量化,1bit LLM,CPU推理,bitnet.cpp,训练时量化,位运算加速,模型压缩
Vue 3.6 深度解析:Vapor Mode 颠覆传统与 defineModel 响应式绑定革命
编程
Vue 3.6 深度解析:Vapor Mode 颠覆传统与 defineModel 响应式绑定革命
2026-05-12 16:00:07 +0800 CST
view 492
深度解析Vue 3.6最新版本核心变化:Vapor Mode无虚拟DOM编译模式提升性能300%、defineModel正式发布简化v-model双向绑定、defineOptions宏增强、Pinia状态管理优化。含Vapor Mode原理、代码示例与性能对比实测。
Vue3.6
Vapor Mode
defineModel
无虚拟DOM
前端框架
Vue3新特性
性能优化
defineOptions
Netdata 深度拆解:当可观测性遇上 AI Native——79.6K Star 监控系统如何用机器学习革了告警的命
编程
Netdata 深度拆解:当可观测性遇上 AI Native——79.6K Star 监控系统如何用机器学习革了告警的命
2026-07-15 00:16:35 +0800 CST
view 442
深度拆解 Netdata 2026 版技术架构:AI-native 全栈可观测性、18 模型无监督异常检测、MCP 协议集成 Claude Code、零 Pipeline 分布式采集、Parent-Child 大规模集群监控,配完整生产配置代码。
Netdata
AI可观测性
ML异常检测
MCP协议
Anomaly Advisor
AI运维
零Pipeline架构
监控
1.58-bit 大模型极限量化实战:从 BitNet 三值权重到单颗 CPU 跑起 100B 模型
编程
1.58-bit 大模型极限量化实战:从 BitNet 三值权重到单颗 CPU 跑起 100B 模型
2026-07-21 16:20:29 +0800 CST
view 219
2026极限量化实战:BitNet三值权重、absmean/absmax量化、BitLinear实现、带宽数学与bitnet.cpp内核优化,单CPU跑100B模型。
BitNet
1.58-bit
大模型量化
LLM
端侧推理
bitnet.cpp
sqlite-vec 深度拆解:用 60KB 二进制把向量搜索塞进 SQLite,这个「零依赖」方案凭什么成为 AI Agent 的记忆引擎
编程
sqlite-vec 深度拆解:用 60KB 二进制把向量搜索塞进 SQLite,这个「零依赖」方案凭什么成为 AI Agent 的记忆引擎
2026-07-28 08:45:18 +0800 CST
view 150
深度拆解 sqlite-vec:60KB 二进制、零依赖的 SQLite 向量搜索扩展,从架构原理、IVF/DiskANN 索引、性能 Benchmark 到完整的 RAG 记忆系统实战代码,解析为什么 OpenClaw、Hermes、claude-mem 都选择了它。
sqlite-vec
向量搜索
SQLite
AI Agent
RAG
sqlite-vec 技术深度解析:60KB 零依赖向量搜索,OpenClaw/Hermes/claude-mem 的记忆引擎选型逻辑
编程
sqlite-vec 技术深度解析:60KB 零依赖向量搜索,OpenClaw/Hermes/claude-mem 的记忆引擎选型逻辑
2026-07-28 08:45:41 +0800 CST
view 140
深度拆解 sqlite-vec:60KB 二进制、零依赖的 SQLite 向量搜索扩展,从架构原理、IVF/DiskANN 索引、性能 Benchmark 到完整的 RAG 记忆系统实战代码,解析为什么 OpenClaw、Hermes、claude-mem 都选择了它。
sqlite-vec
向量搜索
SQLite
AI Agent
RAG
2026 LLM 推理框架深度拆解:当 vLLM 0.5 决定「让 PagedAttention 吞掉最后一块显存碎片」——从 PagedAttention 到 FlashAttention 3.0,四大推理框架如何用「算子融合 + 量化混合 + 动态批处理」重新定义大模型推理的终极形态
编程
2026 LLM 推理框架深度拆解:当 vLLM 0.5 决定「让 PagedAttention 吞掉最后一块显存碎片」——从 PagedAttention 到 FlashAttention 3.0,四大推理框架如何用「算子融合 + 量化混合 + 动态批处理」重新定义大模型推理的终极形态
2026-08-06 06:16:32 +0800 CST
view 110
深度拆解2026年四大主流LLM推理框架:vLLM 0.5 PagedAttention进化、TGI 2.0流式输出优化、TensorRT-LLM 1.8算子融合、DeepSpeed-MII 0.9自动优化,含完整架构分析、代码实战、性能基准测试与成本计算
LLM
vLLM
TensorRT-LLM
推理框架
PagedAttention
量化
GPU
H100
大模型
DeepSpeed
TGI
sqlite-vec 深度解析:零依赖的 SQLite 向量搜索扩展如何用一个 .so 文件让嵌入式数据库拥有百万级向量检索能力——从 vec0 虚拟表架构到 RAG/语义搜索生产级实战的完整指南
编程
sqlite-vec 深度解析:零依赖的 SQLite 向量搜索扩展如何用一个 .so 文件让嵌入式数据库拥有百万级向量检索能力——从 vec0 虚拟表架构到 RAG/语义搜索生产级实战的完整指南
2026-07-07 04:13:20 +0800 CST
view 392
深度解析sqlite-vec:纯C编写的零依赖SQLite向量搜索扩展,支持float/int8/binary三种向量类型、L2/cosine/hamming/jaccard四种距离度量、IVF近似搜索索引。从vec0虚拟表架构原理到Python/Go/Node.js多语言实战,涵盖RAG系统构建、FTS5混合检索、WASM浏览器运行、MCP协议集成,含完整性能基准与ChromaDB/Qdrant/Milvus对比分析。
sqlite-vec
SQLite
向量搜索
RAG
向量数据库
嵌入式
语义搜索
AI Agent
开源
LLM推理引擎深度实战:从PagedAttention到生产级部署,万字长文吃透2026年最关键的AI基础设施
编程
LLM推理引擎深度实战:从PagedAttention到生产级部署,万字长文吃透2026年最关键的AI基础设施
2026-06-27 12:44:29 +0800 CST
view 373
2026年LLM推理引擎深度实战:从PagedAttention、连续批处理、量化技术到生产级K8s部署,万字长文覆盖vLLM、SGLang、TensorRT-LLM、TGI四大框架架构原理与实测对比
LLM推理
vLLM
PagedAttention
SGLang
推理优化
TensorRT-LLM
生产部署
KV Cache
量化
KV Cache 显存优化深度解析:从 PagedAttention 到 2026 年最新压缩技术演进
编程
KV Cache 显存优化深度解析:从 PagedAttention 到 2026 年最新压缩技术演进
2026-08-01 15:47:00 +0800 CST
view 146
从第一性原理深度剖析 KV Cache 显存困境,系统拆解 PagedAttention 核心原理,对比 vLLM/TensorRT-LLM/SGLang 三大推理框架技术路线,涵盖 FP8/INT4 量化、前缀缓存、StreamingLLM 等 2026 年最新压缩技术,含完整代码示例与生产调优指南。
KV Cache
PagedAttention
vLLM
TensorRT-LLM
SGLang
LLM推理
GPU优化
显存优化
量化
深度学习
sqlite-vec 深度实战:当 SQLite 遇见向量搜索,AI 应用的轻量级记忆系统从此有了标准答案(2026)
编程
sqlite-vec 深度实战:当 SQLite 遇见向量搜索,AI 应用的轻量级记忆系统从此有了标准答案(2026)
2026-07-22 01:16:13 +0800 CST
view 184
深度解析 sqlite-vec:一个纯C实现的SQLite向量搜索扩展,让SQLite直接支持语义搜索。涵盖核心架构、HNSW索引原理、SQL API完全指南、Python实战案例(知识库检索系统、AI Agent长期记忆、RAG系统)、性能优化、常见问题解决方案以及LangChain/LlamaIndex生态集成。
sqlite-vec
SQLite
向量搜索
AI应用
语义检索
RAG
Embedding
HNSW
AI Agent
File-as-State:零重型框架的 AI Agent 生产级自动化架构——从多步任务崩溃到 99.9% 可靠性的完整工程指南(2026)
编程
File-as-State:零重型框架的 AI Agent 生产级自动化架构——从多步任务崩溃到 99.9% 可靠性的完整工程指南(2026)
2026-07-04 03:41:28 +0800 CST
view 263
2026 年 AI Agent 从 Demo 走向生产的最大拦路虎是多步任务的状态管理。本文提出 File-as-State 架构,基于文件系统实现零重型框架的 Agent 状态管理,含完整代码实战与生产部署指南。
File-as-State
AI Agent
状态管理
生产级
轻量级架构
文件系统
LangGraph替代
Temporal替代
LLM 推理的显存战争:从 PagedAttention 到统一内存架构——KV Cache 管理五世代深度解析(2026)
编程
LLM 推理的显存战争:从 PagedAttention 到统一内存架构——KV Cache 管理五世代深度解析(2026)
2026-06-15 11:18:23 +0800 CST
view 516
深度解析大模型推理中 KV Cache 管理的五世代演进:从连续分配到 PagedAttention,再到异构缓存、分布式 KV 和统一混合内存架构。结合 vLLM、SGLang、TensorRT-LLM 给出生产环境选型指南。
LLM
大模型
KVCache
PagedAttention
vLLM
SGLang
TensorRT
推理优化
显存管理
分布式
React 19.2 深度实战:Activity、useEffectEvent 与部分预渲染——一次重写前端渲染心智模型的工程实践
编程
React 19.2 深度实战:Activity、useEffectEvent 与部分预渲染——一次重写前端渲染心智模型的工程实践
2026-07-10 18:44:59 +0800 CST
view 230
深度实战 React 19.2 三大新特性:Activity 可控活动边界、useEffectEvent 事件逻辑解耦、部分预渲染与 cacheSignal,配可运行 TSX 代码与性能优化地图。
React 19.2
Activity
useEffectEvent
部分预渲染
React Compiler
前端渲染
vLLM 深度实战:当 PagedAttention 遇上生产级 LLM 推理——从内存革命到分布式部署的完全指南(2026)
编程
vLLM 深度实战:当 PagedAttention 遇上生产级 LLM 推理——从内存革命到分布式部署的完全指南(2026)
2026-06-10 10:17:56 +0800 CST
view 539
深度解析 vLLM 的核心架构 PagedAttention 和 Continuous Batching,从内存管理原理到生产级分布式部署的完全指南。
vLLM
LLM推理
PagedAttention
GPU优化
大模型部署
AI推理
GPT-6「土豆」深度解析:当「交响乐」架构敲响AGI大门
编程
GPT-6「土豆」深度解析:当「交响乐」架构敲响AGI大门
2026-04-09 08:47:06 +0800 CST
view 1128
深度解析OpenAI GPT-6代号「土豆」的技术突破:Symphony原生多模态统一架构、5-6万亿MoE参数、200万Token上下文窗口、System-2双系统推理引擎。探讨其对AI Agent生态的影响。约12000字。
GPT-6
OpenAI
AGI
Symphony
MoE
多模态
上下文窗口
System-2
Agent
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
46
47
48
49
50
...
131
下一页