程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
一条命令读论文训模型:HuggingFace ml-intern 开源 ML 工程师深度实战
编程
一条命令读论文训模型:HuggingFace ml-intern 开源 ML 工程师深度实战
2026-05-23 14:14:52 +0800 CST
view 512
深入解析HuggingFace推出的ml-intern开源ML工程师Agent,从架构设计到生产部署,一句话搞定从读论文到发布模型的全流程。
AI
ML
HuggingFace
Agent
机器学习
LoRA
Python
KTransformers 深度拆解:一块 RTX 5090 跑 100B+ 大模型,CPU/GPU 异构推理凭什么改写 LLM 本地部署规则
编程
KTransformers 深度拆解:一块 RTX 5090 跑 100B+ 大模型,CPU/GPU 异构推理凭什么改写 LLM 本地部署规则
2026-07-24 07:44:31 +0800 CST
view 141
KTransformers 通过 CPU/GPU 异构计算,让一块 RTX 5090(32GB 显存)能跑起 100B+ MoE 大模型,且无需量化压缩,保持原精度 FP16。实测比 llama.cpp Q8_0 快 4.5 倍。本文深度拆解其专家细粒度卸载、异步预取、DMA 优化等核心技术,以及实战部署指南。
KTransformers
LLM推理
MoE
异构计算
DeepSeek
SGLang
CPU Offload
本地部署
GPU优化
Zig 0.16.0 深度解析:无隐藏魔法的系统编程革命——io_uring、编译时计算与交叉编译如何重新定义底层开发
编程
Zig 0.16.0 深度解析:无隐藏魔法的系统编程革命——io_uring、编译时计算与交叉编译如何重新定义底层开发
2026-05-11 06:53:34 +0800 CST
view 583
Zig 0.16.0深度解析:io_uring异步IO、编译时计算、零配置交叉编译、CGO替代方案
Zig
系统编程
io_uring
交叉编译
comptime
CGO替代
SGLang 深度解析:RadixAttention 如何重塑大模型推理的「结构化革命」
编程
SGLang 深度解析:RadixAttention 如何重塑大模型推理的「结构化革命」
2026-06-30 11:16:18 +0800 CST
view 267
深度解析 SGLang 大模型推理框架:RadixAttention 前缀缓存、零开销 CPU 调度器、结构化输出约束、推测解码、PD 分离等核心技术,对比 vLLM/TensorRT-LLM 选型,提供完整代码示例与生产级部署实践
SGLang
大模型推理
RadixAttention
前缀缓存
结构化输出
推测解码
PD分离
vLLM
TensorRT-LLM
SGLang 深度解析:RadixAttention 前缀缓存与结构化 LLM 推理革命——从 RAG/Agent 场景到生产级部署的完整指南
编程
SGLang 深度解析:RadixAttention 前缀缓存与结构化 LLM 推理革命——从 RAG/Agent 场景到生产级部署的完整指南
2026-06-30 11:17:15 +0800 CST
view 317
深度解析 SGLang 大模型推理框架:RadixAttention 前缀缓存、零开销 CPU 调度器、结构化输出约束、推测解码、PD 分离等核心技术,对比 vLLM/TensorRT-LLM 选型,提供完整代码示例与生产级部署实践
SGLang
大模型推理
RadixAttention
前缀缓存
结构化输出
推测解码
PD分离
vLLM
TensorRT-LLM
NGINX Rift 深度实战:CVE-2026-42945 漏洞原理、利用链与生产级防护完全指南
编程
NGINX Rift 深度实战:CVE-2026-42945 漏洞原理、利用链与生产级防护完全指南
2026-05-23 16:45:06 +0800 CST
view 707
深度解析潜伏18年的NGINX高危漏洞CVE-2026-42945,从源码层面拆解堆溢出原理、RCE利用链及生产级防护策略
NGINX
安全漏洞
RCE
CVE-2026-42945
堆溢出
网络安全
HTMX 深度实战:当"超媒体驱动"重塑 Web 开发范式——从 REST 哲学到不用一行 JavaScript 的现代化全栈指南(2026)
编程
HTMX 深度实战:当"超媒体驱动"重塑 Web 开发范式——从 REST 哲学到不用一行 JavaScript 的现代化全栈指南(2026)
2026-06-11 12:24:17 +0800 CST
view 683
2026年最新!深入讲解 HTMX 超媒体驱动理念,配合 Rust + Axum + HTMX + SSE 完整实战,探讨不用一行 JavaScript 的现代化全栈开发
HTMX
超媒体
HATEOAS
REST
全栈开发
FastAPI
Django
Rust
Axum
DiffusionGemma 深度实战:当离散文本扩散颠覆自回归霸权——从并行去噪原理到 MoE 架构、本地推理优化与混合范式展望的生产级完全指南(2026)
编程
DiffusionGemma 深度实战:当离散文本扩散颠覆自回归霸权——从并行去噪原理到 MoE 架构、本地推理优化与混合范式展望的生产级完全指南(2026)
2026-06-17 07:55:50 +0800 CST
view 336
Google开源DiffusionGemma:基于离散文本扩散的26B MoE模型,并行去噪实现4倍推理加速,双向注意力天然支持代码补全与行内编辑
DiffusionGemma
LLM
扩散模型
推理加速
MoE
Everything Claude Code 深度解析:黑客马拉松冠军如何让 AI 编程从「裸奔」到「武装到牙齿」
编程
Everything Claude Code 深度解析:黑客马拉松冠军如何让 AI 编程从「裸奔」到「武装到牙齿」
2026-05-11 08:21:24 +0800 CST
view 592
深度解析2026年GitHub增长最快的AI开源项目Everything Claude Code:105K Star、27个专业Agent、Instinct持续学习系统、AgentShield安全审计、Hook自动化,让Claude Code从单次会话工具进化为生产级AI编程平台
AI编程,ClaudeCode,EverythingClaudeCode,AI Agent,开发者工具
Headroom 深度实战:让 LLM Token 消耗暴减 95% 的压缩引擎——从语义熵编码到 RAG 块优化的完全指南(2026)
编程
Headroom 深度实战:让 LLM Token 消耗暴减 95% 的压缩引擎——从语义熵编码到 RAG 块优化的完全指南(2026)
2026-06-02 21:19:20 +0800 CST
view 1461
Headroom 是专为 LLM 设计的通用压缩层,以 Library、Proxy、MCP Server 三种形态存在,在信息不丢失的前提下把 Token 消耗砍掉 60-95%。本文从信息论底层原理讲起,完整拆解四层压缩管线,结合真实代码实战演示接入方式。
LLM
Token优化
GitHub Trending
Python
RAG
HTMX 超媒体实战:不用写 JavaScript 也能做现代化全栈(Rust Axum + FastAPI + Django 三大框架全覆盖)
编程
HTMX 超媒体实战:不用写 JavaScript 也能做现代化全栈(Rust Axum + FastAPI + Django 三大框架全覆盖)
2026-06-11 12:24:49 +0800 CST
view 420
深入讲解 HTMX 超媒体驱动理念,配合 Rust + Axum + HTMX + SSE 完整实战
HTMX
超媒体
HATEOAS
REST
全栈开发
FastAPI
Django
Rust
Axum
吴恩达 OpenWorker 深度拆解:开源版AI同事如何用 aisuite 引擎 + 审批门控重新定义桌面自动化
编程
吴恩达 OpenWorker 深度拆解:开源版AI同事如何用 aisuite 引擎 + 审批门控重新定义桌面自动化
2026-07-29 15:14:32 +0800 CST
view 37
深度拆解吴恩达团队开源的 OpenWorker 项目:开源版 AI 同事如何用 aisuite 多模型引擎 + 审批门控机制重新定义桌面自动化,附架构解析、代码实战与生产部署指南。
OpenWorker
吴恩达
AI助手
aisuite
开源
桌面自动化
MCP
Function Calling
审批门控
Python
TradingAgents 深度实战:71.4K Star 的 AI 多智能体交易系统——从多 Agent 投研体系到生产级量化策略的完全指南(2026)
编程
TradingAgents 深度实战:71.4K Star 的 AI 多智能体交易系统——从多 Agent 投研体系到生产级量化策略的完全指南(2026)
2026-06-02 22:14:57 +0800 CST
view 490
TradingAgents 用7个专业LLM Agent完整复刻华尔街投研流程,GitHub 71.4K Star,本文从架构设计、Agent协作机制、LLM调度策略到生产级部署全面深度拆解。
AI交易
多智能体
量化交易
LLM
LangGraph
吴恩达开源 OpenWorker 深度拆解:桌面 AI 助手的开源之路,从 aisuite 引擎到审批门控的工程实践
编程
吴恩达开源 OpenWorker 深度拆解:桌面 AI 助手的开源之路,从 aisuite 引擎到审批门控的工程实践
2026-07-29 15:15:04 +0800 CST
view 46
深度拆解吴恩达团队开源的 OpenWorker 项目:开源版 AI 同事如何用 aisuite 多模型引擎 + 审批门控机制重新定义桌面自动化,附架构解析、代码实战与生产部署指南。
OpenWorker
吴恩达
AI助手
aisuite
开源
桌面自动化
MCP
Function Calling
审批门控
Python
Go应用中使用MongoDB客户端库mongo-driver
编程
Go应用中使用MongoDB客户端库mongo-driver
2024-11-18 21:53:37 +0800 CST
view 1999
本文介绍了如何在Go应用中使用MongoDB客户端库mongo-driver,包括安装、连接、基本的CRUD操作、索引管理、聚合操作和事务支持。通过代码示例,展示了如何高效地与MongoDB进行交互,适用于各种应用场景。
编程
数据库
Go语言
MongoDB
开发
TradingAgents 深度实战:7个LLM Agent复刻华尔街投研——从LangGraph多智能体架构到AI量化交易生产部署(2026完全指南)
编程
TradingAgents 深度实战:7个LLM Agent复刻华尔街投研——从LangGraph多智能体架构到AI量化交易生产部署(2026完全指南)
2026-06-02 22:15:17 +0800 CST
view 731
TradingAgents 用7个专业LLM Agent完整复刻华尔街投研流程,GitHub 71.4K Star,本文从架构设计、Agent协作机制、LLM调度策略到生产级部署全面深度拆解。
AI交易
多智能体
量化交易
LLM
LangGraph
Spec-Kit 深度实战:GitHub 开源的 AI 规格驱动开发工具包,让 Vibe Coding 走向工程化
编程
Spec-Kit 深度实战:GitHub 开源的 AI 规格驱动开发工具包,让 Vibe Coding 走向工程化
2026-07-12 08:14:57 +0800 CST
view 228
深度解析 GitHub 开源的 AI 规格驱动开发工具包 Spec-Kit,剖析六步工作流、Constitution 宪法约束、Agent 命令体系,以及 SDD 生态与 OpenSpec/Amazon Kiro 的对比,帮助开发者从 Vibe Coding 走向工程化。
Spec-Kit
AI编程
SDD
Vibe Coding
Claude Code
GitHub
工程化
Snail-AI:开源免费的企业级 AI Agent 平台,Java 生态的智能体解决方案
编程
Snail-AI:开源免费的企业级 AI Agent 平台,Java 生态的智能体解决方案
2026-07-06 07:22:04 +0800 CST
view 261
基于Spring Boot+Spring AI的企业级AI智能体平台,多模型管理、Agent编排、RAG知识库、长期记忆、MCP工具、全链路追踪,支持信创数据库。
AI
Java
Spring Boot
Agent
RAG
开源
智能体
企业级
Engram 深度实战:当 AI 编程助手终于学会「记住」——从 SQLite FTS5 内核、MCP 协议到 Git 同步与 Cloud 复制的生产级完全指南
编程
Engram 深度实战:当 AI 编程助手终于学会「记住」——从 SQLite FTS5 内核、MCP 协议到 Git 同步与 Cloud 复制的生产级完全指南
2026-07-12 08:44:12 +0800 CST
view 245
深度解析 Engram:AI Coding Agent 的持久化记忆系统,从 SQLite FTS5 全文检索内核、MCP 协议、20 个工具、Git 同步到 Cloud 复制,配生产级实战案例与性能优化指南。
Engram
AI编程
MCP
SQLite
FTS5
记忆系统
Claude Code
Cursor
Windsurf
DSpark深度解析:DeepSeek联合北大开源的推测解码框架——半自回归生成+置信度调度如何让大模型推理速度飙升85%
编程
DSpark深度解析:DeepSeek联合北大开源的推测解码框架——半自回归生成+置信度调度如何让大模型推理速度飙升85%
2026-07-06 07:43:51 +0800 CST
view 407
深度解析DeepSeek联合北京大学开源的DSpark推测解码推理加速框架:半自回归生成架构解决后缀衰减、置信度调度验证机制避免算力浪费、单用户生成速度提升60%-85%、吞吐量最高暴涨661%。含完整代码实战与性能基准测试。
DSpark
DeepSeek
推测解码
Speculative Decoding
推理加速
半自回归
置信度调度
大模型推理
PostgreSQL 18 异步 I/O 深度拆解:io_method 三种模式、ReadStream 流水线与生产调优实录
编程
PostgreSQL 18 异步 I/O 深度拆解:io_method 三种模式、ReadStream 流水线与生产调优实录
2026-07-30 02:13:05 +0800 CST
view 36
深度拆解 PostgreSQL 18 异步 I/O 子系统:sync/worker/io_uring 三种 io_method 架构对比、ReadStream 预读流水线原理、冷缓存实测 2-3 倍提升数据、生产调优参数与边界分析,附 PG18 其他新特性速览。
PostgreSQL
异步IO
io_uring
数据库
性能优化
AIO
ReadStream
云存储
UUIDv7
开源
Transformers.js v4 深度解析:WebGPU 原生化让 AI 推理在 Node/Bun/Deno 中真正起飞
编程
Transformers.js v4 深度解析:WebGPU 原生化让 AI 推理在 Node/Bun/Deno 中真正起飞
2026-04-12 04:55:32 +0800 CST
view 960
深度解析 Transformers.js v4 的 WebGPU 原生化架构:如何用 C++ 重写 WebGPU Runtime、与 ONNX Runtime 深度集成、在 Node/Bun/Deno 中实现原生 GPU AI 推理。包含代码实战、性能对比与生产部署指南。
JavaScript
AI
WebGPU
Transformers
HuggingFace
Node.js
Bun
Deno
ONNX
LangGraph 2026 生产级深度实战:从有状态图编排到企业级多租户 Agent 平台——AI Agent 工程化完全指南
编程
LangGraph 2026 生产级深度实战:从有状态图编排到企业级多租户 Agent 平台——AI Agent 工程化完全指南
2026-05-23 23:32:58 +0800 CST
view 654
2026 年 AI Agent 工程化完全指南,深度剖析 LangGraph 有状态图架构、持久化机制、人工介入、性能优化及企业级多租户部署,附完整研究助手项目实战代码。
LangGraph
AI Agent
Python
生产级
多租户
DeerFlow 2.0 深度解析:字节跳动如何让 AI 从"聊天"进化到"真正干活"
编程
DeerFlow 2.0 深度解析:字节跳动如何让 AI 从"聊天"进化到"真正干活"
2026-05-11 13:22:57 +0800 CST
view 620
字节跳动开源超级智能体框架 DeerFlow 2.0,50K+ Stars,Docker沙箱执行环境、多智能体协作、长期记忆系统、Markdown技能系统。解决传统AI"记性差、不敢乱动、只能动嘴"三大痛点,实现从分钟级到小时级复杂任务自动化。
DeerFlow,字节跳动,SuperAgent,Docker沙箱,多智能体协作,长期记忆,技能系统,AI生产力,LinuxFoundation,LangGraph
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
53
54
55
56
57
...
66
下一页