程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
MiniMax M3 深度实战:当稀疏注意力打破百万 Token 墙——从 MSA 架构原理到 1M 上下文工程实践、原生多模态与 Agent 集群的生产级完全指南(2026)
编程
MiniMax M3 深度实战:当稀疏注意力打破百万 Token 墙——从 MSA 架构原理到 1M 上下文工程实践、原生多模态与 Agent 集群的生产级完全指南(2026)
2026-06-19 07:26:01 +0800 CST
view 448
深度解析MiniMax M3的自研MSA稀疏注意力架构,从KV outer gather Q设计到1M上下文工程实践,包含代码示例、性能优化和部署指南
MiniMax
M3
MSA
稀疏注意力
1M上下文
多模态
Agent
大模型
科大讯飞开源SkillHub:企业级智能体技能注册中心
案例
科大讯飞开源SkillHub:企业级智能体技能注册中心
2026-05-06 07:34:11 +0800 CST
view 754
科大讯飞开源SkillHub企业级智能体技能注册中心,自托管私有化部署,支持发布/发现/管理技能包,RBAC权限控制,两级审核治理,完整审计日志,Java 21 + React 19 + PostgreSQL 16技术栈
AI Agent
Skill Registry
企业级
讯飞开源
技能管理
Rbac
私有化部署
Flowise 深度实战:当 LangChain 遇上低代码——从架构原理到生产级 AI 工作流完全指南(2026)
编程
Flowise 深度实战:当 LangChain 遇上低代码——从架构原理到生产级 AI 工作流完全指南(2026)
2026-06-05 20:08:17 +0800 CST
view 479
Flowise 是一个开源的、可视化的低代码工具,专门用来构建基于大语言模型的应用程序或智能体(AI Agent)。本文深入剖析 Flowise 的架构设计、核心组件、实战案例,并提供生产级部署的最佳实践。
Flowise
LangChain
低代码
AI Agent
LLM
腾讯云 Agent Memory 2.0 深度拆解:当 AI Agent 从「金鱼记忆」进化到「团队大脑」—— 四层记忆架构 × Team Memory 全链路技术解析
编程
腾讯云 Agent Memory 2.0 深度拆解:当 AI Agent 从「金鱼记忆」进化到「团队大脑」—— 四层记忆架构 × Team Memory 全链路技术解析
2026-08-09 10:46:14 +0800 CST
view 226
深度解析腾讯云Agent Memory 2.0的四层记忆架构、Team Memory团队协作设计与生产部署方案
AI
Agent
记忆系统
腾讯云
架构设计
知识图谱
Docker AI Toolkit 2026 深度解析:从镜像构建到推理服务,AI 工作流的全链路重构
编程
Docker AI Toolkit 2026 深度解析:从镜像构建到推理服务,AI 工作流的全链路重构
2026-05-14 01:55:02 +0800 CST
view 586
Docker AI Toolkit 2026于2026年3月1日发布,原生支持PyTorch 2.4、TensorFlow 2.17、ONNX Runtime 1.19一键构建,Sigstore签名+OIDC身份绑定防止供应链攻击,docker ai serve --adaptive自适应推理让GPU利用率稳定在80%,LLM微调延迟压至83ms,WASM沙箱让边缘AI应用启动时间<100ms。
Docker,AI Toolkit,PyTorch,TensorFlow,ONNX Runtime,模型签名验证,Sigstore,WASM沙箱,自适应推理
MiroFish 深度解析:当群体智能遇见数字孪生——如何用10万智能体在数字沙盘中预演未来
编程
MiroFish 深度解析:当群体智能遇见数字孪生——如何用10万智能体在数字沙盘中预演未来
2026-04-15 15:21:53 +0800 CST
view 854
深度解析MiroFish:一个用群体智能构建数字孪生世界的预测引擎。从种子提取、知识图谱构建、OASIS仿真引擎到上帝视角干预,完整剖析其技术架构与代码实现。
群体智能
Multi-Agent
OASIS
GraphRAG
数字孪生
预测引擎
开源AI
MiroFish
llama.cpp 架构深度拆解:从 GGML 到 GGUF、量化内核到跨平台推理栈,一文吃透本地 LLM 推理工程化
编程
llama.cpp 架构深度拆解:从 GGML 到 GGUF、量化内核到跨平台推理栈,一文吃透本地 LLM 推理工程化
2026-08-01 08:18:35 +0800 CST
view 243
深度拆解 llama.cpp 全栈架构:从 GGML 到 GGUF 格式演进、K-Quant 量化内核原理、ggml 张量计算图层、libllama 推理逻辑层、10+ 硬件后端调度,以及生产调优实战与踩坑清单。
llama.cpp
GGUF
GGML
量化
本地LLM
CPU推理
GPU加速
跨平台
K-Quant
Harness Engineering:2026年顶级AI工程师停止写代码的真相——从百万行代码实验到五大核心制品全解析
编程
Harness Engineering:2026年顶级AI工程师停止写代码的真相——从百万行代码实验到五大核心制品全解析
2026-08-16 06:15:18 +0800 CST
view 32
深度解析2026年AI编程新范式Harness Engineering:同一模型42%到78%的性能差距全靠它,OpenAI百万行代码实验、三Agent架构、五大核心制品全讲透。
Harness Engineering
AI Agent
AI编程
缰绳工程
智能体
工程实践
用WiFi信号感知人体:从RuView到ESPectre的WiFi CSI技术全解析
编程
用WiFi信号感知人体:从RuView到ESPectre的WiFi CSI技术全解析
2026-04-24 04:38:49 +0800 CST
view 1044
深度解析WiFi CSI人体感知技术:从RuView的17关键点姿态估计到ESPectre的轻量级运动检测,涵盖技术原理、系统架构、代码实现与性能优化。
WiFi
CSI
人体感知
RuView
ESPectre
物联网
智能硬件
Home Assistant
ESP32
hack-skills:AI智能体专属安全技能知识库
编程
hack-skills:AI智能体专属安全技能知识库
2026-05-18 23:50:53 +0800 CST
view 670
AI智能体专属安全技能知识库,覆盖14个核心安全领域(Web/API/提权/AD/Pwn/逆向/密码学/区块链/AI安全等),三级分层结构,支持Web/GitHub/ZIP三种访问方式。
开源项目
安全
渗透测试
AI Agent
技能库
XY-Serve 深度实战:当昇腾 NPU 终于学会「驯服动态负载」——从元原语分解、Token级调度到 Attention/Linear 双内核优化的完整工程指南(2026)
编程
XY-Serve 深度实战:当昇腾 NPU 终于学会「驯服动态负载」——从元原语分解、Token级调度到 Attention/Linear 双内核优化的完整工程指南(2026)
2026-07-21 08:20:26 +0800 CST
view 222
华为联合清华大学开源的 XY-Serve 论文被 ASPLOS 2026 录用,解决了 NPU 上高效运行动态 LLM 负载的核心挑战。吞吐量提升95%,Attention 内核提速21.5%,Linear 内核提速14.6%。
XY-Serve
华为昇腾
NPU
LLM推理
Meta-Attention
虚拟填充
动态负载
ASPLOS
AI基础设施
FlashPrefill 深度解析:当瞬时注意力遇上 GPU 原语——从 O(N²) 困境到 27 倍速的工程革命
编程
FlashPrefill 深度解析:当瞬时注意力遇上 GPU 原语——从 O(N²) 困境到 27 倍速的工程革命
2026-04-15 17:20:25 +0800 CST
view 816
深度解析中科院与腾讯微信联合研发的 FlashPrefill 如何通过即时注意力模式发现和动态阈值筛选,将 25.6 万字符长文本处理速度提升 27.78 倍,同时保持近乎完美的精度。
LLM推理优化
FlashAttention
GPU计算
长文本处理
注意力机制
Transformer
深度学习
HyperFrames 深度解析:HeyGen 开源的「HTML 写视频」革命——从 FrameAdapter 架构到 AI Agent 驱动的内容生产新范式
编程
HyperFrames 深度解析:HeyGen 开源的「HTML 写视频」革命——从 FrameAdapter 架构到 AI Agent 驱动的内容生产新范式
2026-05-19 00:47:13 +0800 CST
view 1150
HeyGen 开源的 HyperFrames 框架深度解析:HTML+GSAP 写视频的革命性技术,FrameAdapter 架构、Puppeteer 逐帧捕获、FFmpeg 编码、AI Agent 自动化生产完整指南,对比 Remotion 与生产级实战
HyperFrames
AI视频
GSAP
Puppeteer
FFmpeg
视频渲染
前端工具
HeyGen
AI Agent
自动化生产
ASMR 彻底颠覆 RAG:Supermemory 如何以 99% 准确率重新定义 AI Agent 永久记忆
编程
ASMR 彻底颠覆 RAG:Supermemory 如何以 99% 准确率重新定义 AI Agent 永久记忆
2026-05-28 15:44:20 +0800 CST
view 969
ASMR(Agentic Search and Memory Retrieval)在 LongMemEval 基准测试中以 99% 准确率刷新世界纪录,彻底颠覆传统 RAG 方案。本文深入解析 ASMR 的 Observer Agents、Search Agents、Memory Graph 三大核心组件,以及无向量数据库的实现原理。
ASMR
AI Agent
永久记忆
LongMemEval
Supermemory
RAG替代
Headroom 深度实战:当 AI Agent 学会压缩上下文——从 Token 暴降 60-95% 到生产级工程落地的完全指南(2026)
编程
Headroom 深度实战:当 AI Agent 学会压缩上下文——从 Token 暴降 60-95% 到生产级工程落地的完全指南(2026)
2026-06-19 10:57:59 +0800 CST
view 670
深度拆解 Headroom 上下文压缩中间层架构设计与生产级落地
Headroom
AI Agent
上下文压缩
Token优化
LLM
语音智能体流水线深度拆解:VAD→STT→LLM→TTS 四级管线如何用开源模型复刻 OpenAI Realtime
编程
语音智能体流水线深度拆解:VAD→STT→LLM→TTS 四级管线如何用开源模型复刻 OpenAI Realtime
2026-08-01 09:43:09 +0800 CST
view 178
深度拆解 huggingface/speech-to-speech 本地语音智能体:VAD→STT→LLM→TTS 四级流水线架构、OpenAI Realtime 兼容协议、打断处理与延迟优化实战
语音智能体
speech-to-speech
VAD
STT
TTS
OpenAI Realtime
WebSocket
本地部署
AI Agent
流式处理
DeerFlow 2.0 深度实战:字节跳动如何用「子代理并行调度 + Docker沙箱」把 AI Agent 从「会说」变成「会做」
编程
DeerFlow 2.0 深度实战:字节跳动如何用「子代理并行调度 + Docker沙箱」把 AI Agent 从「会说」变成「会做」
2026-08-16 08:44:02 +0800 CST
view 30
深度拆解字节跳动DeerFlow 2.0:子代理并行调度效率提升3-5倍、Docker沙箱真实执行环境、Markdown技能系统非程序员可定义、四层分层记忆系统,从架构设计到代码实战到生产部署的全链路解析。
DeerFlow
AI Agent
字节跳动
Docker
LangGraph
子代理
沙箱
MCP
技能系统
开源框架
万字深度解析 X 托管 MCP 服务器:当社交数据遇见 AI 标准化接入——从 OAuth 2.0 授权到 Streamable HTTP 传输的完整技术指南(2026)
编程
万字深度解析 X 托管 MCP 服务器:当社交数据遇见 AI 标准化接入——从 OAuth 2.0 授权到 Streamable HTTP 传输的完整技术指南(2026)
2026-07-03 01:42:11 +0800 CST
view 404
深入解析X平台托管MCP服务器的架构设计、OAuth 2.0授权机制、工具集实现,提供完整的Python/TypeScript集成实战代码,助你快速接入AI标准化数据接口。
X MCP服务器
托管MCP
MCP协议
AI Agent
X API集成
社交数据接入
OAuth 2.0
Streamable HTTP
MoneyPrinterTurbo 深度拆解:一个关键词如何端到端跑出一条高清短视频——AI 视频生成流水线的工程内幕
编程
MoneyPrinterTurbo 深度拆解:一个关键词如何端到端跑出一条高清短视频——AI 视频生成流水线的工程内幕
2026-07-14 19:41:50 +0800 CST
view 277
从 LLM 脚本、Pexels 素材检索、Edge TTS 配音、字幕生成到 FFmpeg 合成,深度拆解 MoneyPrinterTurbo 的端到端 AI 视频生成流水线架构,并附可运行核心代码与规模化性能优化。
MoneyPrinterTurbo
AI视频生成
短视频自动化
FFmpeg
LLM
TTS
Python
内容创作
Go 1.25 GreenTea GC 深度解析:当垃圾回收器学会"批量思维"——从对象级扫描到页级处理的性能革命
编程
Go 1.25 GreenTea GC 深度解析:当垃圾回收器学会"批量思维"——从对象级扫描到页级处理的性能革命
2026-04-15 20:21:19 +0800 CST
view 681
Go 1.25 带来革命性的 GreenTea 垃圾回收器,通过页级处理和 AVX-512 向量指令,将 GC 时间减少 10%-40%。本文深入剖析其设计哲学、核心算法、实现细节和性能影响。
Go
GC
GreenTea
AVX-512
性能优化
DwarfStar 4 深度实战:当 Redis 之父用 C 语言重新发明本地推理——从磁盘 KV 一等公民到 284B 模型跑进 MacBook 的工程完全指南(2026)
编程
DwarfStar 4 深度实战:当 Redis 之父用 C 语言重新发明本地推理——从磁盘 KV 一等公民到 284B 模型跑进 MacBook 的工程完全指南(2026)
2026-06-14 09:48:41 +0800 CST
view 1132
Redis之父antirez的ds4项目深度解析:非对称2-bit量化、磁盘KV缓存一等公民、session_sync增量推理、方向引导、分布式推理的工程实战指南
ds4
DwarfStar
本地推理
DeepSeek
MoE
KV缓存
antirez
Metal
量化
万字深度解析 Headroom:当 AI Agent 遇见上下文压缩革命——从 Token 成本黑洞到 CCR 可逆存储的完整技术指南(2026)
编程
万字深度解析 Headroom:当 AI Agent 遇见上下文压缩革命——从 Token 成本黑洞到 CCR 可逆存储的完整技术指南(2026)
2026-07-03 02:14:09 +0800 CST
view 601
深度解析 GitHub Trending 榜首项目 Headroom:AI Agent 上下文压缩层,60-95% Token 节省,涵盖六大压缩算法、CCR 可逆存储、跨 Agent 记忆等核心机制,含完整代码实战。
Headroom
AI Agent
上下文压缩
Token优化
CCR
开源工具
AIGC
代码压缩
WebNN + WebGPU + WASM 三端融合:2026年浏览器端AI推理的终极架构——从零构建生产级推理引擎
编程
WebNN + WebGPU + WASM 三端融合:2026年浏览器端AI推理的终极架构——从零构建生产级推理引擎
2026-06-27 07:12:19 +0800 CST
view 512
2026年WebNN、WebGPU、WASM三端融合的浏览器端AI推理架构深度实战。从环境探测、模型加载、推理执行到性能优化,完整代码实现生产级推理引擎。
WebNN
WebGPU
WASM
浏览器AI推理
ONNX Runtime
NPU加速
端侧推理
MemPalace 深度实战:54K+ Star 本地优先 AI 记忆系统,从「记忆宫殿」架构到生产部署完全指南——2026 年 AI Agent 长期记忆终极解决方案
编程
MemPalace 深度实战:54K+ Star 本地优先 AI 记忆系统,从「记忆宫殿」架构到生产部署完全指南——2026 年 AI Agent 长期记忆终极解决方案
2026-06-27 07:44:31 +0800 CST
view 354
MemPalace 深度实战指南:54K+ Star 本地优先 AI 记忆系统,96.6% R@5 召回率,宫殿架构、AAAK 压缩、29+ MCP 工具、完整代码实战与生产部署。
MemPalace
AI记忆
长期记忆
MCP
向量数据库
ChromaDB
本地优先
AI Agent
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
69
70
71
72
73
...
123
下一页