程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
Microsoft MarkItDown 深度实战:把整个世界搬进 Markdown——从多格式解析引擎到 LLM 知识管道完全指南(2026)
编程
Microsoft MarkItDown 深度实战:把整个世界搬进 Markdown——从多格式解析引擎到 LLM 知识管道完全指南(2026)
2026-06-02 23:44:03 +0800 CST
view 782
Microsoft 开源的 MarkItDown 在 2026 年引爆 AI 工程圈。本文从源码级架构解析、多格式解析引擎、与 LLM 工具链的集成实战、性能优化到生产级 RAG 管道,全面拆解这款改变 AI 工程范式的工具。
Microsoft
MarkItDown
Markdown
LLM
RAG
Python
文档解析
AI工程
Headroom 深度实战:当 Netflix 工程师用「上下文压缩」掀翻 AI 成本底牌——从 CCR 可逆机制到跨 Agent 记忆的生产级完全指南(2026)
编程
Headroom 深度实战:当 Netflix 工程师用「上下文压缩」掀翻 AI 成本底牌——从 CCR 可逆机制到跨 Agent 记忆的生产级完全指南(2026)
2026-06-11 15:20:19 +0800 CST
view 754
Netflix工程师开源的AI上下文压缩工具Headroom,能在保持答案质量的前提下将Token消耗压缩60-95%,累计节省70万美元成本。本文深度剖析其架构设计、CCR可逆机制、跨Agent记忆共享与生产级集成实践。
AI编程
Token压缩
上下文管理
LLM优化
OpenSource
OctaFuse Gateway:统一管理Coding Plan/Token Plan的开源AI网关,个人SaaS都能用
编程
OctaFuse Gateway:统一管理Coding Plan/Token Plan的开源AI网关,个人SaaS都能用
2026-06-22 21:00:01 +0800 CST
view 492
OctaFuse Gateway开源AI网关,把Provider、模型路由、API Key、用户、预算、用量审计、财务记账和管理后台放在一起。个人用可统一Coding Plan/Token Plan入口;做SaaS可变成LLM服务底座。支持OpenAI/Anthropic/Gemini多协议,Provider Key池统一调度多套额度,三层成本口径(metered/standard/charged),自带Admin后台+Playground+Simulator。
OctaFuse
AI网关
开源
LLM管理
多模型路由
SaaS
计费审计
Provider Key池
Python 工具链的 Rust 化革命:从 uv、Ruff 到 LiteLLM——当 Rust 吃掉 Python 的工具生态
编程
Python 工具链的 Rust 化革命:从 uv、Ruff 到 LiteLLM——当 Rust 吃掉 Python 的工具生态
2026-06-30 14:43:40 +0800 CST
view 347
深度解析Python工具链的Rust化革命:从uv的包管理、Ruff的静态分析到LiteLLM的AI网关迁移,万字长文剖析Rust如何以10-100倍的性能优势重塑Python开发生态
Rust
Python
uv
Ruff
LiteLLM
Polars
性能优化
包管理
Pydantic
Python 工具链 Rust 化深度解析:从 uv、Ruff 到 LiteLLM——当系统级语言重塑 Python 开发体验
编程
Python 工具链 Rust 化深度解析:从 uv、Ruff 到 LiteLLM——当系统级语言重塑 Python 开发体验
2026-06-30 14:44:22 +0800 CST
view 279
深度解析Python工具链的Rust化革命:从uv的包管理、Ruff的静态分析到LiteLLM的AI网关迁移,万字长文剖析Rust如何以10-100倍的性能优势重塑Python开发生态
Rust
Python
uv
Ruff
LiteLLM
Polars
性能优化
包管理
Pydantic
Headroom 深度拆解:当 AI Agent 学会「断舍离」——从上下文压缩层、CCR 可逆检索到 6 大压缩算法的工程全貌(2026)
编程
Headroom 深度拆解:当 AI Agent 学会「断舍离」——从上下文压缩层、CCR 可逆检索到 6 大压缩算法的工程全貌(2026)
2026-07-18 15:45:16 +0800 CST
view 209
Headroom 是 AI Agent 的上下文压缩层,在 Agent 与 LLM 之间插入本地优先、完全可逆的压缩中间件,实测节省 60-95% Token。本文从架构、4种集成模式、CCR 可逆检索到 6 大压缩算法与可运行代码实战全面拆解。
Headroom
AI Agent
上下文压缩
Token优化
LLM工程
React Compiler 迁移到 Rust 深度拆解:当 Meta 决定「用 Rust 重写自动记忆化编译器」——从 TypeScript 到 Rust 的 3 倍加速,一个 LLM 辅助完成 1725 个测试用例的重写项目如何重新定义前端编译器的终极形态
编程
React Compiler 迁移到 Rust 深度拆解:当 Meta 决定「用 Rust 重写自动记忆化编译器」——从 TypeScript 到 Rust 的 3 倍加速,一个 LLM 辅助完成 1725 个测试用例的重写项目如何重新定义前端编译器的终极形态
2026-08-05 09:47:53 +0800 CST
view 108
深度拆解React Compiler从TypeScript到Rust的重写:3-10倍性能提升、LLM辅助完成1725个测试用例、Arena分配器与索引数据结构、从Babel插件到Turbopack原生集成,附完整架构分析与代码实战
React Compiler
Rust
前端工具链
自动记忆化
Turbopack
SWC
编译器
React 19
性能优化
LLM
Rust 正在吃掉前端:Rolldown、Oxc 与 Vite 8 统一工具链的技术真相与行业启示
编程
Rust 正在吃掉前端:Rolldown、Oxc 与 Vite 8 统一工具链的技术真相与行业启示
2026-04-20 18:19:12 +0800 CST
view 895
深度解析 Rust 如何通过 Rolldown、Oxc 与 Vite 8 重塑 JavaScript 工具链格局,探讨 Rust 在前端领域渗透的深层逻辑与开发者行动建议。
Rust
Vite
Rolldown
Oxc
前端工具链
Rust 正在重塑 Python 的工具链:深入解析 uv、Ruff 与 LiteLLM 的架构革命与 100 倍性能提升
编程
Rust 正在重塑 Python 的工具链:深入解析 uv、Ruff 与 LiteLLM 的架构革命与 100 倍性能提升
2026-06-30 14:45:17 +0800 CST
view 412
深度解析Python工具链的Rust化革命:从uv的包管理、Ruff的静态分析到LiteLLM的AI网关迁移,万字长文剖析Rust如何以10-100倍的性能优势重塑Python开发生态
Rust
Python
uv
Ruff
LiteLLM
Polars
性能优化
包管理
Pydantic
OpenTelemetry 深度实战:当可观测性终于有了「通用语」——从三大支柱、OTLP 协议、Collector 管线到零侵入自动插桩与生产级排障的完全指南(2026)
编程
OpenTelemetry 深度实战:当可观测性终于有了「通用语」——从三大支柱、OTLP 协议、Collector 管线到零侵入自动插桩与生产级排障的完全指南(2026)
2026-07-12 09:17:23 +0800 CST
view 272
深度解析 OpenTelemetry:从可观测性三支柱与 Profiles、OTLP 协议、Collector 管线、零侵入自动插桩,到采样、批处理、基数与背压的生产级调优,以及从厂商私有 SDK 平滑迁移到 OTel 的双写策略完全指南(2026)。
OpenTelemetry
可观测性
分布式追踪
Tracing
OTLP
Collector
云原生
Prometheus
Jaeger
Rolldown 1.0 深度实战:当 Vite 8 用 Rust 重写了自己——从 VoidZero 全工具链全景到 Rollup 兼容插件的完整指南(2026)
编程
Rolldown 1.0 深度实战:当 Vite 8 用 Rust 重写了自己——从 VoidZero 全工具链全景到 Rollup 兼容插件的完整指南(2026)
2026-07-12 09:46:29 +0800 CST
view 321
深度拆解 Rolldown 1.0 技术架构:从 Rust 技术选型、Oxc 解析引擎、Work-Stealing 并行构建,到 Vite 8 统一引擎迁移、Rollup 插件兼容实战与性能基准测试
Rolldown
Vite
Vite8
Rust
前端构建
VoidZero
esbuild
bundler
微软 MarkItDown 深度拆解:一个依赖吃掉所有文档格式,RAG 预处理层的事实标配是怎样炼成的
编程
微软 MarkItDown 深度拆解:一个依赖吃掉所有文档格式,RAG 预处理层的事实标配是怎样炼成的
2026-07-30 03:13:05 +0800 CST
view 166
深度拆解微软开源的 MarkItDown:统一入口把 PDF/Word/PPT/Excel/音频/ZIP 转成结构保留的 Markdown,含转换器注册架构、RAG 流水线实战、插件开发、三档云端后端选型与生产性能安全清单。
MarkItDown
Microsoft
RAG
文档转换
Markdown
LLM
Python
OCR
开源
文档预处理
BitNet 深度拆解:当大模型被压到 1.58 bit——三值量化、BitLinear 与在 CPU 上跑 100B 的工程全貌(2026)
编程
BitNet 深度拆解:当大模型被压到 1.58 bit——三值量化、BitLinear 与在 CPU 上跑 100B 的工程全貌(2026)
2026-07-19 01:12:51 +0800 CST
view 274
深度拆解微软 BitNet 1-bit/1.58-bit 大模型:从三值量化数学、BitLinear 架构、BitNet.cpp 推理内核,到在 CPU 上运行 100B 模型的完整工程实战。
BitNet
1-bit LLM
三值量化
BitLinear
边缘AI
大模型推理
Polonius Alpha 深度拆解:Rust 下一代借用检查器如何重写内存安全的边界——从 NLL 数据流到声明式分析引擎的完整实战指南(2026)
编程
Polonius Alpha 深度拆解:Rust 下一代借用检查器如何重写内存安全的边界——从 NLL 数据流到声明式分析引擎的完整实战指南(2026)
2026-08-14 02:15:16 +0800 CST
view 59
2026年8月 Polonius Alpha 进入 Rust nightly 实测:从 NLL 数据流到 origin-based 声明式借用检查引擎,解析路径敏感分析如何消除条件借用误报,附 nightly 实战与性能折衷。
Polonius
Rust
借用检查器
NLL
内存安全
编译器
nightly
生命周期
BitNet 1.58-bit:微软如何用三个值就让大模型在 CPU 上飞奔
编程
BitNet 1.58-bit:微软如何用三个值就让大模型在 CPU 上飞奔
2026-05-11 13:55:11 +0800 CST
view 730
微软开源BitNet 1.58-bit大模型推理框架,2B参数模型仅需0.4GB内存、29ms/token推理速度。核心创新:训练时量化、-1/0/+1三值权重、位运算加速,精度损失<5%却比INT4表现更好。纯CPU运行,71%能耗降低。
BitNet,1.58bit,微软,大模型量化,1bit LLM,CPU推理,bitnet.cpp,训练时量化,位运算加速,模型压缩
编程
MarkItDown 深度实战:当微软用Python重写文档预处理——从转换器链到LLM集成的生产级完全指南(2026)
2026-06-12 13:48:19 +0800 CST
view 616
深度剖析微软开源的MarkItDown工具,详解其转换器链架构、插件系统、LLM集成和大规模文档处理性能优化,提供15个完整代码示例和生产级部署方案。
MarkItDown
文档预处理
LLM
RAG
Python
微软
CLEAR 深度实战:当浙大+腾讯+北大联手破解AI推理「算力浪费」难题——从理性放弃机制到生产级LLM推理优化完全指南(2026)
编程
CLEAR 深度实战:当浙大+腾讯+北大联手破解AI推理「算力浪费」难题——从理性放弃机制到生产级LLM推理优化完全指南(2026)
2026-06-12 14:20:52 +0800 CST
view 626
深度解析 ICML 2026 接收的 CLEAR 推理优化方法。浙江大学、腾讯、北京大学联合提出:对没有希望的问题理性放弃,把算力集中到能解决的问题上。包含完整 Python 实现、vLLM/SGLang 集成、生产级部署指南。
LLM
推理优化
ICML 2026
CLEAR
算力分配
百度Unlimited-OCR深度解析:R-SWA常量KV缓存如何让OCR一口气吃下几十页文档——从单图解析到多页PDF的完整实战指南
编程
百度Unlimited-OCR深度解析:R-SWA常量KV缓存如何让OCR一口气吃下几十页文档——从单图解析到多页PDF的完整实战指南
2026-07-06 11:16:05 +0800 CST
view 411
深度解析百度开源Unlimited-OCR:13K+ Stars,R-SWA常量KV缓存让端到端OCR模型在32K上下文下一次性转录几十页文档。从架构设计到vLLM/SGLang生产部署完整实战指南。
Unlimited-OCR
百度
R-SWA
OCR
KV缓存
文档解析
长文档
vLLM
WebAssembly 从浏览器走向服务器:WASI + Component Model 如何重塑边缘计算
编程
WebAssembly 从浏览器走向服务器:WASI + Component Model 如何重塑边缘计算
2026-07-12 12:45:20 +0800 CST
view 323
深度解析 WebAssembly 从浏览器到服务器的演进路径,剖析 WASI 系统接口规范、Component Model 组件化架构、WIT 接口语言,以及 Wasmtime / WAMR / WasmEdge 等主流运行时对比,附 Rust 实战代码与边缘计算性能基准测试。
WebAssembly
WASI
Component Model
WASM Runtime
边缘计算
Cloudflare Workers
Wasmtime
WasmEdge
Bytecode Alliance
性能优化
跨平台
Serverless
omlx:Mac 本地 LLM 推理的终极方案——从菜单栏管理到 SSD 缓存的完整工程实践
编程
omlx:Mac 本地 LLM 推理的终极方案——从菜单栏管理到 SSD 缓存的完整工程实践
2026-07-24 17:17:27 +0800 CST
view 268
深度解析 omlx:专为 Mac 优化的本地 LLM 推理服务器,通过连续批处理、分层 KV Cache、SSD 缓存和菜单栏管理,实现便捷与控制兼得的推理体验。涵盖技术架构、性能调优、RAG 实战和最佳实践。
LLM
Mac
Apple Silicon
推理优化
本地部署
omlx
Dolt 2.0 深度拆解:当 SQL 数据库学会 Git 分支——Prolly Tree、Copy-on-Write 与版本控制数据库的三年三级跳
编程
Dolt 2.0 深度拆解:当 SQL 数据库学会 Git 分支——Prolly Tree、Copy-on-Write 与版本控制数据库的三年三级跳
2026-07-30 07:21:37 +0800 CST
view 146
深度拆解 Dolt 2.0:Prolly Tree 存储引擎、Copy-on-Write 写时复制机制、自动垃圾回收、Archives 字典压缩、向量数据类型支持,以及如何在数据治理、测试沙箱、AI Agent 记忆层等场景中落地实践。
Dolt
版本控制数据库
Prolly Tree
Copy-on-Write
Git
MySQL
数据库
开源
MarkItDown 深度解析:微软10万星开源工具如何重塑 LLM 时代的文档处理范式
编程
MarkItDown 深度解析:微软10万星开源工具如何重塑 LLM 时代的文档处理范式
2026-04-21 05:47:35 +0800 CST
view 805
深度解析微软开源工具MarkItDown:如何将PDF、Word、Excel等20+格式转换为结构化Markdown,为LLM和RAG场景提供高质量的文档预处理方案。涵盖架构设计、实战代码、性能优化与生产部署最佳实践。
MarkItDown
文档转换
LLM
RAG
Python
开源工具
微软
Headroom 深度实战:当 AI Agent 的 Token 账单被压缩 90%——从六大压缩算法到 CCR 可逆存储、跨 Agent 记忆与 KV Cache 命中率优化的生产级完全指南(2026)
编程
Headroom 深度实战:当 AI Agent 的 Token 账单被压缩 90%——从六大压缩算法到 CCR 可逆存储、跨 Agent 记忆与 KV Cache 命中率优化的生产级完全指南(2026)
2026-06-17 15:22:23 +0800 CST
view 866
Headroom 是开源上下文压缩中间层,六大算法覆盖 JSON/代码/文本/图片,CCR 可逆存储,跨 Agent 记忆,实测节省 60-95% Token,精度保留 97%。
Headroom
AI Agent
Token优化
LLM
上下文压缩
Zabbix 7.4 深度解析:嵌套低级别自动发现如何重新定义企业监控的自动化边界
编程
Zabbix 7.4 深度解析:嵌套低级别自动发现如何重新定义企业监控的自动化边界
2026-05-11 16:53:52 +0800 CST
view 579
Zabbix 7.4 引入嵌套低级别自动发现,彻底改变企业监控的自动化边界。本文深度解析嵌套LLD原理、发现原型机制、主机向导配置,并提供Kubernetes多层级监控的完整实战代码。
Zabbix
监控
运维
LLD
自动化
DevOps
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
18
19
20
21
22
...
33
下一页