程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
编程
MarkItDown 深度解析:微软开源的文档转换神器如何重塑 LLM 时代的知识处理流水线
2026-04-18 06:17:21
view 753
深度解析微软开源的 MarkItDown 文档转换工具,从架构设计、源码实现到实战应用,揭秘它如何成为 LLM 时代知识处理的基础设施。
MarkItDown
微软开源
文档转换
LLM
RAG
Python工具
Markdown
PDF转换
编程
Microsoft Markitdown 深度解析:AI工作流中的文档转换基础设施——从架构原理到生产级部署的完整技术指南(2026)
2026-07-04 14:12:12
view 317
深度解析Microsoft Markitdown:Python文档转换工具,支持PDF/Word/Excel/PPT/图片/音频转Markdown,为LLM/AI工作流量身定制。涵盖架构原理、Python API实战、RAG集成、性能优化、生产部署最佳实践。
Markitdown
Microsoft
文档转换
RAG
AI工作流
Python
LLM
Markdown
向量数据库
Qwen3.8-Max 深度拆解:2.4万亿参数的MoE巨兽如何重新定义大模型天花板——从稀疏混合专家到1M上下文的全栈架构哲学
编程
Qwen3.8-Max 深度拆解:2.4万亿参数的MoE巨兽如何重新定义大模型天花板——从稀疏混合专家到1M上下文的全栈架构哲学
2026-08-03 17:14:27
view 788
深度拆解Qwen3.8-Max 2.4万亿参数MoE大模型架构:稀疏混合专家路由机制、混合注意力1M上下文、GQA KV Cache优化、量化部署实战、vLLM推理优化,附完整代码示例与性能基准分析
Qwen3.8
MoE
大模型
阿里巴巴
通义千问
混合专家
1M上下文
稀疏注意力
量化部署
vLLM
开源
LLM Wiki 深度解析:当 Karpathy 亲手终结 RAG 的草莽时代
编程
LLM Wiki 深度解析:当 Karpathy 亲手终结 RAG 的草莽时代
2026-04-08 19:24:56
view 2323
Karpathy最新提出的LLM Wiki范式深度解析,从工程实现、架构设计、代码实战等多维度解读这一可能终结RAG的全新知识管理方案。
LLM
RAG
知识管理
Karpathy
Claude
AI
智谱 GLM-5.1 深度解析:当开源模型突破「8小时自治」临界点
编程
智谱 GLM-5.1 深度解析:当开源模型突破「8小时自治」临界点
2026-04-09 00:53:51
view 1608
2026年4月8日智谱发布GLM-5.1,744B参数MIT开源,SWE-bench Pro 58.4分超越Claude Opus 4.6,全球首个支持8小时长程自治的开源模型。
GLM-5.1
智谱AI
开源大模型
MoE
SWE-bench
长程自治
LLM
Pathway 深度解析:用 Python 搞定实时流处理+LLM Pipeline,55K Star 背后的技术革命
编程
Pathway 深度解析:用 Python 搞定实时流处理+LLM Pipeline,55K Star 背后的技术革命
2026-05-15 20:44:26
view 618
Pathway深度解析:Python ETL框架,实时流处理+LLM Pipeline,增量计算引擎,性能对比Flink,完整代码实战。
Pathway
流处理
LLM
Python
ETL
RAG
实时计算
Zig 项目宣布反 AI 贡献政策:开源社区最分裂的话题,程序员怎么看?
编程
Zig 项目宣布反 AI 贡献政策:开源社区最分裂的话题,程序员怎么看?
2026-05-31 11:23:49
view 780
2026年4月,Zig语言官方宣布全面禁止LLM生成的代码贡献,引发开源社区激烈争论。本文从程序员视角深度解析Loris Cro的「Contributor Poker」理论、Bun 4倍提速无法上线的真实案例,以及开源治理的新课题。
Zig
开源
AI编程
LLM
GitHub
社区治理
系统编程
Zerostack 深度解析:用 Rust 和 Unix 哲学重新定义 AI 编码代理
编程
Zerostack 深度解析:用 Rust 和 Unix 哲学重新定义 AI 编码代理
2026-06-29 03:42:32
view 504
Zerostack 用纯 Rust 打造 Unix 风格 AI 编码代理,8MB 内存即可运行。深度解析其架构设计、Rust 实现细节、性能基准,以及与 Claude Code、Cursor、Aider 的对比。
Rust
AI编码代理
Unix哲学
LLM工具
代码生成
NVIDIA Nemotron-Cascade-2 深度实战:30B MoE 模型如何拿下 IMO/IOI 双料金牌——从稀疏专家架构到生产级部署的完全指南(2026)
编程
NVIDIA Nemotron-Cascade-2 深度实战:30B MoE 模型如何拿下 IMO/IOI 双料金牌——从稀疏专家架构到生产级部署的完全指南(2026)
2026-06-01 12:56:48
view 612
深度解析NVIDIA Nemotron-Cascade-2-30B-A3B模型:30B总参、3B激活参数的MoE架构,如何拿下IMO/IOI双料金牌,以及如何从HuggingFace加载到vLLM生产部署。
NVIDIA
Nemotron
MoE
AI模型
GPU
深度学习
推理引擎
vLLM
llama.cpp 深度实战:当 C/C++ 重写遇见端侧 LLM 推理——从 GGUF 量化到 Apple Silicon 38 tokens/s 的生产级完全指南(2026)
编程
llama.cpp 深度实战:当 C/C++ 重写遇见端侧 LLM 推理——从 GGUF 量化到 Apple Silicon 38 tokens/s 的生产级完全指南(2026)
2026-06-16 01:17:28
view 1050
llama.cpp 是端侧 LLM 推理的事实标准(180K+ Stars)。本文从源码架构、GGUF 格式、量化方法、跨平台后端、生产部署、性能优化到 DeepSeek V4 Flash 实战,全方位讲解本地 AI 推理。
llama.cpp
GGUF
量化
端侧推理
本地AI
C/C++
Apple Silicon
3.2万Star开源本地AI知识库:Open Notebook支持18家模型+播客生成+MCP集成
编程
3.2万Star开源本地AI知识库:Open Notebook支持18家模型+播客生成+MCP集成
2026-06-21 12:21:16
view 432
Open Notebook 是3.2万Star的开源本地AI知识库,Google Notebook LM替代品。支持18家AI模型切换、1-4人播客生成、RAG对话+来源标注、MCP集成、REST API。MIT协议,Docker两分钟部署,数据全在本地。
AI知识库
开源
RAG
播客
MCP
Ollama
DeepSeek
本地部署
隐私
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
python
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
上一页
1
...
117
118
119
下一页