程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
FastAPI和WebSockets构建一个实时聊天应用程序
编程
FastAPI和WebSockets构建一个实时聊天应用程序
2024-11-18 16:03:28 +0800 CST
view 2088
本文介绍了如何使用FastAPI和WebSockets构建一个实时聊天应用程序。通过设置WebSocket端点,管理客户端连接,并实现消息的广播功能,用户可以在多个浏览器窗口之间实时发送消息。文章还探讨了增强功能,如用户身份验证、消息持久化和输入指示器,展示了FastAPI在构建实时Web应用中的优势。
Web开发
实时应用
Python框架
聊天系统
技术教程
Hermes Agent 深度拆解:62K Star 的「自进化 AI Agent」如何用闭环学习系统重新定义个人助手——从三层记忆架构到 DSPy+GEPA 技能进化的全栈工程哲学
编程
Hermes Agent 深度拆解:62K Star 的「自进化 AI Agent」如何用闭环学习系统重新定义个人助手——从三层记忆架构到 DSPy+GEPA 技能进化的全栈工程哲学
2026-08-03 20:13:41 +0800 CST
view 58
深度拆解Hermes Agent 62K Star开源AI Agent框架:闭环学习系统自动创建/改进技能、三层记忆架构(FTS5+Honcho用户建模)、DSPy+GEPA技能进化引擎、同步Agent循环设计、40+工具与404个Skill、研究级RL训练环境,附完整代码示例与部署实战指南
Hermes Agent
AI Agent
自进化
Nous Research
闭环学习
DSPy
GEPA
技能系统
记忆架构
Python
Pyrefly 深度解析:Facebook 用 Rust 重写 Python 类型检查器,10 倍性能差距背后的工程哲学
编程
Pyrefly 深度解析:Facebook 用 Rust 重写 Python 类型检查器,10 倍性能差距背后的工程哲学
2026-07-28 01:16:23 +0800 CST
view 118
深度拆解Facebook开源项目Pyrefly:Rust实现的Python类型检查器,比mypy快50倍、比pyright快10倍,AI Agent时代的代码质量保障利器。含架构解析、性能实测、实战指南。
Pyrefly
Python
类型检查
Rust
Meta
Facebook
mypy
pyright
AI编程
静态分析
vLLM 0.5 深度解析:PagedAttention 架构原理与生产级 LLM 推理优化实战
编程
vLLM 0.5 深度解析:PagedAttention 架构原理与生产级 LLM 推理优化实战
2026-07-04 18:15:46 +0800 CST
view 357
深度解析 vLLM 0.5 的 PagedAttention 架构原理,涵盖 KV Cache 分页管理、MoE 优化、分布式推理、量化技术,并通过代码实战和性能对比,帮助开发者掌握生产级 LLM 推理最佳实践。
vLLM
PagedAttention
LLM推理
CUDA
KV Cache
深度学习
AI基础设施
Python
生产部署
性能优化
Headroom深度解析:让AI Agent的Token消耗降低95%的终极方案
编程
Headroom深度解析:让AI Agent的Token消耗降低95%的终极方案
2026-06-29 04:10:47 +0800 CST
view 425
Netflix工程师开源的Headroom通过透明上下文压缩层实现60-95%的Token节省。本文深度拆解架构原理、六层压缩管道、实战集成和性能优化。
AI Agent
Token优化
开源项目
Rust
Python
TinyDB:轻量级 NoSQL 数据库的介绍与应用
综合
TinyDB:轻量级 NoSQL 数据库的介绍与应用
2024-11-19 00:23:02 +0800 CST
view 1898
TinyDB是一个轻量级NoSQL数据库,专为嵌入式场景设计,适合小型项目、原型开发和教学。它提供简单直观的API,支持JSON格式的数据存储和复杂数据结构,具备可扩展性,允许自定义存储引擎和查询操作。本文介绍了TinyDB的安装、主要特性、基本和高级功能,以及实际应用场景,帮助用户全面掌握该库的使用。
数据库
NoSQL
Python编程
数据管理
软件开发
Headroom 深度实战:让 AI Agent 的 Token 消耗暴降 60-95% 的上下文压缩层完全解析
编程
Headroom 深度实战:让 AI Agent 的 Token 消耗暴降 60-95% 的上下文压缩层完全解析
2026-06-29 05:12:24 +0800 CST
view 597
Headroom v0.5.18 完整实战:六层压缩管道深度拆解、SmartCrusher/CodeCompressor/Kompress-base算法原理、四种集成方式代码实战、性能基准验证、headroom learn跨Agent记忆共享。让Token消耗暴降60-95%。
AI Agent
Token压缩
Headroom
上下文管理
LLM优化
编程工具
Python
TypeScript
Python中何时应该使用异常处理
编程
Python中何时应该使用异常处理
2024-11-19 01:16:28 +0800 CST
view 1668
本文介绍了Python中异常处理的关键作用和使用场景,包括如何使用try-except语句捕获和处理异常。通过示例展示了安全的除法函数、输入验证、文件操作、网络请求和数据库操作中的异常处理。强调了异常处理与if-else的区别,以及最佳实践,旨在提高程序的稳定性和用户体验。
编程
Python
软件开发
错误处理
最佳实践
TIOBE 2026年5月编程语言排行榜深度解析:统计编程大整合,Python与R双雄争霸,C语言逆袭第二
编程
TIOBE 2026年5月编程语言排行榜深度解析:统计编程大整合,Python与R双雄争霸,C语言逆袭第二
2026-05-16 02:47:04 +0800 CST
view 927
2026年5月TIOBE编程语言排行榜深度解析:Python占比19.98%但下跌5.37%,C语言逆袭至第二,R语言重回前十。本文深入分析编程语言市场整合趋势,对比Python、C、Java、C++、R、Rust的技术特点与应用场景,并提供多语言代码实战示例。
TIOBE
编程语言
Python
R语言
C语言
Rust
Java
C++
Lyt.js 深度解析:零依赖的 Vue 3 兼容框架,35KB 颠覆前端生态格局
编程
Lyt.js 深度解析:零依赖的 Vue 3 兼容框架,35KB 颠覆前端生态格局
2026-04-28 20:56:59 +0800 CST
view 921
Lyt.js 是一个零依赖、纯 TypeScript 实现的前端框架,核心包 gzip 仅 35KB,兼容 Vue 3 全部核心 API,提供 Signal + Proxy 双轨响应式、Vapor Mode 无 VDOM 渲染、50+ 内置 UI 组件等能力。
Lyt.js
Vue 3
前端框架
TypeScript
SwanLab 深度实战:当国产开源 AI 训练跟踪工具遇见 W&B 替代方案——从 PyTorch 全链路监控到私有化部署、从硬件感知到多框架集成的生产级完全指南(2026)
编程
SwanLab 深度实战:当国产开源 AI 训练跟踪工具遇见 W&B 替代方案——从 PyTorch 全链路监控到私有化部署、从硬件感知到多框架集成的生产级完全指南(2026)
2026-06-21 18:24:22 +0800 CST
view 371
深度解析 SwanLab——国产开源 AI 训练跟踪工具,对标 W&B 和 MLflow。涵盖架构设计、PyTorch/Transformers/LLaMA Factory 集成、硬件全链路监控、实验对比、私有化部署(Docker/K8s)、SDK v0.8.0 性能优化等内容。
SwanLab
AI训练
PyTorch
W&B替代
MLflow
实验跟踪
硬件监控
私有化部署
PyTorch 2.13 深度拆解:从 Metal 原生内核到 4 倍内存优化的工程全貌
编程
PyTorch 2.13 深度拆解:从 Metal 原生内核到 4 倍内存优化的工程全貌
2026-07-17 11:13:32 +0800 CST
view 408
深度拆解 PyTorch 2.13:FlexAttention 在 Apple Silicon 上提速 12 倍、CUTeDSL 为 Inductor 引入第二条代码生成路径、nn.LinearCrossEntropyLoss 将大词汇量模型显存降低 4 倍、torchcomms 重塑分布式训练通信层、ExecuTorch 正式并入核心,配完整生产级代码实战。
PyTorch
深度学习
AI框架
Metal
FlexAttention
Apple Silicon
分布式训练
AMD ROCm 7.14 正式版深度解析:从技术预览到生产级 AI 基础设施的完整蜕变
编程
AMD ROCm 7.14 正式版深度解析:从技术预览到生产级 AI 基础设施的完整蜕变
2026-07-23 12:16:06 +0800 CST
view 203
深度解析 AMD ROCm 7.14 正式版:TheRock 构建系统、Ryzen AI Max PRO 400 硬件支持、PyTorch 2.12 + JAX 0.10.0 框架支持、HIPify CUDA 迁移实战与 vLLM 推理部署完整指南。
ROCm
AMD GPU
HIP
CUDA迁移
PyTorch
JAX
MI350P
Ryzen AI Max
ROCm 7.14
AMD ROCm 7.14 正式版发布:TheRock 构建系统 × Ryzen AI Max PRO 400 × PyTorch 2.12 生产级实战
编程
AMD ROCm 7.14 正式版发布:TheRock 构建系统 × Ryzen AI Max PRO 400 × PyTorch 2.12 生产级实战
2026-07-23 12:17:54 +0800 CST
view 187
深度解析 AMD ROCm 7.14 正式版:TheRock 模块化构建系统、Ryzen AI Max PRO 400 统一内存架构、PyTorch 2.12+JAX 0.10.0 框架支持,配 HIPify 迁移实战与 vLLM 推理部署完整指南。
ROCm
AMD GPU
HIP
CUDA迁移
PyTorch
JAX
MI350P
Ryzen AI Max
Stanford CS336 深度实战:从零实现大语言模型——数据清洗、Transformer 架构、FlashAttention 系统优化到 RL 对齐的完全指南(2026)
编程
Stanford CS336 深度实战:从零实现大语言模型——数据清洗、Transformer 架构、FlashAttention 系统优化到 RL 对齐的完全指南(2026)
2026-06-02 20:14:38 +0800 CST
view 627
Stanford CS336 课程深度解读:从零实现大语言模型,覆盖 Tokenizer、Transformer、FlashAttention-2、FSDP 分布式训练、Scaling Law、Common Crawl 数据清洗去重、SFT 与 GRPO 对齐,配完整代码示例。
LLM
Transformer
Stanford CS336
FlashAttention
PyTorch
AI工程
分布式训练
强化学习
Wasmtime v46 深度解析:WebAssembly 生产级运行时的 2026 架构革命
编程
Wasmtime v46 深度解析:WebAssembly 生产级运行时的 2026 架构革命
2026-06-30 11:48:19 +0800 CST
view 439
深度解析 Wasmtime v46:Cranelift JIT 编译器、WASI 0.2 系统接口、Component Model 组件化架构,以及 AI 推理边缘部署实战
WebAssembly
Wasmtime
WASI
Bytecode Alliance
Cranelift
Component Model
Rust
边缘计算
Serverless
AI推理
Wasmtime v46 深度解析:WebAssembly 生产级运行时的 2026 架构革命——Cranelift、WASI 0.2 与 Component Model 全栈指南
编程
Wasmtime v46 深度解析:WebAssembly 生产级运行时的 2026 架构革命——Cranelift、WASI 0.2 与 Component Model 全栈指南
2026-06-30 11:48:41 +0800 CST
view 300
深度解析 Wasmtime v46:Cranelift JIT 编译器、WASI 0.2 系统接口、Component Model 组件化架构,以及 AI 推理边缘部署实战
WebAssembly
Wasmtime
WASI
Bytecode Alliance
Cranelift
Component Model
Rust
边缘计算
Serverless
AI推理
从140GB到4GB:AirLLM无量化层间推理原理深度剖析与生产级部署实战(2026)
编程
从140GB到4GB:AirLLM无量化层间推理原理深度剖析与生产级部署实战(2026)
2026-06-22 19:28:19 +0800 CST
view 413
深入解析 AirLLM 的无量化层间 Offloading 技术原理,探讨如何通过 CPU-GPU 混合推理在 4GB 显存上运行 70B 大模型,附完整代码实战与生产部署指南。
LLM推理
GPU优化
CPU Offload
层间调度
AirLLM
PyTorch
花3块钱、2小时训练一个64M的"小破模型",能干啥?
编程
花3块钱、2小时训练一个64M的"小破模型",能干啥?
2026-04-21 09:05:56 +0800 CST
view 585
MiniMind:从零手写完整LLM训练流水线,64M参数,2小时+3块钱训练完成,支持预训练+SFT+RLHF+工具调用,适合Multi-Agent/自动化/端侧集成
开源
LLM
PyTorch
模型训练
MiniMind
AI
工具调用
RLHF
Wasmtime 深度解剖:WASI Component Model 如何重塑 Server-Side WebAssembly 的工程边界
编程
Wasmtime 深度解剖:WASI Component Model 如何重塑 Server-Side WebAssembly 的工程边界
2026-07-25 08:44:58 +0800 CST
view 205
深度拆解 Wasmtime v0.19 的三层架构:Cranelift JIT 编译器、WASI 0.2 系统接口、Component Model 组件模型,以及它们如何重塑 Server-Side WebAssembly 的工程边界。
Wasmtime
WebAssembly
WASI
Component Model
JIT编译器
Cranelift
Bytecode Alliance
服务器端Wasm
UI-TARS-Desktop 深度解析:ByteDance 如何用多模态 AI Agent 重新定义 GUI 自动化
编程
UI-TARS-Desktop 深度解析:ByteDance 如何用多模态 AI Agent 重新定义 GUI 自动化
2026-05-12 04:43:13 +0800 CST
view 1133
UI-TARS-Desktop 是 ByteDance 开源的多模态 AI Agent 技术栈,包含 Agent TARS CLI/Web UI 和 UI-TARS-Desktop 原生应用。支持自然语言控制电脑、视觉理解界面、MCP 工具集成、Event Stream 协议驱动的 Context Engineering。本文深入解析其架构设计、核心特性、实战案例、性能基准与部署最佳实践。
UI-TARS
ByteDance
GUI自动化
多模态AI
MCP
世界模型深度解析:从预测下一个词到预测世界下一秒——NTP 到 NSP 的范式革命与生产级实战指南
编程
世界模型深度解析:从预测下一个词到预测世界下一秒——NTP 到 NSP 的范式革命与生产级实战指南
2026-07-07 02:12:36 +0800 CST
view 276
深度解析2026年最火爆的AI技术——世界模型:从Next Token Prediction到Next-State Prediction的范式革命。涵盖DreamerV3潜在空间动力学、Google Gemini Omni原生多模态世界模型、EvoPhys-World国产GPU训练突破,含完整PyTorch实战代码。
世界模型
World Model
NTP
NSP
Next-State Prediction
DreamerV3
Gemini Omni
PyTorch
AI
WebAssembly Component Model 深度解析:用 WIT 接口定义 + 跨语言互操作把 WASM 从「语言孤岛」变成「组件联邦」
编程
WebAssembly Component Model 深度解析:用 WIT 接口定义 + 跨语言互操作把 WASM 从「语言孤岛」变成「组件联邦」
2026-07-07 12:16:32 +0800 CST
view 275
深度解析 WebAssembly Component Model:WIT 接口类型语言、World 世界定义、WASI 0.2.0 系统接口、跨语言互操作、Rust+Go+JS 多组件组合实战、Wasmtime 和 Fermyon Spin 生产级部署。
WebAssembly
WASM
Component Model
WIT
WASI
跨语言
Bytecode Alliance
wasmtime
Fermyon
Docker AI Toolkit 2026 深度解析:从镜像构建到推理服务,AI 工作流的全链路重构
编程
Docker AI Toolkit 2026 深度解析:从镜像构建到推理服务,AI 工作流的全链路重构
2026-05-14 01:55:02 +0800 CST
view 520
Docker AI Toolkit 2026于2026年3月1日发布,原生支持PyTorch 2.4、TensorFlow 2.17、ONNX Runtime 1.19一键构建,Sigstore签名+OIDC身份绑定防止供应链攻击,docker ai serve --adaptive自适应推理让GPU利用率稳定在80%,LLM微调延迟压至83ms,WASM沙箱让边缘AI应用启动时间<100ms。
Docker,AI Toolkit,PyTorch,TensorFlow,ONNX Runtime,模型签名验证,Sigstore,WASM沙箱,自适应推理
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
27
28
29
30
31
...
74
下一页