程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
Ollama v0.14.3 深度实战:从本地部署到多模态 AI——2026 年私有化大模型工程化完全指南
编程
Ollama v0.14.3 深度实战:从本地部署到多模态 AI——2026 年私有化大模型工程化完全指南
2026-05-24 12:04:34 +0800 CST
view 398
Ollama v0.14.3 深度实战指南:从架构解析到生产部署,涵盖 GGUF 格式、API 集成、多模态模型、性能优化等核心内容,2026 年私有化大模型首选方案。
Ollama
大模型
本地部署
GGUF
多模态
pycm:一个强大的混淆矩阵库
综合
pycm:一个强大的混淆矩阵库
2024-11-18 16:17:54 +0800 CST
view 1888
pycm是一个用于生成和分析混淆矩阵的Python库,能够自动计算多种评估指标并提供可视化功能。本文介绍了pycm的安装、基本用法和高级用法,包括如何生成混淆矩阵、导出结果以及支持多标签和多类别分类的功能。通过实际案例展示了如何使用pycm评估机器学习模型的性能,是数据科学家和机器学习工程师的重要工具。
机器学习
数据科学
模型评估
工具
从原理到实战:llama.cpp 与 GGUF 量化格式的工程实践全解
编程
从原理到实战:llama.cpp 与 GGUF 量化格式的工程实践全解
2026-04-12 22:56:41 +0800 CST
view 1111
2026年深度解析 llama.cpp 架构设计与 GGUF 量化格式,从底层原理到工程实战,涵盖 K-Quant/IQ 量化、Flash Attention、KV Cache 优化、Intel NPU/GPU 部署全流程。
llama.cpp
GGUF
量化
大模型
C++
本地部署
Kimi K2.6 开源:12小时连续编码,300个Agent并行,4000次工具调用
编程
Kimi K2.6 开源:12小时连续编码,300个Agent并行,4000次工具调用
2026-04-21 11:06:57 +0800 CST
view 794
Kimi K2.6 开源版发布:SWE-Bench Pro 58.6,多项榜单压GPT-5.4和Claude Opus 4.6,支持300个并行sub-agent、12小时持续编码、4000次工具调用,开源SOTA位置稳固
Kimi
K2.6
开源
SWE-Bench
Agent
Swarm
长程编码
AI编程
模型开源
HuggingFace
Moonshot
Gemini 2.5 Pro I/O 版深度实战:从思考模型到 AI 编程之巅——2026 年最强推理大模型工程化完全指南
编程
Gemini 2.5 Pro I/O 版深度实战:从思考模型到 AI 编程之巅——2026 年最强推理大模型工程化完全指南
2026-05-24 14:03:27 +0800 CST
view 750
2026年I/O大会后Gemini 2.5 Pro I/O版深度解析,涵盖动态思考、并行推理、百万token上下文、代码实战、性能优化全链路指南
AI
Gemini
Google
大模型
代码生成
OmniRoute 深度拆解:一个端点接入 290+ 大模型——免费 AI 网关的工程架构与 2026 年 Token 经济学革命
编程
OmniRoute 深度拆解:一个端点接入 290+ 大模型——免费 AI 网关的工程架构与 2026 年 Token 经济学革命
2026-07-30 20:46:41 +0800 CST
view 198
OmniRoute:GitHub 33k Stars 开源 AI 网关,支持 290+ 提供商、500+ 模型,RTK+Caveman 双引擎 Token 压缩节省 15-95%,18 种智能路由策略,内置 104 MCP 工具,与 Claude Code/Cursor/Copilot 无缝集成,月均 ~15.3 亿免费 Token 配额
OmniRoute
AI网关
Token压缩
RTK
Caveman
AI编程
免费API
开源
多模型路由
MCP
英伟达免费开放H100算力:DeepSeek、Kimi、GLM等主流大模型API免费用
编程
英伟达免费开放H100算力:DeepSeek、Kimi、GLM等主流大模型API免费用
2026-04-21 13:09:34 +0800 CST
view 2214
英伟达Build平台免费开放H100算力和主流大模型API,支持DeepSeek、Kimi、GLM等,3步拿到Key,代码对接OpenAI格式即可使用。
NVIDIA
大模型
免费API
DeepSeek
Kimi
9Router 深度解析:开源路由器如何让 AI 编程成本归零,RTK 压缩省 40% Token
编程
9Router 深度解析:开源路由器如何让 AI 编程成本归零,RTK 压缩省 40% Token
2026-05-12 02:44:46 +0800 CST
view 1007
深度解析9Router:RTK Token Saver压缩工具输出省20-40% token、Caveman Mode省65%输出token、三层自动降级Subscription→Cheap→Free、40+供应商100+模型、格式转换9种API格式、多账户轮询+OAuth自动刷新
9Router,AI路由器,RTK,Token压缩,ClaudeCode,Cursor,多模型路由,自动降级,KiroAI,免费AI编程,CavemanMode,OpenAI兼容
LongCat-2.0 深度解析:美团万亿参数 MoE 大模型如何用国产算力 + LSA 稀疏注意力 + 零计算专家打造 Agentic Coding 王者——从架构原理到生产级实战的完整指南
编程
LongCat-2.0 深度解析:美团万亿参数 MoE 大模型如何用国产算力 + LSA 稀疏注意力 + 零计算专家打造 Agentic Coding 王者——从架构原理到生产级实战的完整指南
2026-07-07 00:13:46 +0800 CST
view 291
深度解析美团开源的LongCat-2.0万亿参数MoE大模型:50K国产卡全流程训练、LSA稀疏注意力实现1M超长上下文、零计算专家动态激活33B-56B、MOPD多专家融合、SWE-bench Pro 59.5超越GPT-5.5。从架构原理到生产级实战的完整指南。
LongCat-2.0
美团
MoE
万亿参数
国产算力
LSA稀疏注意力
Agentic Coding
开源大模型
2.8万亿参数的开源大模型工程极限:Kimi K3 架构深度拆解与本地部署完全指南
编程
2.8万亿参数的开源大模型工程极限:Kimi K3 架构深度拆解与本地部署完全指南
2026-07-30 22:15:48 +0800 CST
view 275
深度拆解 Kimi K3 的 2.8T MoE 架构:KDA 线性注意力、Attention Residuals、Stable Latent MoE、Benchmark 分析与完整本地部署指南
大模型
MoE
混合注意力
Kimi
开源AI
本地部署
世界模型深度解析:从预测下一个词到预测世界下一秒——NTP 到 NSP 的范式革命与生产级实战指南
编程
世界模型深度解析:从预测下一个词到预测世界下一秒——NTP 到 NSP 的范式革命与生产级实战指南
2026-07-07 02:12:36 +0800 CST
view 301
深度解析2026年最火爆的AI技术——世界模型:从Next Token Prediction到Next-State Prediction的范式革命。涵盖DreamerV3潜在空间动力学、Google Gemini Omni原生多模态世界模型、EvoPhys-World国产GPU训练突破,含完整PyTorch实战代码。
世界模型
World Model
NTP
NSP
Next-State Prediction
DreamerV3
Gemini Omni
PyTorch
AI
VibeVoice 深度解析:微软开源语音AI的架构革命,7.5Hz帧率如何重塑长音频处理范式
编程
VibeVoice 深度解析:微软开源语音AI的架构革命,7.5Hz帧率如何重塑长音频处理范式
2026-04-22 01:51:38 +0800 CST
view 690
微软开源VibeVoice语音AI模型家族深度解析,7.5Hz超低帧率连续语音Tokenizer、Next-Token Diffusion架构、ASR长音频识别、TTS多说话人合成、实时流式语音生成,附完整代码实战与生产部署指南
VibeVoice
语音AI
ASR
TTS
微软开源
扩散模型
Qwen3.8-Max 深度拆解:当阿里决定「用 2.4 万亿参数只激活 4%」——从稀疏 MoE 路由到混合注意力分层,一个 PaperBench 全球第一的旗舰模型如何用「极致稀疏化 + 自主进化」重新定义国产大模型的终极形态
编程
Qwen3.8-Max 深度拆解:当阿里决定「用 2.4 万亿参数只激活 4%」——从稀疏 MoE 路由到混合注意力分层,一个 PaperBench 全球第一的旗舰模型如何用「极致稀疏化 + 自主进化」重新定义国产大模型的终极形态
2026-08-06 06:42:51 +0800 CST
view 144
深度拆解阿里Qwen3.8-Max旗舰大模型:2.4T MoE架构、混合注意力分层、16天自主编程、125小时论文复现,PaperBench全球第一的技术内幕
Qwen3.8-Max
MoE
混合注意力
大模型
阿里千问
AI Agent
PaperBench
自主编程
SurrealDB 深度解析:Rust 打造的六合一多模型数据库如何用 Record Links + 向量检索 + ACID 事务让 AI Agent 的「记忆」不再碎片化——从 SurrealQL 语法到生产级知识图谱实战的完整指南
编程
SurrealDB 深度解析:Rust 打造的六合一多模型数据库如何用 Record Links + 向量检索 + ACID 事务让 AI Agent 的「记忆」不再碎片化——从 SurrealQL 语法到生产级知识图谱实战的完整指南
2026-07-07 03:41:54 +0800 CST
view 260
深度解析Rust编写的SurrealDB多模型数据库:六种数据模型(文档+图+关系+向量+时序+KV)统一到单一引擎,Record Links记录链接自动解引用、HNSW向量索引、ACID事务、实时订阅。从SurrealQL语法到AI Agent知识图谱生产实战,含Python/Go SDK完整代码示例与企业案例。
SurrealDB
多模型数据库
Rust
Record Links
向量检索
ACID
AI Agent
SurrealQL
知识图谱
开源
EchoBird百灵鸟:2.2K Star开源AI桌面客户端,一个工具搞定所有AI Agent的安装配置与管理
编程
EchoBird百灵鸟:2.2K Star开源AI桌面客户端,一个工具搞定所有AI Agent的安装配置与管理
2026-06-18 08:34:13 +0800 CST
view 925
EchoBird(百灵鸟)是2200+ Star的开源AI桌面客户端,基于Tauri+Rust,图形界面一键安装管理12+ AI Agent工具(Claude Code/Codex/OpenClaw/Aider等),Model Nexus统一配置模型,内置llama.cpp/vLLM本地推理引擎,一键启动本地大模型。
EchoBird
AI桌面客户端
Agent管理
Tauri
Rust
开源
本地大模型
AI工具管理
百灵鸟
K8s 1.36 ImageVolume 正式 GA:把 OCI 镜像当 Volume 挂载,AI 模型分发终于有了「官方正解」
编程
K8s 1.36 ImageVolume 正式 GA:把 OCI 镜像当 Volume 挂载,AI 模型分发终于有了「官方正解」
2026-07-31 01:43:56 +0800 CST
view 157
K8s 1.36 ImageVolume 正式 GA:深度拆解 OCI 镜像作为 Volume 挂载的底层机制、kubelet 与容器运行时链路、模型镜像分层构建、vLLM 部署实战、P2P 加速与 GC 调优,AI 模型分发的官方正解。
Kubernetes
ImageVolume
OCI
云原生
模型分发
containerd
AI基础设施
vLLM
2026年端侧AI千亿参数突破深度解析:从量化技术到NPU架构,手机如何跑赢云端大模型
编程
2026年端侧AI千亿参数突破深度解析:从量化技术到NPU架构,手机如何跑赢云端大模型
2026-04-22 03:52:11 +0800 CST
view 860
深度解析2026年端侧AI千亿参数突破的技术原理:从INT4量化到MoE架构,从存算一体NPU到动态内存优化,揭示手机如何跑赢云端大模型的核心工程密码。
AI
端侧AI
大模型
量化
NPU
万字深度解析百度 Unlimited OCR:当 R-SWA 注意力机制让端到端 OCR 一次性解析数十页文档——从架构设计到生产级部署完整指南(2026)
编程
万字深度解析百度 Unlimited OCR:当 R-SWA 注意力机制让端到端 OCR 一次性解析数十页文档——从架构设计到生产级部署完整指南(2026)
2026-07-01 15:43:34 +0800 CST
view 293
2026年6月百度开源Unlimited OCR深度解析:R-SWA参考滑动窗口注意力机制将KV Cache压为常数,3B参数(500M激活)在OmniDocBench以93.92%刷新SOTA,单次解析40+页文档。从架构设计到生产级部署完整技术指南。
Unlimited-OCR
R-SWA
百度
端到端OCR
大模型
MoE
DeepEncoder
性能优化
开源项目
Python
Trae IDE 深度实战:当字节跳动用 AI 原生重新定义 IDE——从 SOLO 模式到全链路智能开发的完全指南(2026)
编程
Trae IDE 深度实战:当字节跳动用 AI 原生重新定义 IDE——从 SOLO 模式到全链路智能开发的完全指南(2026)
2026-06-18 09:57:04 +0800 CST
view 529
2026年的编程工具市场,正在经历一场前所未有的范式转移。 回望过去五年,我们经历了三个阶段: **第一阶段(2021-2023):补全时代**。GitHub Copilot 开创了 AI 代码补全的先河,开发者开始习惯"写一半,AI 补一半"的开发体验。核心交互是:在 IDE 中输入代码,AI 在后台默默生成补全建议,开发者按 Tab 接受或 Esc 拒绝。工具的定位是"高级 Autocomplete",本质上是加速人的输出。
AI编程
Tra eIDE
字节跳动
SOLO模式
AI Agent
多模型
GitHub Copilot
Cursor
开发效率
编程工具
Headroom深度解析:如何让AI上下文压缩60-95%的Token?原理、实战与性能优化
编程
Headroom深度解析:如何让AI上下文压缩60-95%的Token?原理、实战与性能优化
2026-06-26 01:44:48 +0800 CST
view 391
深度解析Headroom上下文压缩技术,如何实现60-95%的Token节省,包含原理剖析、实战代码、性能优化和源码解析。适合AI应用开发者。
AI
上下文压缩
Token优化
大语言模型
代码压缩
MCP 深度实战:把大模型接进真实世界——从 JSON-RPC 2.0、Streamable HTTP 传输到生产级 MCP Server 与安全护栏的完整工程指南(2026)
编程
MCP 深度实战:把大模型接进真实世界——从 JSON-RPC 2.0、Streamable HTTP 传输到生产级 MCP Server 与安全护栏的完整工程指南(2026)
2026-07-20 05:13:17 +0800 CST
view 252
2026 年 MCP 已成 AI 工具集成事实标准。本文深度拆解协议内核、Streamable HTTP 传输、Tools/Resources/Prompts 原语,用 FastMCP 与 TypeScript SDK 手把手构建生产级 Server/Client,并给出性能优化与防工具投毒的安全护栏。
MCP
模型上下文协议
AI智能体
FastMCP
Streamable HTTP
工具调用
JSON-RPC
AI工程化
Anthropic 在 Claude 内部发现了"意识前厅":J空间如何重写 AI 可解释性与安全格局
编程
Anthropic 在 Claude 内部发现了"意识前厅":J空间如何重写 AI 可解释性与安全格局
2026-07-13 15:14:42 +0800 CST
view 214
2026年7月Anthropic重磅论文解读:Claude内部自发涌现的J空间(雅可比空间)与人类全局工作空间高度相似,从神经科学理论到五大因果实验,从AI可解释性突破到安全范式革命,一次把大模型内部黑箱讲透。
Claude
Anthropic
J空间
全局工作空间
AI可解释性
AI安全
大模型
意识科学
Transformer
AGI
红队测试
LangGraph 深度实战:从状态机架构到生产级 Multi-Agent 编排的完整指南(2026)
编程
LangGraph 深度实战:从状态机架构到生产级 Multi-Agent 编排的完整指南(2026)
2026-06-04 18:45:17 +0800 CST
view 605
2026年最全面的LangGraph实战指南:从状态机架构原理到生产级Multi-Agent协作系统开发,包含完整代码示例与电商智能客服案例。
LangGraph
Multi-Agent
AI Agent
Python
大模型
WASI 0.3 深度实战:当异步成为 WebAssembly 组件的原生特性——从事件循环协调到 stream/future/async ABI、跨语言绑定与生产级完全指南(2026)
编程
WASI 0.3 深度实战:当异步成为 WebAssembly 组件的原生特性——从事件循环协调到 stream/future/async ABI、跨语言绑定与生产级完全指南(2026)
2026-06-18 14:24:59 +0800 CST
view 425
2026年6月11日发布的WASI 0.3将异步操作提升为WebAssembly组件的原生特性。本文深入剖析共享事件循环、stream/future/async一等构造、基于完成的I/O模型,以及Rust/Go/Python多语言实战。
WebAssembly
WASI
异步编程
组件模型
Go
Rust
Python
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
13
14
15
16
17
...
20
下一页