程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
腾讯版"贾维斯"Marvis上线:6个Agent协同干活,每天1000万Token免费用
编程
腾讯版"贾维斯"Marvis上线:6个Agent协同干活,每天1000万Token免费用
2026-05-22 07:14:58 +0800 CST
view 1024
腾讯操作系统层级AI助手Marvis正式上线,预置6个Agent协同团队,L2级安全兜底机制,效率/隐私双模式,每人每天1000万免费Token,支持手机远程接管电脑。
腾讯AI
Marvis
AI助手
操作系统级
多Agent
L2安全
OmniRoute 深度实战:一个开源 AI 网关如何用 RTK+Caveman 双层压缩算法省掉你 95% 的 Token 账单
编程
OmniRoute 深度实战:一个开源 AI 网关如何用 RTK+Caveman 双层压缩算法省掉你 95% 的 Token 账单
2026-07-10 10:47:32 +0800 CST
view 340
深度拆解 OmniRoute:237家AI提供商聚合、RTK+Caveman双层压缩算法(节省15-95%Token)、四级断路器自动故障转移,从架构设计到生产部署的完整实战指南
OmniRoute
AI网关
RTK压缩
Caveman
Token优化
开源
AI Agent
TypeScript
DeepSeek V4-Flash 正式版深度拆解:284B MoE 架构如何用 13B 激活参数干翻自家 1.6T 旗舰——CSA+HCA 混合压缩注意力、Muon 优化器与 Agent 能力跃迁的全栈工程哲学
编程
DeepSeek V4-Flash 正式版深度拆解:284B MoE 架构如何用 13B 激活参数干翻自家 1.6T 旗舰——CSA+HCA 混合压缩注意力、Muon 优化器与 Agent 能力跃迁的全栈工程哲学
2026-08-03 19:12:41 +0800 CST
view 263
深度拆解DeepSeek V4-Flash 284B MoE架构:CSA+HCA混合压缩注意力机制让1M上下文KV Cache降至V3.2的7%,Muon优化器替代AdamW,Agent能力跃迁至Terminal Bench 82.7分,13B激活参数推理成本仅0.88元/530万token,附完整部署代码与性能优化实战指南
DeepSeek
V4-Flash
MoE
CSA
HCA
Muon优化器
Agent
大模型
开源
AReaL:当异步强化学习遇上大模型Agent,训练效率狂飙2.77倍
编程
AReaL:当异步强化学习遇上大模型Agent,训练效率狂飙2.77倍
2026-04-18 09:13:49 +0800 CST
view 634
深度解析蚂蚁集团开源的大规模异步强化学习框架AReaL,训练效率提升2.77倍,支持数学推理、搜索Agent、多模态等多种场景。
强化学习
Agent
AI训练
开源框架
异步计算
DeepSeek V4 深度解析:百万token上下文的技术革命,让开源模型站上全球之巅
编程
DeepSeek V4 深度解析:百万token上下文的技术革命,让开源模型站上全球之巅
2026-04-28 08:19:25 +0800 CST
view 769
深度解析 DeepSeek V4:混合注意力机制、MoE 架构、100万token 上下文、Agent 能力,从技术原理到部署实战,全面剖析开源模型新天花板
DeepSeek
AI大模型
开源
长上下文
MoE
混合注意力
Agent
又一个爆火的神级Skill,开源了!PinMe全栈Web应用开发底座
编程
又一个爆火的神级Skill,开源了!PinMe全栈Web应用开发底座
2026-05-15 21:49:39 +0800 CST
view 793
PinMe从部署工具进化为全栈Web应用开发底座,一条命令搭起完整应用,服务端、数据库、大模型调用全包,支持Claude Code等主流编程Agent。
开源项目
AI Agent
全栈开发
Skill
事件溯源与CQRS深度实战:从状态存储到事件日志的架构革命
编程
事件溯源与CQRS深度实战:从状态存储到事件日志的架构革命
2026-05-09 03:05:57 +0800 CST
view 644
深入探讨事件溯源与CQRS架构模式的核心原理、实现方式与生产级实践,从状态存储到事件日志的架构革命
Event Sourcing
CQRS
架构设计
DDD
分布式系统
WWDC 2026 深度前瞻:从「雪豹式」iOS 27 到 AI 原生 Swift——苹果开发者生态的范式迁移
编程
WWDC 2026 深度前瞻:从「雪豹式」iOS 27 到 AI 原生 Swift——苹果开发者生态的范式迁移
2026-05-22 07:49:46 +0800 CST
view 661
WWDC 2026 前瞻深度解析:iOS 27雪豹式更新、Siri Agent化、Apple Intelligence系统级渗透、Swift 6.2并发模型革新
WWDC
iOS 27
Swift
Apple Intelligence
Siri
TradingAgents-CN 深度实战:当 AI 多智能体遇上量化交易——从架构原理到 A 股智能决策的完全指南(2026)
编程
TradingAgents-CN 深度实战:当 AI 多智能体遇上量化交易——从架构原理到 A 股智能决策的完全指南(2026)
2026-06-10 03:50:20 +0800 CST
view 840
深入解析 TradingAgents-CN 的核心架构、多智能体协作机制、A 股本地化适配方案,从零搭建生产级 AI 量化交易系统。
AI量化交易
多智能体系统
TradingAgents
量化交易
金融AI
OmniRoute 深度拆解:免费无限用 Claude/GPT/Gemini?用 28K Stars 的开源 AI 网关给所有 AI 编程工具装上「永不掉线」引擎
编程
OmniRoute 深度拆解:免费无限用 Claude/GPT/Gemini?用 28K Stars 的开源 AI 网关给所有 AI 编程工具装上「永不掉线」引擎
2026-07-28 00:45:12 +0800 CST
view 287
深度拆解 28.8K Stars 的开源项目 OmniRoute:一个本地 AI 网关,支持 290+ Provider、500+ 模型,通过智能路由、自动故障转移和 RTK+Caveman 双层 Token 压缩,让 AI 编程工具永不掉线且成本可控。
OmniRoute
AI网关
智能路由
Token压缩
AI编程
OpenAI
Anthropic
免费API
UI-TARS-desktop 深度解析:字节跳动开源多模态AI Agent技术栈——让AI真正"看懂"并"操作"你的桌面
编程
UI-TARS-desktop 深度解析:字节跳动开源多模态AI Agent技术栈——让AI真正"看懂"并"操作"你的桌面
2026-05-15 23:17:35 +0800 CST
view 804
深度解析字节跳动开源的UI-TARS-desktop项目,探讨多模态AI Agent如何通过视觉语言模型实现桌面自动化操作,包含完整架构分析、代码实战和性能优化。
AI Agent
多模态
字节跳动
UI-TARS
桌面自动化
Qwen3
UI-TARS-desktop实战:用Qwen3-4B构建跨平台多模态AI Agent——从屏幕理解到桌面自动化
编程
UI-TARS-desktop实战:用Qwen3-4B构建跨平台多模态AI Agent——从屏幕理解到桌面自动化
2026-05-15 23:18:28 +0800 CST
view 595
深度解析字节跳动开源的UI-TARS-desktop项目,探讨多模态AI Agent如何通过视觉语言模型实现桌面自动化操作,包含完整架构分析、代码实战和性能优化。
AI Agent
多模态
字节跳动
UI-TARS
桌面自动化
Qwen3
Buzz 深度拆解:Jack Dorsey 的 Block 开源「人机蜂巢」,为什么说它可能是 Slack 之后团队协作的下一站
编程
Buzz 深度拆解:Jack Dorsey 的 Block 开源「人机蜂巢」,为什么说它可能是 Slack 之后团队协作的下一站
2026-07-28 02:19:36 +0800 CST
view 209
深度拆解 Block 开源项目 Buzz:基于 Nostr 的人机同权团队工作区,Rust 实现的单 relay 架构、12 步事件管线、三级订阅索引与签名审计链,附自托管部署与 Agent 接入实战。
Buzz
Nostr
AI Agent
Rust
Block
团队协作
自托管
开源
Jack Dorsey
DuckDB 1.5.0 深度拆解:向量化执行引擎如何把 TB 级分析塞进一台笔记本——从 VARIANT 类型到湖仓直查的全链路实战
编程
DuckDB 1.5.0 深度拆解:向量化执行引擎如何把 TB 级分析塞进一台笔记本——从 VARIANT 类型到湖仓直查的全链路实战
2026-08-18 19:12:37 +0800 CST
view 57
深度拆解 DuckDB 1.5.0 向量化执行引擎:从列式存储、Data Chunk、Morsel-Driven 并行到 VARIANT 半结构化类型与湖仓直查,配 Python/Go/SQL 代码与性能优化清单。
DuckDB
向量化执行
OLAP
嵌入式数据库
VARIANT
湖仓直查
数据分析
Python
MiroFish 深度解析:当群体智能引擎把"预测未来"做成了一门生意
编程
MiroFish 深度解析:当群体智能引擎把"预测未来"做成了一门生意
2026-04-09 03:35:55 +0800 CST
view 1164
深度解析MiroFish——北邮学生用Claude Code 10天写出的群体智能预测引擎,获陈天桥3000万投资的技术内幕、架构原理与商业前景
MiroFish
群体智能
多智能体
Agent
OASIS
数字沙盘
预测引擎
vLLM 0.5 深度解析:PagedAttention 架构原理与生产级 LLM 推理优化实战
编程
vLLM 0.5 深度解析:PagedAttention 架构原理与生产级 LLM 推理优化实战
2026-07-04 18:15:46 +0800 CST
view 473
深度解析 vLLM 0.5 的 PagedAttention 架构原理,涵盖 KV Cache 分页管理、MoE 优化、分布式推理、量化技术,并通过代码实战和性能对比,帮助开发者掌握生产级 LLM 推理最佳实践。
vLLM
PagedAttention
LLM推理
CUDA
KV Cache
深度学习
AI基础设施
Python
生产部署
性能优化
2026 大模型推理框架选型实战:从 vLLM、TGI 到 TensorRT-LLM 的全链路架构拆解与性能防线
编程
2026 大模型推理框架选型实战:从 vLLM、TGI 到 TensorRT-LLM 的全链路架构拆解与性能防线
2026-08-12 11:14:56 +0800 CST
view 161
深度拆解 2026 年四大主流推理框架 vLLM 0.5、TGI 2.0、TensorRT-LLM 1.8、DeepSpeed-MII 0.9 的核心技术、性能对比与选型指南,涵盖 PagedAttention、Continuous Batching、量化优化、分布式推理与生产踩坑清单。
vLLM
TensorRT-LLM
TGI
DeepSpeed-MII
大模型推理
KV Cache
PagedAttention
推理优化
量化
分布式推理
GitHub MCP Server 深度解析:当全球最大代码平台接过 MCP 生态的接力棒
编程
GitHub MCP Server 深度解析:当全球最大代码平台接过 MCP 生态的接力棒
2026-04-09 03:44:42 +0800 CST
view 1208
GitHub 官方与 Anthropic 联合开发的 MCP 服务器深度解析,涵盖协议原理、Go 架构设计、Claude Desktop 与 VS Code Agent Mode 配置实战,以及 MCP 生态全景与安全实践
MCP
AI
GitHub
Anthropic
协议
Scenethesis 深度实战:当 Agent 闭环遇见 3D 世界生成——英伟达 ICLR 2026 论文全解析
编程
Scenethesis 深度实战:当 Agent 闭环遇见 3D 世界生成——英伟达 ICLR 2026 论文全解析
2026-05-09 06:06:57 +0800 CST
view 855
深度解析英伟达ICLR 2026论文Scenethesis:用四阶段Agent闭环系统实现文本到3D场景生成,碰撞率降至0.8%,首轮通过率72%,自检后提升至91%。含完整代码实现。
AI
3D生成
Agent
英伟达
ICLR
MiroFish 深度解析:群体智能预测引擎的技术革命——用数千个AI Agent构建平行数字世界,让未来在数字沙盘中预演
编程
MiroFish 深度解析:群体智能预测引擎的技术革命——用数千个AI Agent构建平行数字世界,让未来在数字沙盘中预演
2026-05-16 00:46:06 +0800 CST
view 669
MiroFish 深度解析:群体智能预测引擎的技术革命。本文从核心概念、架构分析、代码实战、算法解析、性能优化等维度,全面剖析 MiroFish 如何用数千个 AI Agent 构建平行数字世界,让未来在数字沙盘中预演。
MiroFish
群体智能
AI Agent
预测引擎
Headroom深度解析:让AI Agent的Token消耗降低95%的终极方案
编程
Headroom深度解析:让AI Agent的Token消耗降低95%的终极方案
2026-06-29 04:10:47 +0800 CST
view 485
Netflix工程师开源的Headroom通过透明上下文压缩层实现60-95%的Token节省。本文深度拆解架构原理、六层压缩管道、实战集成和性能优化。
AI Agent
Token优化
开源项目
Rust
Python
OpenAI Astra 深度拆解:2000 美元破解十年数学悬案——多智能体长时程协作架构如何重新定义「AI 做科研」
编程
OpenAI Astra 深度拆解:2000 美元破解十年数学悬案——多智能体长时程协作架构如何重新定义「AI 做科研」
2026-08-03 23:14:51 +0800 CST
view 251
深度拆解OpenAI Astra下一代模型架构:多智能体长时程协作、10项数学突破Lean 4形式化验证、2000美元算力成本的完整工程分析
OpenAI
Astra
多智能体
数学证明
Lean 4
形式化验证
GPT-6
长时程Agent
算力成本
开源
Headroom 深度实战:让 AI Agent 的 Token 消耗暴降 60-95% 的上下文压缩层完全解析
编程
Headroom 深度实战:让 AI Agent 的 Token 消耗暴降 60-95% 的上下文压缩层完全解析
2026-06-29 05:12:24 +0800 CST
view 711
Headroom v0.5.18 完整实战:六层压缩管道深度拆解、SmartCrusher/CodeCompressor/Kompress-base算法原理、四种集成方式代码实战、性能基准验证、headroom learn跨Agent记忆共享。让Token消耗暴降60-95%。
AI Agent
Token压缩
Headroom
上下文管理
LLM优化
编程工具
Python
TypeScript
SGLang 深度拆解:当 RadixAttention 把 KV Cache 变成一棵可复用的「记忆树」——从前缀缓存、零开销调度到生产级推理服务的全链路实战
编程
SGLang 深度拆解:当 RadixAttention 把 KV Cache 变成一棵可复用的「记忆树」——从前缀缓存、零开销调度到生产级推理服务的全链路实战
2026-08-18 21:45:21 +0800 CST
view 59
深度拆解 SGLang 推理引擎:从 RadixAttention 前缀缓存、零开销 CPU 调度、约束解码到 PD 分离与量化,配可运行代码与生产调优清单。
SGLang
RadixAttention
KV Cache
LLM推理
前缀缓存
结构化生成
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
69
70
71
72
73
...
132
下一页