程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
综合
使用OpenAI文本嵌入模型的全面指南
2024-11-18 11:26:06 +0800 CST
view 2257
本文提供了关于使用OpenAI文本嵌入模型的全面指南,涵盖向量嵌入的定义、应用场景及模型选择。向量嵌入能够将非结构化数据转换为机器可处理的向量表示,广泛应用于语义搜索、推荐系统等。文中还介绍了如何使用OpenAI的嵌入模型生成向量嵌入,并与ZillizCloud集成,以实现高效的语义搜索。
人工智能
机器学习
数据处理
技术指南
开发者资源
AReaL 2.0 深度解析:蚂蚁联合清华港科大开源的 Agent 自演进引擎——在线强化学习如何让智能体「越用越强」的完整实战指南
编程
AReaL 2.0 深度解析:蚂蚁联合清华港科大开源的 Agent 自演进引擎——在线强化学习如何让智能体「越用越强」的完整实战指南
2026-07-06 14:44:28 +0800 CST
view 327
深度解析蚂蚁联合清华港科大开源的AReaL 2.0在线强化学习基础设施:ATDP轨迹协议、Agentic Data Proxy、Agent Evolution Control Plane三根支柱架构、微服务化Online RL工作流、KPop稳定化策略、防reward hacking机制、Hermes/Claude Code Agent训练实战、AReaL-SEA在τ²-bench超越GPT-5。含完整代码示例与Docker部署指南。
AReaL
Agent自演进
在线强化学习
Online RL
蚂蚁
清华大学
智能体
开源
Thinc是一个轻量级的Python机器学习库,专为自然语言处理设计,简化模型的创建、训练和部署
编程
Thinc是一个轻量级的Python机器学习库,专为自然语言处理设计,简化模型的创建、训练和部署
2024-11-18 13:18:03 +0800 CST
view 1762
Thinc是一个轻量级的Python机器学习库,专为自然语言处理设计,简化模型的创建、训练和部署。它基于PyTorch和CycleHub,提供简洁的接口,支持文本分类、序列标注、命名实体识别等任务。Thinc旨在让更多开发者能够使用机器学习,通过简单的API快速构建功能强大的模型。
机器学习
自然语言处理
Python库
zerod是一个功能强大且高效的开源Python库,专为数据处理和机器学习设计
编程
zerod是一个功能强大且高效的开源Python库,专为数据处理和机器学习设计
2024-11-18 20:43:14 +0800 CST
view 1762
zerod是一个功能强大且高效的开源Python库,专为数据处理和机器学习设计。它引入动态长度数组,支持异步I/O、分布式计算和高效的数据处理,适用于网络编程、数据分析和游戏开发等多个领域。zerod提供简洁的API,帮助开发者快速构建高效应用。
Python库
数据处理
机器学习
网络编程
分布式系统
游戏开发
Python 实现验证码识别:使用 Ddddocr 库
综合
Python 实现验证码识别:使用 Ddddocr 库
2024-11-18 18:38:02 +0800 CST
view 2706
本文介绍了`ddddocr`库的使用,该库是一个基于`pytorch`和`onnxruntime`的开源OCR工具,专注于验证码和图片文字识别。提供了安装方法、基本使用示例、目标检测功能以及高级特性,如滑块检测和自定义模型导入。通过简单的代码示例,开发者可以快速实现OCR识别和目标检测,适合处理各种验证码场景。
Python
OCR
图像处理
机器学习
开源
智谱 slime 深度实战:当 RL 后训练终于有了工业级「炼丹炉」——从 Megatron+SGLang 三模块联调到 GLM-5.2 两天完成 OPD 后训练的生产级完全指南(2026)
编程
智谱 slime 深度实战:当 RL 后训练终于有了工业级「炼丹炉」——从 Megatron+SGLang 三模块联调到 GLM-5.2 两天完成 OPD 后训练的生产级完全指南(2026)
2026-06-23 07:54:24 +0800 CST
view 365
2026年6月智谱开源RL后训练框架slime,支撑GLM-5.2仅用2天完成OPD后训练。本文深度解析其三模块架构、原生引擎透传设计、PD分离、增量权重同步等核心技术,附完整生产级部署实战代码。
强化学习
RL训练
slime框架
智谱AI
GLM-5.2
Megatron
SGLang
后训练
开源框架
生产级部署
µP 深度拆解:当调参侠终于破解 scaling 诅咒——从最大更新参数化到万亿参数大模型超参迁移的工程全貌(2026)
编程
µP 深度拆解:当调参侠终于破解 scaling 诅咒——从最大更新参数化到万亿参数大模型超参迁移的工程全貌(2026)
2026-07-19 08:43:41 +0800 CST
view 124
深度拆解微软/ OpenAI 的 µP(最大更新参数化)理论:从 Tensor Programs 数学框架、为什么标准参数化失效、到 PyTorch mup 库完整实战代码,含 Transformer 层、AdamW 配置、跨尺度超参数迁移验证与生产级 Pipeline。
µP
Max Update Parametrization
超参数迁移
Tensor Programs
深度学习
Transformer
LLM训练
AdamW
mup
微软
万字深度解析百度 Unlimited OCR:当 R-SWA 遇见 MoE——3B 参数如何碾压端到端 OCR 全场(2026)
编程
万字深度解析百度 Unlimited OCR:当 R-SWA 遇见 MoE——3B 参数如何碾压端到端 OCR 全场(2026)
2026-07-01 03:42:17 +0800 CST
view 264
2026年6月百度开源Unlimited OCR,5天GitHub Star破万。深度解析R-SWA注意力机制、MoE架构、16倍视觉Token压缩,以及为何能将KV Cache从线性增长压成常数。
Unlimited OCR
OCR
R-SWA
MoE
百度
深度学习
计算机视觉
文档识别
KV Cache
VibeVoice深度解析:微软如何用7.5Hz超低帧率Tokenizer突破语音AI的「超长上下文」困境
编程
VibeVoice深度解析:微软如何用7.5Hz超低帧率Tokenizer突破语音AI的「超长上下文」困境
2026-04-12 14:25:53 +0800 CST
view 770
深入解析微软VibeVoice开源语音AI框架,探讨其7.5Hz超低帧率Tokenizer、LLM+Diffusion混合架构如何突破60分钟ASR和90分钟TTS的长上下文困境,附完整工程实践代码。
语音AI
ASR
TTS
VibeVoice
微软
开源
深度学习
Hermes Agent 深度实战:从自学习 Skill 到三层记忆——15 万 Star 的自进化 AI Agent 架构完全指南(2026)
编程
Hermes Agent 深度实战:从自学习 Skill 到三层记忆——15 万 Star 的自进化 AI Agent 架构完全指南(2026)
2026-05-24 07:03:26 +0800 CST
view 631
Hermes Agent 深度实战:从源码级架构拆解到生产级部署,完整解析自学习 Skill 系统、三层记忆架构、Cron 定时任务、MCP 集成与安全防线
Hermes Agent
AI Agent
自学习
技能系统
记忆架构
MCP
FastFM是一个高效的Python库,实现了因子分解机(FM)算法,特别适用于处理高维稀疏数据,如推荐系统和广告点击率预测
综合
FastFM是一个高效的Python库,实现了因子分解机(FM)算法,特别适用于处理高维稀疏数据,如推荐系统和广告点击率预测
2024-11-18 20:20:49 +0800 CST
view 1794
FastFM是一个高效的Python库,实现了因子分解机(FM)算法,特别适用于处理高维稀疏数据,如推荐系统和广告点击率预测。它提供灵活的API,支持多种特征和损失函数,允许开发者轻松构建和训练FM模型。示例代码展示了如何使用FastFM进行分类和预测,适合大规模数据集的应用场景。
机器学习
数据分析
推荐系统
Python中的shapley-regression库,重点在于如何安装、使用及其在机器学习模型中的应用
综合
Python中的shapley-regression库,重点在于如何安装、使用及其在机器学习模型中的应用
2024-11-19 05:02:08 +0800 CST
view 1767
本文介绍了Python中的shapley-regression库,重点在于如何安装、使用及其在机器学习模型中的应用。通过计算SHAP值,用户可以理解特征对模型预测的贡献,并利用可视化工具展示这些信息。文章涵盖了库的基本用法和高级用法,包括模型训练、SHAP值计算和特征重要性的可视化,适用于房价预测等实际案例。
数据分析
机器学习
模型解释
patmlkit是一个专为数据分析与机器学习设计的Python库
综合
patmlkit是一个专为数据分析与机器学习设计的Python库
2024-11-18 15:51:33 +0800 CST
view 1580
patmlkit是一个专为数据分析与机器学习设计的Python库,提供数据预处理、模型训练、评估与优化的高效功能。本文介绍了如何安装和使用patmlkit,包括数据标准化、模型选择与训练、网格搜索参数调优以及模型评估。无论是初学者还是经验丰富的数据科学家,patmlkit都能帮助快速完成机器学习任务。
Python
数据科学
机器学习
库
工具
DiffusionGemma 深度实战:当谷歌用图像扩散的逻辑重塑文本生成——从离散扩散原理到 4 倍推理加速的生产级完全指南(2026)
编程
DiffusionGemma 深度实战:当谷歌用图像扩散的逻辑重塑文本生成——从离散扩散原理到 4 倍推理加速的生产级完全指南(2026)
2026-06-17 23:28:33 +0800 CST
view 470
2026年6月谷歌开源DiffusionGemma,26B MoE参数仅激活3.8B,通过离散扩散实现4倍推理加速。本文从原理、架构、代码实战、性能优化全面深度解析这一范式级创新。
DiffusionGemma
谷歌
文本扩散
MoE
AI推理
Gemma
开源模型
离散扩散
并行生成
深度学习
Hermes Agent 深度实战:自进化 AI Agent 的三层记忆架构与 Skill 自动生成完全指南(下篇)
编程
Hermes Agent 深度实战:自进化 AI Agent 的三层记忆架构与 Skill 自动生成完全指南(下篇)
2026-06-04 04:45:35 +0800 CST
view 487
下篇:深入讲解 Nudge Engine 定时复盘、强化学习从经验中学习、完整代码实战(从零搭建自进化 Agent)、与其他框架对比、生产级最佳实践、性能优化策略。
Hermes Agent
自进化
AI Agent
Nudge Engine
强化学习
代码实战
pycm:一个强大的混淆矩阵库
综合
pycm:一个强大的混淆矩阵库
2024-11-18 16:17:54 +0800 CST
view 1848
pycm是一个用于生成和分析混淆矩阵的Python库,能够自动计算多种评估指标并提供可视化功能。本文介绍了pycm的安装、基本用法和高级用法,包括如何生成混淆矩阵、导出结果以及支持多标签和多类别分类的功能。通过实际案例展示了如何使用pycm评估机器学习模型的性能,是数据科学家和机器学习工程师的重要工具。
机器学习
数据科学
模型评估
工具
dsnd-prob-vd是一个专为数据科学和机器学习开发的Python库
综合
dsnd-prob-vd是一个专为数据科学和机器学习开发的Python库
2024-11-17 15:00:38 +0800 CST
view 1635
dsnd-prob-vd是一个专为数据科学和机器学习开发的Python库,提供数据处理、概率计算和可视化功能。本文介绍了该库的安装、基本用法、高级用法及实际案例,帮助用户快速掌握如何使用该库进行数据分析。通过示例代码,用户可以学习如何导入数据、处理数据、进行统计分析和绘制可视化图表。
数据科学
机器学习
Python库
数据处理
可视化
WiFi DensePose 深度解析:用无线电波「看穿」世界——从 CSI 信号到人体姿态的完整工程实践
编程
WiFi DensePose 深度解析:用无线电波「看穿」世界——从 CSI 信号到人体姿态的完整工程实践
2026-04-21 12:52:19 +0800 CST
view 612
深度拆解WiFi DensePose开源项目:从CSI信号采集、相位清洗、Hampel滤波到图神经网络模型架构,从ESP32固件开发到Rust 54000FPS推理引擎,完整工程实践指南
WiFi感知
CSI
深度学习
ESP32
Rust
人体姿态估计
隐私计算
colibrì 深度拆解:1300行纯C代码驱动7440亿参数大模型——当「不可能」变成「只是慢」
编程
colibrì 深度拆解:1300行纯C代码驱动7440亿参数大模型——当「不可能」变成「只是慢」
2026-07-19 14:42:08 +0800 CST
view 190
深度拆解 colibrì 项目:一位意大利开发者用 10 天、1300 行纯 C 代码,在 25GB 笔记本上运行 7440 亿参数大模型的工程全貌。涵盖 MoE 稀疏推理、NVMe 流式专家、MLA 注意力、MTP 推测解码等核心技术的完整解析。
C语言
MoE
大模型
NVMe
量化
GPU
深度学习
GLM-5.2
推理引擎
推测解码
Hermes Agent 深度解析:当 AI 学会「自我进化」——从四层记忆架构到技能自生成的工程全解
编程
Hermes Agent 深度解析:当 AI 学会「自我进化」——从四层记忆架构到技能自生成的工程全解
2026-04-13 02:56:20 +0800 CST
view 1528
深度解析Hermes Agent的工程实现:四层记忆架构(SQLite+FTS5)、技能自生成闭环、与OpenClaw的本质对比,以及这条「自我进化」路线对AI工具链未来的意义。
AI Agent
Hermes Agent
自我进化
记忆架构
Nous Research
技能系统
SQLite
机器学习
Microsoft Agent Lightning 深度实战:零代码变更优化AI代理的强化学习完全指南(2026)
编程
Microsoft Agent Lightning 深度实战:零代码变更优化AI代理的强化学习完全指南(2026)
2026-05-24 15:00:19 +0800 CST
view 424
深度解析Microsoft Agent Lightning框架,探讨如何通过零代码变更方式优化AI代理,包括架构分析、代码实战和性能优化
AI Agent
强化学习
微软开源
agent训练框架
RL训练
HuggingFace ml-intern 深度实战:一个命令让 AI 读论文、训模型、推到 Hub——ML 工程自动化的端到端革命(2026)
编程
HuggingFace ml-intern 深度实战:一个命令让 AI 读论文、训模型、推到 Hub——ML 工程自动化的端到端革命(2026)
2026-06-04 08:41:56 +0800 CST
view 646
HuggingFace ml-intern 深度实战解析:从架构原理到代码实战,完整拆解这个能自主读论文、训模型、推送到 Hub 的 AI 实习生项目。
HuggingFace
ml-intern
AI Agent
机器学习
开源项目
综合
使用Ollama部署本地大模型
2024-11-19 10:00:55 +0800 CST
view 3473
本文介绍了如何使用Ollama部署本地大模型服务,Ollama是一个开源的管理框架,支持多种流行的大语言模型(LLM)。通过简单的命令,用户可以快速安装、启动和运行模型,并结合MaxKB构建私人知识库。文章详细说明了安装步骤、模型下载与运行命令,以及如何配置服务和导入模型,适合希望在本地环境中使用大模型的用户。
人工智能
机器学习
软件开发
Helios深度解析:北大袁粒团队如何用14B参数重塑实时视频生成——从架构革命到工程落地的全解
编程
Helios深度解析:北大袁粒团队如何用14B参数重塑实时视频生成——从架构革命到工程落地的全解
2026-04-13 05:23:52 +0800 CST
view 871
深入解析北京大学袁粒团队发布的Helios 14B实时长视频生成模型,涵盖三阶段训练流程、统一历史注入、金字塔预测校正器、对抗层次蒸馏等核心技术创新,以及完整部署实战指南
视频生成
Helios
扩散模型
深度学习
实时推理
PyTorch
HuggingFace
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
2
3
4
5
6
...
8
下一页