|
12月前
|
机器学习/深度学习 存储 JSON
|

PyCharm 创建了第一个项目

在 PyCharm 中创建项目时,合理的目录结构有助于代码、依赖和资源的高效管理。本文详细解析了 PyCharm 的默认目录结构,如 `.idea/`(配置文件)、`venv/`(虚拟环境)、`src/`(源代码)、`tests/`(测试代码)、`data/`(数据文件)等,并提供了文件创建建议和最佳实践。同时介绍了核心代码、脚本文件、测试文件的存放位置,以及 PyCharm 的常用操作技巧,帮助开发者构建清晰、可维护的项目结构。

877 2
|
12月前
|
供应链 搜索推荐 API
|

1688平台提供的基于图像识别的商品搜索服务

1688图片搜索API基于图像识别技术,支持通过图片查找同款或相似商品,适用于电商选品、供应链管理等场景。开发者需注册账号获取权限,并上传合规图片调用接口。返回数据包含商品信息及相似度评分,助力高效决策。

799 0
|
前端开发 Java 数据库
|

2025 版大学四年学好 Java 并成功拿到 offer 的技术选型与环境搭建全攻略

这篇指南为大一新生提供了系统化的Java学习路线,涵盖环境搭建、核心技术实战与项目经验。首先推荐使用IntelliJ IDEA和OpenJDK 21,掌握函数式编程、异常处理及虚拟线程等关键技能。其次通过图书馆管理系统项目实践MVC架构,结合Spring Boot与H2数据库巩固知识。规划建议从基础语法到集合框架逐步深入,并参与开源项目提升能力。配套在线课程与技术社区资源助力高效学习,助你在大学四年打下坚实基础,顺利拿到offer。

399 0
|
监控 API 开发者
|

1688API接口终极宝典:列表、详情全掌握,图片搜索攻略助你一臂之力

1688为开发者提供涵盖商品、交易、物流和会员等核心业务的丰富API接口。商品类接口支持搜索、详情查询及图片搜索;交易类接口实现订单创建与支付;物流类接口提供报价与轨迹查询;会员类接口获取用户信息与认证。示例代码展示如何用Python通过图片搜索商品,并打印关键信息如价格、起订量和供应商详情。建议先在沙箱环境测试,确保稳定后再投入生产,以实现选品分析与价格监控等功能。

468 7
|
JSON API 开发者
|

淘宝淘口令转换API接口(淘宝API系列)

淘宝淘口令转换API是用于将淘宝商品或店铺链接与淘口令进行双向转换的接口,支持HTTP POST请求。开发者可通过此API生成或解析淘口令,方便在不同平台传播淘宝内容,吸引更多潜在客户。API返回JSON格式数据,包含转换结果和状态信息。使用前需注册并申请权限,确保调用稳定可靠。示例代码展示了如何通过Python实现淘口令的生成和解析功能。

944 5
|
人工智能 自然语言处理 小程序
|

让小程序拥有“视觉之眼“:DeepSeek图像识别实战指南

本文介绍如何通过DeepSeek计算机视觉技术,赋予小程序“看懂世界”的能力。从构建视觉感知系统、训练专属视觉词典到创造会思考的界面,详细讲解了实现智能相册、植物识别器和老旧照片修复等功能的步骤。最后探讨性能优化与安全合规要点,展望未来视觉智能应用的无限可能。

2700 2
|
机器学习/深度学习 算法 PyTorch
|

深度强化学习中SAC算法:数学原理、网络架构及其PyTorch实现

软演员-评论家算法(Soft Actor-Critic, SAC)是深度强化学习领域的重要进展,基于最大熵框架优化策略,在探索与利用之间实现动态平衡。SAC通过双Q网络设计和自适应温度参数,提升了训练稳定性和样本效率。本文详细解析了SAC的数学原理、网络架构及PyTorch实现,涵盖演员网络的动作采样与对数概率计算、评论家网络的Q值估计及其损失函数,并介绍了完整的SAC智能体实现流程。SAC在连续动作空间中表现出色,具有高样本效率和稳定的训练过程,适合实际应用场景。

6228 7
|
JSON 数据库 数据格式
|

[开发技巧] 如何获取汉字笔画数?

在开发卜筮小脚本时遇到获取汉字笔画数的需求,起初尝试使用`pypinyin`库却未得理想结果。经过探索,发现Unicode联盟维护的Unihan数据库提供准确的汉字笔画数据。通过下载Unihan数据库文件,解析其中的`kTotalStrokes`字段,利用正则表达式提取所需信息,并将其保存为JSON格式以供快速查询。最终编写函数`get_character_stroke_count`实现任意汉字笔画数的高效获取,满足了项目需求并提供了准确的数据支持。此方法不仅解决了问题,还为类似需求提供了参考方案。

1097 10
|
JSON 缓存 监控
|

淘宝商品详情接口(Taobao.item_get)丨淘宝API接口指南

淘宝商品详情接口(Taobao.item_get)允许开发者通过HTTP GET方法获取淘宝商品的详细信息,包括商品ID、价格、库存等。请求需包含key、secret、num_iid等必选参数,支持缓存及多种返回格式。此接口广泛应用于电商数据分析、商品选品、价格监控等领域,提升商家运营效率。

3407 1
|
JSON 数据可视化 NoSQL
|

基于LLM Graph Transformer的知识图谱构建技术研究:LangChain框架下转换机制实践

本文介绍了LangChain的LLM Graph Transformer框架,探讨了文本到图谱转换的双模式实现机制。基于工具的模式利用结构化输出和函数调用,简化了提示工程并支持属性提取;基于提示的模式则为不支持工具调用的模型提供了备选方案。通过精确定义图谱模式(包括节点类型、关系类型及其约束),显著提升了提取结果的一致性和可靠性。LLM Graph Transformer为非结构化数据的结构化表示提供了可靠的技术方案,支持RAG应用和复杂查询处理。

1575 2
|
机器学习/深度学习 人工智能 自然语言处理
|

前端大模型入门(三):编码(Tokenizer)和嵌入(Embedding)解析 - llm的输入

本文介绍了大规模语言模型(LLM)中的两个核心概念:Tokenizer和Embedding。Tokenizer将文本转换为模型可处理的数字ID,而Embedding则将这些ID转化为能捕捉语义关系的稠密向量。文章通过具体示例和代码展示了两者的实现方法,帮助读者理解其基本原理和应用场景。

5980 1
|
数据采集 存储 数据处理
|

从网络请求到Excel:自动化数据抓取和保存的完整指南

本文介绍了如何使用Python自动化采集东方财富股吧的发帖信息,并将其保存到Excel中。通过代理IP、多线程和网页解析技术,规避反爬虫机制,高效抓取帖子标题和发帖时间,帮助投资者获取市场情绪和热点数据。

796 0
|
人工智能 数据可视化 数据处理
|

推荐2款免费开源的标注工具,支持大模型对话标注

【LabelLLM】一款开源免费的大模型对话标注平台,专为优化大型语言模型的数据标注过程设计。支持灵活配置与多模态数据(音频、图像、视频),具备全面任务管理和AI辅助标注功能,大幅提升标注效率与准确性。了解更多请前往https://github.com/opendatalab/LabelLLM 【LabelU】一款轻量级开源标注工具,支持图像、视频、音频的高效标注。特色功能包括多功能图像处理、视频和音频分析等,简易灵活,支持多种数据格式输出。了解更多请前往https://github.com/opendatalab/labelU

5564 11
|
存储 JSON API
|

批量采集抖音商品详情数据:推荐你使用API(通过商品id取商品详情商品主图sku属性)

批量采集抖音商品详情,建议使用API接口。步骤包括:注册抖音开放平台获取App Key和Secret,调用商品详情API接口传入商品ID及相关参数,解析返回的JSON获取商品信息(如名称、价格、主图和SKU)。此外,接口列表提供商品搜索、销售量查询、历史价格、订单管理等多种功能。已封装的API接口地址:c0b.cc/R4rbK2,可测试并联系获取SDK文件。

2584 1
|
SQL BI HIVE
|

【Hive SQL 每日一题】统计用户留存率

用户留存率是衡量产品成功的关键指标,表示用户在特定时间内持续使用产品的比例。计算公式为留存用户数除以初始用户数。例如,游戏发行后第一天有10000玩家,第七天剩5000人,第一周留存率为50%。提供的SQL代码展示了如何根据用户活动数据统计每天的留存率。需求包括计算系统上线后的每日留存率,以及从第一天开始的累计N日留存率。通过窗口函数`LAG`和`COUNT(DISTINCT user_id)`,可以有效地分析用户留存趋势。

2262 1
|
机器学习/深度学习 XML JSON
|

LLM 系列 | 08:ChatGPT Prompt实践:文本转换

今天这篇小作文主要介绍如何通过构建ChatGPT Prompt以解决文本转换任务。

1434 0
|
存储 SQL 分布式计算
|

数据湖架构及概念简介

本文整理自阿里云开源大数据技术专家陈鑫伟在7月17日阿里云数据湖技术专场交流会的分享。

5011 0
|
分布式计算 MaxCompute
|

MaxCompute执行作业慢的原因排查

大家在平时开发过程中经常遇到作业(SQL、MR等)执行慢的原因,今天带大家一起学习自排查方法。 1、wait wait ,job querying 遇到这个提示,就是资源出现了排队,如果你是后付费用户,那就是整个后付费的共享池已经没有富余的资源了,要等前一个作业处理完。

27934 6
来自: 大数据计算 MaxCompute  版块
|
12天前
|
数据采集 架构师 网络协议
|

架构师视角:如何设计一套高扩展性的通用爬虫中间件系统?

这篇文章讨论了如何设计一套高扩展性的通用爬虫中间件系统。作者从架构师视角出发,分析了爬虫系统的需求和挑战,并提出了相应的设计原则和解决方案。文章强调了模块化、可配置性和容错性的重要性,旨在帮助读者构建一个稳定、高效且易于扩展的爬虫系统。

80 1
|
17天前
|
SQL NoSQL Java
|

团队暂时没有条件部署 SkyWalking

本文详解APM链路追踪核心实践:先定位慢在哪一跳。通过SkyWalking开箱即用方案(Java零侵入Agent接入)或自研轻量方案(MDC+AOP日志埋点),快速生成耗时瀑布图,将3.2秒慢请求精准定位至2.35秒SQL,大幅提升性能排查效率。(239字)

114 1
|
19天前
|
数据采集 人工智能 搜索推荐
|

GEO投资回报率计算模型:基于三层收益拆解与成本归因框架及实证验证

本文构建GEO(生成式引擎优化)投资回报率量化模型,首创“成本归因+三层收益”框架:拆解为内容生产、技术基建等四类成本;将收益分为品牌曝光(AI引用率×CPM)、AI流量(访问增量×转化率×客单价)、间接转化(GEO归因线索×客单价)三层。基于普林斯顿大学研究与行业数据验证,ROI达1.2–2.5,具持续积累效应。

140 0
来自: 智能搜索推荐  版块
|
20天前
|
数据采集 人工智能 搜索推荐
|

AI搜索引擎引用源选择机制的数据分析与技术解析

本文基于普林斯顿大学GEO研究数据,从技术视角解析AI搜索引擎引用源选择机制,聚焦引用结构设计、内容可信度评估与迭代优化三大维度,揭示结构化标注提升引用率24.9%等关键发现。

125 0
来自: 智能搜索推荐  版块
|
25天前
|
人工智能 搜索推荐 API
|

从 SEO 到 GEO:Schema.org 如何提升企业网站在 LLM 中的可发现性

2026年,用户从搜索转向直接向AI提问,企业竞争已从SEO升级为GEO(生成式引擎优化)。Schema.org结构化数据成为AI理解网页的关键基础设施,助力LLM精准抽取事实、提升RAG召回准确率,并支撑AI Agent自动化交互。它是AI时代的知识图谱基石。

163 0
|
27天前
|
消息中间件 人工智能 物联网
|

为什么你的物联网平台总是“掉链子”?真正的问题,不是设备,而是数据平台!

为什么你的物联网平台总是“掉链子”?真正的问题,不是设备,而是数据平台!

127 1
|
1月前
|
人工智能 自然语言处理 前端开发
|

AI 时代的 API:大模型如何重塑接口设计

本文探讨大模型时代API设计的范式变革:从REST/GraphQL/gRPC的结构化契约,转向意图理解、生成响应与Agent编排。涵盖三大演进方向——自然语言意图解析、流式生成+函数调用、有状态多轮对话,并提供可落地的FastAPI工程示例。(239字)

134 1
|
2月前
|
数据采集 存储 人工智能
|

AI搜索重构制造业采购逻辑:基于阿里云的企业级GEOCMS优化实践

福建制造企业官网内容多为PDF/图片,AI无法识别,导致“隐形”。本文提出基于阿里云的GEO(生成式引擎优化)方案,含结构化建模、向量知识库、AI引用监测、llms.txt引导四大引擎,助力企业从“人类可读”升级为“AI可理解”,抢占AI搜索新流量。

297 0
来自: 智能搜索推荐  版块
|
2月前
|
安全 数据可视化 数据挖掘
|

零代码应用搭建平台选型指南:2026 年企业落地实践

目前,很多企业管理者和 IT 负责人都面临一个共同难题:想上线业务系统,但传统开发模式成本高、周期长,专业技术人才招聘和留存难度大。一个基础的报销管理系统定制开发费用动辄十几万元,开发周期半年起步,等系统正式上线,业务流程往往已经发生了变化。零代码应用搭建平台的出现,为解决这一难题提供了新的思路,让不具备编程能力的业务人员也能自主构建简单的业务应用。

326 0
来自: 数据可视化DataV  版块
|
3月前
|
移动开发 人工智能 小程序
|

分享开发直播系统遇到的问题及解决方案(uniapp)

本项目基于UniApp开发跨端直播系统(H5/小程序/APP),采用FastAdmin+Workerman技术栈。针对H5卡顿、APP层级错乱、推流复杂等难题,创新采用本地化资源、.vue/.nvue双端分离、推流模块化开发策略,实现稳定多端适配。代码已开源。

302 2
|
4月前
|
人工智能 自然语言处理 算法
|

从Function Call到Skill商店:三层技术栈如何解决大模型输出不稳定难题?

2026年AI领域关键趋势——Agent Skill(智能体技能):一种以Markdown脚本标准化AI工作流的创新范式。它通过步骤锁定与标准量化,彻底解决大模型输出不一致痛点。

585 2
来自: 人工智能平台PAI  版块
|
4月前
|
人工智能 架构师 Apache
|

相约深圳,全球征集|Flink Forward Asia 2026 演讲议题征集正式启动

Flink Forward Asia 2026将于6月26–27日首次落地深圳,聚焦实时计算与AI深度融合。面向全球征集议题(截止5月29日),涵盖实时AI、AI Agent、湖流一体等前沿方向。免费报名开启,共探下一代实时计算范式!

871 4
来自: 实时计算 Flink  版块
|
4月前
|
存储 算法 定位技术
|

一套底座支撑多场景:高德地图基于 Paimon + StarRocks 轨迹服务实践

面对轨迹数据“高实时、高并发、长周期存储”的典型特征,高德团队以访问跨度为依据完成热/温/冷分层,并以 Apache Paimon + StarRocks 构建统一的数据底座,支撑轨迹数据的近实时写入与高性能查询。

604 4
|
5月前
|
数据采集 传感器 人工智能
|

AI质检+MES如何重构智能制造质量闭环

AI质检与MES深-度融合,构建“感知-分析-决策-执行”质量闭环:实现100%全检、自动拦截、一物一档、工艺自优化及缺-陷预-测;通过OPC UA/MQTT/边缘网关打通设备数据,支撑全流程精-准质量追溯。

700 4
|
5月前
|
机器学习/深度学习 人工智能 自然语言处理
|

别再说“AI听不懂人话”:从0到1手把手搭一个意图识别 + 槽位提取系统

别再说“AI听不懂人话”:从0到1手把手搭一个意图识别 + 槽位提取系统

910 11
|
5月前
|
自然语言处理 安全 JavaScript
|

Cnfans 反向海淘代购系统搭建经验

面向欧美的淘宝/1688代购集运平台,支持链接粘贴→自动抓取翻译计价→多币种支付→代采合包→国际物流清关→末端派送。集成PayPal/Stripe、4PX等API,采用Vue+FastAPI+Docker技术栈,合规覆盖IOSS、GDPR及仿牌审核,盈利含服务费、物流差价与增值服务。(239字)

469 2
|
6月前
|
存储 人工智能 缓存
|

一种基于分层记忆与注意力约束的对话AI架构

本文提出一种新型对话AI记忆架构:从空白记忆库起步,分三层(核心/中层/临时)动态存储信息;通过两层过滤(模型识别+用户反馈)精准入库;采用注意力降压、高频抑制等机制杜绝复读;核心记忆上锁保护,满库自动清理。让AI真正“记得住、不啰嗦、不乱记、越聊越懂你”。(239字)

693 5
|
6月前
|
数据采集 JSON 供应链
|

1688商品详情API数据采集指南

1688商品详情API(1688.item_get)是阿里开放平台核心接口,支持通过商品ID获取标题、价格、库存、SKU、图文详情、商家资质等50+字段,JSON格式返回。广泛用于ERP同步、跨境铺货、比价监控与供应链管理,需签名认证,调用稳定高效。(239字)

3989 5
|
7月前
|
存储 人工智能 关系型数据库
|

传统数据库与向量数据库:一个管“是什么”,一个管“像什么”

向量数据库是AI时代的语义检索引擎,将文本、图片等非结构化数据转化为“语义向量”,支持基于相似性的毫秒级搜索。它不替代MySQL等传统数据库,而是作为大模型的“海马体”,赋能RAG、智能问答与多模态应用,实现从“关键词匹配”到“理解含义”的跃迁。(239字)

1111 7
|
7月前
|
SQL 存储 分布式计算
|

【赵渝强老师】基于Hudi的大数据湖仓一体架构

Apache Hudi(Hadoop Upserts Delete and Incremental)是开源的流式数据湖平台,支持事务、高效upsert/delete、增量处理、多引擎SQL读写(Spark/Flink/Trino等),自动管理小文件与压缩,兼容云存储,助力构建湖仓一体架构。

1019 3
|
7月前
|
存储 安全 API
|

隐私合规红线不能碰:大模型微调3大重灾区防护手册

本文聚焦大模型微调中训练数据、中间产物与部署链路三大隐私泄露重灾区,剖析90%开发者易踩的技术陷阱,从分层脱敏、差分隐私到权限管控,提供全链路可落地的防护方案,并结合性能与安全双重验证,助力企业实现合规与效能双赢。

700 0
|
7月前
|
编解码 并行计算 物联网
|

【实战教程】Flux.1-dev 360° 全景驾驶舱:从零到一的“零坑”部署指南

本教程教你如何在24G显存单卡环境下部署超大文生图模型Flux.1-dev。通过ModelScope极速下载、Hugging Face身份鉴权与显存顺序卸载技术,解决下载慢、授权难、显存溢出等问题,实现稳定推理。

1078 1
|
7月前
|
机器学习/深度学习 数据采集 人工智能
|

零代码基础也能懂的LoRA微调全指南

LoRA(低秩适应)让普通人也能用消费级显卡高效微调大模型。它不改动原模型,仅添加小型“适配模块”,以0.1%-1%的参数量实现接近全量微调的效果,快速打造专属AI助手,推动AI民主化。

764 0
|
7月前
|
JSON 安全 JavaScript
|

闲鱼商品列表API接口指南

本指南基于逆向分析,提供闲鱼商品列表数据获取的技术方案,适用于关键词、地区、价格等条件筛选。支持网页端GET与移动端POST请求,返回HTML或JSON格式数据,需注意登录态与参数编码,仅用于学习研究。

921 2
|
8月前
|
Shell 测试技术 Apache
|

Jmeter快速入门

本文介绍了Apache JMeter的下载、解压与运行方法,并指导用户进行中文语言设置及基本使用。通过添加线程组、HTTP取样器和监听器,快速完成性能测试配置,适合初学者入门学习。

416 0
|
8月前
|
机器学习/深度学习 数据采集 人工智能
|

大模型训练方法与技术术语解释

预训练、微调、RLHF、思维链等技术共同推动大模型发展。预训练构建语言基础,微调适配特定任务,RLHF融入人类偏好,思维链提升推理能力,少样本与零样本实现快速迁移,指令微调增强指令理解,自监督学习利用海量无标数据,温度控制生成风格,蒸馏压缩模型规模,缩放定律指导模型扩展,全面提升大模型理解、生成与泛化能力。

578 0
|
8月前
|
前端开发 NoSQL Java
|

低代码IDEA启动项目

本教程介绍如何使用IDEA启动低代码项目Jeecg-Boot(Java+Vue3)。先启动后端SpringBoot项目,需初始化MySQL与Redis,配置application-dev.yml;再启动前端Vue3项目,安装pnpm依赖并配置代理,最后通过localhost访问系统,默认账号admin/123456。

462 0
|
8月前
|
JSON 监控 API
|

京东商品列表 API使用指南

京东商品列表API是京东开放平台提供的核心接口,支持按关键词、分类、价格、销量等条件筛选商品,返回标题、价格、库存、销量等结构化信息,适用于店铺管理、价格监控、竞品分析等场景。需认证开发者身份并获取appkey、access_token及相应权限后调用,接口以JSON格式传输,部分按量计费。

464 2
|
8月前
|
并行计算 数据可视化 PyTorch
|

实用程序:无需付费软件!自制音视频转字幕工具,复制代码直接运行

一款基于Whisper模型的音视频转字幕工具,支持多格式文件,提供可视化界面与实时进度反馈,可自动识别语音并生成简体SRT字幕,操作简单,开源免费,显著提升字幕制作效率。

682 4
|
9月前
|
存储
|

参数不是越多越好?聊聊模型规模与智能能力的那些“门道”

参数不是越多越好?聊聊模型规模与智能能力的那些“门道”

768 2
|
10月前
|
机器学习/深度学习 数据采集 人工智能
|

别怪推荐系统不懂你,可能是你的数据“太模糊”了

别怪推荐系统不懂你,可能是你的数据“太模糊”了

475 9
|
11月前
|
存储 人工智能 数据可视化
|

从零构建能自我优化的AI Agent:Reflection和Reflexion机制对比详解与实现

AI能否从错误中学习?Reflection与Reflexion Agent通过生成-反思-改进循环,实现自我优化。前者侧重内容精炼,后者结合外部研究提升准确性,二者分别适用于创意优化与知识密集型任务。

2108 9

大数据与机器学习

大数据领域前沿技术分享与交流,这里不止有技术干货、学习心得、企业实践、社区活动,还有未来。

0
今日
70020
内容
128
活动
440138
关注
你好!
登录掌握更多精彩内容

相关产品

  • 大数据开发治理平台 DataWorks
  • 检索分析服务 Elasticsearch版
  • 日志服务