官方博客-第30页-阿里云开发者社区

  • 2024-05-15
    393

    用消费级显卡微调属于自己的Agent

    本文为魔搭社区轻量级训练推理工具SWIFT微调实战教程系列

  • 2024-05-15
    1216

    快来与 CodeQwen1.5 结对编程

    今天,来自 Qwen1.5 开源家族的新成员,代码专家模型 CodeQwen1.5开源!CodeQwen1.5 基于 Qwen 语言模型初始化,拥有 7B 参数的模型,其拥有 GQA 架构,经过了 ~3T tokens 代码相关的数据进行预训练,共计支持 92 种编程语言、且最长支持 64K 的上下文输入。效果方面,CodeQwen1.5 展现出了优秀的代码生成、长序列建模、代码修改、SQL 能力等,该模型可以大大提高开发人员的工作效率,并在不同的技术环境中简化软件开发工作流程。

    1,216
  • 2024-05-15
    477

    奇思妙想的SQL|兼顾性能的数据倾斜处理新姿势

    本篇为系列第2篇,分享在支付宝支付数据链路改造升级过程中,针对数据倾斜的优化实践新方法,在解决数据倾斜问题的同时,还能兼顾更优的计算性能!

    477
  • 2024-09-03
    330

    MySQL 8.0:filesort 性能退化的问题分析

    用户将 RDS MySQL 实例从 5.6 升级到 8.0 后,发现相同 SQL 的执行时间增长了十几倍。本文就该问题逐步展开排查,并最终定位根因。

    330
  • 2024-11-21
    304

    突破T-SQL限制:利用CLR集成扩展RDS SQL Server的功能边界

    CLR集成为SQL Server提供了强大的扩展能力,突破了T-SQL的限制,极大地拓展了SQL 的应用场景,如:复杂字符串处理、高性能计算、图像处理、机器学习集成、自定义加密解密等,使开发人员能够利用 .NET Framework的丰富功能来处理复杂的数据库任务。

    304
  • 2025-02-20
    617

    在IDE里使用DeepSeek-V3 和 DeepSeek-R1 满血版模型

    如何在IDE里使用DeepSeek-V3 和 DeepSeek-R1 满血版模型

  • 2025-03-06
    1255

    一篇关于DeepSeek模型先进性的阅读理解

    本文以DeepSeek模型为核心,探讨了其技术先进性、训练过程及行业影响。首先介绍DeepSeek的快速崛起及其对AI行业的颠覆作用。DeepSeek通过强化学习(RL)实现Time Scaling Law的新范式,突破了传统大模型依赖算力和数据的限制,展现了集成式创新的优势。文章还提到开源的重要性以及数据作为制胜法宝的关键地位,同时警示了业务发展中安全滞后的问题。

    1,255
  • 2024-05-15
    77454

    PolarDB-X Operator 基于两次心跳事务的指定时间点恢复方案介绍

    本文将介绍,PolarDB-X Operator将在事务策略为XA事务或者TSO事务时,如何实现全局一致的任意时间点恢复,提出了基于两次心跳事务的恢复方案。

    77,454
  • 2024-05-15
    48488

    走进RDS之MySQL内存分配与管理(下)

    本篇为下篇,主要对MySQL内存限制特性进行解读,代码基于8.0.28。本文将围绕该项工作的改动、设计实现等方面展开介绍。

    48,488
  • 1
    ...
    29
    30
    31
    ...
    39
    到第
    30/39