avatar
文章
38
标签
13
分类
8
首页
归档
标签
分类
友链
Logokjore's blog
首页
归档
标签
分类
友链

kjore's blog

参数调优《AgentTune》
发表于2026-03-10|AI4DB
概述 现有方法通常需要数百次工作负载重放或依赖海量训练数据,导致调优效率低下或准备成本高昂。此外,这些方法还面临生成无效配置的风险,可能导致性能下降甚至数据库崩溃。 调优效率低。基于机器学习(ML)的方法,通常需要数百次迭代才能收敛到理想的配置。每次迭代都涉及在数据库管理系统(DBMS)上执行工作负载(即工作负载重放),导致调优过程可能持续数小时。尽管大语言模型(LLM)辅助的方法实现了更快的收敛,但它们仍受限于基于机器学习的参数调优器固有的低效性。 可靠性低。尽管基于机器学习(ML)的调优通过平衡探索与利用来避免局部最优解,但它经常产生无效配置——即那些导致性能低于默认水平甚至使数据库管理系统(DBMS)崩溃的配置。同样,初步研究表明,直接使用大语言模型(LLMs)进行参数推荐可能会导致不安全的值(例如,过小的缓冲池大小),这源于幻觉和有限的数值推理能力等问题。这些问题可能导致调优过程中的资源耗尽或系统不稳定。 准备工作耗费大量资源。为了提高效率,许多基于机器学习(ML)和大型语言模型(LLM)的方法利用历史调优数据进行模型初始化、缩小配置空间或微调端到端参数调优器。然而,收...
openclaw在安装和应用上的笔记
发表于2026-03-10|Agent
安装 首先需要安装Node.js 22+ 然后使用npm安装openclaw: 1npm i -g openclaw@latest 然后使用以下命令快速配置: 1openclaw onboard 之后每次使用输入以下命令 1openclaw dashboard 安装问题一 登录网页后显示404,说明gateway没有正确启动,可能是端口被占用或者权限问题. 首先查看有没有这个文件 1dir "$env:USERPROFILE\.openclaw\gateway.cmd" 如果没有,说明安装过程中可能出现了问题,可以尝试重新安装openclaw。如果有这个文件,尝试手动运行它,看看是否有错误提示。 安装问题二 打开页面后,显示: 12⚠️ Agent failed before reply: No API key found for provider "openai-codex". Auth store: C:\Users\86182.openclaw\agents\main\agent\auth-profiles.json (agentDi...
决策树 Decision Tree
发表于2026-03-10|机器学习
决策树 决策树是一种树形结构的分类和回归模型。每个内部节点表示一个属性测试,每个分支表示一个测试结果,每个叶子节点表示一个类别或一个数值预测。决策树通过递归地划分数据集来构建模型,直到满足某个停止条件为止。 划分选择 关键是划分最优属性 结点的纯度要越来越高,三种度量节点纯度的指标: 信息增益 香农用“信息熵”来描述信源的不确定性 信息熵:当前样本集合D中第$i$类样本所占的比例为$p_i$,则D的信息熵定义为: $$ H(D) = -\sum_{i=1}^{n} p_i \log_2 p_i $$ H(D) 越大,数据集 D 的纯度越低;H(D) 越小,数据集 D 的纯度越高。对于二分类问题,n等于2. 假设离散属性A有V个不同的取值,按照A的每个取值划分数据集D后得到V个子集$D_1, D_2, …, D_V$,则属性A对数据集D的信息增益定义为: $$ G(D, A) = H(D) - \sum_{v=1}^{V} \frac{|D^v|}{|D|} H(D^v) $$ 其中,$D^v$ 表示属性A取第v个值时,数据集D中对应的子集。 信息增益准则对可取值较多的属性有偏好...
cs336作业五实现
发表于2026-02-26|LLM
环境与准备 使用conda下载好的flash-atten,cuda和python版本要匹配,安装transformers和datasets库 下载Qwen2.5-Math-1.5B作为基座模型 数据集直接使用原项目中的/data目录下的几个数据集 sft 核心函数 tokenize_prompt_and_output 1234567891011121314151617181920212223242526272829303132333435363738394041424344454647def tokenize_prompt_and_output( prompt_strs: list[str], output_strs: list[str], tokenizer: PreTrainedTokenizerBase,) -> dict[str, Tensor]: # 该函数将提示和输出字符串列表转换为模型输入张量,包括 input_ids、labels 和 response_mask。 prompt_ids = [] output_ids ...
SQL查询多样性与相似性度量方法
发表于2026-02-07|数据库
现有研究表明,提升大模型输出的多样性在一定程度上可以提高模型的准确率。将此思路拓展至Text-to-SQL任务中,可以通过提升模型输出SQL查询的多样性来优化模型性能。本文将综述一些常用的SQL查询多样性与相似性度量方法。 1. 词法形态 该类方法主要关注SQL的文本相似度。 实现步骤如下: 1.1 SQL 标准化处理 格式化与清洗 :利用 Python 库 sqlparse 对 SQL 进行格式化,去除冗余空格,将 SQL 整合成单行,去除注释,并将字符统一转换为大写或小写。 符号掩码化 全统一占位符 :将具体的表名、列名、字符串、数字等替换为统一占位符,如 TABLE_NAME, COLUMN_NAME, STRING_LITERAL 等。 例如: 原始 SQL A: 1SELECT DISTINCT u.id FROM users u JOIN orders o ON u.id = o.user_id; 标准化后 SQL A: 1SELECT DISTINCT COLUMN_NAME FROM TABLE_NAME JOIN TABLE_NAME ON COLU...
cs336作业五文档
发表于2026-02-04|LLM
这是一份名为 CS336 作业 5 (Alignment):对齐与推理强化学习 (RL) 的课程作业文档翻译。 以下是文档内容的详细中文翻译,保持了原文档的结构、代码块占位和专业术语。 [页 1] CS336 作业 5 (Alignment):对齐与推理 RL 1. 作业概览 版本:1.0.0 CS336 教研组 2025 年春季 在本作业中,通过训练语言模型解决数学问题,你将获得让模型进行推理 (Reasoning) 的实战经验。 你将实现的内容: Zero-shot prompting baseline(零样本提示基线) :针对 Hendrycks et al. [2021] 的 MATH 竞赛数学数据集。 Supervised Finetuning (SFT,监督微调) :基于来自更强推理模型(DeepSeek R1, DeepSeek-AI et al. 2025)的推理轨迹数据。 Expert Iteration (专家迭代) :利用已验证的奖励来提升推理性能。 Group-Relative Policy Optimization (GRPO,组相对策略优化) ...
推理
发表于2026-01-30|LLM
inference概述 推理应用场景 实际应用 (Actual Use) :这是用户最直观的感受,包括聊天机器人(如 ChatGPT)、代码自动补全(如 Copilot)以及对海量数据的离线批处理。 模型评估 (Model Evaluation) :为了衡量模型的性能(例如指令遵循能力),需要运行推理来生成结果并进行打分。 测试时计算 (Test-time Compute) :这与当前流行的“推理模型”(如 OpenAI o1 系列)相关,即通过增加推理时的计算量(如思考过程、多路径搜索)来提升模型解决复杂问题的能力。 强化学习训练 (RL Training) :在强化学习(如 PPO 或 GRPO)过程中,模型需要生成大量样本,然后由奖励模型进行打分,这个“生成样本”的过程本质上就是大规模推理。 指标 ime-to-first-token (TTFT) / 首字延迟 定义 :从用户发出请求到屏幕上蹦出第一个字的时间。 重要性 :这是即时交互(Chatbot)体验的生命线。如果 TTFT 过长,用户会感觉系统“卡死”了。这主要取决于Prefill(预填充)阶段的速度,即模...
scaling laws
发表于2026-01-29|LLM
导入 我们知道,像H100,A100这样的高性能GPU在训练大规模深度学习模型时成本是很昂贵的,因此,我们不能盲目地设定参数来试错,而是需要有一定的理论依据来指导我们如何选择模型的规模和训练数据的规模。Scaling Laws(缩放定律)为我们提供了这样的理论依据。 训练一个大模型需要 基础设施 数据 训练策略 虽然你有算力(H100)、有系统(Infra)、有数据(Dataset),但当你真正要敲下回车键开始训练时,你会面临一系列决策瘫痪: 我应该训练一个 600 亿参数的模型,跑久一点? 还是训练一个 1750 亿参数的模型,跑短一点? 层数要多深?宽度要多大? 设计大模型有无数种参数组合,盲目尝试太贵,照抄别人又不一定对。 利用缩放定律。我们发现模型的性能(Loss)与资源(算力、参数)在双对数坐标下呈线性关系。 通过学习 Scaling Laws,我们可以更好地理解如何在给定的计算预算下,选择模型规模和训练数据规模,以达到最佳的性能表现。 scaling laws 历史和背景 在经典的统计学习理论(如 VC 维理论)中,理论学家早就推导出模型的估计误差 $\e...
深度学习初识
发表于2026-01-27|机器学习
反向传播 我们将考虑一个通用输入 $x$,并计算 $h_\theta(x)$ 关于 $\theta$ 的梯度。为简便起见,我们用 $o$ 作为 $h_\theta(x)$ 的简写($o$ 代表 output,即输出)。为简便起见,虽然有滥用符号之嫌,我们使用 $J = \frac{1}{2} (y - o)^2$ 来表示损失函数。(注意:这覆盖了 7.1 节中将 $J$ 定义为总损失的设定。)我们的目标是计算 $J$ 关于参数 $\theta$ 的导数。 单个神经元的反向传播 先假设$x$和$w$都是简单的标量。我们有如下: $x \xrightarrow{w, b} z \rightarrow o \rightarrow J$ 前向公式: $z = w \cdot x + b$ $o = \text{ReLU}(z)$ $J = \frac{1}{2}(y - o)^2$ 求导 (链式法则): 由链式法则可得: $$ \frac{\partial J}{\partial w} = \frac{\partial J}{\partial o} \cdot \frac{\parti...
生成式学习算法
发表于2026-01-23|机器学习
判别式模型 vs. 生成式模型 在分类问题中,我们的最终目标是确定样本 $x$ 属于类别 $y$ 的概率。 判别式模型 (Discriminative Learning Algorithms) 目标: 直接学习 $p(y|x)$ 或从输入空间 $X$ 到标签 ${0, 1}$ 的映射。 直觉: 寻找不同类别之间的 决策边界(Decision Boundary) 。 例子: “我不需要知道大象长什么样,我只需要知道大象和狗之间那条区分的线在哪里。” 代表算法: 逻辑回归 (Logistic Regression)、感知机 (Perceptron)、SVM。 生成式模型 (Generative Learning Algorithms) 目标: 学习 $p(x|y)$(给定类别下特征的分布)和 $p(y)$(类别的先验概率)。 直觉: 学习每一个类别 具体的特征模型 。 例子: “我先学习大象长什么样,再学习狗长什么样。新来一个动物时,看它更像谁。” 代表算法: 朴素贝叶斯 (Naive Bayes)、高斯判别分析 (GDA)、HMM。 Q: 为什么有了判别式模型我们却还需要生...
1234
avatar
kjore
什么都不懂
文章
38
标签
13
分类
8
关注我
公告
欢迎来到我的博客!
最新文章
大模型采样参数2026-07-09
语言模型的演化2026-07-09
Transformer架构详解2026-07-08
ThemeKG在构建数据库参数信息这个特定主题的知识图谱上的启发2026-03-22
知识图谱入门2026-03-20
分类
  • AI4DB6
  • Agent1
  • LLM10
  • 操作系统4
  • 数据库6
  • 机器学习6
  • 知识图谱1
  • 算法1
标签
Neo4j agent 参数调优 LLM基础 笔记 论文研读 Cypher 工具 python 查询优化 cs336 参数优化 综述
归档
  • 七月 2026 3
  • 三月 2026 10
  • 二月 2026 3
  • 一月 2026 8
  • 十二月 2025 3
  • 十一月 2025 4
  • 十月 2025 7
网站信息
文章数目 :
38
本站访客数 :
本站总浏览量 :
最后更新时间 :
© 2025 - 2026 By kjore