LeetCode|398.随机数索引

本文介绍了一种解决LeetCode上特定问题的方法,该问题是给定一个可能包含重复元素的整数数组,要求随机输出指定数字的索引,且每个索引的返回概率相等。文章提供了一个高效的解决方案,避免了大量额外空间的使用。

LeetCode习题答案汇总

题目:
给定一个可能含有重复元素的整数数组,要求随机输出给定的数字的索引。 您可以假设给定的数字一定存在于数组中。

注意:
数组大小可能非常大。 使用太多额外空间的解决方案将不会通过测试。

示例:

int[] nums = new int[] {1,2,3,3,3};
Solution solution = new Solution(nums);

// pick(3) 应该返回索引 2,3 或者 4。每个索引的返回概率应该相等。
solution.pick(3);

// pick(1) 应该返回 0。因为只有nums[0]等于1。
solution.pick(1);

分析:

  • 通过建立字典存储数字索引
  • 最后通过choice函数返回随机的结果

代码:

class Solution:

    def __init__(self, nums: List[int]):
        self.dicts = {}
        for k,v in enumerate(nums):
            if v not in self.dicts:
                self.dicts[v] = [k]
            else:
                self.dicts[v].append(k)
        

    def pick(self, target: int) -> int:
        return choice(self.dicts[target])


# Your Solution object will be instantiated and called as such:
# obj = Solution(nums)
# param_1 = obj.pick(target)

结果:
在这里插入图片描述

该文档【DeepSeek模型训练数据处理全流程详解:基于数据去重、噪声过滤、格式标准化的高质量训练数据技巧】共计 253 页,共51个大章节,文档支持目录章节跳转同时还支持阅读器左侧书签大纲显示和章节快速定位,文档内容完整、条理清晰。文档内所有文字、图表、目录等元素均显示正常,无任何异常情况,敬请您放心查阅与使用。文档仅供学习参考,请勿用作商业用途。文档前20个章节内容:【引言:DeepSeek训练数据处理的核心价值与行业痛点、DeepSeek训练数据采集策略:多源数据的筛选与获取原则、原始数据预处理:编码统一与字符清洗的实操细节、数据去重技术选型:基于SimHash的海量文本去重实现、语义级去重方案:Sentence-BERT模型的相似度计算优化、重复数据判定阈值设定:动态阈值与场景适配方法、噪声数据分类:DeepSeek训练中的典型噪声类型解析、低质量文本过滤:基于文本长度与复杂度的初步筛选、语义噪声识别:预训练模型辅助的噪声检测流程、事实性错误过滤:知识图谱驱动的矛盾数据校验、格式标准化基础:DeepSeek训练数据的统一格式定义、文本格式规整:标点符号、换行符的标准化处理、结构化数据转换:表格与JSON数据的文本化适配、多模态数据格式统一:图文数据的对齐与标准化、数据标注需求分析:DeepSeek模型的标注任务定义、标注体系设计:实体、关系与意图标注的规范制定、标注工具选型:本地化标注平台的部署与配置、标注质量控制:多人交叉标注与冲突解决机制、标注数据清洗:标注错误的识别与修正流程、小样本标注策略:Prompt辅助的高效标注方法】。更多精品资源请访问 https://blog.csdn.net/ashyyyy/article/details/146464041
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

xiao黄

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值