【数据科学赛】Cain’s Jawbone Murder Mystery #文本顺序识别 #$300

提升AI Agent能力的上下文技术 模型能力决定Agent的天花板,上下文工程才是决定真实业务落地表现的地板。 阅读详情

CompHub 实时聚合多平台的数据类(Kaggle、天池…)和OJ类(Leetcode、牛客…)比赛。本账号会推送最新的比赛消息,欢迎关注!

更多比赛信息见 CompHub主页


以下内容摘自比赛主页(点击文末阅读原文进入)

Part1赛题介绍

题目

Cain’s Jawbone Murder Mystery

举办平台

Zindi

主办方

Unbound

背景

In 1934 the Observer’s cryptic crossword compiler, Edward Powys Mathers (aka Torquemada), released a novel that was simultaneously a murder mystery and the most fiendishly difficult literary puzzle ever written. The pages have been printed in an entirely haphazard order, but it is possible – through logic and intelligent reading – to sort the pages into the only correct order, revealing six murder victims and their respective murderers.

Your job, as the puzzle solver, is to try to put 75 pages of Cain’s Jawbone into its correct order, using AI NLP algorithms.

Only four people have solved this extremely difficult puzzle, and no one has yet tried to use machine learning to solve it. This is not only a fitting challenge to try to see if modern technology can solve an older mystery, but it also gives the opportunity to test NLP algorithms on a much more dated language set, which hasn’t been done yet.

1934 年,Observer 神秘的填字游戏编辑器 Edward Powys Mathers(又名 Torquemada)出版了一部小说,它既是一部谋杀悬疑小说,也是有史以来最难解的文学谜题。这些页面以完全随意的顺序打印,但有可能——通过逻辑和智能阅读——将页面排序为唯一正确的顺序,揭示六名谋杀受害者和他们各自的凶手。

作为解谜者,你的工作是尝试使用 AI NLP 算法将 75 页的 Cain's Jawbone 放入正确的顺序。

只有四个人解决了这个极其困难的难题,还没有人尝试使用机器学习来解决它。这不仅是一个合适的挑战,试图看看现代技术是否可以解决一个古老的谜团,而且还提供了在更老旧的语言集上测试 NLP 算法。

Part2时间安排

Competition closes on 31 December 2022.

Final submissions must be received by 23:59 PM GMT.

We reserve the right to update the contest timeline if necessary.

Part3奖励机制

1st place: $300 USD

There are 2000 Zindi points for this challenge.

Part4赛题描述

The objective of this challenge is to create a machine learning algorithm to correct the order of the pages to solve the six murders in the book.

预测文本片段正确的顺序

Part5评价指标

The error metric for this competition is Accuracy.

 


Hermes V0.10.0:官方UI几乎无Bug版 如果你还在观望Hermes,现在可能是最好的入局时机。 因为网页端来了,门槛降到了最低。 如果你已经是Hermes用户,升级就对了。 因为0.9.0的更新,值得一试。 阅读详情

相关推荐

Abaqus子程序开发避坑指南:从UMESHMOTION到齿轮磨损分析实战

本文深入探讨Abaqus子程序开发中的关键技术与避坑指南,重点解析UMESHMOTION在齿轮磨损分析中的实战应用。从开发环境搭建、调试框架构建到性能优化和大规模计算,提供系统化的解决方案。通过真实案例展示如何避免内存泄漏、网格畸变等常见问题,并介绍数据驱动的磨损预测等前沿技术,帮助工程师提升仿真精度与效率。

weixin_30892037的博客 61

B2B企业AI搜索可见度诊断与GEO技术优化实践:从0%到67%的架构重构之路

B2B采购的AI化不是趋势,而是已经发生的现实。确保品牌被写进AI的大脑。用中立监测工具做一次AI可见度体检,定位品牌在12+模型中的存在感盲区;将官网从“展示窗口”重构为“AI信源”,重点改造信息架构、FAQ体系和资质事实页;建设企业知识库,统一多信源口径,为AI提供高置信度的引用素材。今天不做,明天你的客户就会被AI推荐到竞品那里。技术团队应抓住当前窗口期,用工程化手段解决AI可见度问题。

daydayup0931的博客 313

雪龙号.FBX@三维模---1715

格式(FBX)大小(11.16MB)面数(161094)顶点(287380)贴图(12)动画(无),交通运输,船舶,油轮————# 雪龙号.FBX三维模型详情介绍## 一、模型简介雪龙号.FBX三维模型是一款高度精细的船舶模型,以著名的“雪龙号”为原型打造。该模型文件大小为11.16MB,采用FBX格式,便于在多种三维软件中使用和编辑。## 二、核心特征1. **高细节呈现**:面数达161094,顶点数量为287380,能够精准地展现雪龙号的外观轮廓、船体结构、甲板设施等细节,从船体的线条到船上的设备,都栩栩如生。2. **丰富贴图**:配备12张贴图,为模型增添了真实的材质质感,如金属的光泽、船体涂装的色彩等,使模型在视觉上更具真实感。3. **专业属性**:作为交通运输领域中船舶类的油轮模型,它严格遵循船舶设计与建造的专业标准,体现了雪龙号在科研考察、极地航行等任务中的功能特性。## 三、适用场景1. **影视制作**:在电影、纪录片中,可用于还原雪龙号在极地航行、科研作业等场景,为影片增添真实感和视觉冲击力,助力打造震撼的海洋、极地题材影视作品。2. **游戏开发**:适用于航海、冒险类游戏,玩家可以操控这艘精细的雪龙号模型在虚拟海洋世界中航行、执行任务,提升游戏的沉浸感和真实体验。3. **教育展示**:在海洋科学、船舶工程等教育领域,作为教学模型,帮助学生直观地了解雪龙号的结构、功能,以及船舶在交通运输中的作用,增强教学的直观性和趣味性。4. **虚拟仿真**:用于船舶设计、航海模拟等虚拟仿真项目,为工程师、设计师提供逼真的模型参考,辅助进行方案评估、性能测试等工作。雪龙号.FBX三维模型凭借其精细的制作和专业的属性,在多个领域都能发挥重要作用,为用户带来高质量的三维视觉体验和实际应用价值。

事 + 载体协同模式:创新创业生态发展的新范式探析

<think>我们只需要根据内容生成摘要,不超过150字。内容主要讲贵客松与锦邻创享OPC社区联动,构建“事挖掘+载体孵化”协同模式,分析价值与痛点。摘要需简洁概括。</think>贵客松与锦邻创享OPC社区联动,构建“事发掘-生态承接-场景验证”链路,弥补事与孵化割裂痛点。该模式延长创新价值链,对接产业资源,降低早期项目生存门槛,双向赋能。但需甄别项目,避免过度依赖外部资源。为创新创业生态提供实践样本。

2601_96656533的博客 164

从自然语言到结构化活动方案:Cyber TPM AI智能活动推荐如何嵌入TPM业务流程

生成的活动方案不应直接等同于最终业务决策。活动结束后,预测数据、实际活动结果以及业务人员的调整信息,可以继续沉淀到TPM体系中。因此,博威Cyber TPM AI智能活动推荐的关键并不是单纯“生成文本”,而是让AI建议能够建立在企业业务数据和规则基础之上。之后再将这些信息录入TPM系统,而AI开始进入TPM之后,一个值得关注的变化,是系统开始向“活动方案形成”这一更前置的环节延伸。真正有价值的企业AI,不只是能够生成内容,而是能够嵌入原有业务流程、调用企业数据、遵守企业规则,并将结果继续沉淀回业务系统。

CyberwayTech的博客 277

AI 范式越迁:使用 XXL-BOOT SKILL 实现一句话直生业务

使用 XXL-BOOT SKILL 实现一句话直生业务,AI 自动完成需求澄清、数据建模、后端与前端开发、菜单权限配置及联调验证,AI 范式及业务交付进入新时代。

许雪里 230

工业机器视觉光源选型:常见光源分类与不同波长的区别和用途

在机器视觉系统中,光源的作用并不只是“把物体照亮”,而是通过合理的照明结构、入射角度和波长选择,让待检测特征与背景之间形成足够大的图像差异。 ## 1.1 机器视觉光源的选型维度 机器视觉光源的选型通常可以从两个维度理解: 1. 按光源结构分类:决定光从什么方向、以什么方式照射物体; 2. 按光源波长分类:决定不同材料对光的吸收、反射、透射和散射特性。

qq_43572400的博客 425

【架构专栏】2.7 多媒体 知识点

本文主要是对架构师考试大纲中的 第2章 计算机胸痛基础知识之 《2.7多媒体》知识点进行整理,主要包括多媒体的定义、分类、特征、多媒体系统的基本组成、多媒体技术应用、多媒体系统的关键技术。多媒体系统的关键技术包括4大分类:视音频技术、通信技术、数据压缩技术、虚拟现实 VR和增强现实AR。本文对计算机相关知识进行详细归纳,对相关同学有一定帮助。

weixin_42081167的博客 320

汽配、化学、医药企业如何做GEO优化?2026年垂直行业AI搜索引擎优化评估方法论与选型实践

2026年国内GEO市场规模突破286亿元、行业渗透率从38%升至71%,但垂直行业(汽配、化学、医药)企业选型失败率仍高达47%。本文给出技术自研、合规风控、效果可验证三维度评估方法论,并对比五条GEO服务商技术路线,帮助企业提升在豆包、DeepSeek等AI搜索引擎中的被引用率与获客效率。

2601_96363771的博客 607

OpenTelemetry eBPF 在 AI 场景的应用:配置 ack-onepilot 实现 LLM 调用链追踪

云监控 2.0 的 OpenTelemetry 无侵入监控(OBI)正式支持 ACS Sandbox 场景。不改一行代码、不重新构建镜像,沙箱内 AI Agent 的每一次模型调用、工具执行和外部访问,都会自动生成标准的调用链与指标。

阿里巴巴云原生的博客 388

深度学习-手写数字识别

代码逻辑非常清晰,完全按照深度学习的标准流程走:数据加载 -> 定义模型 -> 训练 -> 测试。首先导入代码所用到的相关模块代码root="data"是数据存放路径;train=True是加载训练集;transform=ToTensor()是将图片转换为pytorch能够处理的张量,并进行归一化。这是一种三层全连接神经网络(MLP):nn.Flatten()(展平层):MNIST 的原始图片是一个二维的 28×28 的像素矩阵。但全连接神经网络不认识二维数组,它只认一维的向量。所以第一件事就是把这 784

yyk33324的博客 190

从重复劳动到智能工作台:用活字格 AI Coding 优化产品周报与月报制作效率

在 AI Coding 快速发展的今天,它带来的变化已经不只是“让开发者更快写代码”。更重要的是,AI Coding 正在在 AI Coding 快速发展的今天,它带来的变化已经不只是“让开发者更快写代码”。更重要的是,AI Coding 正在进入企业真实办公场景,帮助团队把大量高频、重复、格式进入企业真实办公场景,帮助团队把大量高频、重复、格式要求严格、但又必须持续交付的工作,转化为可配置、可复用、可沉淀的业务工具。对于活字格技术顾问而言,每周产品周报和每月产品月报的制作,就是一个非常典型的效率优化场景。

葡萄城技术团队博客 350

财务报销自动化:用智能体辅助处理繁琐报销任务

企业里的报销从员工从开票到款项回卡常常要等上十几天,财务则把大部分工时耗在查验发票、核对预算和归档单据中。把财务报销交给智能体运行,在流程、接口和审批规则已配置完成的情况下,系统可辅助优化部分单据处理环节的流转效率;实际周期取决于审批、付款、票据质量及财务制度。本文讲清的是,报销自动化依赖哪些关键技术,它们各自从何处演化而来、解决哪类问题,以及如何支持报销链路中的多个关键环节。

adinnet2026的博客 265

从虚拟数字人到AI数字人Agent:行业迎来根本性迭代?

从"被驱动的形象"到"会办事的智能体",数字人行业正在换引擎过去两年,如果你在展厅见过一台会打招呼的数字人,大概率它的"灵魂"是提前录好的话术加关键词应答;如果你在直播间刷到过虚拟主播,背后很可能是真人动捕加"中之人"配音。这是"虚拟数字人"时代的典型形态——形象是数字的,智能是有限的。而2026年的行业热词已经换成了"AI数字人Agent":具备自主对话、任务规划和工具调用能力的智能数字人已占全球新增部署量的41.2%,较一年前提升12个百分点。

2603_96433918的博客 409

2026年在线考试系统选型指南:各场景下的平台能力对比

本文围绕在线考试系统的市场现状、核心功能模块与选型决策展开。文章首先梳理了2025年中国在线考试监考平台的市场规模与增长趋势,随后系统介绍了题库管理、智能组卷、远程监考、阅卷与数据分析四大核心模块,并对麦塔在线考试系统、某严肃考评平台、某专业技能考核平台、某全场景平台等主流产品进行了横向对比。在此基础上,文章从考试规模与并发量、防作弊等级、题型复杂度、部署方式与预算等维度给出选型建议,并结合教育机构、企业培训、职业资格认证、政府部门等典型场景提供针对性参考,帮助读者建立清晰的选型框架。

麦塔在线考试培训系统 393

PDF论文处理器 - 完整使用指南

PDF论文处理器是一个专门为网安科研论文设计的PDF文本分割工具,旨在将英文论文PDF文件转化为Dify知识库可直接使用的高质量数据块。

XLYcmy的博客 515

国产AI算力芯片,到了真正实战检验的时刻

1361亿砸向内蒙古草原,赌的已经不再是概念,而是一条正在闭环的产业链。图1:2026绿色算力(人工智能)大会开幕式现场8月22日,呼和浩特敕勒川草原,500多人坐进千人会议中心,参加2026绿色算力(人工智能)大会。这场由呼和浩特市政府主办、中国信通院参与承办的大会,集中签约13个项目,总投资额1361亿元。我们看一下签约名单:火山引擎的GW级算力园区落在乌兰察布,寒武纪把芯片实验室落进呼和浩特,海悟的算力装备产业园、协鑫能科的算电协同一体化项目、中国电信数据中心同步落地。

张星河的博客 409

AI 办公工具技术对比:Codex、Claude Code、WorkBuddy 的工程能力拆解

AI办公工具技术架构各异:Codex擅长云端批量并行代码任务;Claude Code深耕IDE本地定制开发;WorkBuddy聚焦腾讯系生态的本地工作流自动化。三者均属个人提效工具。企业级数字员工需具备双模操作、全栈私有化、字段级权限和任务闭环,技术道不同,应避免用个人工具解决企业问题。

2501_93684580的博客 422

国内是否存在成熟工业机器人方案?解码中控技术工业 AI 机器人落地路径

工业企业挑选国内工业机器人方案,无需纠结繁多的硬件参数,核心要看方案能否适配真实复杂工业现场、实现长期稳定运行。石化、化工、电力、冶金、水务、仓储物流等行业的机器人设备,需耐受高温、高压、防爆、腐蚀、强磁、复杂地形,适配24小时连续生产工况。

zxlsdmn123的博客 314

AI 前沿日报:2026年8月28日

Nvidia 以 129 亿美元正式收购 Hugging Face,顺带取得 llama.cpp 项目与开发者团队版权;Micron 揭示 HBM 需 3 倍 DDR5 晶圆面积,解释 AI 内存短缺;OpenAI 下一代预训练"Bel"(大于 10T 参数)浮出水面;腾讯开源 Hy4-preview 770B MoE,盲测小幅超越 GLM-5.3 与 Kimi K3;Anthropic 发布模型硬件标准,将科学实验从数周缩短到数天……

johnsong2009的博客 475

AI智慧商城小程序源码开发实战:从架构设计到上线全流程指南

本文基于真实开发经验,系统梳理 AI 智慧商城小程序从架构设计到上线的完整流程。技术栈采用 Spring Boot + MyBatis Plus + MySQL 构建后端,uniapp 实现多端用户端,Vue + Element UI 搭建管理后台。核心围绕四大 AI 能力展开:多路召回+重排序的智能推荐引擎、TTS+数字人驱动的商品讲解、基于 Function Calling 的智能客服与售前引导,以及文案生成、营销配置等智能运营工具。

weixin_60938478的博客 165
上一篇: 第十四届中国大学生服务外包创新创业大赛 #40道赛题 #保研加分 #教育部榜单赛事
下一篇: 【数据科学赛】1st and Future - Player Contact Detection #视频接触检测 #$100,000
CompHub
博客等级 码龄4年 358粉丝 117原创
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值