Kimi版超级玛丽效果“惊人”,配额不足5厘米!

作者:甲维斯日期:2026/6/13

让 AI 一句话写一个《超级玛丽》的测试继续!

测完了国内最强的 GLM-5.1 之后,我们来看看国内第二强的 Kimi2.6。

Kimi 这次的表现可是“非常精彩”,我都有点不知道该如何展示!

我就先上一张图吧:

各位有何感想?这是超级玛丽?玛丽呢?管道呢?蘑菇呢?

好像已经没有什么好评了,这个结果....已经很难打分了!

我就不信这个邪了,可能真的是我运气太好了,直接抽到废卡。

我专门用它们的 Kimi Code 再跑了一遍。

这次结果好了一些,但是也很“抽象”!

能玩了,但是并不能玩多久。它根本没有跳跃功能,唯一激活它跳跃功能的方法,就是死掉!

我觉得视频摆在这边,我也不需要过多评价了,反正这肯定不是超级玛丽

第二个例子,可是用它们官方的智能体工具跑的!!

这个应该能体现它们的真实实力了吧。

跑的时候,还跑了好久好久。我以为十拿九稳了。

你们看看它输出的这些东西,是不是很专业。

中途还修复了多个潜在的 Bug。

最后给我的报告也非常专业,东西也非常多,生成的文件就属他最多了。

项目结构

1  index.html          # 游戏入口
2  css/game.css        # 样式
3  js/
4    input.js          # 键盘输入
5    audio.js          # Web Audio 音效
6    level.js          # 第一关完整地图
7    mario.js          # 马里奥物理/状态机/碰撞
8    enemy.js          # 敌人 AI(Goomba / Koopa)
9    item.js           # 道具与火球
10    renderer.js       # Canvas渲染与相机
11    game.js           # 主循环与游戏逻辑
12

已实现的核心玩法

1   World 1-1 完整关卡:地面、砖块、问号块、管道、楼梯、6个坑洞、终点旗杆与城堡
2   马里奥状态机:小/大/火焰花三种形态,支持可变高度跳跃、奔跑加速、发射火球
3   敌人AI:Goomba 直线巡逻+智能转身不掉坑;Koopa 可踩成龟壳,踢飞后能撞死其他敌人/碎砖
4   道具系统:蘑菇变大、火焰花、顶问号块出金币/道具、100币奖命
5   碰撞检测:精确的AABB瓦片碰撞,支持从下方顶砖块(大马里奥可破砖)
6   通关流程:碰到旗杆→滑下→走进城堡→胜利画面
7   UI 与音效:分数/金币/时间显示、跳跃/金币/顶砖/踩敌/死亡/通关音效
8

操作方式

1   移动
2 Z  空格 跳跃(按住跳得更高)
3 X  Shift 加速跑 / 火焰花状态下发射火球
4

最后告诉我,直接在浏览器中打开 index.html 即可游玩,祝你通关愉快!

我只能说,通关是不可能了,但是很愉快地结束了。

当然也有不愉快的地方:

为了跑这一个例子,我用了大概 2-3 个 5 小时周期,用了 63% 的周配额!!!

你们敢想么,为了这么一个结果,我用了大半个星期的配额,还等了十几个小时。

时间浪费了,结果一坨!

Kimi 在这个测试项目中表现是非常弱的!

大概率要垫底了!为什么别人都说这个牛逼那个牛逼,我随手一测,就挂了。

我总是能发现别人发现不了的问题~~还是别人发了不说!

刚写完,听说 Kimi 2.7 来了,又有得玩了。

根据我的原则,我上传了第一个版本,你们可以去玩一下(玩干瞪眼!)

说实话,K2.6 就没必要玩了,其它的这几个可以试试看,有些结果别有一番趣味,当然做得最好的是 Fable 5,还原度非常高,真的是断代领先!

地址:

topai.jarvisuni.com/

最后强调,我的测试并不针对任何人,我只是把真实的情况发出来而已。

可以点赞了!😄


Kimi版超级玛丽效果“惊人”,配额不足5厘米!》 是转载文章,点击查看原文


相关推荐


2.PDF长文档完整读取
HappyAcmen2026/6/6

一、先知道什么是RAG 1. 一句话给 RAG 下定义 RAG = 给大模型(比如 ChatGPT、豆包、开源大模型)外挂了一个你自己的私有知识库,让大模型能精准、无差错地回答你私有数据里的内容,不会瞎编、不会用过时的知识。 你可以把 RAG 理解成: 大模型是一个超级会说话、会总结的「秘书」,但她的知识是固定的、过时的,而且完全不知道你电脑里的 PDF、文档、笔记这些私有内容RAG 就是你给这个秘书配的一个专属智能文件柜 + 精准检索神器,你把自己的所有文档、PDF、笔记都放进这个柜子里,秘书


Neo4j + Graph RAG 医疗知识图谱工程实践:患者教育问答真正需要的是“关系可追溯”
swipe2026/5/31

做医疗患者教育问答时,很多团队第一反应是把科普文章、指南摘要、院内宣教材料全部切片,然后丢进向量库。用户问“高血压要看哪个科”“为什么建议做血压监测”“糖尿病患者教育材料应该关联哪些检查”,系统就从文档里召回几段相似文本,再让大模型总结。 这条路能跑通,但很快会遇到一个问题:患者教育知识不是只有“文本相似”,还有大量“实体关系”。 比如“高血压”不是孤立的一段说明,它可能关联到常见表现、风险器官、建议就诊科室、常见检查、生活方式教育材料、随访提醒。用户真正想问的也不一定是“高血压是什么”,而是:


面试通关:JWT 认证与双 Token 机制深度解析
Lee川2026/5/9

面试通关:JWT 认证与双 Token 机制深度解析 本文专为面试准备,以问答形式拆解 JWT 认证体系的核心考点。每个问题都包含"面试怎么说"和"代码怎么写的"两个层面,让你既能侃侃而谈,也能落笔有物。 开篇:为什么面试官爱问 JWT? 在前后端分离成为主流的今天,身份认证 是每个系统必须解决的第一道门槛。JWT(JSON Web Token)作为无状态认证方案的代表,几乎出现在每一份后端/全栈岗位的 JD 中。面试官问 JWT,通常是在考察三个层面的理解:


【动态规划算法】(斐波那契数列模型详解)
承渊政道2026/4/29

🔥承渊政道:个人主页 ❄️个人专栏: 《C语言基础语法知识》 《数据结构与算法》 《C++知识内容》 《Linux系统知识》 《算法刷题指南》 《测评文章活动推广》 《大模型语言路线学习》 ✨逆境不吐心中苦,顺境不忘来时路!✨ 🎬 博主简介: 在算法学习的过程中,动态规划始终是一个绕不开的重要主题.它不仅是解决复杂问题的高效工具,也是面试和竞赛中出现频率极高的核心考点.对于初学者而言,动态规划之所以难,往往不在于代码实现本身,而在于如何理解


从0到1:Spring Boot 中WebSocket实战揭秘,开启实时通信新时代
常利兵2026/4/21

从0到1:Spring Boot 中WebSocket实战揭秘,开启实时通信新时代 引言:实时通信的需求与挑战 在当今数字化时代,互联网应用的实时交互需求日益增长。从在线聊天、股票行情实时更新,到多人协作办公、在线游戏等场景,实时通信已成为提升用户体验和业务效率的关键因素。传统的 HTTP 协议基于请求 - 响应模式,客户端发起请求,服务器被动响应,这种模式在实时通信场景中存在诸多局限性,如高延迟、高开销以及单向性(服务器无法主动推送数据,需客户端轮询) 。为了满足实时通信的需求,WebSo


公网 IP、私网 IP、路由表、转发表与 MAC 地址的关系
小红的布丁2026/4/12

引言 学习网络时,最容易混淆的不是协议流程,而是几个看起来相近、其实不在一个层面的概念,比如: 私网 IP 和公网 IP路由表和转发表“在链路上”到底是什么意思MAC 地址和 IP 地址分别属于哪一层 这篇文章把这些概念放到同一条线上梳理清楚,尽量用能直接形成画面的方式去理解。 私网 IP、公网 IP 和 NAT 到底是什么关系 很多人第一次接触家庭网络时,容易把 192.168.x.x 这类地址叫成“虚拟 IP”。这个说法不够准确,更准确的叫法应该是: 公网 IP私网 IPNAT 什么是公网


大模型推理凭什么这么贵?从GRPO到BCR,推理效率之战全解析
陆业聪2026/4/4

一个反常识的观察:推理越强,账单越贵 DeepSeek-R1 横空出世之后,"o1-style 推理"几乎成了大模型进化的标配动作。CoT、长思考链、自我反思……这些机制确实让模型在数学、代码、逻辑推理上表现亮眼。但随之而来的问题是——每一次"深度思考",都是在烧钱。 最极端的案例:让 o1 解一道简单的小学数学题,它会生成好几百个 token 的"内心独白",然后给出一个一眼就能看出来的答案。这就像雇了个博士级顾问,让他帮你决定午饭吃什么——能力没问题,但成本不对等。 这个问题的本质不是"推理


SwiftUI 如何实现 Infinite Scroll?
RickeyBoy2026/3/27

欢迎点个 star:github.com/RickeyBoy/R… 面试题:用 SwiftUI 实现一个无限滚动列表,支持分页加载。 这道题我在面试中遇到过好几次,说实话第一次答的时候以为随便写个 LazyVStack + onAppear 就完事了。后来才发现,面试官真正想考的不是你会不会用 API,而是你对状态管理、性能优化、Task 生命周期这些东西到底理解多深。 我的思路是从最简方案出发,一步步暴露问题、一步步优化。在开始写代码之前,先聊一下架构选型。 为什么选 MVVM? 先说一下


基于 Cloudflare 生态的 AI Agent 实现
Surmon2026/3/19

2026 新年的一个夜晚,窗外炮竹烟花争相闪耀,脑海里灵光一闪:我这快十年的老博客能不能也赶一波时髦,实现一个真正「有用」的智能助手? 有用 的意思是,它不能是一个只会随便聊天的机器人,而是一个真正了解我(博主)、了解博客内容的 AI 分身。它最好能事无巨细地知道我写过哪些文章,了解我的观点、立场和经历,能根据访客的问题去知识库里精准地找到最相关的内容,再结合上下文给出自然又富有意义的回答。 它应该是一张鲜活、灵动的个人名片。 这并不是一个多么复杂的需求,开源工具和商业基建也已经很成熟了,但真正


从零开发一个掘金自动发布 Skill,并上架 Clawhub
小巫debug日记2026/3/10

从零开发一个掘金自动发布 Skill,并上架 Clawhub 本文记录了一次完整的 Skill 开发旅程:从一句「帮我创建一个可以自动发布文章到掘金的 skill」开始,到最终成功上架 Clawhub,全程真实还原每一个关键决策和踩坑过程。 背景:为什么要做这个 Skill? 我日常运营一个 AI 资讯账号,每天需要将 Markdown 格式的文章发布到多个平台,包括微信公众号、小红书、掘金等。其中微信公众号和小红书已经有现成的 Skill 可以用,但掘金没有。 每次发布掘金都要: 打开

首页编辑器站点地图

本站内容在 CC BY-SA 4.0 协议下发布

Copyright © 2026 聚合阅读