# 实验
18 个相关产品 · 中文解读 · 按热度排序
kunchenguid/gnhf
一个让 AI 代理在睡前“休息”并“自我管理”的 TypeScript 项目,体现 AI 代理的拟人化与自主行为设计。
I put a $2.43 necklace on 3 outfits. VLMs priced it at $19 to $104
该实验用视觉语言模型(VLM)为一件2.43美元的项链估价,结果从19到104美元不等,揭示了AI在商品定价上的不可靠性与潜在偏差。
Opalith Compiler and Executor
一个用于软件工程的激进编译器与执行器,支持复杂代码生成与运行,适合探索前沿编程范式与实验性语言设计。
My AI agent has 9 hours left to win a public bet – live dashboard
一个实时公开的 AI 代理竞赛仪表板,展示某个 AI 代理在 9 小时内完成任务的进度与结果,让公众见证 AI 自主决策与执行能力,适合关注 AI 进展与自动化实验的开发者与技术爱
cognizant-ai-lab/neuro-san-studio
神经符号AI实验平台,用于探索神经网络与符号推理的融合,适合AI研究者进行创新性实验。
AIMoneyBattle
AIMoneyBattle 让多个 AI 模型在三个月内进行真实市场表现对决,通过实际交易结果评估模型优劣,适合 AI 与金融交叉领域的研究者。
AgentsProof – a small project for testing AI agents
一个用于测试AI智能体(AI Agents)的小型项目,帮助开发者验证智能体的决策、规划与执行能力,适合AI研究与工程落地场景
I had models play Slime Soccer against each other
让多个AI模型在Slime Soccer游戏中对战,通过强化学习和策略博弈展示模型的决策能力,适合AI研究者和游戏AI爱好者。
I'm a Robot
I'm a Robot 是一个互动式网页实验,通过行为模拟让访问者体验“AI 身份”,引发对人机边界思考。
I Built a Capture the Flag Arena for Agents
我构建了一个用于 AI Agent 的 CTF 比赛场域,让多个智能体在对抗环境中竞争与学习,适合 AI 研究者与开发者测试 Agent 的策略与鲁棒性,亮点是提供可复现的智能体博
Quatuor – Kick back and watch 4 agents LLM talk to each other (FOSS)
一个开源项目,让四个 LLM 代理自由对话,可观察智能体间的协作与辩论,适合研究 AI 交互与生成内容的趣味实验
Senbonzakura – remove the safety guardrails from open AI models
Senbonzakura 是一个用于移除开源大模型安全限制的工具,让开发者能自由探索模型的极限能力,适合追求实验性AI应用的开发者。
We let Muse Spark 1.1 vibe code itself to produce 2048
利用Muse Spark 1.1模型让代码自动生成2048游戏,展示AI自编程能力,适合开发者探索AI创作边界
A BIOS-style terminal for observing a deterministic persistent world
一个类 BIOS 风格的终端,用于观察一个确定性且持久化的虚拟世界,适合构建可复现、可调试的系统级开发与实验环境,为开发者提供类似「时间回溯」的调试能力。
I ran 12 AI bots predicting stocks for two months, every call public
一个公开运行的实验项目,通过12个AI机器人持续预测股票走势并公开所有交易决策,用于验证AI在金融预测中的真实表现与可复现性。
NULLXES
NULLXES 是一个极简主义的用户体验实验项目,通过“空”与“无”探索界面设计的边界。
Verify what an AI agent did, then tamper with the record (no signup)
可验证 AI 代理行为并故意篡改记录的实验工具,用于审计与透明性研究
Codex Plays NetHack
Codex Plays NetHack 是让 OpenAI Codex 模型自主运行在经典文字游戏 NetHack 中,探索 AI 在复杂决策与环境交互中的表现