← 返回信息流
产品 Reddit-LocalLLaMA · /u/Helpful-Series132 2026-08-29 11:47 🔥 热度 1

我们正在设计一个微型的自主研究代理

设计微型自主研究Agent,参数4300万

原文:Were designing a tiny autonomous research agent

这个基础模型只有4300万参数,在300万篇arXiv摘要上进行训练。我们计划继续进行预训练和后训练。如果您创建了微调数据集,或者您知道有哪些数据集可以帮助塑造我们目标的行为,我们欢迎所有贡献者。我们的目标是制作一个能够在本地自主进行研究的代理。这只是一个简单的循环,用于搜索网络并记录其发现,作为实验看看可能实现什么。如果我们仅在科学、物理学和技术上进行语言模型训练,它能做出新的发现吗?我们通过创建包含提问和回答模式的微调示例来测试这一点,直到从第一原理得出结论。如果您有任何建议来实现我们的目标,我们洗耳恭听。请留下您的评论。

🖼 相关图片

查看原文 ↗ Agent

📌 相关阅读

模型 再强也救不了 Agent:语义和记忆才是真正的瓶颈| AI Agent| AI 大模型 |Agent 记忆 热度 8 从单Agent到Multi-Agent:企业级智能体的7层核心能力一次讲透!| AI大模型 |Agent| AI |项目实战| 热度 7 GLM 5.3 和 GLM 5.3 Flash 在 RTX PRO 6000 WS 上本地运行,用 BlenderMCP 建了一座顶层豪华公寓 热度 6 千问创作上线Agent Teams,覆盖专业视频制作场景 热度 6 AQuA:让量化研究 Agent 持续进化,也让回测结果经得起检验 热度 6