03
VeriRun aaron-for-value/VeriRun
⭐ 327 · 近30天 +未获取到
Python · Apache-2.0
最近提交 09-16
定位面向 RLVR(可验证奖励)的隔离可执行评测与在线奖励基础设施,提供可复现、隔离的执行与打分。
痛点训练与评测 Agent/模型时缺可信、可复现的执行环境与奖励信号,现有方案零散或闭源。
付费做大模型训练与 Agent 评测的团队;开源核心 + 企业支持/托管。
规模化评测与奖励是训练链路通用组件,可跨任务复用。
边际低 · 纯软件,新增评测任务成本趋零。
验证git clone https://github.com/aaron-for-value/VeriRun && cd VeriRun,按 README 跑一个 Docker 隔离评测样例(需 Docker)。
风险上线约 8 周、327 星,社区早期;RLVR 标准未统一,接入成本取决于自有训练栈。
加权 4.1
04
cosmo-edge cosmo-wander-ai/cosmo-edge
⭐ 1,122 · 近30天 +未获取到
C · Apache-2.0
最近提交 09-17
定位生产级 C++ 边缘 AI 引擎,做视频分析与端侧 VLM,覆盖 Sophon、Rockchip RKNN 与 x86,带编排、OSD、事件与基准。
痛点零售、制造、安防现场做视频智能分析,往往依赖昂贵的 VMS 与云端 CV 平台。
付费视觉智能化集成商与终端企业;开源引擎 + 实施/授权,替代付费 VMS 与 CV SaaS。
规模化跨零售、制造、安防等行业,但硬件碎片化使标准化交付中等。
边际低 · 软件引擎,自托管;每类硬件有少量集成成本。
验证git clone https://github.com/cosmo-wander-ai/cosmo-edge && cd cosmo-edge,x86 CPU 路径跑视频分析 demo(完整验证需 Rockchip 开发板)。
风险硬件碎片化带来适配成本;边缘算力有限,大模型 VLM 需量化;项目较新。
加权 4.0
05
OpenResearch alphaXiv/OpenResearch
⭐ 4,456 · 近30天 +未获取到
Rust · MIT
最近提交 09-17
今日 Trending +1,017
定位把 coding agent 变成研究 agent——自动做深度研究、可计算机执行的研究流程。
痛点研究者与分析师付钱买研报与调研服务,过程慢且数据留在别人手里。
付费学术、医药、金融研究用户;alphaXiv 可走托管/增值,替代付费调研服务。
规模化研究自动化跨领域通用,需求稳定。
边际低 · 纯软件,新增用户成本趋零。
验证git clone https://github.com/alphaXiv/OpenResearch && cd OpenResearch,按 README 把 coding agent 接成研究 agent(需 LLM key)。
风险研究结论的引用与准确性需人工把关;与 GPT Researcher 等深度研究工具竞争;星数刚过 3k 软线,靠近期增速归入小众观察。
加权 4.2