Cosmos 是一个用于构建持续运行的软件交付系统的平台,目标是把工作从规格说明推进到验证。它允许团队用自然语言构建和调优工作流,由智能体承担软件开发生命周期中的重复性工作,工程师则在重要质量门处进行审查和批准。与只把智能体指向单个编码任务的工具不同,Cosmos 将工单分派、代码编写、代码审查、测试、部署审批、监控和纠正连接成循环,让一个循环的结果可以交给下一个循环。
核心功能
软件交付循环编排
Cosmos 可以把软件工厂拆成多个相互连接的循环。官网展示了从 Ticket 到 Code、Review、Deploy、Monitor,再返回 Ticket 的流程;工单分诊可以触发代码编写,代码编写的结果进入审查,后续的监控和告警又能形成新的修复任务。循环中的重复性工作交给智能体执行,工程师保留质量门和关键操作的控制权。
自然语言创建工作流
用户可以描述希望建立的循环,选择 Advisor 并用自然语言说明需求。Advisor 会询问所需信息,随后列出使用的 Experts、运行环境和自动化步骤;用户在检查点批准计划后,Fleet 被创建、触发器启用,第一次运行即可启动。官网将这一过程概括为描述循环、批准计划和运行循环三个步骤。
面向软件开发生命周期的 Experts
Cosmos 自带覆盖软件开发生命周期不同阶段的专家。Work Dispatcher 扫描开放工单、按照分诊规则处理并分派合适的专家;PR Author 根据任务描述从首次提交推进到合并;Code Review Fleet 包含 Pair Review、Deep Code Review 和 PR Risk Analysis,并在拉取请求中发布行内发现;Tester 端到端执行变更并发布结果及截图。用户也可以从专家库中选择、派生已有专家,或创建自己的专家模板。
代码审查与自动修复
代码审查循环会为每个拉取请求提供实质性的首轮审查,关注意图和架构,而不只是逐行比较差异。漏洞修复循环可以从告警开始,分析影响范围,并将待团队批准的补丁交给审查流程。官网还展示了依赖升级、代码审查执行和安全漏洞分诊等专家,它们分别处理依赖更新、团队编码标准检查和带有修复步骤的漏洞工单。
事件响应与测试验证
事件响应循环会在值班工程师加入前完成调查,识别可能原因、整理时间线并汇集上下文。Incident Response Coordinator 可在 PagerDuty 告警后通过 Slack 通知值班工程师、创建协作频道、附加运行手册,并持续更新时间线文档。Tester 则会端到端执行变更并发布测试结果,截图也会包含在结果中。
运行环境、集成与人工控制
Cosmos 提供 GitHub、GitLab、Slack、Linear、Jira 的原生触发器,也支持为其他技术栈使用带类型的 Webhook。运行环境包括托管云沙箱、无法离开组织环境的代码所使用的自有机器,以及两者组成的池。平台支持调度、隔离、共享文件系统、代码库理解、触发与自动化,并通过质量门暂停工作,等待人工审查或批准后再继续。
使用方式
Cosmos 通过 Advisor 和自然语言创建循环,用户在检查点批准计划后启动运行。平台支持 GitHub、GitLab、Slack、Linear、Jira 和带类型的 Webhook 触发,也可使用托管云、自有机器、AWS、GCP 等环境。官网展示了 Cosmos 会话界面以及专家库,但没有说明是否必须注册、是否提供独立客户端或是否需要自备模型 Key。
适用人群与场景
软件工程团队可以用它把工单分派、代码编写、审查和测试串成连续流程。负责代码质量的团队可以让每个拉取请求获得首轮审查,并将编码标准作为审查条件。安全团队可以处理 Dependabot、Snyk 等漏洞告警,生成按优先级排列的 GitHub 工单和修复步骤。值班与事件响应团队可以在 PagerDuty 告警后自动展开调查、创建 Slack war room 并整理事件时间线。
注意事项
Cosmos 的关键动作不是完全无人值守:官网明确说明质量门是一等能力,工作会在审查处暂停,回复后恢复,具有后果的操作需要人员批准。对于不能离开组织环境的代码,需要使用自有机器运行;官网没有给出具体价格、免费额度或模型 Key 要求。