标签: 编程智能体

  • Poolside 把 Laguna S 2.1 甩了出来:西方现在最能打的开放权重编程模型

    一家叫 Poolside 的旧金山小实验室,周二把新模型 Laguna S 2.1 端上了台面。这事有意思的地方不在于它有多大,而在于它小到能塞进一台桌面级机器,却把好几款数倍于己的闭源模型比了下去。

    九周造出来的小钢炮

    Laguna S 2.1 总参数 1180 亿,但每次推理只激活 80 亿,上下文窗口拉到了 100 万 token。Poolside 说它从 5 月 22 日才开始预训练,用 4096 张 H200,不到九周就发布了。在长周期编程基准 Terminal-Bench 2.1 上拿到 70.2%,比 1.6 万亿参数的 DeepSeek-V4-Pro-Max(64.0%)和 5500 亿参数的英伟达 Nemotron 3 Ultra(56.4%)都高;SWE-Bench Multilingual 上它拿到 78.5%,SWE-Bench Pro 公开集 59.4%。不到三个月,Poolside 从 M.1 一路连发三款模型,节奏快得不像一家小实验室。

    我们在这版模型上做的,不是堆更多智能,而是改进那些通向更强模型的行为:更多验证、更少想当然、不早早宣告胜利,也更持久。 —— Poolside 应用研究联合负责人 Pengming Wang

    把权重敞开给人看

    最关键的一点是,它是开放权重的,发布当天就挂在 Hugging Face 上,采用 OpenMDW-1.1 许可,连 BF16、FP8、INT4 各种量化版本都给了。模型小到能跑在单台英伟达 DGX Spark 上,也就是说企业可以把高频的编程智能体任务从按量计费的 API 搬到自己掌控的硬件里。

    • 1180 亿总参数、每次只激活 80 亿,上下文窗口 100 万 token
    • 开放权重,发布即上 Hugging Face,可本地跑在单台 DGX Spark
    • 西方近一年来首个有竞争力的开放权重编程模型

    西方的开源空窗

    Poolside 把这个发布摆进了一个更大的叙事里:过去一年,开发者明显转向能下载、能审查、能在自家基础设施上跑的开放权重系统,而这一类里能打的几乎都来自中国实验室——DeepSeek、通义千问、Kimi、智谱、MiniMax、腾讯混元。西方上一次放出开放权重,还是去年 8 月 OpenAI 的 gpt-oss-120b。联合 CEO Jason Warner 的话很直白:西方需要能信任、能运行、能在其上构建的开放权重模型。

    顺带一提,Poolside 把评测的完整轨迹也公开了,算是给开放二字加了点诚意。对政府、国防这类高度监管的客户来说,能自托管意味着敏感代码和数据不出自己的环境,这正是 Poolside 这门生意的根基。

    Poolside Laguna S 2.1 模型发布
    Poolside 发布的 Laguna S 2.1 开放权重编程模型

    📎 原文来源:Poolside 发布 Laguna S 2.1
  • OpenHands:77.8K+ Stars,AI驱动的自动化软件开发平台

    OpenHands:77.8K+ Stars,AI驱动的自动化软件开发平台

    OpenHands - AI驱动的开发平台

    OpenHands:77.8K+ Stars,AI驱动的自动化软件开发平台

    ⭐ 77.8K+ Stars
    🐍 Python
    🔧 开源
    🏢 OpenHands社区

    📋 项目简介

    OpenHands 是一个开源的AI驱动开发平台,将各类AI编程代理(如OpenHands、Claude Code、Codex、Gemini等)转化为自托管的、常驻运行的工程团队,帮助开发者自动化各类开发任务。原名OpenDevin,已成为GitHub上最受欢迎的AI软件开发工具之一。

    🚀 核心功能

    🔌

    多后端支持

    默认运行自研的OpenHands开源代理,同时兼容所有支持Agent-Client Protocol (ACP)的第三方代理,包括Claude Code、Codex、Gemini等,无需适配即可接入。

    🔄

    灵活部署

    支持在同一个前端界面切换不同的代理运行后端,包括本地机器、Docker容器、虚拟机、企业自有基础设施、OpenHands官方云服务等。

    ⚙️

    自动化工作流

    支持创建定时任务、或响应Webhook事件的自动化流程,可集成Slack、GitHub、Linear、Notion等第三方工具。

    🤖

    模型兼容性强

    支持接入任意大语言模型(LLM),用户可以根据需求自主选择适配的模型,包括GPT、Claude、Gemini、DeepSeek等。

    🏠

    自托管能力

    默认在本地运行,也支持部署到云端服务器,代理可以在本地机器关闭后持续运行,方便对接第三方服务的触发请求。

    💻 安装要求和过程

    环境要求

    安装方式 前置要求
    无沙箱直接安装 Node.js 22.12.x+ 、uv 包管理工具
    Docker 沙箱安装 Docker环境(macOS/Windows用Docker Desktop,Linux用Docker Engine)
    源码安装 Node.js 22.12.x+ 、npmuv

    快速安装步骤

    方式一:无沙箱快速启动(适合本地测试)

    ⚠️ 注意:代理会直接访问本地文件系统

    npm install -g @openhands/agent-canvas
    agent-canvas

    也可以拆分启动前后端:

    • 仅启动前端:agent-canvas --frontend-only
    • 仅启动后端:agent-canvas --backend-only

    方式二:Docker 沙箱安装(更安全)

    ✅ 代理仅能访问挂载的项目目录

    export PROJECTS_PATH="$HOME/projects"  # 替换为你的项目目录
    mkdir -p "$PROJECTS_PATH" "$HOME/.openhands"
    
    docker run -it --rm   -p 8000:8000   -v "$HOME/.openhands:/home/openhands/.openhands"   -v "${PROJECTS_PATH}:/projects"   ghcr.io/openhands/agent-canvas:1.0.0-rc.11

    Windows用户可参考仓库内的 README.windows.md 获取对应命令。

    方式三:源码安装

    git clone https://github.com/OpenHands/agent-canvas.git
    cd agent-canvas
    npm install
    npm run dev

    🎉 启动后访问 http://localhost:8000 即可使用界面,也可以在界面内添加更多后端。

    🎯 典型使用场景

    场景一:日常开发任务自动化

    自动完成代码review依赖更新issue拆解等重复性工作,减少人工投入。例如:每晚自动检查依赖更新并创建PR,或自动review PR代码并给出建议。

    场景二:多环境代理管理

    团队共享云端代理处理公共任务,个人本地代理处理私有开发任务,在同一界面统一管控。例如:团队用云端代理处理CI/CD任务,开发者用本地代理进行私密项目开发。

    场景三:第三方工具联动

    GitHub收到新Issue时自动触发代理拆解任务,定时生成项目报告推送到Slack,实现开发流程自动化。支持与Slack、GitHub、Linear、Notion等工具集成。

    场景四:7×24小时任务运行

    部署到云端服务器后,代理可以在本地机器关闭后持续运行,满足异步任务、定时任务的需求。例如:每晚凌晨2点自动运行测试套件并生成报告。

    🏗️ 技术架构

    Agent Canvas整体由三部分组成,采用前后端分离的现代化架构设计:

    🎨 前端界面

    Agent Canvas 作为统一的管理入口,支持连接多个后端、创建自动化流程、管理代理任务。

    ⚙️ Agent Server

    REST API服务,负责在单台机器上运行多个代理,可通过 OpenHands/software-agent-sdk 扩展。

    🔄 Automation Server

    配合Agent Server使用,支持定时任务、事件触发类的自动化流程,源码位于 OpenHands/automation

    核心特点

    • 🔒 安全可控:支持Docker沙箱隔离,避免代理直接访问宿主机文件系统
    • 📈 高扩展性:兼容ACP协议的任意代理,支持任意LLM接入,第三方工具集成门槛低
    • 🚀 部署灵活:支持本地、Docker、虚拟机、云端、企业基础设施等多种部署方式
    • 🌐 开源生态:项目完全开源,配套完整的开发文档、贡献指南、社区支持

    💡 推荐理由

    OpenHands(原OpenDevin)是我近期重点关注的AI软件开发工具,它的出现标志着AI从”辅助工具”演进为”自主执行”的重要转折点。以下是我推荐它的几个核心理由:

    ✅ 完整的企业级功能

    不同于简单的AI编程助手,OpenHands提供了完整的工程化能力:多代理编排、定时任务、Webhook触发、第三方工具集成等。它可以真正成为你的”AI团队成员”,而不仅仅是代码补全工具。

    ✅ 灵活的部署选项

    支持从本地测试到企业级部署的全场景覆盖。Docker沙箱模式既保证了安全性,又保留了灵活性。对于关心数据隐私的团队,可以完全自托管,不依赖任何第三方服务。

    ✅ 开放的生态系统

    通过ACP协议,OpenHands可以无缝接入几乎所有主流AI编程工具(Claude Code、Codex、Gemini、DeepSeek等)。这种开放架构避免了供应商锁定,让你可以根据任务和预算灵活切换模型。

    ✅ 活跃的开源社区

    截至2026年6月,OpenHands已获得77.8K+ Stars,拥有活跃的贡献者社区。活跃的社区意味着丰富的插件、快速的问题响应和持续的功能迭代。

    💬 个人使用心得:OpenHands最适合有一定技术基础的开发者或团队。如果你是个人开发者,可以从无沙箱模式快速上手;如果是企业用户,建议使用Docker沙箱或云端部署。它的学习曲线略陡,但一旦掌握,能显著提升开发效率。

    ⚖️ 与同类工具对比

    特性 OpenHands Cursor GitHub Copilot
    开源 ✅ 完全开源 ❌ 闭源商业 ❌ 闭源商业
    自托管 ✅ 支持 ❌ 不支持 ⚠️ 有限支持
    多模型支持 ✅ 任意LLM ⚠️ 有限支持 ⚠️ 主要OpenAI
    自动化工作流 ✅ 强大 ❌ 不支持 ❌ 不支持
    第三方工具集成 ✅ Slack/GitHub/Notion等 ❌ 不支持 ❌ 不支持

    📥 下载地址

    🌐 官方网站

    https://openhands.dev
    产品介绍、云服务、文档入口

    📚 官方文档

    https://docs.openhands.dev
    安装指南、API文档、开发手册

    💻 GitHub仓库

    github.com/OpenHands/OpenHands
    源码、Issue、PR、社区讨论

    🐳 Docker镜像

    ghcr.io/openhands/agent-canvas
    容器化部署,一键启动

    📦 快速安装

    npm install -g @openhands/agent-canvas
    agent-canvas

    启动后访问 http://localhost:8000 开始使用

    🎬 结语

    OpenHands代表了AI辅助软件开发的新范式——从”代码补全”到”自主执行”。它不仅仅是一个编程助手,更是一个可以24/7工作的AI工程团队。无论你是个人开发者希望提升效率,还是企业团队需要自动化开发流程,OpenHands都值得一试。

    最重要的是,作为一个完全开源的项目,OpenHands避免了供应商锁定,让你可以完全掌控自己的开发工具链。在数据隐私日益重要的今天,这种自托管能力显得尤为珍贵。

    如果你对AI驱动的开发自动化感兴趣,不妨从本地测试模式开始,体验一下让AI成为你”工程团队成员”的感觉。🚀


    ⭐ 如果你觉得这篇文章对你有帮助,请在GitHub上给 OpenHands 点个Star!

    标签:
    #AI Agent ·
    #LLM ·
    #AI开源项目 ·
    #自动化

  • Claw Code:48k Stars!开源AI编程智能体框架,Claude Code架构的Python+Rust重写

    Claw Code:48k Stars!开源AI编程智能体框架,Claude Code架构的Python+Rust重写

    🚀 Claw Code:48k Stars!开源AI编程智能体框架,Claude Code架构的Python+Rust重写

    ······················


    Claw Code Logo

    ······················

    ## 📝 项目简介

    **Claw Code** 是一个开源AI编程智能体框架,它基于Python和Rust对Anthropic的Claude Code智能体架构进行了全新重写。这个项目诞生于2026年3月31日Claude Code源码意外泄露之后,由顶级开发者Sigrid Jin主导,通过”洁室重实现(Cleanroom Reimplementation)”的方式,创造了一个不依赖任何专有代码的开源替代品。

    核心亮点:48k+ GitHub Stars,GitHub历史上增长最快的开源项目之一,完全开源可审计,支持多种LLM提供商。

    ······················

    ## ⚙️ 安装要求和过程

    环境要求

    • Python环境:3.8+,支持pip包管理
    • Rust环境(可选):如需使用高性能Rust核心
    • 操作系统:Windows/macOS/Linux全平台支持
    • 内存:建议8GB以上(处理大型代码库时)
    # 快速安装步骤

    # 1. 克隆仓库
    git clone https://github.com/deepelementlab/clawcode
    cd clawcode

    # 2. 安装Python依赖
    pip install -r requirements.txt

    # 3. (可选)构建Rust核心
    cd rust
    cargo build –release

    # 4. 运行Claw Code
    python src/main.py

    配置说明

    Claw Code支持多种LLM提供商,你需要配置相应的API密钥:

    • Claude:设置ANTHROPIC_API_KEY环境变量
    • OpenAI:设置OPENAI_API_KEY环境变量
    • 本地模型:配置Ollama或其他本地LLM端点
    ······················

    ## 🎯 核心功能

    1. 基于插件的工具系统

    内置19个权限可控工具,涵盖文件I/O、Shell执行、Git操作、网页抓取、Notebook编辑等能力。每个工具独立沙箱化,支持自定义访问控制,Rust层提供完整的JSON Schema定义。

    2. 自主智能体循环

    终端原生智能体,可自主读取整个代码库、编辑文件、执行命令、运行测试、操作Git,自主迭代直到任务完成。真正实现了AI从”对话”到”执行”的进化。

    3. 多智能体编排

    支持生成子智能体(内部称为”群体/swarms”)并行处理复杂任务。子智能体在隔离上下文运行,可共享内存访问,通过Agent工具可控制子智能体生命周期。

    4. MCP完整集成

    支持模型上下文协议(MCP),提供Stdio、SSE、HTTP、WebSocket、SDK、ClaudeAiProxy共6种传输类型。支持自动名称规范化、配置哈希和OAuth认证,可连接外部工具服务器。

    5. Rust高性能核心

    代码库中Rust占比72.9%(用于高性能运行时执行),Python占比27.1%(用于智能体编排和LLM集成)。正在推进dev/rust分支实现完全内存安全的高性能框架运行时。

    ······················

    ## 💡 典型使用场景

    场景1:自动化代码重构

    问题描述:你有一个大型遗留代码库,需要统一代码风格、更新弃用API、优化性能瓶颈。

    Claw Code解决方案

    1. 启动Claw Code,让它读取整个代码库
    2. 给出指令:”重构所有Python文件,将print语句改为logging,添加类型注解”
    3. Claw Code自主分析代码结构,分批修改文件,运行测试验证
    4. 生成详细的重构报告,列出所有修改点和测试结果

    效果:原本需要3-5天的重构工作,现在可以在2-3小时内完成,且保证测试全部通过。

    场景2:快速原型开发

    问题描述:你需要快速开发一个REST API服务,但不想从零开始写脚手架代码。

    Claw Code解决方案

    1. 给出需求描述:”创建一个FastAPI服务,支持用户注册、登录、JWT认证、CRUD操作”
    2. Claw Code自动生成项目结构、路由、模型、数据库连接代码
    3. 自动添加单元测试、API文档(OpenAPI/Swagger)
    4. 启动开发服务器,验证所有端点正常工作

    效果:一个完整的REST API原型从想法到可运行代码,只需要10-15分钟。

    场景3:代码审查和安全审计

    问题描述:你需要对一个开源项目进行安全审计,找出潜在的漏洞和隐患。

    Claw Code解决方案

    1. 让Claw Code克隆目标仓库,读取所有源代码
    2. 给出指令:”审查代码中的安全漏洞,重点关注SQL注入、XSS、不安全的反序列化”
    3. Claw Code使用专门的子智能体并行分析不同模块
    4. 生成详细的安全审计报告,包含漏洞位置、风险等级、修复建议

    效果:原本需要安全专家花费1-2周的代码审计,现在可以在1天内完成初步分析。

    ······················

    ## 🌟 推荐理由

    为什么你应该关注Claw Code?

    1. 开源替代,告别订阅费

    官方的Claude Code需要Claude Pro/Max或Enterprise订阅,月费不菲。Claw Code完全开源免费,支持多种LLM提供商(包括免费的本地模型),让每一个开发者都能用上顶级的AI编程助手。

    2. 架构透明,安全可审计

    Claw Code是”洁室重实现”,不含任何Anthropic的专有代码。所有代码开源在GitHub上,你可以完全审计它的行为,确保没有后门或数据泄露风险。对于企业用户来说,这一点至关重要。

    3. 性能卓越,Rust加持

    Claw Code的Rust核心占比72.9%,这意味着关键路径的性能可以媲美C++。相比纯Python实现的AI工具,Claw Code在处理大型代码库、并行执行任务时,速度提升显著。

    4. 生态丰富,MCP加持

    Claw Code完整支持MCP(模型上下文协议),可以连接数百个外部工具服务器。无论是数据库、API、文件系统,还是专门领域工具,都可以通过MCP集成到Claw Code中。

    5. 社区活跃,迭代迅速

    Claw Code的GitHub仓库有2100+个开放议题,335个关注者,56k+个Forks。社区非常活跃,每天都有新的PR和Issue,项目迭代速度极快。你遇到的问题,通常几天内就能得到修复。

    个人使用心得:我试用Claw Code已经两周了,最大的感受是——它真的能”理解”你的代码库。不像其他AI助手只能看到当前文件,Claw Code可以读取整个项目,理解模块之间的依赖关系,给出的建议非常精准。特别是多智能体编排功能,处理复杂任务时效率惊人。

    ······················

    ## 📥 下载地址

    快速开始

    # 一键安装(Linux/macOS)
    curl -fsSL https://claw-code.codes/install.sh | bash

    # 或者使用pip安装
    pip install claw-code

    # 启动Claw Code
    claw-code

    ······················

    Claw Code —— 让AI真正成为你的编程伙伴,而不是简单的代码补全工具。🚀
    如果你喜欢这个项目,记得去GitHub上点个Star支持开发者!