跳到正文
今天10月6日周二38 条
  1. Hacker News · AI40

    Plainserp – 为 AI 智能体提供按需调用的 Google 搜索 API,每 1k 次查询 $0.30

    Plainserp 提供一个为 AI 智能体设计的 Google 搜索 API,按需付费每 1,000 次查询 $0.30,首次 1,000 次查询免费。该 API 返回原始搜索结果的标题、链接和摘要,以 JSON 格式呈现,不包含 Google 的广告或知识面板等内容。用户可通过 MCP 服务器直接集成 web_search 工具,无需编写代码。

  2. 钛媒体65

    Manus重新独立,Agent之战换了打法

    Manus在脱离Meta后推出2.0版本和新应用Cue,引入长期在线云电脑、事件触发自动化及多Agent协作,同时Meta推出个人Agent产品Muse并快速扩展生态。文章分析了Agent竞争从单一能力转向生态连接,以及Manus估值翻倍背后的收入与成本挑战。

    推荐理由:原文分析了Manus独立后的产品变化和生态竞争,读者可以据此理解Agent从工具到角色的演进路径和行业格局变化。

  3. Hacker News · AI59

    AI 智能体从零到英雄:纯 Python 教程开源

    Tanmay Sah 发布了开源教育框架 ai-agents-zero-to-hero,提供从零构建 AI 智能体的纯 Python 教程,涵盖 Observe-Decide-Act 循环、工具调用、状态管理、多智能体系统等内容,支持无依赖运行,可接入 OpenAI、Anthropic、Gemini 或 Ollama 等模型。

    推荐理由:原文提供了从零构建 AI 智能体的纯 Python 教程,读者可据此理解智能体核心机制并复用代码结构。

  4. 极客公园29

    OpenAI 宣布「28 天计划」,持续改进 Codex、Work;TikTok 上线一系列 AI 电商功能;蓝色起源公布月球「动力塔计划」

    OpenAI 宣布将在未来 28 天持续改进 Codex 和 ChatGPT Work,每天推出一项对用户有明显改善的功能更新。TikTok 推出 AI 购物助手 Shopping Assistant 和应用内购买功能 Buy Direct,尝试用 AI Agent 串起从商品发现到购买的完整链路。

  5. Hacker News · AI43

    什么是主动式 AI?

    主动式 AI 不依赖提示即可自主执行任务,例如自动预订航班或提交申请。这类 AI 通过持续监控数据源、积累持久记忆并自主判断是否采取行动来实现功能。Meta 的 Muse 和 Instinct 等主动式 AI 助手已引发关注,但其便利性需以完全开放个人账户数据为代价。

  6. Hacker News · AI61

    Schema-guard:防止AI智能体在SQL中虚构列名的工具

    Schema-guard是一个开源工具,通过在代码仓库中维护真实数据库表结构的快照(仅含表名和列名),在AI智能体生成SQL前进行校验,阻止其因依赖过时文档或命名习惯而虚构列名。

    推荐理由:该工具通过实时校验SQL与真实表结构,防止AI智能体因依赖过时文档而生成错误列名,可直接集成到开发流程中。

  7. IT之家52

    Reflection AI 发布首款开放权重模型 Beam,参数量5010亿,稀疏激活架构对标千问与GLM

    由英伟达投资的初创企业 Reflection AI 发布首款开放权重大模型 Beam,总参数量5010亿,采用稀疏激活架构,每次仅激活230亿参数,以提升推理速度并降低成本。该模型在代码和智能体任务上性能接近千问3.8-Max,对标智谱AI的GLM-5.2。公司由前DeepMind研究人员创立,已与SpaceX合作获取算力支持。

  8. SiliconANGLE45

    Ghost AI 由19岁创始人领导完成1100万美元融资,打造首个专为运行个人AI代理的计算机

    Ghost AI 完成1100万美元融资,用于打造首款专为运行个人AI代理的计算机 Core。该设备搭载 Nvidia RTX Pro 4000 SFF Blackwell 显卡,支持本地运行 Qwen-3.8、Qwen-3.8-2.7B 和 Gemma-4-31B 等开源模型,用户数据全程加密且无需连接云端。设备通过手机和网页应用控制,售价3499美元,首批已售罄。

  9. Hacker News · AI46

    Design Systems for AI Agents (Luke Wroblewski)

    AI 智能体可通过设计系统实现协作对齐,确保网站更新符合统一的品牌与开发规范。Intent 网站通过 AGENTS.md 文件指导智能体复用全局样式表中的主题类和 CSS 变量,无需人工查找即可自动适配暗色模式等设计规则。设计系统页面直接从代码构建,保持与网站同步,并支持智能体反向更新 Figma 文件。

  10. Hacker News · AI66

    Nova Sprint:跨多模型和框架协调AI冲刺的开源工具

    Nova Sprint 是一个开源工具,用于在多个AI模型和框架间协调工作流,通过定义任务卡片、依赖关系和阶段门控,实现自动化的任务分配、状态追踪和流程推进。它将工作计划、依赖、评审和落地状态存储在外部系统,避免依赖聊天记录,提升协作可靠性。支持并行任务、跨流依赖、自动与手动门控,并提供实时仪表盘和文档。项目开源,MIT许可证,可立即使用。

    推荐理由:原文提供了可复用的协调工作流框架和开源实现,读者可以据此构建跨模型的AI协作系统。

  11. The Next Web44

    TikTok 添加 AI 购物助手和一键结账功能

    TikTok 在 Advertising Week New York 宣布新增 AI 购物助手和一键结账功能,用户可在 For You 页面直接购买商品。AI 购物助手能记住用户需求并完成购买流程,功能与 Salesforce、Shopify 等平台合作开发。TikTok 还推出 Agentic Leads,用于在私信和广告商网站表单中与潜在客户对话,提升销售线索质量。

  12. Hacker News · AI33

    Show HN: The mainbrella effect – AI code / Agent machines

    Andrew 发布了 mainbrella 项目,提供与 e2b.dev 或 daytona.io 类似的 AI 代码和智能体机器服务,基于开源 GPL 3.0 协议。测试显示其沙箱启动速度达 381 毫秒,100 个并发启动平均耗时 680 毫秒,且全部成功运行。该项目目前无免费计划,基础构建者计划每月收费 $5,但用户可在自己的 Cloudflare 账户中运行代码。

  13. Hacker News · AI52

    为 AI 智能体设计领域特定语言以提升效率

    作者通过金融建模案例说明,为 AI 智能体设计领域特定语言(DSL)可减少上下文负担,提升准确性和速度。在 Excel 中实现硬编码延续模式需9步,而使用 DSL 仅需3步调用工具。DSL 通过抽象执行细节,让智能体聚焦概念而非低层操作,适用于需重复处理的复杂任务。

  14. SiliconANGLE18

    Infor Velocity Week:企业如何将智能体AI融入日常运营流程

    Infor Velocity Week 将探讨企业如何将智能体AI嵌入日常运营流程,以提升业务效率。Infor 正在通过行业专用AI智能体和流程智能技术,推动AI从实验工具向生产系统过渡。活动将于10月7日举行,theCUBE 将提供独家直播报道,并分析行业知识是否能帮助AI实现可衡量的业务成果。

  15. Hacker News · AI13

    Agility: Build Software at AI Speed

    Agility 通过 AI 原生工作流帮助资深工程师将软件交付时间压缩至原计划的三分之一,例如在受监管的医疗平台项目中将交付周期从 3 个月缩短至 1 个月。每个工程师的产出能力提升至 2 倍,覆盖需求、实现、测试和评审各环节。所有发布均经过审查、测试和审计,确保生产级质量,适用于各行业复杂项目。

  16. IEEE Spectrum · AI49

    6 条治理 AI 的指南

    本文提出六条治理 AI 的指南,强调从构建 AI 系统转向设定其执行原则与边界。治理 AI 需要将企业文化和价值观转化为可执行的代码,并通过三层结构(宪法、教义、战术手册)确保系统决策符合优先级原则。治理还应安装“信任恒温器”而非“信任开关”,通过置信度评分机制实现透明、可审计的决策流程。

  17. TechCrunch · AI52

    Instinct 将其AI智能体扩展至群聊,支持无账号好友参与

    Instinct宣布将其AI智能体扩展至群聊功能,即使群成员未注册Instinct也可使用。该功能适用于旅行规划、票务、拼车等协作场景,智能体在群聊中独立运行,与用户个人账户隔离,需用户授权后才可共享信息或执行操作。功能目前面向早期用户开放,后续将逐步推广。

  18. Hacker News · AI60

    Metagente:一个支持 MCP 和 A2A 的轻量级 AI 智能体语言

    Metagente 是一个用于构建 AI 智能体的轻量级语言,支持 MCP 和 A2A 协议,可直接运行无需 Python 环境。它提供单个 Rust 二进制文件,包含目标、工具、输入和回复的声明式语法,支持动态调用其他智能体并具备安全权限控制。项目已开源,提供示例、文档和构建指南,当前版本为 v0.1.1。

    推荐理由:原文提供了可直接运行的 agent 语法示例和下载方式,读者可以快速验证其在无 Python 环境下构建智能体的能力。

  19. Hacker News · AI31

    我还没准备好让 AI 控制我的电脑

    作者表示目前不准备让 AI 控制自己的电脑,担忧 AI 智能体失控可能导致意外操作。Claude 和 ChatGPT 的桌面应用已具备直接操作文件、浏览器和系统的能力,但网页版仍仅限于浏览器内使用。银行近期提醒用户不要向 AI 提供账户信息,强调使用责任仍由用户承担。

  20. Hacker News · AI32

    AI SDLC转型手册:Atlassian的实践与关键流程转变

    Atlassian分享了AI原生软件开发生命周期(SDLC)转型的实践与关键流程转变,强调需同步投资平台基础(如上下文与测量系统)并转向AI原生的工作方式。传统SDLC中,需求定义依赖手动操作且知识不完整,而AI能合成用户需求与代码上下文,生成版本化的需求文件。设计阶段通过Live原型与AI智能体协作,实现UI代码与修复的直接提交,提升跨团队一致性与效率。

  21. IEEE Spectrum · AI40

    保持人类在 AI 循环中的尝试可能实际上将他们排除在外

    三位领先的人工智能伦理研究人员指出,当前设计中试图让人类参与 AI 智能体决策循环的做法,实际上可能将人类排除在循环之外。AI 智能体往往以速度、准确性和工作量为优先,而忽视了人类监督者的需求,导致他们被过多信息淹没。为解决这一问题,作者建议在人机交互中引入“摩擦”,例如让用户在 AI 提出计划前先记录自己的选择,或在用户批准后反问“什么证据会改变你的想法?”

  22. MIT Technology Review · AI22

    连接 AI 智能体与企业知识

    企业 AI 智能体常因缺乏对组织数据的上下文理解而难以推进到生产环境,MIT Technology Review 的报告指出,仅约 34% 的企业智能体项目能进入生产阶段。数据碎片化是主要障碍,被 55% 的受访者列为首要挑战,而生产领先企业更关注安全与隐私问题(72% 提及)。专家建议通过知识图谱、检索增强生成(RAG)等技术加强数据与智能体的联系,以提升决策质量。

  23. AWS · AI 博客30

    Amazon Bedrock AgentCore 评估多智能体系统的可解释性与实用性

    Amazon Bedrock AgentCore 提供了一种全托管的评估能力,用于衡量多智能体系统在开发和生产环境中的准确性、任务成功率和行为表现。该平台支持内置评估器和自定义评估器,前者用于快速评估通用质量维度,后者用于验证供应链场景中的约束满足、路线可行性、SQL 正确性及可解释性。企业可通过此框架同时评估智能体响应的语言质量与业务决策的有效性。

  24. AWS · AI 博客35

    Agentic retrieval with LangChain and Amazon Bedrock Knowledge Bases

    Amazon Bedrock 管理知识库支持通过 AgenticRetrieveStream API 实现智能体式检索,将复杂问题拆解为多个子查询并逐步执行。与标准检索相比,该方法能更全面覆盖问题意图,但成本可能更高。文章演示了使用 LangChain 和 Amazon Bedrock 知识库构建 RAG 应用,并介绍了两种检索方式的权限配置及实现流程。

  25. AWS · AI 博客31

    Amazon Quick 如何实现跨账户资源推广的自动化

    Amazon Quick 通过 API 和 Model Context Protocol (MCP) 服务器实现跨账户资源推广的自动化,支持创建、读取、更新和删除操作。该方案可在单次调用中推广资源,保留权限并提供版本化备份,确保可审查和回滚。推广过程包括聊天代理、操作连接器、知识库、流程和空间的配置迁移,且不复制 S3 对象本身,仅重建数据源和权限。

  26. Hacker News · AI49

    Show HN: Leftovers – FOSS macOS 应用用于清理 AI 智能体残留进程

    Leftovers 是一款开源 macOS 应用,用于清理 AI 智能体(如 Claude Code、Codex、Gemini CLI、Cursor Agent、Aider、OpenCode)运行后残留的进程和资源。它通过读取每个进程的内存占用(包括 RAM、压缩内存和交换内存)识别潜在内存泄漏,并提供菜单栏仪表盘和清理操作。应用支持保护特定进程,不会清理系统核心进程或用户指定的保护应用。

  27. Databricks 博客26

    Genie Ontology 如何赋能 Databricks 产品开发

    Genie Ontology 通过整合企业内部的认证定义、规则和权威来源,使 Genie 能够在推理过程中准确理解业务上下文。它结合了 Unity Catalog 中的核心概念、组织内的仪表板、文档和查询数据,并利用 OntoRank 对上下文进行权威排序。

10月5日周一
  1. Hacker News · AI72

    AI智能体主导的渗透测试:自主漏洞狩猎的内部运作

    Huntback披露了一套由AI智能体驱动的自主漏洞狩猎平台“Brainstorm”,该平台通过Claude Code等智能体执行扫描、代码分析、漏洞确认与分类,结合自建OOB协作器和传统渗透工具(如nuclei、responder),实现机器速度的漏洞挖掘。系统支持Anthropic与Kimi等多模型后端切换,强调防御需关注行为特征而非特定API。

    推荐理由:原文揭示了AI智能体在渗透测试中的实际部署方式,展示了自动化攻击流程与模型后端可替换性的现实影响。

  2. Hacker News · AI22

    什么是 AI 智能体 – 一篇入门指南

    AI 智能体是一个程序循环运行,代表用户执行任务,其核心是不断接收请求、调用模型、运行工具并反馈结果。智能体的行为依赖于“harness”程序如何编译上下文并决定是否执行模型请求的工具。当前前沿模型如 gpt-6-astra、claude-opus-5-5、gemini-3.8-flash 等可处理约 750 thousand words 的上下文,但模型本身无状态,每次调用均基于全新输入。