Anthropic 希望了解你对 AI 的看法
Anthropic 启动一项新研究,邀请用户分享与 AI 相关的正面和负面经历,并决定是否公开访谈内容。此次研究将完整发布访谈内容及所属国家,不包含 Claude 账户信息。用户可在此链接参与,但需注意公开访谈可能带来身份被识别的风险。
Anthropic 启动一项新研究,邀请用户分享与 AI 相关的正面和负面经历,并决定是否公开访谈内容。此次研究将完整发布访谈内容及所属国家,不包含 Claude 账户信息。用户可在此链接参与,但需注意公开访谈可能带来身份被识别的风险。
本文详解如何用纯 Python 和 Anthropic API 从零构建 AI 智能体,涵盖工具调用定义、请求-执行-响应循环、持久化记忆实现等核心模块,代码可直接运行,适用于需要自定义智能体逻辑的开发者。
Seylo 是一个工具,允许用户将图片、页面、笔记、文件和 AI 对话保存到项目中,供 AI 使用。它支持 Web、iPhone 和 Chrome 扩展,通过 MCP 连接 Claude、ChatGPT 和 Cursor 等 AI 工具,使 AI 能基于项目内容生成内容。Pro 版本提供完整退款保障,适合创作者、创始人、设计师等使用。
中国铁路指出,第三方平台不产生任何“票源”,其“抢票”行为最终依赖铁路 12306 系统。第三方平台存在附加收费、虚假宣传、个人信息泄露等风险,例如诱导用户购买“双通道”“加速包”等收费服务,但这些服务并无实际作用,且可能占用用户仅有的改签机会。铁路 12306 作为唯一官方售票平台,持续识别并限制恶意抢票行为,提醒旅客通过官方渠道购票,避免非理性消费和信息泄露。
三星 Galaxy S27 Ultra 基础颜色选项包括黑色、蓝色、浅粉色和白色。该系列预计包含 4 款机型,Pro 和 Ultra 机型将配备 Privacy Display 隐私显示功能,通过限制屏幕侧面可视范围提升隐私保护。Galaxy S27 系列近日通过中国 CCC 认证,Pro 和 Ultra 支持 60W 有线快充(20V、3A)。
苹果近期将 iCloud 邮箱别名的创建上限从 3 个提升至 9 个,用户可在不新建账户的情况下生成多个 @iCloud.com 邮箱地址用于不同注册场景。iCloud 用户指南尚未更新相关说明,但实际调整已生效。该功能改进有助于提升用户隐私保护和使用灵活性。
Rockstar Games 为《GTA 6》专门设立团队设计 NPC 路人对话,并安排广告和喜剧内容编剧,以增强玩家对游戏世界社会文化的感知。玩家在快速穿过街道时可听到零散对话,停留聆听则能获取更多信息,内容涵盖竞选标语、广播广告等环境叙事元素。游戏采用现代背景,通过夸张讽刺手法呈现现实社会现象与文化冲突。
使用 statsmodels 的 PredictionResults 对象可同时获取预测值和置信区间,无需手动重新计算。通过 append 方法可添加新数据而不必重新拟合模型,节省计算资源。STLForecast 对象可自动处理季节性分解与预测,避免手动步骤中的误差。
MIT 报告指出 AI 正在减少学生参加办公室时间、在线讨论和学习小组的频率,导致师生间信任下降。部分课程中学生依赖 AI 生成答案,而非真正学习,影响了 UROP 研究项目的核心目标。报告建议各课程应制定独立的 AI 政策,优先考虑学习目标,并推荐采用口头考试、项目作业等替代方式,以减少 AI 对真实学习成果的干扰。
Jev 可以在 70-500 毫秒内完成模型路由决策,成本低至 $0.042 每百万输入 token,且不会因过度智能而产生错误输出。它通过 Choice、noul 和 score 等类型进行决策,用户可定义路由规则并设置最低置信度阈值。Jev 作为专有模型,需通过其 SDK 接入,适合用于将请求路由到 Claude 的 haiku、sonnet 或 opus 等不同模型。
构建可靠的 AI 智能体系统需将决策分为模型建议、策略服务验证和执行层实施三个独立部分。策略服务可检查请求是否符合用户授权范围,并记录审计信息。智能体上下文应默认视为不可信输入,需追踪来源并验证其有效性,以防止恶意或过时信息影响决策。
OpenAI将在ChatGPT中测试视觉广告,用户生成图片时界面可能出现商品灵感或服务体验广告,但广告不会嵌入图像或影响生成结果。测试预计10月下旬在美国启动,初期面向部分广告商,广告展示位置、频率及用户偏好管理尚未详细说明。公司还将扩展广告效果衡量工具及合作伙伴网络,接入转化数据并评估广告展示环境的安全性。
开源工具RemoveMacAI可关闭Apple Intelligence、删除本地AI模型并阻止系统重新下载,帮助Mac用户释放数十GB存储空间。该工具通过配置文件禁用模型资源管理服务,无需修改系统核心文件或关闭SIP。
三星 W27 心系天下折叠屏手机发布会预计于 10 月 29 日举行,线下预定已开启。新机基于 Galaxy Z Fold8 系列打造,首批门店取机时间为 11 月 5 日,支持优先选配色。
开源项目维护者 Naor Peled 认为,尽管 AI 可以生成代码,开源仍然重要。他提到 AI 生成的 PR 无法替代社区参与,因为维护者仍需判断代码质量与方向。他通过维护 TypeORM 和 Cyphernetes 等项目,强调开源贡献有助于社区成长和技术学习。
UC Riverside 研究团队发现,大语言模型中的不确定性和正确性由不同的内部特征驱动,这挑战了模型自信度与答案准确性相关的假设。通过使用稀疏自编码器工具,他们识别出三类特征,并在不重新训练模型的前提下,通过抑制部分特征使模型准确率提升最高达 1.1%,同时减少不确定性达 75%。研究还表明,这些特征可应用于不同问答基准,为开发者提供了一种提升 AI 可靠性的实用方法。
Anil Madhavapeddy指出,AI智能体可从公开漏洞线索生成利用代码,导致传统披露禁令失效;GPT-4智能体在15漏洞基准中凭CVE描述成功利用87%。
推荐理由:AI智能体能从公开线索快速生成漏洞利用,迫使开源项目重新思考披露与修复流程。
该 AI 说唱生成工具可在数秒内将文本提示转换为完整说唱歌曲和节拍,支持多种风格如 UK Drill、Trap、Lo-Fi Hip Hop 等,无需登录即可免费试用。生成的音频为免版税使用,可直接下载用于社交媒体、视频或流媒体平台。工具内置自适应节奏引擎和多风格匹配功能,提供接近专业制作的音质。
财务团队每天花费至少 10% 的时间验证 AI 输出,其中 32% 的团队花费 26–50% 的时间进行此类工作。调查显示,仅 4% 的财务团队拥有统一的数据来源,而 76% 的 CFO 面临高压要求全面实施 AI,但只有 7% 的财务职能已准备好在所有流程中使用 AI。微软 Copilot 是当前 CFO 办公室中最常用的通用 AI 工具,其次是 ChatGPT 和 Claude。
AI-Native 公司正在通过引入智能体改变传统管理结构,Block、Lovable 和 Every 等公司已开始实践并取得成效。员工与智能体协作完成原本需要部门完成的工作,岗位界限模糊,所有人可直接访问公司知识库并参与实验决策。P&G 的试验显示,使用 AI 的团队情绪更积极,工作效率和质量提升明显。
Union.ai 今日推出自助服务功能,用户可通过 AWS Marketplace 注册并直接在自己的云账户中运行生产工作负载,无需安排会议。该功能解决了安装流程复杂、配置分散及支付流程繁琐等问题,支持通过 AWS 账户自动计费并利用现有折扣。用户可运行真实工作流,无需依赖演示环境,并可邀请同域团队成员加入,默认为管理员权限。
挪威计划在部分公共场所临时禁止使用AI眼镜。该提案旨在应对AI眼镜可能带来的隐私和安全风险。目前该禁令尚未实施,具体范围和时间将由政府进一步评估决定。
AI 令牌价格近期出现下跌趋势,市场对其背后原因展开讨论。当前多个主流模型和平台的令牌价格均出现不同程度的下降,但具体原因尚未明确。部分用户和开发者正在分析是否与模型性能提升、使用成本降低或市场供需变化有关。
AI 智能体正在改变计算资源的使用和成本结构。文章指出,智能体通过自主决策和任务分配,显著提升了计算效率并降低了单位任务成本。这一趋势可能影响未来云计算和边缘计算的定价模式及资源分配策略。
本文基于Uber、Spotify、Stripe等公司实践,提出构建AI原生软件工厂的六层架构:模型网关、沙箱环境、工具目录、上下文图谱、执行框架和安全门禁。作者强调应优先处理重复性工作,通过测量当前瓶颈(如评审等待时间)选择首个自动化任务,并建议采用‘买工具、建平台’的策略,即购买现成AI代理,自建支持其运行的基础设施。
推荐理由:原文基于多家公司实践,梳理了AI原生软件工厂的构建路径和关键控制点,读者可据此判断自身团队的落地优先级和风险边界。
首个 Agentic AI 设计系统推出,可直接用于构建和启动 AI 产品。该系统支持通过提示词驱动开发流程,减少人工干预。其开源特性允许开发者快速集成并扩展功能。
Hindsight 是一个开源的智能体记忆系统,旨在让 AI 智能体具备学习能力而非仅记忆对话历史。它通过生物启发式数据结构组织记忆,支持 retain、recall、reflect 三种操作,已在 LongMemEval 基准上取得 SOTA 性能。
推荐理由:原文提供了部署方式、集成方法和基准测试结果,读者可以据此判断它如何增强现有智能体的记忆能力。
快手于9月28日同时推出AI创作工具likli内测和新一代视频模型Kling 4.0,前者定位为交付结果的创作Agent,支持从想法到成片的全流程,内置多套Skill,提供macOS与Windows客户端;后者单次生成时长提升至30秒,支持10张关键帧、8000 tokens提示词输入,轻量版已向黑金会员开放体验。
推荐理由:快手在模型与Agent双线推进,likli工具和Kling 4.0模型共同指向从生成片段到交付成片的完整工作流,读者可借此理解当前AI视频工具的竞争焦点转向。
A股硬科技企业大普微计划赴港第二上市募资至少10亿美元,预计2026年底或2027年初挂牌。2026年港股IPO募资榜前三名均为A股硬科技公司,合计募资超1100亿港元,但新股破发率已超过70%。AI算力硬件产业链企业因扩产需求强烈,纷纷转向港股融资,但二级市场承接力不足导致恒生科技指数创一年新低。
人形机器人已在DQ冰淇淋、全家便利店、霸王茶姬等线下门店上岗,执行制作冰淇淋、递送商品等任务,但效率仍不及真人。京东、Figure等公司正在采集真人动作数据用于训练机器人,其中京东计划两年内采集1000万小时数据,Figure的Index项目已获100万注册用户上传1600万段视频。
挪威政府今日宣布计划在特定公共场所临时禁止使用AI眼镜,担忧其可能在未经允许的情况下拍摄或录音。禁令可能涵盖公园、海滩、博物馆、购物中心等人群聚集地,以及学校、健身房等场所。政府表示不会全面禁止,私人使用及不涉及他人未经同意被拍摄的情况仍被允许,并将考虑是否纳入大学和学院。
华为与高通宣布签署多年专利许可协议,涵盖5G、AI、计算和网络领域,这是双方首次涉及5G的许可协议。协议允许双方使用对方相关专利,高通还将收购华为部分美国专利,待监管批准后完成交易。华为预计该协议将使其专利许可总价值超过69亿美元,并称其许可业务自2021年起已实现营收为正。
OpenAI 正在测试在 ChatGPT 图像生成中嵌入视觉广告,通过情绪敏感性评估决定广告展示时机。广告已在31个欧洲国家上线,面向免费和Go用户,Plus及Pro订阅用户不显示。
本文系统阐述了构建生产级LLM平台的六大核心工程实践,包括在平台层强制结构化输出、智能重试机制、提示词版本管理、意图验证路由、MCP工具授权及行为可观测性。通过在平台层而非应用层处理幻觉、成本归因和行为漂移,将生产幻觉率从15%降至1.5%。
推荐理由:原文系统性拆解了生产级LLM平台的六大基础设施设计,读者可据此理解如何避免幻觉、控制成本和实现可观测性。
Elastic 在生产环境中运行 AI 智能体,并介绍了构建可复用评估框架的实践,包括使用追踪技术实现评估自动化。该框架包含多个模块,支持不同场景下的评估需求,如网络安全事件检测和企业级聊天机器人。Elastic 通过与安全专家合作创建数据集,使用精确率、召回率、相似度和事实性等指标确保智能体性能稳定。
OpenAI 在 ChatGPT 中引入新的视觉广告格式,并扩展了广告测量工具、归因合作伙伴和品牌适配功能。该广告格式支持更丰富的视觉内容展示,归因合作伙伴包括多家主流数据分析平台,品牌适配功能可过滤不适宜内容。这些更新旨在提升广告主在 AI 使用场景下的投放效果与用户体验。
俄罗斯 Shturm 无人坦克在 Tsentr-2026 军事演习中首秀失败,失去遥控指挥链接后陷入泥地。该坦克基于苏联 T-72 和 T-90 车体设计,配备 125mm 火炮或双 30mm 自动炮等配置,其控制依赖 3 公里内的遥控车,缺乏可靠通信保障。俄装甲专家指出其发动机舱和炮塔顶部几乎无防护,且依赖视线内的指挥所,难以在实战中发挥作用。
一名佛罗里达州女子因在 Anthropic 的 Claude AI 聊天记录中威胁射杀 Lee County 警长办公室而被起诉,相关对话被 Anthropic 人工审核团队上报警方。该聊天记录包含至少三条威胁性内容,其中一条提及次日将获得新枪,警方据此对其提出重罪指控。此案是近期多家 AI 公司因用户在聊天机器人中发布威胁信息而被卷入法律纠纷的又一例。
Windows 11 五年前发布,近期推出的 26H2 更新承诺为“可预测且低干扰”的改进。微软此前因强制使用在线账户和硬件兼容性问题引发争议,如今正减少内置 AI 功能,转向跨平台智能体模型。目前 Windows 11 占据约 76% 的桌面电脑市场,仍是主流操作系统。
NorthWestRepair 修复了一对价值 $16,000 的 DDR5 内存条,其中一块为 128GB、另一块为 256GB 的 ECC 服务器内存。修复过程中,他通过重新焊接和更换 PMIC 芯片等操作使内存模块恢复运行,避免了电子垃圾的产生。随着 AI-pocalypse 的影响,修复高价值内存的成本已远低于更换新模块,使得内存维修成为一项可行的商业活动。