跳到正文
10月5日周一
  1. Hacker News · AI33

    Anthropic 希望了解你对 AI 的看法

    Anthropic 启动一项新研究,邀请用户分享与 AI 相关的正面和负面经历,并决定是否公开访谈内容。此次研究将完整发布访谈内容及所属国家,不包含 Claude 账户信息。用户可在此链接参与,但需注意公开访谈可能带来身份被识别的风险。

  2. Hacker News · AI46

    Seylo:为 AI 提供项目文件和参考的工具

    Seylo 是一个工具,允许用户将图片、页面、笔记、文件和 AI 对话保存到项目中,供 AI 使用。它支持 Web、iPhone 和 Chrome 扩展,通过 MCP 连接 Claude、ChatGPT 和 Cursor 等 AI 工具,使 AI 能基于项目内容生成内容。Pro 版本提供完整退款保障,适合创作者、创始人、设计师等使用。

  3. IT之家30

    中国铁路:所有第三方平台自身不产生任何“票源”,其“抢票”行为的尽头都是 12306

    中国铁路指出,第三方平台不产生任何“票源”,其“抢票”行为最终依赖铁路 12306 系统。第三方平台存在附加收费、虚假宣传、个人信息泄露等风险,例如诱导用户购买“双通道”“加速包”等收费服务,但这些服务并无实际作用,且可能占用用户仅有的改签机会。铁路 12306 作为唯一官方售票平台,持续识别并限制恶意抢票行为,提醒旅客通过官方渠道购票,避免非理性消费和信息泄露。

  4. IT之家11

    三星 Galaxy S27 Ultra 基础颜色选项曝光:黑色、蓝色、浅粉色、白色

    三星 Galaxy S27 Ultra 基础颜色选项包括黑色、蓝色、浅粉色和白色。该系列预计包含 4 款机型,Pro 和 Ultra 机型将配备 Privacy Display 隐私显示功能,通过限制屏幕侧面可视范围提升隐私保护。Galaxy S27 系列近日通过中国 CCC 认证,Pro 和 Ultra 支持 60W 有线快充(20V、3A)。

  5. IT之家25

    《GTA 6》投入专门团队打造 NPC 路人对话:玩家可鲜明感知游戏世界社会文化风采

    Rockstar Games 为《GTA 6》专门设立团队设计 NPC 路人对话,并安排广告和喜剧内容编剧,以增强玩家对游戏世界社会文化的感知。玩家在快速穿过街道时可听到零散对话,停留聆听则能获取更多信息,内容涵盖竞选标语、广播广告等环境叙事元素。游戏采用现代背景,通过夸张讽刺手法呈现现实社会现象与文化冲突。

  6. The Decoder48

    MIT 报告发现 AI 正侵蚀办公室时间、学习小组和师生信任

    MIT 报告指出 AI 正在减少学生参加办公室时间、在线讨论和学习小组的频率,导致师生间信任下降。部分课程中学生依赖 AI 生成答案,而非真正学习,影响了 UROP 研究项目的核心目标。报告建议各课程应制定独立的 AI 政策,优先考虑学习目标,并推荐采用口头考试、项目作业等替代方式,以减少 AI 对真实学习成果的干扰。

  7. Towards Data Science48

    如何用 Jev 构建一个廉价而可靠的模型路由系统

    Jev 可以在 70-500 毫秒内完成模型路由决策,成本低至 $0.042 每百万输入 token,且不会因过度智能而产生错误输出。它通过 Choice、noul 和 score 等类型进行决策,用户可定义路由规则并设置最低置信度阈值。Jev 作为专有模型,需通过其 SDK 接入,适合用于将请求路由到 Claude 的 haiku、sonnet 或 opus 等不同模型。

  8. O'Reilly Radar49

    如何构建可靠的生产级 AI 智能体系统

    构建可靠的 AI 智能体系统需将决策分为模型建议、策略服务验证和执行层实施三个独立部分。策略服务可检查请求是否符合用户授权范围,并记录审计信息。智能体上下文应默认视为不可信输入,需追踪来源并验证其有效性,以防止恶意或过时信息影响决策。

  9. cnBeta40

    OpenAI将在ChatGPT生成图片时测试视觉广告 不会影响生成结果

    OpenAI将在ChatGPT中测试视觉广告,用户生成图片时界面可能出现商品灵感或服务体验广告,但广告不会嵌入图像或影响生成结果。测试预计10月下旬在美国启动,初期面向部分广告商,广告展示位置、频率及用户偏好管理尚未详细说明。公司还将扩展广告效果衡量工具及合作伙伴网络,接入转化数据并评估广告展示环境的安全性。

  10. Hacker News · AI37

    研究:发现让 AI 模型标记可疑答案的路径

    UC Riverside 研究团队发现,大语言模型中的不确定性和正确性由不同的内部特征驱动,这挑战了模型自信度与答案准确性相关的假设。通过使用稀疏自编码器工具,他们识别出三类特征,并在不重新训练模型的前提下,通过抑制部分特征使模型准确率提升最高达 1.1%,同时减少不确定性达 75%。研究还表明,这些特征可应用于不同问答基准,为开发者提供了一种提升 AI 可靠性的实用方法。

  11. Hacker News · AI41

    用 AI 在数秒内生成火辣说唱歌曲与节拍

    该 AI 说唱生成工具可在数秒内将文本提示转换为完整说唱歌曲和节拍,支持多种风格如 UK Drill、Trap、Lo-Fi Hip Hop 等,无需登录即可免费试用。生成的音频为免版税使用,可直接下载用于社交媒体、视频或流媒体平台。工具内置自适应节奏引擎和多风格匹配功能,提供接近专业制作的音质。

  12. Hacker News · AI42

    CFO 调查:财务团队每天花费 26% 的时间验证 AI 输出

    财务团队每天花费至少 10% 的时间验证 AI 输出,其中 32% 的团队花费 26–50% 的时间进行此类工作。调查显示,仅 4% 的财务团队拥有统一的数据来源,而 76% 的 CFO 面临高压要求全面实施 AI,但只有 7% 的财务职能已准备好在所有流程中使用 AI。微软 Copilot 是当前 CFO 办公室中最常用的通用 AI 工具,其次是 ChatGPT 和 Claude。

  13. Hacker News · AI47

    AI-Native 公司如何重建管理职能

    AI-Native 公司正在通过引入智能体改变传统管理结构,Block、Lovable 和 Every 等公司已开始实践并取得成效。员工与智能体协作完成原本需要部门完成的工作,岗位界限模糊,所有人可直接访问公司知识库并参与实验决策。P&G 的试验显示,使用 AI 的团队情绪更积极,工作效率和质量提升明显。

  14. Hacker News · AI49

    Union 如何实现主权 AI 的自助服务

    Union.ai 今日推出自助服务功能,用户可通过 AWS Marketplace 注册并直接在自己的云账户中运行生产工作负载,无需安排会议。该功能解决了安装流程复杂、配置分散及支付流程繁琐等问题,支持通过 AWS 账户自动计费并利用现有折扣。用户可运行真实工作流,无需依赖演示环境,并可邀请同域团队成员加入,默认为管理员权限。

  15. Hacker News · AI33

    AI 令牌价格下跌现象引发关注

    AI 令牌价格近期出现下跌趋势,市场对其背后原因展开讨论。当前多个主流模型和平台的令牌价格均出现不同程度的下降,但具体原因尚未明确。部分用户和开发者正在分析是否与模型性能提升、使用成本降低或市场供需变化有关。

  16. Hacker News · AI37

    AI 智能体正在改写计算的经济性

    AI 智能体正在改变计算资源的使用和成本结构。文章指出,智能体通过自主决策和任务分配,显著提升了计算效率并降低了单位任务成本。这一趋势可能影响未来云计算和边缘计算的定价模式及资源分配策略。

  17. Hacker News · AI71

    如何构建AI原生软件工厂:从Uber等公司实践中提炼的六层架构与落地路线

    本文基于Uber、Spotify、Stripe等公司实践,提出构建AI原生软件工厂的六层架构:模型网关、沙箱环境、工具目录、上下文图谱、执行框架和安全门禁。作者强调应优先处理重复性工作,通过测量当前瓶颈(如评审等待时间)选择首个自动化任务,并建议采用‘买工具、建平台’的策略,即购买现成AI代理,自建支持其运行的基础设施。

    推荐理由:原文基于多家公司实践,梳理了AI原生软件工厂的构建路径和关键控制点,读者可据此判断自身团队的落地优先级和风险边界。

  18. Hacker News · AI61

    Hindsight 开源智能体记忆系统发布,支持多 LLM 和 MCP 协议

    Hindsight 是一个开源的智能体记忆系统,旨在让 AI 智能体具备学习能力而非仅记忆对话历史。它通过生物启发式数据结构组织记忆,支持 retain、recall、reflect 三种操作,已在 LongMemEval 基准上取得 SOTA 性能。

    推荐理由:原文提供了部署方式、集成方法和基准测试结果,读者可以据此判断它如何增强现有智能体的记忆能力。

  19. 钛媒体63

    快手发布视频创作Agent likli并官宣Kling 4.0模型

    快手于9月28日同时推出AI创作工具likli内测和新一代视频模型Kling 4.0,前者定位为交付结果的创作Agent,支持从想法到成片的全流程,内置多套Skill,提供macOS与Windows客户端;后者单次生成时长提升至30秒,支持10张关键帧、8000 tokens提示词输入,轻量版已向黑金会员开放体验。

    推荐理由:快手在模型与Agent双线推进,likli工具和Kling 4.0模型共同指向从生成片段到交付成片的完整工作流,读者可借此理解当前AI视频工具的竞争焦点转向。

  20. 钛媒体35

    A股硬科技企业正在排队去港交所募资

    A股硬科技企业大普微计划赴港第二上市募资至少10亿美元,预计2026年底或2027年初挂牌。2026年港股IPO募资榜前三名均为A股硬科技公司,合计募资超1100亿港元,但新股破发率已超过70%。AI算力硬件产业链企业因扩产需求强烈,纷纷转向港股融资,但二级市场承接力不足导致恒生科技指数创一年新低。

  21. 钛媒体50

    这个国庆,第一批机器人员工已经上岗

    人形机器人已在DQ冰淇淋、全家便利店、霸王茶姬等线下门店上岗,执行制作冰淇淋、递送商品等任务,但效率仍不及真人。京东、Figure等公司正在采集真人动作数据用于训练机器人,其中京东计划两年内采集1000万小时数据,Figure的Index项目已获100万注册用户上传1600万段视频。

  22. The Next Web37

    挪威计划暂时禁止在公园、学校和健身房使用AI眼镜

    挪威政府今日宣布计划在特定公共场所临时禁止使用AI眼镜,担忧其可能在未经允许的情况下拍摄或录音。禁令可能涵盖公园、海滩、博物馆、购物中心等人群聚集地,以及学校、健身房等场所。政府表示不会全面禁止,私人使用及不涉及他人未经同意被拍摄的情况仍被允许,并将考虑是否纳入大学和学院。

  23. The Next Web37

    华为与高通签署涵盖5G、AI和网络的专利许可协议

    华为与高通宣布签署多年专利许可协议,涵盖5G、AI、计算和网络领域,这是双方首次涉及5G的许可协议。协议允许双方使用对方相关专利,高通还将收购华为部分美国专利,待监管批准后完成交易。华为预计该协议将使其专利许可总价值超过69亿美元,并称其许可业务自2021年起已实现营收为正。

  24. InfoQ · AI/ML66

    生产级LLM平台工程实践:从幻觉控制到可观测性

    本文系统阐述了构建生产级LLM平台的六大核心工程实践,包括在平台层强制结构化输出、智能重试机制、提示词版本管理、意图验证路由、MCP工具授权及行为可观测性。通过在平台层而非应用层处理幻觉、成本归因和行为漂移,将生产幻觉率从15%降至1.5%。

    推荐理由:原文系统性拆解了生产级LLM平台的六大基础设施设计,读者可据此理解如何避免幻觉、控制成本和实现可观测性。

  25. InfoQ · AI/ML42

    构建可复用的智能体产品评估框架:Elastic 的实践与经验分享

    Elastic 在生产环境中运行 AI 智能体,并介绍了构建可复用评估框架的实践,包括使用追踪技术实现评估自动化。该框架包含多个模块,支持不同场景下的评估需求,如网络安全事件检测和企业级聊天机器人。Elastic 通过与安全专家合作创建数据集,使用精确率、召回率、相似度和事实性等指标确保智能体性能稳定。

  26. OpenAI News24

    OpenAI 在 ChatGPT 中推出新的视觉广告格式并扩展广告测量工具

    OpenAI 在 ChatGPT 中引入新的视觉广告格式,并扩展了广告测量工具、归因合作伙伴和品牌适配功能。该广告格式支持更丰富的视觉内容展示,归因合作伙伴包括多家主流数据分析平台,品牌适配功能可过滤不适宜内容。这些更新旨在提升广告主在 AI 使用场景下的投放效果与用户体验。

  27. Tom's Hardware28

    俄罗斯 Shturm 无人坦克在 Putin 面前首秀时因控制失联陷入泥潭

    俄罗斯 Shturm 无人坦克在 Tsentr-2026 军事演习中首秀失败,失去遥控指挥链接后陷入泥地。该坦克基于苏联 T-72 和 T-90 车体设计,配备 125mm 火炮或双 30mm 自动炮等配置,其控制依赖 3 公里内的遥控车,缺乏可靠通信保障。俄装甲专家指出其发动机舱和炮塔顶部几乎无防护,且依赖视线内的指挥所,难以在实战中发挥作用。

  28. Tom's Hardware46

    佛罗里达女子因 Claude AI 聊天记录威胁射杀警长办公室被起诉

    一名佛罗里达州女子因在 Anthropic 的 Claude AI 聊天记录中威胁射杀 Lee County 警长办公室而被起诉,相关对话被 Anthropic 人工审核团队上报警方。该聊天记录包含至少三条威胁性内容,其中一条提及次日将获得新枪,警方据此对其提出重罪指控。此案是近期多家 AI 公司因用户在聊天机器人中发布威胁信息而被卷入法律纠纷的又一例。

  29. Tom's Hardware27

    NorthWestRepair 修复价值 $16,000 的 DDR5 内存模块

    NorthWestRepair 修复了一对价值 $16,000 的 DDR5 内存条,其中一块为 128GB、另一块为 256GB 的 ECC 服务器内存。修复过程中,他通过重新焊接和更换 PMIC 芯片等操作使内存模块恢复运行,避免了电子垃圾的产生。随着 AI-pocalypse 的影响,修复高价值内存的成本已远低于更换新模块,使得内存维修成为一项可行的商业活动。