跳到正文
2月25日周三
2月24日周二
  1. fal 博客31

    Ulysses 上下文并行:通信与计算重叠的实验

    针对视频扩散模型长序列处理的 Ulysses 上下文并行方法,通过异步执行和融合投影优化了通信与计算的重叠。在 8 块 B200 GPU 的基准测试中,异步 Ulysses 使预注意力块延迟降低约 23–25%,端到端性能提升约 3%;融合 QKV 投影在 2-4 GPU 配置下将块延迟进一步降低 33-37%。实验表明,重叠是稳健的高规模默认方案,而融合在中低规模下效果最强。

2月23日周一
  1. Ollama 博客51

    Ollama 博客:使用 Ollama 0.17 一键部署 OpenClaw 智能体助手

    Ollama 0.17 版本支持通过单条命令 `ollama launch openclaw` 快速部署个人 AI 助手 OpenClaw,它能在本地硬件上运行,帮你处理邮件、日历并通过 WhatsApp 等聊天应用执行任务。部署后,用户可以在终端直接与助手对话,并可选择连接 Ollama 云模型以获得完整上下文长度和网络搜索功能,或使用本地模型。

2月21日周六
2月18日周三
2月14日周六
2月1日周日
  1. Ollama 博客51

    Ollama 发布个人 AI 助手 OpenClaw

    Ollama 发布个人 AI 助手 OpenClaw,它作为中央网关,将 WhatsApp、Telegram、Slack 等消息平台与 AI 编程智能体连接起来,并在本地设备上运行以保护隐私。用户可通过 Ollama 启动 OpenClaw 来连接本地或云端模型,建议使用至少 64k token 上下文长度的模型,如 qwen3-coder 或 glm-4.7。

1月31日周六
  1. Replit 博客40

    Replit 与 Snowflake 推出数据应用实时连接功能 [webinar]

    Replit 推出与 Snowflake 的连接器,允许用户通过自然语言提示构建数据应用,无需手动编写代码。连接器提供安全的只读访问,简化了认证和配置流程,支持实时数据更新和 SQL 查询验证。该功能通过两种模式(Build 和 Plan)提升开发效率,用户可一键部署应用并选择私有、密码保护或公开发布。

1月24日周六
  1. Replit 博客38

    Replit Agent 如何构建私人书签管理器和浏览器扩展 [webinar]

    Replit Agent 在直播中演示了如何用不到两小时从零构建一个私人书签管理器及 Chrome 浏览器扩展,初始构建成本约 5 美元。直播展示了实际调试过程,包括处理认证问题、数据库迁移和性能优化,并通过一次提示词实现了 OpenAI 集成的 AI 内容摘要功能。Replit 团队强调了提示词设计的重要性,并提供了控制开发成本的策略,如使用免费计划、Fast Mode 和 Plan Mode。

1月23日周五
1月21日周三
  1. Replit 博客54

    Replit Agent 推出决策时引导机制

    Replit Agent 推出决策时引导机制,通过轻量级分类器动态注入短小、情境化的指导指令,仅在必要时干预,提升长轨迹任务的可靠性与代码质量,同时降低上下文负担和成本。该机制避免了静态提示的局限,支持数百种可复用微指令,通过诊断信号和外部咨询两种模式有效应对错误循环和高风险操作。

    推荐理由:原文给出了决策时引导机制的设计原理和实际效果,读者可以据此理解它如何提升长轨迹任务的可靠性与成本效率。

1月15日周四
  1. Ollama 博客32

    OpenAI Codex 可通过 Ollama 使用开源模型

    OpenAI 的 Codex CLI 现可通过 Ollama 使用开源模型,如 gpt-oss:20b 或 gpt-oss:120b,来读取、修改和执行工作目录中的代码。用户需安装 Codex CLI 并使用 `--oss` 标志启动,默认调用本地 gpt-oss:20b 模型。该集成要求至少 32K token 的上下文窗口,并支持切换至 Ollama Cloud 上的模型。

1月14日周三
1月9日周五
  1. Fly.io 博客61

    Fly.io 发布持久化云计算机 Sprites,并论证 AI 智能体需要完整计算机而非沙箱

    Fly.io 发布名为 Sprites 的新产品,这是一种可快速创建(1-2秒)、持久化、支持即时快照与恢复的云计算机,旨在替代传统的只读沙箱。作者认为,像 Claude 这样的 AI 智能体需要的是完整的计算机环境,而非每次任务后销毁的沙箱,以便保留状态、避免重复构建环境,并支持更长的交互周期。

    推荐理由:作者从自家产品出发,提出了AI智能体开发需要持久化、可快速恢复的完整计算机环境,而非传统只读沙箱的观点。

12月11日周四
  1. Fly.io 博客47

    Litestream VFS:从对象存储直接查询 SQLite 数据库

    Litestream VFS 允许 SQLite 通过 VFS 插件接口直接从 S3 等对象存储 URL 读取数据,无需下载整个数据库。它利用 LTX 文件格式的压缩特性,支持通过 `PRAGMA litestream_time` 指令进行任意时间点的即时恢复查询。该插件与现有 SQLite 库兼容,保持了 Litestream 无需修改应用即可使用的特点。

12月3日周三
  1. Vector Institute13

    Vector 研究人员在 NeurIPS 2025 发表 80 篇论文,推动 AI 前沿发展

    Vector 研究人员在 NeurIPS 2025 会议上提交了 80 篇论文,涵盖下一代基础模型、扩散生成系统、强化学习突破和隐私保护联邦方法等多个领域。其中提出 ActiveVOI 框架,用于开放世界智能体的主动知识获取,显著优于现有基于大语言模型和视觉语言模型的规划方法。另一项研究引入连续时间流图蒸馏方法,通过自引导和对抗微调提升性能,适用于不同步数的生成任务。

11月6日周四
  1. Fly.io 博客58

    Fly.io 博客:为什么你应该亲手写一个 AI 智能体

    作者认为理解 AI 智能体的最佳方式是亲手构建一个,并展示了使用 OpenAI Responses API 从零开始实现一个具备工具调用能力的智能体的核心代码。文章指出智能体的核心是管理上下文数组和工具调用循环,其设计自由度很高,实现子智能体、上下文工程等复杂功能在代码层面可能非常简单。作者鼓励开发者通过实践来形成自己对这项技术的判断。

    推荐理由:作者通过亲手构建一个简单智能体的代码示例,展示了其核心机制和设计自由度,为读者提供了可复现的实践起点。

10月23日周四
10月13日周一