Replit 发布 Agent 4,支持并行任务、协作可见性与即时分支
Replit 发布 Agent 4,新增并行任务系统可自动解决 90% 的合并冲突,通过微虚拟机实现即时分支,引入 Infinite Canvas 实现设计与工程同环境协作,并提供实时协作可见性,支持团队成员查看彼此任务进度。CEO Amjad Masad 表示 Agent 4 实现从想法到产品的一站式开发,FireCrown Media 使用该工具年节省超 100 万美元。
Replit 发布 Agent 4,新增并行任务系统可自动解决 90% 的合并冲突,通过微虚拟机实现即时分支,引入 Infinite Canvas 实现设计与工程同环境协作,并提供实时协作可见性,支持团队成员查看彼此任务进度。CEO Amjad Masad 表示 Agent 4 实现从想法到产品的一站式开发,FireCrown Media 使用该工具年节省超 100 万美元。
Replit 团队通过直播展示了 Agent 4 的开发过程和实际应用,包括 Manny Bernabe 演示的 Taste 应用和 Raymmar Tirado 展示的 Replitopolis 3D 城市项目。
fal 推出 MCP Server,让 Claude、Cursor 等 AI 助手能直接搜索、运行和串联 fal 平台上的 1000 多个生成模型。该服务器提供 9 个工具,涵盖模型发现、执行和文件上传,用户只需配置 API 密钥即可在对话中完成图像生成、视频制作、语音合成等复杂工作流。服务本身免费,按标准 fal 定价支付模型调用费用。
推荐理由:通过 MCP 协议将上千个生成模型直接接入 Claude、Cursor 等 AI 助手,简化了多模态创作的工作流。
Replit Agent 4 对设计、协作、构建和规划四大核心模块进行升级,推出无限设计画布支持所有 artifact 类型,改用共享项目协作模式并由 Agent 协助合并,实现规划与构建并行。旧项目仍可使用,新功能如多应用构建和并行任务执行在新项目中可用。
推荐理由:原文详细对比了 Agent 3 与 Agent 4 的核心功能变化,包括设计画布、协作模式和构建流程,读者可据此判断新版本对开发效率的实际提升。
Together AI 扩展其微调服务,新增了对工具调用、推理和视觉语言模型的原生支持。服务升级了训练栈,可更高效地处理 100B+ 参数模型,吞吐量提升最高达 6 倍,并支持最大 100GB 的数据集。
推荐理由:Together AI 的微调服务新增了对工具调用、推理和视觉模型的支持,并提升了大规模模型训练的效率。
Together AI 在 NVIDIA GTC 2026 上宣布多项合作与产品更新,旨在支持更开放、智能体化和生产就绪的 AI 系统。其模型库现已集成 NVIDIA Nemotron 3 Super 和 NVIDIA Parakeet TDT 0.6B V3 等模型,并通过 NVIDIA Dynamo 1.0 和 NemoClaw 优化推理性能。
Replit 推出与 Databricks 的新连接器,允许用户在 Replit 中直接访问 Databricks 的治理数据、模型和仓库,无需复制敏感数据。通过 Replit Agent,用户可快速构建如3D天气地球仪等数据应用,Databricks Genie 提供自然语言问答与数据溯源能力。该集成使产品经理、分析师等非工程角色能直接构建受控的企业级数据应用,缩短开发周期。
推荐理由:原文展示了Replit与Databricks的集成方式和实际应用案例,读者可以据此判断该连接器如何支持企业级数据应用的快速构建。
Together AI 推出了一个统一的解决方案,用于在共置的 STT、LLM 和 TTS 基础设施上构建实时语音智能体。该架构将整个语音技术栈保留在同一云上,旨在将端到端延迟降至 500 毫秒以下,并简化部署。平台原生集成了 Cartesia 和 Deepgram 的领先语音模型,为开发者提供了模型选择和配置的灵活性。
推荐理由:Together AI 将语音识别、大模型和语音合成整合在同一集群,为构建实时语音智能体提供了一个低延迟、可灵活选模的解决方案。
Replit 推出 Agent 4,速度比 Agent 3 快 10 倍,旨在将人类创造力置于开发流程的核心。Agent 4 支持实时设计、统一项目输出、团队协作任务管理和多 Agent 并行操作,适用于教育、企业及个人创作场景。Replit 近期获得多轮融资,计划加速全球扩张并深化与 Google、Microsoft 等企业的合作。
Replit 推出 Agent 4,强调在单一环境中实现设计、开发与协作的无缝整合。其四大支柱包括:自由设计(无限画布与UI变体)、快速推进(并行任务与自动拆分)、协同构建(任务流与智能排序)和统一交付(支持Web、移动、幻灯片、动画等多类型产出)。
推荐理由:原文详细说明了 Agent 4 的四大核心能力与协作模式,读者可据此判断其对开发流程的重构潜力。
Replit 推出 Vibe Code 功能,允许用户在代码环境中直接生成动态风格视频,无需依赖外部动画工作室。该功能基于 Gemini 模型构建,支持通过自然语言描述视频内容,生成类似专业工作室制作的动画片段。用户可快速生成初稿并在 Replit 内进行迭代,社区已有超过 1,800 名开发者参与相关项目。
HeyGen 的模型已登陆 fal 平台,提供视频智能体 API、Avatar IV API、视频翻译和 Avatar Video 等核心功能。用户可通过 Video Agent API 输入提示词或 URL,一键生成包含脚本、素材和剪辑的完整视频。Avatar IV API 能将单张照片转换为具备自然表情和手势的说话头像,无需专业工作室。
Replit 推出 Pro 计划($100/月),支持最多 15 个开发者、Turbo 模式(速度提升 2 倍)和优先支持。Core 计划价格降至 $20/月(原 $25/月),支持最多 5 人协作,且无需额外订阅。Teams 计划将于 2026 年 3 月 3 日起逐步停用,用户将自动升级至 Pro 且无需额外付费。
Replit 与 Databricks 推出集成方案,使企业用户能在 Replit 中编写数据应用代码并直接部署至 Databricks Apps,实现与治理数据的实时连接。
Ollama 宣布为 Claude Code 新增子智能体和联网搜索功能,无需 MCP 服务器或 API 密钥即可使用。子智能体可并行执行文件搜索、代码探索和研究等任务,部分模型(如 minimax-m2.5、glm-5、kimi-k2.5)会自动触发,也可通过指令强制创建。联网搜索功能已集成至 Anthropic 兼容层,模型需要最新信息时会自动处理搜索并返回结果。
推荐理由:Ollama 为 Claude Code 增加了子智能体和联网搜索功能,无需额外配置,这直接提升了复杂任务的并行处理能力。
Ollama 发布个人 AI 助手 OpenClaw,它作为中央网关,将 WhatsApp、Telegram、Slack 等消息平台与 AI 编程智能体连接起来,并在本地设备上运行以保护隐私。用户可通过 Ollama 启动 OpenClaw 来连接本地或云端模型,建议使用至少 64k token 上下文长度的模型,如 qwen3-coder 或 glm-4.7。
Replit 推出与 Snowflake 的连接器,允许用户通过自然语言提示构建数据应用,无需手动编写代码。连接器提供安全的只读访问,简化了认证和配置流程,支持实时数据更新和 SQL 查询验证。该功能通过两种模式(Build 和 Plan)提升开发效率,用户可一键部署应用并选择私有、密码保护或公开发布。
Ollama 发布新命令 `ollama launch`,可一键设置并运行 Claude Code、OpenCode 和 Codex 等编码工具,支持本地或云端模型,无需配置环境变量或文件。
推荐理由:Ollama 通过新命令简化了本地或云端模型与主流编码工具的集成流程,无需手动配置环境变量或文件。
Ollama 在 macOS 平台新增实验性图像生成功能,支持运行 x/z-image-turbo 和 x/flux2-klein 等模型。
Ollama v0.14.0 及更高版本现已兼容 Anthropic Messages API,使得 Claude Code 等工具能够使用开源模型。用户可以在本地机器上运行 Claude Code 并连接本地模型,或通过 ollama.com 连接云端模型。官方提供了环境变量配置、安装命令和代码示例,并推荐了适用于编码场景的本地和云端模型。
推荐理由:Ollama 通过兼容 Anthropic API 将 Claude Code 的智能体能力扩展到开源模型,为本地和云端开发提供了新的工具调用选项。
Fly.io 推出名为 Sprites 的新型 Linux 虚拟机,其创建仅需一两秒,并自带 100GB 持久根文件系统。Sprites 在闲置时会自动休眠以降低成本,其设计放弃了用户容器镜像,并采用 S3 兼容对象存储作为存储根。
Fly.io 发布名为 Sprites 的新产品,这是一种可快速创建(1-2秒)、持久化、支持即时快照与恢复的云计算机,旨在替代传统的只读沙箱。作者认为,像 Claude 这样的 AI 智能体需要的是完整的计算机环境,而非每次任务后销毁的沙箱,以便保留状态、避免重复构建环境,并支持更长的交互周期。
推荐理由:作者从自家产品出发,提出了AI智能体开发需要持久化、可快速恢复的完整计算机环境,而非传统只读沙箱的观点。
Litestream VFS 允许 SQLite 通过 VFS 插件接口直接从 S3 等对象存储 URL 读取数据,无需下载整个数据库。它利用 LTX 文件格式的压缩特性,支持通过 `PRAGMA litestream_time` 指令进行任意时间点的即时恢复查询。该插件与现有 SQLite 库兼容,保持了 Litestream 无需修改应用即可使用的特点。
Ollama 宣布与 OpenAI 及非营利组织 ROOST 合作,将开源安全推理模型 gpt-oss-safeguard 提供给用户,用于安全分类任务。该模型提供 20B 和 120B 两个版本,采用 Apache 2.0 许可,核心功能包括根据用户书面策略进行推理、提供完整的推理过程以及可配置的推理强度。
MiniMax M2 模型已在 Ollama 云平台上线,该模型专为编码和智能体工作流设计。根据 Artificial Analysis 的基准测试,其综合得分在全球开源模型中排名第一,在数学、科学、指令遵循、编码和智能体工具使用方面表现出高度竞争力。
Ollama 云服务上线了 GLM-4.6 和 Qwen3-Coder-480B 两款编码模型,并更新了 Qwen3-Coder-30B 以提供更快的工具调用。这些模型可通过 VS Code、Zed 和 Droid 等常用工具集成使用,拥有 16384 token 的上下文长度,并支持通过 Ollama 云 API 直接访问。
Qwen3-VL 现已在 Ollama 云端可用,本地版本即将推出。该模型具备视觉智能体、长上下文视频理解、高级空间感知、增强的多模态推理与视觉识别等能力。用户可通过 Ollama 的 CLI、API 及 JavaScript/Python 库免费使用云端模型,并支持 OpenAI 兼容的 API 端点。
推荐理由:Ollama 官方博客列出了 Qwen3-VL 在视觉智能体、长上下文、空间感知等方面的具体能力,并提供了详细的接入方式。
NVIDIA DGX Spark 与 Ollama 合作,确保大语言模型能在该硬件上开箱即用地高效运行。