Ollama 新增图像生成功能(实验性)
Ollama 在 macOS 平台新增实验性图像生成功能,支持运行 x/z-image-turbo 和 x/flux2-klein 等模型。
Ollama 在 macOS 平台新增实验性图像生成功能,支持运行 x/z-image-turbo 和 x/flux2-klein 等模型。
Ollama v0.14.0 及更高版本现已兼容 Anthropic Messages API,使得 Claude Code 等工具能够使用开源模型。用户可以在本地机器上运行 Claude Code 并连接本地模型,或通过 ollama.com 连接云端模型。官方提供了环境变量配置、安装命令和代码示例,并推荐了适用于编码场景的本地和云端模型。
推荐理由:Ollama 通过兼容 Anthropic API 将 Claude Code 的智能体能力扩展到开源模型,为本地和云端开发提供了新的工具调用选项。
Fly.io 推出名为 Sprites 的新型 Linux 虚拟机,其创建仅需一两秒,并自带 100GB 持久根文件系统。Sprites 在闲置时会自动休眠以降低成本,其设计放弃了用户容器镜像,并采用 S3 兼容对象存储作为存储根。
Fly.io 发布名为 Sprites 的新产品,这是一种可快速创建(1-2秒)、持久化、支持即时快照与恢复的云计算机,旨在替代传统的只读沙箱。作者认为,像 Claude 这样的 AI 智能体需要的是完整的计算机环境,而非每次任务后销毁的沙箱,以便保留状态、避免重复构建环境,并支持更长的交互周期。
推荐理由:作者从自家产品出发,提出了AI智能体开发需要持久化、可快速恢复的完整计算机环境,而非传统只读沙箱的观点。
OpenAI 推出 Circuit-Sparsity 模型的 HuggingFace 实现,用于演示 Gao 等人 2025 年论文中的定性结果(如括号计数和变量绑定)。该模型包含加载本地转换后的 HF 模型和 tokenizer 的代码,并支持运行小型生成任务。项目采用 Apache License 2.0 开源授权。
Litestream VFS 允许 SQLite 通过 VFS 插件接口直接从 S3 等对象存储 URL 读取数据,无需下载整个数据库。它利用 LTX 文件格式的压缩特性,支持通过 `PRAGMA litestream_time` 指令进行任意时间点的即时恢复查询。该插件与现有 SQLite 库兼容,保持了 Litestream 无需修改应用即可使用的特点。
Ollama 宣布与 OpenAI 及非营利组织 ROOST 合作,将开源安全推理模型 gpt-oss-safeguard 提供给用户,用于安全分类任务。该模型提供 20B 和 120B 两个版本,采用 Apache 2.0 许可,核心功能包括根据用户书面策略进行推理、提供完整的推理过程以及可配置的推理强度。
MiniMax M2 模型已在 Ollama 云平台上线,该模型专为编码和智能体工作流设计。根据 Artificial Analysis 的基准测试,其综合得分在全球开源模型中排名第一,在数学、科学、指令遵循、编码和智能体工具使用方面表现出高度竞争力。
Ollama 云服务上线了 GLM-4.6 和 Qwen3-Coder-480B 两款编码模型,并更新了 Qwen3-Coder-30B 以提供更快的工具调用。这些模型可通过 VS Code、Zed 和 Droid 等常用工具集成使用,拥有 16384 token 的上下文长度,并支持通过 Ollama 云 API 直接访问。
Qwen3-VL 现已在 Ollama 云端可用,本地版本即将推出。该模型具备视觉智能体、长上下文视频理解、高级空间感知、增强的多模态推理与视觉识别等能力。用户可通过 Ollama 的 CLI、API 及 JavaScript/Python 库免费使用云端模型,并支持 OpenAI 兼容的 API 端点。
推荐理由:Ollama 官方博客列出了 Qwen3-VL 在视觉智能体、长上下文、空间感知等方面的具体能力,并提供了详细的接入方式。
NVIDIA DGX Spark 与 Ollama 合作,确保大语言模型能在该硬件上开箱即用地高效运行。