TurboMail.ai 发布本地优先的 AI 邮件客户端
TurboMail.ai 发布了一款在设备本地运行的 AI 邮件客户端,默认使用内置的 1GB 本地模型处理搜索、摘要和草稿,邮件内容不会离开用户设备。用户可选择接入自己的 OpenAI、Anthropic 或 Google API 密钥以使用更强大的云模型,所有请求直接发送至对应提供商。
TurboMail.ai 发布了一款在设备本地运行的 AI 邮件客户端,默认使用内置的 1GB 本地模型处理搜索、摘要和草稿,邮件内容不会离开用户设备。用户可选择接入自己的 OpenAI、Anthropic 或 Google API 密钥以使用更强大的云模型,所有请求直接发送至对应提供商。
瓦尔基里公布了 VK 99 V2 系列三模机械键盘的完整参数。该键盘支持 AI 创想灯效和音乐律动,MAX 版集成 1.47 英寸竖向 IPS 智慧屏,在蓝牙静核模式下续航可达 12000 小时。
技嘉推出 AI TOP 100 B850 桌面 AI 工作站,其双 AMD Radeon AI PRO R9700 显卡方案提供总计 64GB 显存,可支持高达 2350 亿参数模型的本地推理。
开发者通过定制软件将 iPhone 17 Pro Max 与 M4 Pro MacBook Pro 连接,作为额外计算节点协同运行 Qwen3.8-27B 模型,显著提升了预填充性能。在 16K 上下文窗口下,处理速度从每秒 109 个 Token 提升至 157 个 Token,增幅达 44%。该方案通过 USB-C 接口实现流水线计算,但目前需要专门软件支持,尚不适用于普通用户直接部署。
半导体分析机构 Kurnal Insights 发布了华为麒麟 9050 Pro 芯片的裸片显微照,首次展示其内部结构。该芯片由两颗尺寸相同的裸片垂直堆叠而成,总面积小于前代,晶体管密度提升约 55%,并在性能对齐条件下实现了 NPU、GPU 和 CPU 性能核的功耗显著降低。
推荐理由:原文提供了芯片结构、密度提升和功耗降低的具体数据,读者可以据此评估其技术突破点和实际应用潜力。
微软将降低 Windows 11 内存占用列为 2026 年剩余时间的重要工作,以应对内存成本上涨。团队正从内存管理器、压缩机制及 WinUI 3、Chromium 等应用框架层面进行优化,旨在减少不必要的常驻资源消耗。部分 Windows Insider 版本已实现内存占用减少约 1.5GB~2GB,相关优化将在后续更新中继续推进。
作者成功将 Muse Gadget SDK 移植到仅有 321 KB RAM 的 Xteink X3 电子阅读器上,实现了通过 Wi-Fi 连接 Muse AI 并显示待办事项、笔记等内容。
推荐理由:作者分享了在内存极有限的 ESP32-C3 设备上适配 Muse SDK 的具体步骤和内存优化技巧,为其他端侧 AI 项目提供了可参考的工程经验。
Recly 是一款免费开源应用,可将 Galaxy Watch 或 Apple Watch 变为 AI 录音笔,支持本地免费转录,并将笔记任务交给用户已有的 AI 智能体。
推荐理由:作者开源了将智能手表变为录音笔的方案,并详细说明了本地转录和与现有AI集成的技术路径。
华为推出睿影 Z10 模块相机,通过 HyperClick 超级卡口外挂于 Mate 90 Pro Max 典藏版及非凡大师机型。该模块配备 1 英寸 5000 万像素 RYYB 传感器和 24-240mm 10 倍连续光学变焦镜头,将光学与感光部分独立于手机外,并利用手机算力进行深度计算摄影处理。其专利显示图像数据传输速率可达或超过 10.7Gbps,售价接近 6000 元,定位为高端小众配件。
SCM 是一个 macOS 本地优先的 AI 媒体搜索工具,可对照片和视频的每一帧进行语义搜索。它使用本地视觉模型(如 CLIP、SigLIP)和 Whisper 进行推理,支持基于含义、场景、OCR 文本和对话的搜索,所有数据均不离开设备。项目通过 Homebrew 安装,使用 Electron、Bun、ONNX Runtime 等技术栈构建。
推荐理由:原文详细说明了本地化多模态搜索的实现路径和隐私设计,为有类似需求的开发者提供了可参考的技术栈和架构思路。
WhatsApp 正在向部分 Android 和 iOS 测试版用户推出“受限聊天”功能,为特定对话增加额外限制。启用后,对话中的媒体不会自动保存、聊天记录无法导出、不能使用 Meta AI 功能,且对话不会同步到关联设备,只能通过主手机进行。该功能目前仅适用于一对一对话,仍处于测试阶段。
Meta 宣布开源 Muse Gadgets 项目,允许爱好者自行构建 AI 硬件,包含 ESP32 板固件和连接自制设备至其 AI 智能体 Muse 的 Linux SDK。Meta 还制造了自有设备 Muse Home Link,这款 USB-C 小工具可将 Muse 连接至家庭网络以控制智能设备,并将向 Muse 订阅者免费发放 5000 台。
NVIDIA 发布 DGX Spark 64GB 内存配置,为开发者提供更低成本的本地 AI 开发与部署平台。该配置支持高达 1000 亿参数的模型完全在设备上运行,并可通过 NVIDIA Sync Cluster Assistant 将两台设备集群,将内存扩展至 128GB,在 Qwen 3.8 27B 测试中实现最高 1.7 倍的性能提升。
推荐理由:NVIDIA 为 DGX Spark 推出更低内存配置,降低了本地 AI 开发的门槛,并展示了通过集群扩展性能的具体方法。
卫星 AI 软件提供商 Satlyt 完成了 800 万美元的种子轮融资。其平台使配备 GPU 的卫星能在轨处理数据,在测试中将需下传分析的遥测数据量减少了 64% 以上。公司正将其软件栈升级至性能更强的 Gemma 4 E2B 模型,并计划进一步降低模型的内存占用。
Apple 已发布 watchOS 27.0.1 更新,以修复 Apple Watch Series 12 和 Ultra 4 设备上出现的随机重启问题。该问题可能与 Neural Engine 超时有关,用户可通过 iPhone 或手表本身的设置菜单下载并安装此更新。
NVIDIA TensorRT Edge-LLM 在 Jetson AGX Thor 平台上运行 MLPerf Edge Agentic Benchmark,推理速度比基准快 6.4 倍。该基准测试模拟了 AI 智能体在边缘设备(如车辆、机器人)上执行多步骤任务的工作流。
NVIDIA 介绍了在 Jetson 边缘计算平台上部署和优化前沿推理模型的方法。此举旨在解决多步推理模型因体积过大而难以在边缘硬件本地运行的问题,使开发者能够构建不依赖数据中心、降低成本和保护本地数据的智能体。
NVIDIA Nemotron 3.5 Lightning 模型已在 Ollama 上提供,这是一个专为长期运行的智能体设计的 300 亿参数开源模型。它采用混合专家架构,每 token 仅激活 30 亿参数,支持高达 100 万 token 的上下文,并针对本地 NVIDIA RTX 设备进行了优化,可实现比同类开源模型高 4 倍的吞吐量。
推荐理由:原文提供了模型的核心架构、性能基准和本地部署优势,读者可以据此评估它是否适合作为长期运行的智能体基座。
作者在 iOS 和 macOS 27 开发者测试版中实测新版 Siri,发现其将 Spotlight 搜索变成了一个以 Siri 为先的界面,导致进行网页搜索需要多次点击。作者认为这类似于 Google 的 AI Overviews,并指出苹果 AI 负责人来自 Google 的背景可能与此有关。作为替代方案,作者通过 Siri 创建了一个可放置在主屏幕的快捷指令来直接进行 Google 搜索。