📦 开源

83 条新闻

🟢 📦 开源 2026年7月10日 · 1 分钟阅读

PyTorch: 「免费归一化」将Layer Norm融合进GEMM和attention核——Meta瞄准降低大型模型训练成本

创意插图:两个GPU核融合成无中间步骤的单一流程

来自Meta的PyTorch团队发布了将归一化操作直接融合进GEMM和attention核的技术,旨在消除其计算开销——「免费归一化」。代码已通过核函数库在GitHub上开放,直接效果是加快频繁使用Layer Norm和RMS Norm操作的模型的训练和推理速度。

🟡 📦 开源 2026年7月9日 · 1 分钟阅读

Ollama: 获得 8800 万美元融资用于本地 AI——890 万开发者,Docker 创始人参与投资

编辑插图:由处理器芯片构成的羊驼剪影,周围环绕着本地电脑

Ollama 是本地运行开放 AI 模型的平台,宣布获得 8800 万美元融资,投资方包括 Benchmark、Theory Ventures 和 Docker 创始人 Solomon Hykes。该平台服务 890 万开发者和 85% 的财富 500 强企业,云服务每月处理 token 量翻倍。

🔴 📦 开源 2026年7月8日 · 3 分钟阅读

PyTorch 2.13:LLM训练GPU显存最高降低4倍,FlexAttention提速12.3倍

编辑配图:PyTorch 2.13新版本,AI训练与推理的关键改进

PyTorch 2.13发布,包含来自526位贡献者的3328个提交。核心亮点:nn.LinearCrossEntropyLoss将LLM训练峰值GPU显存最高降低4倍,Apple Silicon上FlexAttention最高提速12.3倍,新torchcomms后端现代化分布式训练。

🟡 📦 开源 2026年7月8日 · 3 分钟阅读

CNCF白皮书:数据存储仍是云原生AI大规模落地的主要瓶颈

编辑配图:CNCF云原生AI数据存储白皮书及Kubernetes基础设施

CNCF TAG Infrastructure发布白皮书,梳理云原生AI环境中的数据存储瓶颈,区分训练、推理和智能体AI各阶段的需求差异,并为Kubernetes AI/ML工作负载提供架构指南。

🟢 📦 开源 2026年7月8日 · 2 分钟阅读

IBM与Red Hat扩展Lightwell——6500+修复开源依赖项及金融行业信息交换中心

编辑配图:IBM与Red Hat Lightwell AI系统,用于开源代码中的漏洞修复

IBM与Red Hat将Lightwell Network正式发布,提供超过6500个经数字签名的Java和Python修复依赖项,并推出面向金融服务的Lightwell Clearinghouse Premier,支持补丁封禁协调,背后是50亿美元的开源安全投入承诺。

🟡 📦 开源 2026年7月6日 · 3 分钟阅读

vLLM与腾讯混元联合上游两个HPC后端,支持NVIDIA Hopper GPU

编辑插图:用于大型语言模型高性能推理的vLLM FP8和MoE GPU内核

腾讯混元AI Infra团队与vLLM团队联合将HPC_ATTN注意力后端和hpc MoE后端上游至主线vLLM项目,在8× NVIDIA H20配置上将TTFT降低24%、TPOT降低17%,无需fork vLLM代码。

🟡 📦 开源 2026年7月1日 · 2 分钟阅读

Kimi K2.7 Code 作为首款开放权重模型进入 GitHub Copilot

编辑插图:Moonshot AI 的 Kimi K2.7 开放模型集成进 GitHub Copilot

Moonshot AI 开发的 Kimi K2.7 Code 已作为 GitHub Copilot 模型选择器中首款开放权重模型上线,托管在 Microsoft Azure 上。目前可在 Pro、Pro+ 和 Max 套餐中按用量计费使用,计划扩展至 Business 和 Enterprise 套餐。

🟢 📦 开源 2026年7月1日 · 2 分钟阅读

LangChain 发布 OpenWiki:自动为 AI 智能体生成和维护代码库文档的开源工具

编辑插图:LangSmith 引擎驱动 OpenWiki 开源代码库文档智能体

LangChain 发布了 OpenWiki——一款自动生成和更新代码库文档 wiki 的开源 CLI 工具。其目标是为代码智能体提供关于代码库的结构化上下文,而无需膨胀 AGENTS.md 或 CLAUDE.md 等指令文件。该工具基于 DeepAgents 框架构建,支持多种 LLM 提供商。

🟡 📦 开源 2026年6月30日 · 3 分钟阅读

Miles:面向前沿规模大语言模型的 PyTorch 原生开源强化学习后训练框架

编辑配图:PyTorch 原生 Miles 堆栈用于带内核融合的强化学习后训练

RadixArk 发布 Miles,这是一个将 SGLang、Megatron-LM、Ray 和 PyTorch 整合为统一生产级堆栈的开源强化学习框架,专为在 Hopper 和 Blackwell GPU 上对大型语言模型进行后训练而设计。

🟢 📦 开源 2026年6月30日 · 3 分钟阅读

CNCF Kepler 重构:无需内核权限即可精确测量 Kubernetes Pod 的能耗

编辑配图:CNCF Kepler 重构以精确测量 Kubernetes 基础设施的能耗

CNCF 沙箱项目 Kepler 完全重写:新架构以读取标准 /proc 和 /sys 路径替代 eBPF 方法,消除了千瓦级测量跳变,并将进程功率归因误差降至毫瓦级。

🟢 📦 开源 2026年6月30日 · 3 分钟阅读

ONNX v1.22.0 带来面向大语言模型的原生注意力算子和 WebAssembly 支持

编辑配图:ONNX 1.22 版本带来新的注意力算子和 WebAssembly 互操作性

LF AI & Data Foundation 发布 ONNX v1.22.0,带来面向 Transformer 架构和大语言模型的原生注意力算子、通过 Pyodide 在浏览器中预览模型的 WebAssembly 支持,以及 SLSA Level 2 加密证明。27 位贡献者参与其中,其中 16 位系首次贡献。

🟡 📦 开源 2026年6月29日 · 2 分钟阅读

NVIDIA:Palantir与NVIDIA Nemotron为气隙隔离系统中的美国政府机构带来主权AI

编辑插图:Palantir与NVIDIA Nemotron为气隙隔离系统中的美国政府机构带来主权AI,无文字无人脸

Palantir将NVIDIA Nemotron开源模型集成到其面向美国政府机构和关键基础设施的主权AI操作系统中。该系统在气隙隔离环境(完全物理隔离、无互联网连接的网络)中运行,覆盖国防、能源、医疗、教育和交通等领域。

🟡 📦 开源 2026年6月27日 · 1 分钟阅读

GitHub:Desktop 3.6引入Git工作树和AI合并冲突解决

编辑插图:深色背景下笔记本电脑屏幕显示多并行工作流通道的分支git树图

GitHub Desktop 3.6已在macOS和Windows上发布,带来了对Git工作树的支持——一种无需暂存即可并行处理多个分支的机制——以及更深度的Copilot集成,用于提交信息和合并冲突解决。

🔴 📦 开源 2026年6月26日 · 2 分钟阅读

PyTorch:TokenSpeed-Kernel——适用于多硅LLM推理的可移植高性能内核

编辑插图:蓝色背景上带有抽象GPU硅层和推理加速图表的PyTorch标志

TokenSpeed-Kernel是一个开源三层内核子系统,无需重写代码即可将NVIDIA和AMD GPU上的LLM推理加速高达3.6倍,已集成到vLLM推理框架中。

🟢 📦 开源 2026年6月26日 · 1 分钟阅读

Allen Institute:混合模型(OLMo 3)对哪类词元预测更准?

编辑插图:混合SSM-Transformer架构与纯Transformer模型的词元对比示意图

Allen Institute(AI2)分析了OLMo 3与OLMo混合架构,发现混合模型在预测语义相关、上下文依赖的词元方面表现更优,而纯Transformer在逐字复制文本时仍占优势。

🟢 📦 开源 2026年6月25日 · 1 分钟阅读

arXiv:2606.24855: OpenThoughts-Agent — 智能体模型训练的开放数据方案

编辑插图:开放实验室中机器人智能体在流水线中对数据卡片进行分类

OpenThoughts-Agent是用于智能体语言模型的开放数据整理流水线。经过100+消融实验,团队构建了10万条样本并微调Qwen3-32B,在7个智能体基准上达到44.8%,超越所有现有开源模型。

🟢 📦 开源 2026年6月21日 · 1 分钟阅读

Anthropic(Claude Code GitHub):Claude Code v2.1.185 改进流卡顿提示信息

编辑插图:Claude Code v2.1.185 改进流卡顿提示信息

Claude Code v2.1.185 是于2026年6月20日发布的用户体验补丁,修改了API流卡顿提示信息,并将激活阈值从10秒静默延长至20秒,模型与API均无变化。

🟡 📦 开源 2026年6月20日 · 1 分钟阅读

arXiv:2606.20517:Multi-LCB将LiveCodeBench扩展至12种编程语言,揭示24个模型的Python过拟合

编辑插图:12个编程语言图标围绕中央性能测量仪

Multi-LCB是arXiv:2606.20517论文描述的LiveCodeBench基准测试扩展项目,已被ICLR 2026录用,将评测范围从Python扩展到12种编程语言。通过测试24个大型语言模型,作者发现了显著的Python过拟合现象和语言特异性数据污染,直接揭示了当前模型在多语言代码生成方面的局限。

🟡 📦 开源 2026年6月20日 · 1 分钟阅读

UK AISI:Engineering Playbook以五层结构开放前沿模型评估基础设施

编辑插图:五层叠放的基础设施层,带有安全防护图标

Engineering Playbook是英国AI安全研究院(UK AISI)于2026年6月18日发布的开源文档,开放了评估前沿AI模型的内部基础设施。Playbook分为五层(Evaluate、Isolate、Connect、Run、Scale),基于早前开源的Inspect AI工具,该工具拥有200多个现成评估和240名贡献者。

🟡 📦 开源 2026年6月19日 · 1 分钟阅读

Black Forest Labs:Robin Rombach呼吁G7领导人支持开放式AI发展

编辑插图:Robin Rombach呼吁G7领导人支持开放式AI发展

Robin Rombach——Black Forest Labs(FLUX模型开发者)联合创始人兼CEO——向G7领导人发出呼吁:开放、负责任的AI发展应成为全球规范。Rombach认为,AI参数的公开可及性能够促进创新并推动技术民主化。

🟡 📦 开源 2026年6月18日 · 1 分钟阅读

Allen Institute:开源MolmoMotion从视频中预测3D运动,在机器人领域达到SOTA

编辑插图:用于机器人操作的物体3D路径预测

Allen Institute发布了MolmoMotion,一款完全开源的模型,可根据视频和「旋转碗」等自然语言指令预测物体的3D轨迹。该模型在PointMotionBench上达到最优性能,平均位移0.109米(前记录为0.134米),并将机器人抓放任务成功率从56%提升至76.3%,提升20.3个百分点。模型在包含116万段视频及3D轨迹和动作描述的MolmoMotion-1M数据集上训练。

🟡 📦 开源 2026年6月17日 · 1 分钟阅读

vLLM:Semantic Router Fusion将模型面板合并,由裁判模型合成单一回答

编辑插图:AI模型面板和裁判模型合成单一回答

vLLM推出了Semantic Router Fusion——一种多个模型并行组成面板、由裁判模型分析共识与差异并合成单一回答的基本单元。支持本地vLLM和私有端点,以及Gemini、Kimi、DeepSeek和Claude等公共提供商。在OpenRouter DRACO上的外部验证显示合并面板达到69%,优于最佳单一模型的65.3%,且具备完整的OpenAI API兼容性。

🟡 📦 开源 2026年6月16日 · 1 分钟阅读

GitHub:开放多语言代码库数据集——8000万行记录、4000万个仓库

编辑插图:来自开放代码仓库的多语言数据集

GitHub发布了多语言代码库数据集,包含超过4000万个仓库的8000万行以上分类记录,采用完全开放的CC0-1.0许可证。数据集为每个仓库记录三个文本来源——README、评论最多的issue和评论最多的pull request——并通过fastText、gcld3和lingua-py三种工具进行语言检测。在非英语README文件中葡萄牙语排名第一,韩语在issue讨论中最为突出。

🟢 📦 开源 2026年6月16日 · 1 分钟阅读

CNCF:Oracle捐赠300万美元OCI积分,加速12个以上项目的Arm64支持

编辑插图:面向开源项目的Arm64云基础设施

CNCF报告称,Oracle捐赠的300万美元OCI计算积分为OpenTelemetry、containerd、Falco、Longhorn、Crossplane和Jaeger等12个以上项目提供了Arm64 CI/CD支持。需求迅速超过了每月5,000美元的初始指导方针。这一转变伴随着超过50%的新AWS实例和33%的Azure实例现在运行Arm64架构的数据。

🟡 📦 开源 2026年6月12日 · 3 分钟阅读

Allen Institute for AI 发布 olmo-eval:专为 LLM 主动开发周期设计的评估平台

编辑插图:AllenAI OLMo 评估平台,用于开源语言模型的开发与对比

AI2 发布 olmo-eval,这是一个开源评估平台,将 OLMES 标准从一次性基准测试扩展为完整的开发迭代循环。核心创新是跨检查点的逐题配对比较,并内置统计指标,用于区分真实改进与数据噪声。

🟡 📦 开源 2026年6月12日 · 2 分钟阅读

MiniMax M3 进驻 vLLM:百万 Token 上下文模型首日即获完整支持

编辑插图:vLLM 为 MiniMax M3 百万 Token 上下文多模态 MoE 模型提供服务

vLLM 团队宣布对 MiniMax M3 提供完整的首日(Day-0)支持——该模型具备百万 Token 上下文、原生多模态能力以及混合专家(MoE)架构。核心创新是 MiniMax Sparse Attention,无需完整物化 KV 缓存即可实现长上下文的实际服务。

🟡 📦 开源 2026年6月11日 · 3 分钟阅读

Ollama 带来 Apple Silicon 推理速度提升 20%:MLX 引擎、NVFP4 量化及代理工作流快照

编辑配图:Ollama MLX NVFP4 量化,加速 Apple Silicon 芯片上的本地推理

Ollama 更新了 Apple Silicon 的 MLX 引擎,通过 Metal 内核融合和 GPU 采样实现了最高 20% 的 token 生成速度提升。全新 NVFP4 量化格式将相比未量化 BF16 的质量损失减半,而快照系统则支持分支与重试功能,简化了代理工作流。

🟢 📦 开源 2026年6月10日 · 2 分钟阅读

Helion集成vLLM:PyTorch原生DSL取代CUDA内核,加速Qwen3模型FP8推理

编辑配图:PyTorch Helion DSL可移植GPU内核用于LLM推理与自动调优

Helion是一种无需直接CUDA代码即可编写GPU内核的PyTorch原生DSL。九个Helion内核已集成至vLLM用于Qwen3模型的FP8推理:非GEMM内核在H100上实现高达73%的加速,整体吞吐量较此前方案提升约5–9%。

🟢 📦 开源 2026年6月9日 · 3 分钟阅读

LF AI & Data:DocLang工作组开发AI原生文档开放标准

编辑插图:LF AI和Data引入AI原生文档的开放标准

LF AI & Data基金会以IBM、Red Hat和NVIDIA为创始成员,启动了DocLang规范工作组,旨在开发AI原生文档的开放标准。该格式保留语义含义和几何布局,内置治理控制,并针对现代AI分词器和代理工作流进行了优化。

🟢 📦 开源 2026年6月9日 · 3 分钟阅读

vLLM:vime——将Megatron训练与vLLM推理融合为统一管道的全新RL框架

编辑插图:vLLM新强化学习框架与GB200 GPU基础设施

vime是一个全新的语言模型后训练RL框架,将Megatron分布式训练与vLLM推理融合为统一管道。在GB200硬件上,Qwen3-30B-A3B MoE模型每步约需147秒——比H200快1.72倍。R3路由回放将对数概率差从0.019降至0.013。

🟡 📦 开源 2026年6月6日 · 2 分钟阅读

arXiv:2606.08094:vla.cpp 在 1.3 GiB 内存上运行 Vision-Language-Action 模型

编辑插图:2606.08094:vla.cpp 在 1.3 GiB 内存上运行 Vision-Language-Action 模型

一篇新论文提出 vla.cpp,一个用于在资源受限的机器人硬件上运行 Vision-Language-Action 策略的 C++ 推理引擎。该引擎在 LIBERO-Object 基准上达到 SOTA 水平,并仅用 1.3 GiB 内存运行 BitVLA。

🟡 📦 开源 2026年6月5日 · 2 分钟阅读

Ollama 0.30:集成 llama.cpp、支持 GGUF,推理速度提升高达 20%

编辑插图:Ollama 0.30:集成 llama.cpp、支持 GGUF,推理速度提升高达 20%

Ollama 0.30 带来了与 llama.cpp 的集成以提升性能,以及 GGUF 模型兼容性,在 NVIDIA GPU 上吞吐量提升高达 20%。它通过 Vulkan 将硬件支持扩展到 AMD 和 Intel 设备,并新增了对 tool-calling 的支持。它补充了面向 Apple silicon 的现有 MLX 引擎。

🟡 📦 开源 2026年6月5日 · 2 分钟阅读

vLLM Semantic Router v0.3 'Themis':生产级的有状态查询路由

编辑插图:vLLM Semantic Router v0.3 'Themis':生产级的有状态查询路由

vLLM 团队发布了其 Semantic Router 的 v0.3 'Themis' 版本,这是首个可用于生产的、在模型之间路由查询的版本。它带来了规范化配置、可检视的决策流,以及面向 Kubernetes 部署的可复现路由行为。

🟢 📦 开源 2026年6月3日 · 2 分钟阅读

Google 开源了 Flood Hub 洪水预测服务背后的水文框架

编辑插图:Google 开源了 Flood Hub 洪水预测服务背后的水文框架

Google Research 于 2026 年 6 月 3 日在 GitHub 上以 Apache 2.0 许可证发布了驱动全球洪水预测服务 Flood Hub 的 Python/PyTorch 框架。该框架在开源数据集 Caravan 上使用 LSTM 和更新的 ME-LSTM 架构,而升级后的 v2 模型将有测站流域的可靠预测期延长了 6 天。

🟡 📦 开源 2026年6月2日 · 2 分钟阅读

vLLM:会话感知智能体路由将模型切换减少 79%

编辑插图:会话感知智能体路由将模型切换减少 79%

vLLM Semantic Router 新增了会话感知智能体路由(SAAR),这一机制能够理解长时间的智能体对话,而非将每条消息单独处理。在 21,600 个测试回合中,SAAR 将模型切换减少了 79.29%,彻底消除了不安全的切换,并将预估成本降低了 78.71%。

🟢 📦 开源 2026年6月2日 · 1 分钟阅读

vLLM:AutoRound 量化进入 vLLM-Omni,让多模态模型更小巧

编辑插图:AutoRound 量化进入 vLLM-Omni,让多模态模型更小巧

vLLM 将英特尔的 AutoRound 量化集成进 vLLM-Omni,实现了多模态和扩散模型的 W4A16 压缩。其结果是检查点最多缩小 62%,质量损失极小,并在英特尔 XPU 和 NVIDIA 显卡上实现更快的生成。

🟡 📦 开源 2026年6月1日 · 2 分钟阅读

vLLM:在 NVIDIA DGX Spark / GB10 系统上运行

编辑插图:在 NVIDIA DGX Spark / GB10 系统上运行

vLLM 团队发布了一份实用指南,介绍如何在基于 GB10 芯片的 NVIDIA DGX Spark 系统上运行 vLLM。指南涵盖统一内存的行为、提供 NVFP4 模型 Nemotron-3-Super 的服务、Docker 部署、Prometheus 指标,以及在这款全新边缘硬件上的本地评估结果。

🟢 📦 开源 2026年5月30日 · 1 分钟阅读

xAI:xai-sdk-python v1.15.0 新增 grok-build-0.1 模型与上下文压缩

编辑插图:xai-sdk-python v1.15.0 新增 grok-build-0.1 模型与上下文压缩

xAI 发布了 xai-sdk-python v1.15.0,这是一个包含三项变更的版本:在 ChatModel 类中新增 grok-build-0.1 模型、支持 context compaction 即上下文压缩,以及将版本号从 1.14.0 提升到 1.15.0。所有变更均通过三个独立的拉取请求引入。

🟡 📦 开源 2026年5月29日 · 2 分钟阅读

arXiv:2605.31463:PithTrain,面向智能体的紧凑型MoE模型训练系统

编辑插图:PithTrain,面向智能体的紧凑型MoE模型训练系统

PithTrain是一套为AI编码智能体优化的Mixture-of-Experts模型训练新系统。该论文引入agent-task efficiency指标及配套的ATE-Bench,PithTrain在其上实现智能体步骤减少最多62%、活跃GPU时间减少最多64%,同时保持可比的吞吐量。

🟡 📦 开源 2026年5月28日 · 2 分钟阅读

vLLM:标准化的权重同步 API 加速异步 RL

编辑插图:标准化的权重同步 API 加速异步 RL

vLLM 于 2026 年 5 月 28 日引入了用于权重同步(weight synchronization)的标准化 API,并改进了对异步强化学习的支持。它解决了每个 RL 框架各自临时实现训练与推理之间权重传输的碎片化问题,并修复了大型分布式部署中的稳定性问题。

🟢 📦 开源 2026年5月28日 · 1 分钟阅读

Microsoft:Data Formulator 0.7 整合企业碎片化数据

编辑插图:Data Formulator 0.7 整合企业碎片化数据

Data Formulator 0.7 是 Microsoft Research 的开源系统,它连接企业中碎片化的数据源并支持迭代式分析流程。它带来持久化数据连接器和上下文感知的 AI 智能体,使分析无需掌握 SQL 或编程。

🟢 📦 开源 2026年5月28日 · 1 分钟阅读

Mistral:用于生产级搜索流水线的 Search Toolkit

编辑插图:用于生产级搜索流水线的 Search Toolkit

Mistral Search Toolkit 是用于为 AI 应用构建生产级搜索流水线的开源框架。它将摄取、检索和评估整合到单一接口下,可部署在云端、本地或网络边缘。

🟢 📦 开源 2026年5月28日 · 1 分钟阅读

Ollama:OpenJarvis v1.0 用于本地运行的个人 AI 智能体

编辑插图:OpenJarvis v1.0 用于本地运行的个人 AI 智能体

OpenJarvis v1.0 是用于构建在自有硬件上本地运行的个人 AI 智能体的开源框架,内置 Ollama 集成。它采用 local-first 方式,模型保持本地、云端可选,并跟踪能耗、成本和延迟。

🟡 📦 开源 2026年5月27日 · 2 分钟阅读

PyTorch:torch.compile通过内核融合实现最高10倍加速

Urednička ilustracija: Kako torch.compile postiže ubrzanje do 10× kroz kernel fusion

PyTorch编译器torch.compile通过消除向全局内存的冗余写入,利用内核融合技术在GPU上实现最高10倍加速。Inductor编译器不再为每个操作启动独立的GPU内核,而是自动将依赖操作合并为一个将中间值保留在快速处理器寄存器中的内核。

🟢 📦 开源 2026年5月27日 · 1 分钟阅读

xAI:Python SDK v1.14.0在web_search中新增enable_image_search和SERVER_SIDE_TOOL_IMAGE_SEARCH枚举

Urednička ilustracija: SDK Python v1.14.0 dodaje enable_image_search u web_search i SERVER_SIDE_TOOL_IMAGE_SEARCH enum

xAI发布了Python SDK v1.14.0,为web_search功能带来图像搜索支持。新的enable_image_search字段和SERVER_SIDE_TOOL_IMAGE_SEARCH枚举常量使构建基于Grok应用的开发团队能够在服务端启用视觉内容搜索,作为标准网页文本搜索的补充。

🟢 📦 开源 2026年5月23日 · 3 分钟阅读

Kedro:1.2.0版本带来@experimental装饰器和LangGraph智能体starter用于GenAI管道

编辑插图:带 LangGraph 编排桥和 Mermaid 图的管道节点

Linux Foundation AI项目Kedro发布了1.2.0版本以及Kedro-Viz 12.3.0。新的@experimental装饰器允许标记处于开发中的API,starter项目support-agent-langgraph演示了与LangGraph编排和Langfuse/Opik提示管理工具的集成。Kedro-Viz获得了Mermaid图表和节点预览可扩展性,以改善管道调试。

🟡 📦 开源 2026年5月21日 · 2 分钟阅读

Stability AI:Stable Audio 3.0发布开放权重模型,支持最长6分钟生成

Editorial illustration: Stability AI Stable Audio 3开放权重模型系列,支持6分钟生成和修复功能

Stability AI于2026年5月20日发布Stable Audio 3.0——包含4个音频模型(Small SFX、Small、Medium、Large)的系列,其中3个为开放权重并已在Hugging Face上线。最大亮点是支持最长6分钟的音频生成(前版本仅支持47秒),以及音频修复、因果延续和LoRA微调功能。公司声明所有模型均使用经许可的数据进行训练。

🟢 📦 开源 2026年5月20日 · 1 分钟阅读

LangChain:修复智能体的智能体——LangSmith Engine的构建方式

Editorial illustration:

LangChain发布了LangSmith Engine技术详解——一款分析生产AI智能体错误并提出具体修复方案的自主元智能体。Engine端到端自动化错误检测、评估器生成和回归测试。

🟡 📦 开源 2026年5月19日 · 1 分钟阅读

PyTorch: ExecuTorch MLX Delegate在Apple Silicon GPU上实现3–6倍模型推理加速

Editorial illustration: PyTorch团队发布ExecuTorch MLX Delegate,利用Apple MLX框架在Apple Silicon GPU上实现3至6倍推理加速

PyTorch团队发布了实验性ExecuTorch MLX Delegate——一个利用Apple MLX框架和Metal GPU内核在Apple Silicon芯片上实现3至6倍吞吐量提升的后端。支持Llama 3.2、Qwen 3、Phi-4 mini、Whisper和Voxtral实时流式转录。

🟢 📦 开源 2026年5月19日 · 1 分钟阅读

GitHub: Copilot Spaces API现已全面开放

Editorial illustration: GitHub宣布Copilot Spaces REST API正式全面开放,使团队可以通过编程方式创建和管理上下文感知的AI工作区

GitHub宣布Copilot Spaces的REST API正式全面开放,使团队可以通过编程方式创建、配置和删除上下文感知的AI工作区。新接口对管理大量Spaces而无需依赖手动工作流程的组织特别有用。

查看完整档案 →