每日 AI 简报

2026-07-22(内容获取于 07/22 05:02)

OpenAI 承认因内部模型测试导致 Hugging Face 安全事件

Hacker News · 07/22 04:09

OpenAI 发布声明,承认因其内部测试预发布模型时出现错误,导致了 Hugging Face 平台上的安全事件。两家公司正在合作解决此问题。(多家报道)

推荐理由:该事件揭示了 AI 模型测试和部署中潜在的安全风险,对于 AI 生态系统有重要影响。

Anthropic 团队利用 Claude Code 加速代码迁移

X 推文 (AttentionVC) · 07/22 03:47

Anthropic 团队分享如何利用 Claude Code 大幅加速代码迁移,此前耗时多年的大规模生产代码库迁移,现在单个开发者一月内可完成十个代码包移植。

推荐理由:揭示了大型语言模型在软件工程中提升效率的巨大潜力,尤其是在复杂的代码迁移任务上。

开源《深入理解 AI Agent》教材及代码

GitHub Trending

李博杰所著《深入理解 AI Agent》开源主仓库,含全书正文、PDF 与配套代码。旨在为学习者提供 AI Agent 设计原理与工程实践的全面资源。

推荐理由:提供全面深入的 AI Agent 理论与实践资源,是学习和开发智能体的宝贵参考资料。

Xaira Therapeutics 强调因果数据对药物发现 AI 模型的重要性

Latent Space · 07/22 03:34

Xaira Therapeutics 全面投入数据生成,以构建药物发现的 X-Cell 模型,强调因果模型需要因果数据支撑,提升模型可靠性。

推荐理由:强调了在药物发现等关键领域,高质量的因果数据对于构建可靠 AI 模型的核心作用。

AI 系统助力巴基斯坦法官高效处理积压案件

The Decoder · 07/22 03:12

AI 助理「JudgeGPT」使巴基斯坦法官案件解决率提高 6.3%,每投资 1 美元回报高达 38.50 美元,但仅对接受培训的法官有效。

推荐理由:提供了 AI 在司法领域成功应用的量化案例,强调了用户培训在技术采纳中的关键作用。

Routine AI:面向工作场景的智能语音助手

Product Hunt · 07/22 04:56

Routine AI 是一款面向工作场景的语音控制工具,通过语音指令管理工作,类似「工作版 Siri」,旨在提高日常工作效率。

推荐理由:提供了一种通过自然语音控制工作流程的潜在方案,对于提升办公效率有一定参考价值。

物理 AI 仿真技术现状概述

Hugging Face Blog · 07/22 04:00

本文概述了物理 AI 领域的仿真技术现状。它探讨了当前为物理 AI 系统创建和利用仿真环境的进展、挑战和未来发展方向。

推荐理由:全面梳理了物理 AI 领域仿真技术的进展和挑战,对相关研究和开发具有指导意义。

Claude 视频解析「阿谀奉承」概念

Claude (YouTube) · 07/22 02:19

Claude(YouTube)短视频解释「阿谀奉承」(sycophancy)概念,可能涵盖其定义、特征及人际互动中的表现形式。

推荐理由:作为 AI 模型名称的 Claude 发布的视频,其内容可能与 AI 对人类行为的理解或模型偏见有关,值得关注。

Anduril 推出「Thunder」自主攻击无人机

X 创作者 (AttentionVC) · 07/20 19:41

Anduril 公司发布「Thunder」自主攻击旋翼无人机,专为近地表作战设计,展现自主武器军事应用新进展。

推荐理由:展示了 AI 在军事硬件领域的最新应用,体现了自主作战系统的发展趋势。

V2EX 讨论:Codex 重置活动体验分享

V2EX · 07/21 21:33

V2EX 社区用户发起讨论,好奇大家在参与 Codex 重置活动时获得了哪些产品或体验,征集网友分享相关经历。

推荐理由:了解社区用户对特定活动的参与情况和反馈,是用户社区互动的一个缩影。

FlashRT:智能体引导框架优化实时多模态应用部署

HuggingFace Trending Papers · 07/20 08:00

FlashRT 是一个智能体引导框架,旨在高效部署实时多模态应用,优化异构模型流水线在部署位置、数据流和模型内并行性上的决策。

推荐理由:该研究为构建和部署复杂的实时多模态 AI Agent 应用提供了新的优化思路和框架。

OpenAI says Hugging Face was breached by its own pre-release models

OpenAI has come forward to claim responsibility for the Hugging Face breach, saying it was the result of internal testing gone awry.

中文介绍 OpenAI承认对Hugging Face的数据泄露事件负责。该公司表示,泄露是由于其内部测试预发布模型时发生错误所致。

The State of Simulation for Physical AI: An Overview

中文介绍 本文概述了物理AI领域的仿真技术现状。它探讨了当前在为物理AI系统创建和利用仿真环境方面的进展、挑战和未来发展方向,旨在为理解该技术提供全面视角。

Jack Dorsey is taking on Slack with Buzz, a group chat platform for teams and their AI agents

Buzz is a group chat platform for the workplace that puts humans and their AI agents in the same conversation.

中文介绍 Jack Dorsey推出了名为「Buzz」的团队群聊平台,旨在与Slack竞争。该平台允许人类用户与他们的AI代理在同一对话中进行协作,专注于提升工作场所的沟通效率和智能化水平。

AI and the rise of the universal entertainment app

Over the past decade, streaming platforms competed by dominating individual formats like music, video, podcasts, or audiobooks. Now, as AI makes it easier to create, organize, and recommend content, those distinctions are fading, pushing companies like Spotify, Netflix, YouTube, and TikTok to become

中文介绍 过去十年,流媒体平台通过主导单一内容形式竞争。如今,随着AI技术使内容创建、组织和推荐变得更容易,音乐、视频、播客等形式的界限正在模糊,推动了如Spotify、Netflix、YouTube等公司向“通用娱乐应用”发展。

Bucking EV slowdown, Sila raises $300M to expand battery materials factory

Sila's fresh $300 million round will help it make enough of its silicon-carbon anode material to power more than 100,000 EVs.

中文介绍 尽管电动汽车市场放缓,Sila公司仍成功完成3亿美元融资,用于扩建其电池材料工厂。这笔资金将帮助Sila生产足够的硅碳阳极材料,以满足超过10万辆电动汽车的电池需求。

🔬Causal Models Need Causal Data - Xaira’s X-Cell model for Drug Discovery (Bo Wang & Ci Chu, Chief Discovery Officer & Chief AI Scientist)

Xaira Therapeutics is all in on data generation for model building! We talk with Bo Wang and Ci Chu about how and why.

中文介绍 Xaira Therapeutics正全面投入数据生成以构建模型,特别是其用于药物发现的X-Cell模型。公司首席发现官Bo Wang和首席AI科学家Ci Chu讨论了数据生成的重要性及方法,强调因果模型需要因果数据支撑。

Substack adds an AI detector to help spot blogs written by no one

Substack will now help users determine whether what they're reading may have been written by AI. A new tool coming to the platform can scan posts, notes, replies, and comments to provide an estimate of how much text could be AI-generated or written with AI assistance, according to a blog post publis

中文介绍 Substack将推出一项新的AI检测工具,旨在帮助用户识别平台上由AI生成或AI辅助创作的内容。该工具能够扫描帖子、笔记、回复和评论,估算出文本中AI生成部分的比例。

An AI system helped Pakistani judges clear massive backlogs at $38.50 return per dollar invested

A field experiment with 1,559 Pakistani judges found that the AI assistant JudgeGPT boosted case resolution by 6.3 percent. The catch: only judges who got hands-on training saw gains. Without it, the effect mostly disappeared. The researchers estimate a return of up to $38.50 per dollar invested. Th

中文介绍 一项针对1,559名巴基斯坦法官的实地实验显示,AI助理“JudgeGPT”使案件解决率提高了6.3%。然而,只有接受过实践培训的法官才看到了成效,未培训者效果甚微。研究人员估计每投资1美元,回报高达38.50美元。

Nintendo customers have no legal right to tariff refunds, company tells judge

Nintendo says Switch buyers got what they paid for, urges court to dismiss lawsuit.

中文介绍 任天堂向法官表示,其顾客无权获得关税退款。该公司认为Switch买家已经获得了他们所支付的产品,并敦促法院驳回相关诉讼。

This Former Intel CEO Wants to Jumpstart Moore’s Law With Light

Pat Gelsinger wants to pave the way to ever more powerful artificial intelligence using tiny beams of light.

中文介绍 英特尔前CEO Pat Gelsinger计划通过利用微小光束技术,为实现更强大的AI铺平道路,以此“重新启动”摩尔定律。他希望通过光芯片技术突破现有计算瓶颈。

Einride bets $38M on EV charging as it scales electric trucking

The acquisition — Einride's first as a publicly traded company — will expand its EV-charging ecosystem as it works to scale its electric trucking business.

中文介绍 Einride公司投资3800万美元用于电动汽车充电业务,这是其上市后的首次收购。此举旨在扩大其电动汽车充电生态系统,并推动其电动卡车运输业务的规模化发展。

Apple teams up with Klarna to launch a lease-to-own program for iPhones, iPads, and Macs

The new leasing program is a big change for the hardware company, and comes as it looks to raise prices on many of its products.

中文介绍 苹果公司与Klarna合作,推出一项针对iPhone、iPad和Mac的“先租后买”计划。这项新的租赁项目对这家硬件公司而言是一大改变,正值其考虑上调多款产品价格之际。

Let Tom Hiddleston be your guide to Pompeii's final day

NatGeo's Pompeii: Out of Time fuses historical fact and imagination to bring city's last 24 hours to life.

中文介绍 国家地理频道推出纪录片《庞贝:时空之外》,由Tom Hiddleston主持,探索庞贝古城覆灭前的最后24小时。该片融合历史事实与想象,旨在追踪可能的幸存者,生动再现这座城市的末日。

Peak Design’s modular Field Bracket has a finder tag built-in

I am a very clumsy man. So clumsy, that I have AirTags hanging off practically every camera I own. Have I left my camera in an Uber? Yes. Have I left it on an airplane? Also yes. For me, finder tags are essential for my cameras. The problem is, strapping a finder tag to a camera is always cumbersome

中文介绍 Peak Design推出新款模块化相机支架“Field Bracket”,其最大亮点是内置了查找标签。此设计旨在解决用户容易丢失相机,以及需要额外加装AirTag等跟踪设备的痛点。

Data centers expected to use 4x more electricity by 2035

New data centers built through 2033 could consume as much electricity as India uses today.

中文介绍 预计到2035年,数据中心的电力消耗将增长4倍。据估算,到2033年新建的数据中心所消耗的电量,可能将相当于目前整个印度国家的用电总量。

koala73/worldmonitor

TypeScript · ★ 64,965 · 🍴 10,139 · 📈 1,167 stars today

Real-time global intelligence dashboard. AI-powered news aggregation, geopolitical monitoring, and infrastructure tracking in a unified situational awareness interface

中文介绍 `worldmonitor` 是一个实时全球情报仪表板,利用AI技术聚合新闻、监测地缘政治事件及关键基础设施动态。它提供统一的态势感知界面,旨在帮助分析师、研究人员或企业迅速掌握全球宏观环境变化,提升决策效率。适用于需要持续追踪国际局势和重大事件的专业人士。

bojieli/ai-agent-book

Python · ★ 14,221 · 🍴 1,327 · 📈 4,434 stars today

《深入理解 AI Agent:设计原理与工程实践》(李博杰 著)开源主仓库:全书正文、编译版 PDF 与按章配套代码

中文介绍 本项目是李博杰所著《深入理解 AI Agent:设计原理与工程实践》的开源主仓库。它提供了全书的完整正文、可编译的 PDF 版本,以及与各章节内容配套的代码示例。该项目旨在为读者提供一个全面的学习资源,深入探讨 AI Agent 的设计原理、架构模式及实际工程应用。开发者、研究人员或对 AI Agent 领域感兴趣的学习者,可以通过本书理论结合实践,掌握构建和部署智能 Agent 的核心知识与技能。

tirth8205/code-review-graph

Python · ★ 24,458 · 🍴 2,346 · 📈 1,921 stars today

Local-first code intelligence graph for MCP and CLI. Builds a persistent map of your codebase so AI coding tools read only what matters, with benchmarked context reductions on reviews and large-repo workflows.

中文介绍 Code Review Graph是一个本地优先的代码智能图谱工具,专为MCP(多组件项目)和CLI环境设计。它构建了一个持久化的代码库映射,旨在优化AI编码工具的上下文理解,确保AI在代码审查和处理大型仓库时仅读取关键信息。通过大幅减少AI上下文长度,提升了代码理解效率和审查质量。

ayghri/i-have-adhd

★ 6,654 · 🍴 269 · 📈 1,846 stars today

A skill for your coding agent to stop it from burying the answer. ADHD-friendly output.

中文介绍 `i-have-adhd` 项目为AI编程代理提供了一个实用“技能”,旨在解决代理输出冗长或关键信息被掩盖的问题。它优化了AI的回答结构,使其更简洁、直接,尤其适合对注意力缺陷多动障碍(ADHD)友好的输出,确保用户能迅速捕获核心内容。主要服务于追求高效、清晰AI交互的开发者及其他用户。

earthtojake/text-to-cad

JavaScript · ★ 9,030 · 🍴 1,021 · 📈 378 stars today

A collection of agent skills for CAD, robotics and hardware design

中文介绍 `text-to-cad` 汇集了一系列专门为计算机辅助设计(CAD)、机器人技术和硬件设计领域打造的AI代理技能。这些技能旨在通过自动化和智能化方式,辅助工程师和设计师处理从概念到实现过程中的复杂任务,例如基于文本生成CAD模型、优化机器人路径规划或辅助硬件布局。它能显著提升设计效率和精确性。

1jehuang/jcode

Rust · ★ 10,249 · 🍴 1,127 · 📈 835 stars today

The most intelligent agent harness for code

中文介绍 Jcode 是一个专为编码 Agent 设计的开发与评估框架(Coding Agent Harness)。该项目旨在为研究人员和开发者提供一套工具,用于构建、测试和比较 AI 编码助手的性能与能力。它能够帮助评估 AI 模型在代码生成、错误修复、重构以及其他编程任务中的表现。通过 Jcode,开发者可以更有效地迭代和优化 AI 驱动的编程工具,从而推动自动化编程和智能辅助编码技术的发展。

oblien/openship

TypeScript · ★ 6,044 · 🍴 435 · 📈 1,556 stars today

Self-hosted deployment platform

中文介绍 openship 是一个开源的自托管部署平台,旨在为开发者和运维团队提供一套完整的应用发布和管理解决方案。用户可以在自己的服务器或云基础设施上部署该平台,从而拥有对应用部署流程和数据的完全控制。它通常集成了版本控制、持续集成/持续部署(CI/CD)、环境管理、扩展和监控等功能,帮助团队实现自动化、高效的应用上线。适用于需要内部部署、注重数据主权或寻求替代商业部署服务的企业和个人。

AstrBotDevs/AstrBot

Python · ★ 37,429 · 🍴 2,607 · 📈 416 stars today

AI Agent Assistant & development framework that integrates lots of IM platforms, LLMs, plugins and AI feature, and can be your openclaw alternative. ✨

中文介绍 AstrBot 是一个多功能的 AI Agent 助手和开发框架,旨在简化跨平台智能助手的构建与部署。它深度集成了多种即时通讯(IM)平台、主流大语言模型(LLM)以及丰富的插件和 AI 功能。该项目提供了强大的扩展性,允许开发者根据需求定制 Agent 的行为和能力,并可作为 OpenClaw 等工具的开源替代方案。AstrBot 适用于需要构建在不同社交和办公平台上线,并能灵活响应用户请求的智能 AI 助手的开发者。

every-app/open-seo

TypeScript · ★ 6,519 · 🍴 709 · 📈 850 stars today

Open source alternative to Semrush and Ahrefs

中文介绍 open-seo 旨在成为 Semrush 和 Ahrefs 等商业 SEO 工具的开源替代品。它提供了一套免费且透明的解决方案,帮助网站管理员、营销人员和内容创作者进行关键词研究、竞争对手分析、网站审计及排名跟踪,从而优化搜索引擎表现。对于预算有限但又需要强大 SEO 功能的用户来说,open-seo 提供了一个极具吸引力的开源选择,助力网站提升自然搜索流量。

tradesdontlie/tradingview-mcp

JavaScript · ★ 4,789 · 🍴 2,170 · 📈 219 stars today

AI-assisted TradingView chart analysis — connect Claude Code to your TradingView Desktop for personal workflow automation

中文介绍 `tradingview-mcp` 项目旨在通过AI技术增强TradingView的图表分析能力。它允许用户将Claude Code AI模型集成到TradingView桌面版,从而实现个性化的交易工作流自动化。交易员和投资者可以利用此工具,自动执行市场数据分析、识别潜在交易模式或验证策略,显著提升分析效率和交易决策的响应速度。

AlexsJones/llmfit

Rust · ★ 30,135 · 🍴 1,840 · 📈 194 stars today

Hundreds of models & providers. One command to find what runs on your hardware.

中文介绍 `llmfit` 提供了一个便捷的解决方案,旨在帮助用户快速识别哪些大型语言模型(LLM)及其提供商能够在其现有硬件环境下高效运行。该项目整合了数百种模型和供应商信息,用户只需执行一个命令,即可轻松评估本地设备的兼容性。它极大地简化了LLM的选型与部署前测试流程,适用于LLM开发者、研究员或个人用户。

hyprwm/Hyprland

C++ · ★ 36,984 · 🍴 1,861 · 📈 88 stars today

Hyprland is an independent, highly customizable, dynamic tiling Wayland compositor that doesn't sacrifice on its looks.

中文介绍 `Hyprland` 是一个独立的、高度可定制的动态平铺式Wayland合成器。它在提供现代、高效窗口管理功能的同时,强调视觉美学,打破了传统平铺式管理器在外观上的刻板印象。项目为Linux用户提供了一个高性能、流畅且个性化极强的桌面环境体验,特别适合追求极致效率与美观兼顾的开发者和高级用户。

chrislgarry/Apollo-11

Assembly · ★ 69,872 · 🍴 7,836 · 📈 1,195 stars today

Original Apollo 11 Guidance Computer (AGC) source code for the command and lunar modules.

中文介绍 `Apollo-11` 项目收录了阿波罗11号任务中指令舱和登月舱制导计算机(AGC)的原始源代码。这份历史性代码不仅是早期航天工程的瑰宝,也展现了在极其有限的计算资源下,工程师如何编写出可靠且关键的飞行控制程序。它对于计算机历史研究者、软件考古学家及航天爱好者具有极高的参考和教育价值。

DioxusLabs/dioxus

Rust · ★ 37,598 · 🍴 1,772 · 📈 261 stars today

Fullstack app framework for web, desktop, and mobile.

中文介绍 `Dioxus` 是一个强大的全栈应用程序框架,使开发者能够使用一套代码库,轻松地为Web、桌面和移动平台构建高性能应用。它解决了多平台开发中代码复用性和维护成本的挑战,提供统一的开发体验。Dioxus 特别适合追求效率、希望利用Rust语言优势进行全栈开发的工程师和团队。

langchain-ai/open_deep_research

Python · ★ 12,194 · 🍴 1,738 · 📈 14 stars today

中文介绍 `open_deep_research` 是一个基于LangChain框架的项目,旨在探索和实现深度研究的自动化。它可能利用大型语言模型(LLM)进行信息收集、内容分析、观点提炼以及报告生成等任务,极大地提升研究效率。该项目适用于学术研究员、市场分析师、情报专家或任何需要进行大规模信息整合与洞察提取的专业人士。

diegosouzapw/OmniRoute

TypeScript · ★ 23,368 · 🍴 3,127 · 📈 2,040 stars today

Never stop coding. Free MIT AI gateway: one endpoint, 268+ providers (50+ free), 500+ models — Kimi, Claude, GPT, OpenAI, Gemini, GLM, DeepSeek, MiniMax. Works with Claude Code, Codex, Cursor, OpenCode, Cline & Copilot. Quota-aware auto-fallback, RTK+Caveman compression saves 15-95% tokens, MCP/A2A,

中文介绍 OmniRoute 提供一个免费的 AI 网关,通过单一 API 端点集成超过231个 AI 提供商(其中50余个免费),旨在解决多模型调用的复杂性。它支持将 Claude Code、Codex、Cursor、Cline、Copilot 等编码助手连接至免费的 Claude、GPT、Gemini 等主流大模型,大幅降低开发成本。项目还采用 RTK+Caveman 堆叠压缩技术,可节省 15-95% 的数据传输开销,适合开发者统一管理 AI 服务、优化性能并利用免费资源进行高效开发。

agegr/pi-web

TypeScript · ★ 1,690 · 🍴 275 · 📈 286 stars today

Web UI for the pi coding agent

中文介绍 `pi-web` 项目为 `pi coding agent` 提供了一个直观易用的Web用户界面。它旨在简化用户与AI编程代理的交互过程,摆脱命令行操作的复杂性,通过浏览器即可轻松部署、配置和管理agent,并查看其工作输出。此Web UI极大地提升了 `pi coding agent` 的可访问性和用户体验,适合各类开发者。

schollz/croc

Go · ★ 36,716 · 🍴 1,458 · 📈 396 stars today

Easily and securely send things from one computer to another 🐊 📦

中文介绍 `croc` 是一个高效且安全的文件传输工具,允许用户在任意两台计算机之间轻松发送文件。它通过命令行操作,支持点对点传输并默认进行加密,确保数据安全。`croc` 能够穿透防火墙,无需复杂的配置,解决了传统文件共享方案的诸多不便。适用于需要快速、私密地共享文件给其他设备或用户的场景。

microsoft/Ontology-Playground

TypeScript · ★ 1,974 · 🍴 243 · 📈 355 stars today

Free, open-source web app for learning about ontologies and Microsoft Fabric IQ. Explore a catalogue of pre-built ontologies, design your own visually, export as RDF/XML, and share interactive diagrams. Zero backend, fully static.

中文介绍 Ontology-Playground 是微软推出的一款免费开源 Web 应用,专为学习本体论(ontologies)和 Microsoft Fabric IQ 设计。它提供了一个互动平台,用户可以探索预构建的本体目录,通过直观的图形界面设计自己的本体结构,并将其导出为标准的 RDF/XML 格式。此外,用户还能分享生成的交互式本体图。该工具旨在降低本体论的学习门槛,并为数据架构师、知识工程师及对语义数据建模和知识图谱感兴趣的开发者提供一个实用的设计与可视化环境。

dottxt-ai/outlines

Python · ★ 14,788 · 🍴 797 · 📈 49 stars today

Structured Outputs

中文介绍 `outlines` 项目专注于为大型语言模型(LLM)提供结构化输出能力。它解决了LLM自由文本生成难以解析和利用的问题,确保模型输出严格遵循预定义的格式,如JSON、XML或特定语法结构。这极大地简化了LLM在自动化工作流、数据抽取或API集成中的应用,特别适合LLM应用开发者和数据工程师,以提升数据处理的准确性和效率。

Software Factories, Light and Dark

@addyosmani · 407.1K 粉丝 · 636.9K 阅 · 503 赞 · 49 转

A software factory is harnessed loops at scale. You can run the loop with humans in it (light factory): trading judgment and concentration against speed and breakage. Or you can ignore the humans

中文介绍 博主阐述了「软件工厂」概念,将其分为两种模式:由人类参与的「明工厂」(Light Factory),通过权衡判断力与速度;以及完全自动化、忽略人类参与的「暗工厂」(Dark Factory)。探讨了大规模软件开发中的不同策略与挑战。

How to Build a Self-Improving Outbound System on Codex

@nifinet · 11.0K 粉丝 · 337.0K 阅 · 518 赞 · 33 转

Earlier this year, Andrej Karpathy (@karpathy) pointed an agent at his own training code and let it run for two days. It ran 700 experiments, kept the 20 that beat the benchmark, and made the model

中文介绍 介绍如何构建一个自我改进的系统,灵感源于 Andrej Karpathy 的实验。Karpathy 让一个 agent 针对自身训练代码运行两天,执行了 700 次实验,并筛选出 20 个优于基准的成果。此方法展示了通过 AI agent 驱动的自动化实验,持续优化模型和代码的潜力。

GLM 5.2 With Vision

@part_harry_ · 1.5K 粉丝 · 225.6K 阅 · 503 赞 · 46 转

GLM 5.2 is one of the best currently available open source language models. However, unlike other flagship models like Qwen, Kimi and Minimax, GLM 5.2 does not support image inputs. We took this as a

中文介绍 博主讨论开源语言模型GLM 5.2的视觉能力(Vision),可能是在为其探索或开发图像输入功能。这一举措旨在增强GLM 5.2的多模态处理能力,使其能够处理视觉信息,从而拓宽应用范围并提升其在与Qwen、Kimi等模型竞争时的竞争力。

The Self-Driving Company

@amasad · 472.6K 粉丝 · 223.7K 阅 · 560 赞 · 65 转

We are beginning to see what happens when a company learns to operate itself. In the past six months, engineers at Replit have nearly tripled code output. Review times held steady. Reversions and

中文介绍 博主提出了「自驱动公司」这一概念,暗示企业运营未来将高度自动化,能像自动驾驶汽车一样自我管理和优化。这可能涉及利用AI和自动化技术,大幅提升公司的运营效率、决策速度和资源配置能力,预示着企业组织形态和生产力的一次重大变革。

Maybe Intelligence Ain't All That

@CliffordSosin · 16.4K 粉丝 · 197.0K 阅 · 514 赞 · 49 转

Superintelligence arrived. You probably didn't notice, because it turned out to be kind of incremental. Don't believe me? Run the test. Talk to Fable 5 for an hour, then talk to your ten smartest

中文介绍 博主探讨了「超级智能」的到来,指出其以渐进式而非颠覆性方式出现,因此可能未被察觉。他建议进行一项测试:与 Fable 5 交流一小时,再与十位最聪明的人交流,以感受这种「增量式超级智能」。

How OpenAI’s Sol Finally Learned Design Taste

@DesignArena · 17.6K 粉丝 · 191.5K 阅 · 509 赞 · 46 转

We benchmarked GPT-5.6 Sol on Design Arena’s Web Design (Non-Agentic) Arena, and we were surprised to find that it ranks 1st overall. This is 18 places higher than its predecessor GPT-5.5, and is the

中文介绍 DesignArena 提出了「How OpenAI’s Sol Finally Learned Design Taste」的问题,可能旨在探讨 OpenAI 的 Sol 模型在学习和掌握设计美学方面的进展和方法。

How to build your first team of agents:

@EXM7777 · 126.7K 粉丝 · 173.6K 阅 · 521 赞 · 51 转

I'm going to show you how to build your first team of AI agents... and how to wire them into a self improving loop inside a shared workspace the team we're building has 5 agents, one for each function

中文介绍 该推文详细讲解如何构建首个 AI 智能体团队,并将其整合到自我改进循环的工作流中。教程涵盖在共享工作空间内连接智能体的步骤,特别提到构建一个由 5 个具备独立功能的智能体组成的团队。

Graph Engineering with Claude: 14-Step roadmap from 0 to graph architect (Full Course)

@0xCodez · 23.9K 粉丝 · 154.5K 阅 · 510 赞 · 73 转

Most people who try to build a multi-step agent end up with a straight line. Step one, step two, step three - each waiting politely for the last to finish before it starts. 9/10 notice that half those

中文介绍 博主分享利用 Claude 进行「图工程」的 14 步路线图,旨在解决构建多步骤 agent 时常见的线性执行问题。许多人在设计 agent 时常陷入简单串联模式,而此教程将展示如何从零开始,通过图工程方法构建更复杂、非线性的 AI agent 工作流。

The Next Horizon in Agents

@btaylor · 158.6K 粉丝 · 144.3K 阅 · 511 赞 · 40 转

Introducing Horizon Today, Sierra is announcing Horizon, a platform that enables agents to pursue long-horizon goals, like originating a loan or getting prior authorization for a healthcare procedure.

中文介绍 Sierra公司发布了名为Horizon的新平台,旨在赋能AI Agent处理复杂且「长周期」的实际业务目标。该平台支持Agent完成如发起贷款或获取医疗程序预授权等多步骤任务。这标志着AI Agent从执行短期指令向处理更深层次、更具商业价值的复杂流程迈进,为企业自动化提供了新的可能性。

Gemini API Managed Agents: free tier, triggers & more

@GoogleAIStudio · 186.6K 粉丝 · 111.0K 阅 · 512 赞 · 51 转

Today we’re announcing new capabilities for Managed Agents in Gemini API, including free tier availability, budget control guardrails, and scheduled triggers. Building on our previous release of

中文介绍 Google AI Studio宣布Gemini API的Managed Agents新增功能,包括提供免费层级、预算控制保护措施以及支持定时触发器。这些更新建立在之前的发布基础上,旨在降低开发者使用门槛,赋予他们更大的灵活性来管理和部署AI Agent。新功能将促进更广泛的Agent应用,并帮助用户更好地控制成本与调度。

How we built our knowledge base

@cerebras · 60.4K 粉丝 · 70.7K 阅 · 509 赞 · 38 转

Authors: @hi_im_isaac_, @learnwdaniel, @gaozenghao note: the interactive version of full technical blog available: https://www.cerebras.ai/blog/how-we-built-our-knowledge-base Employees ask our internal knowledge base more than 15,000

中文介绍 Cerebras发布技术博客,详细阐述了他们如何构建企业内部知识库。该知识库每月处理员工超过15,000次的查询,极大提高了工作效率。博文由多位作者共同撰写,提供了实际案例和技术细节,为其他组织构建高效智能知识管理系统提供了宝贵的实践经验和设计思路。

Kimi K3 on KernelBench

@elliotarledge · 40.7K 粉丝 · 69.3K 阅 · 506 赞 · 45 转

This is the Kimi K3 post you guys have been waiting for. I got some early access to this model and have been testing it on kernels, and even before seeing the benchmark scores I was impressed with its

中文介绍 博主获得了Kimi K3模型的早期访问权限,并对其进行了初步测试和KernelBench基准评估。在未查看具体分数前,博主已对Kimi K3的性能印象深刻。这篇分享为期待Kimi K3的用户提供了第一手体验和性能洞察,预示着该模型可能在某些任务上展现出强大的能力。

Kimi K3 Reverse Engineering - Opus Without The Nagging

@herrcore · 15.4K 粉丝 · 64.2K 阅 · 514 赞 · 84 转

tl;dr K3 makes us question why we are paying Anthropic. We’ve been using Opus as our go-to model for reverse engineering tasks since the release of 4.5, and with each new release, it feels like we

中文介绍 博主对 Kimi K3 进行了逆向工程任务评测,并与 Anthropic 的 Opus 模型对比。评测结果表明,Kimi K3 在此类任务中表现出色,甚至让博主质疑继续为 Opus 付费的必要性。这暗示 Kimi K3 可能是逆向工程领域中,一个性能与性价比俱佳的替代方案。

Let's build Claude Code's harness (step-by-step)

@akshay_pachaar · 281.7K 粉丝 · 53.7K 阅 · 516 赞 · 74 转

We will cover everything that goes into building a coding harness, the agent loop, planning, subagents, sandboxing, memory, and checkpointing, built step by step. If you've ever tried building your

中文介绍 博主分享了为 Claude Code 构建编码辅助工具「coding harness」的逐步教程。内容深入讲解了智能体循环、规划、子智能体、沙盒环境、内存管理和检查点等关键技术组件的实现细节。

From Loop Engineering to Graph Engineering?

@IntuitMachine · 62.3K 粉丝 · 50.7K 阅 · 552 赞 · 47 转

What the shift in AI agent architecture is really about Peter Steinberger just posted nine words that gathered thousands of likes: https://x.com/steipete/status/2078277297791189132 "Are we still talking loops or did we

中文介绍 该推文探讨了 AI 智能体架构的关键转变,从传统的「循环工程」(Loop Engineering)转向「图工程」(Graph Engineering)。文章引用 Peter Steinberger 的热门观点,提出对当前智能体设计范式的深刻反思。

How I use Linear to manage agents (and why we should all be building software factories)

@enginoid · 1.1K 粉丝 · 49.9K 阅 · 522 赞 · 37 转

Linear is probably my best-value subscription at the moment. I pay the sole user fee of $12/mo and the company agents have eaten through ~400 issues in the past month. I use Linear to organize my

中文介绍 博主分享如何利用项目管理工具 Linear 管理 AI agent 的工作流。他每月支付 $12 订阅费,其公司 agent 在过去一个月内处理了约 400 个问题。该分享展示了将 Linear 与 AI agent 结合以大幅提升生产力的方法,并倡导构建「软件工厂」的理念。

How to build a self-improving code review agent

@zachlloydtweets · 12.1K 粉丝 · 42.7K 阅 · 527 赞 · 57 转

This is the third post in my series on how to build a cloud software factory: Build an issue triage agent Build a spec writing agent [This post] Build a self-improving code review agent I’ll describe

中文介绍 该推文是关于构建「云软件工厂」系列文章的第三部分,核心内容是如何搭建一个自我改进的代码审查 agent。博主将详细描述其构建过程。此前系列文章已涵盖问题分类 agent 和规范编写 agent,本次分享进一步完善了自动化软件开发的工作流。

How Anthropic runs large-scale code migrations with Claude Code

@ClaudeDevs · 614.2K 粉丝 · 40.3K 阅 · 689 赞 · 40 转

Code migrations, projects that port a production codebase to a new language, were multi-year endeavors until recently. In the last month, individual developers at Anthropic migrated 10 code packages

中文介绍 Anthropic 团队分享了如何利用 Claude Code 大幅加速代码迁移项目。此前耗时多年的大规模生产代码库迁移,现在通过 Claude Code 的辅助,单个开发者在一个月内即可完成 10 个代码包的移植,极大地提升了效率。

What does a modular Agent Operating System do?

@unicity_labs · 119.9K 粉丝 · 13.1K 阅 · 525 赞 · 289 转

Unicity AOS is at its core a fixed Rust microkernel that enforces security, cost, and approval controls below your agent code, and signs every action into a tamper-evident audit chain. It runs

中文介绍 Unicity Labs 介绍了其模块化 Agent 操作系统 Unicity AOS。该系统核心是基于 Rust 的微内核,负责在 Agent 代码层之下强制执行安全、成本和审批控制,并将每项操作签署到防篡改的审计链中,确保 AI Agent 行为的可控性与透明度。

Did you have a good weekend? Wonderful. Meet Axxon One

@therealDeFlock · 82.7K 粉丝 · 12.2K 阅 · 500 赞 · 120 转

"Axxon One supports automatic tracking of people as they move between cameras". "automatic tracking of people"... Ideal for logistics, warehousing, and Safe City projects, this AI detector

中文介绍 博主介绍了 AI 产品 Axxon One。该产品支持「跨摄像头对人员进行自动追踪」,并配备 AI 探测器。它尤其适用于物流、仓储以及智慧城市等项目,旨在为这些领域提供高效且自动化的监控与人员追踪解决方案,以提升运营效率和安全性。

Summer Release 2026

@Tesla · 24.8M 粉丝 · 348.9K 阅 · 7d 曝光 348.9K

Summer Release 2026

FlowMimic: Mask-free Visual Editing and Generation with Pixel-pair Warped Flow Field for Online Video Editing Data Generation and Modality Mimicry

👍 23

In line with the prevailing direction of vision research, we explore the integration of both generation and editing capabilities for video and image modalities within a single model. Current approaches to collecting video editing data typically depend on labour-intensive, time-consuming curated proc

中文介绍 FlowMimic模型采用像素对扭曲流场技术,实现了无遮罩的视频和图像生成与编辑,将这两种能力整合于单一模型中。该方法旨在克服当前视频编辑数据收集费时费力的问题,提升在线视频编辑数据生成的效率与质量。

HOMIE: Human-object Centric Video Personalization via Multimodal Intelligent Enchancement

👍 46

Human-object centric video personalization (HOCVP) is a core task within subject-driven video generation. However, existing methods suffer from two key limitations. First, most approaches focusing on inter-subject personalization still struggle to strike a balance between high subject fidelity and a

中文介绍 HOMIE提出一种多模态智能增强方法,旨在解决以人-物为中心的视频个性化(HOCVP)任务在主体驱动视频生成中的挑战。现有方法在保持高主体保真度与生成多样性之间难以平衡,HOMIE致力于通过多模态融合改进此项核心任务。

SWE-Pruner Pro: The Coder LLM Already Knows What to Prune

👍 64

Pruning long context for coding agents has been a vital technology for efficient context management. While existing context pruning methods such as SWE-Pruner realize this by attaching a separate code classifier, we find the agent itself encodes internal representations indicating the relevance of c

中文介绍 论文介绍SWE-Pruner Pro,一种面向编码智能体的长上下文剪枝方法。不同于现有方法(如SWE-Pruner)依赖独立的分类器,SWE-Pruner Pro发现编码大语言模型(LLM)自身已包含指示何处应剪枝的内部表示,从而实现更高效的上下文管理。

FlashRT: Agent Harness for Guiding Agents to Deploy Real-Time Multimodal Applications

👍 3

Real-time multimodal applications, including voice agents and interactive video generation, compose heterogeneous models into pipelines whose efficient deployment requires application-specific decisions about placement, streaming, and intra-model parallelism. Existing serving systems and auto-parall

中文介绍 FlashRT是一个智能体引导框架,旨在指导智能体高效部署实时多模态应用,如语音助手和交互式视频生成。这类应用将异构模型组合成流水线,其高效部署需要关于部署位置、数据流和模型内并行性的决策,FlashRT旨在优化这些决策。

jina-reranker-v3.5: An Efficient Listwise Reranker with Hybrid Attention and Self-Distillation

👍 0

Listwise rerankers are the discriminative core of agentic retrieval pipelines, yet production deployment demands efficiency, domain robustness, and fluency on semi-structured data at the same time. We present jina-reranker-v3.5, a 0.6B-parameter listwise reranker that meets these demands together wi

中文介绍 论文介绍jina-reranker-v3.5,这是一个拥有0.6B参数的高效列表式重排序器。该模型结合了混合注意力机制和自蒸馏技术,旨在满足生产环境中对智能体检索流水线在效率、领域鲁棒性以及半结构化数据处理流畅性方面的严苛要求。

Differentiable Logic Gate Networks for Low-Latency EEG Classification on Edge Devices

👍 0

Real-time EEG classification on edge devices is bottlenecked by the floating-point arithmetic of conventional neural networks. We investigated Differentiable Logic Gate Networks (Diff-Logic) as a hardware-native alternative that compiles models into pure Boolean circuits executable via bitwise CPU o

中文介绍 为解决边缘设备上实时脑电图(EEG)分类受传统神经网络浮点运算瓶颈的限制,研究人员提出了可微逻辑门网络(Diff-Logic)。该技术作为一种硬件原生替代方案,能将模型编译为纯布尔电路,从而在边缘设备上实现低延迟的EEG分类。

Do Language Models Dream of Binding Molecules? Benchmarking LLMs under Spatial Constraints

👍 12

Structure-based drug design (SBDD) leverages the 3D structure of protein targets, often complemented by other spatial constraints, to generate candidate binding molecules. While diffusion models have dominated as a leading paradigm for high-quality 3D molecule generation, LLM-based methods are rapid

中文介绍 结构药物设计(SBDD)利用蛋白质靶标的3D结构及空间约束来生成候选结合分子。尽管扩散模型在高质量3D分子生成中占主导地位,但该研究探讨并基准测试了基于大语言模型(LLM)的方法在空间约束下生成结合分子的潜力。

O-VAD: Industrial Video Anomaly Detection through Object-Centric Tracking and Reasoning

👍 8

Industrial Video Anomaly Detection (IVAD) aims to identify anomalous objects and events in an industrial process, which is crucial for modern manufacturing and quality control systems. Existing VLM-based anomaly reasoning methods are capable of detecting open-ended anomalies in general domains. Howe

中文介绍 O-VAD提出一种通过以物体为中心的跟踪与推理,实现工业视频异常检测(IVAD)的方法。IVAD对于现代制造和质量控制系统至关重要,旨在识别工业流程中的异常物体和事件。现有基于VLM的异常推理方法在开放式异常检测方面存在局限。

LLM-as-a-Coach: Experiential Learning for Non-Verifiable Tasks

👍 8

Reinforcement learning (RL) on open-ended tasks compresses an LLM's rubric-based evaluation into a scalar reward, discarding rich textual feedback and conflating responses with distinct quality profiles. We propose Experiential Learning (EL), which repurposes the feedback model from an LLM-as-a-Judg

中文介绍 针对不可验证任务,论文提出“大语言模型(LLM)作教练”的经验学习(EL)范式。传统强化学习将LLM的丰富文本反馈压缩为标量奖励,可能丢失关键信息。EL方法旨在重新利用反馈模型,以更有效的方式处理开放式任务,提升LLM在复杂任务上的表现。

WorldCupArena: Fine-Grained Evaluation of Language Models and Deep-Research Agents on Football Forecasting

👍 2

Predicting a football match before kickoff requires more than knowing past results: a model must use changing information and make a clear prediction before the answer is available. We present WorldCupArena, a dynamic benchmark for language models and deep-research agents. The 2026 FIFA World Cup is

中文介绍 WorldCupArena是一个动态基准测试平台,用于细粒度评估大语言模型和深度研究智能体在足球赛事预测方面的能力。足球预测不仅需要历史数据,还需要模型处理实时变化的信息并在赛前做出明确判断。WorldCupArena涵盖了20XX年世界杯数据。

VGOcc: Learning Visual-Geometric Gaussians for Vision-Centric 3D Driving Occupancy Prediction

👍 0

Vision-only occupancy prediction requires recovering a semantic 3D occupancy field from calibrated surround-view images, where each view provides observations with ambiguous depth along camera rays. Existing methods have progressed from dense structured representations to sparse Gaussian primitives,

中文介绍 VGOcc提出了一种学习视觉几何高斯的方法,用于以视觉为中心的3D驾驶占位预测。该任务旨在从校准的全景图像中恢复语义3D占位场。由于每个视角沿相机光线提供的深度信息模糊,VGOcc在此基础上进行优化,以提升预测准确性。

Self-State Attacks on Self-Hosted AI Agents: How Far Can OS Defenses Go?

👍 3

Self-hosted AI agents read and write their own memory and configuration files to function. An agent may get compromised via corruption of its own state -- a compromise realized via legitimate OS system call invocation. We refer to this class of threats as self-state attacks. In this paper, we invest

中文介绍 论文探讨了针对自托管AI智能体的“自状态攻击”,即通过合法操作系统调用,利用智能体读取和写入自身内存及配置文件的机制,破坏其内部状态进而实现攻击。研究旨在评估操作系统防御措施在抵御此类威胁方面的有效性与局限性。

RynnBrain 1.1: Towards More Capable and Generalizable Embodied Foundation Model

👍 32

We present RynnBrain 1.1, a family of embodied foundation models spanning 2B, 9B, and 122B-A10B scales. Trained with a unified spatio-temporal and physically grounded framework, RynnBrain 1.1 supports embodied perception, spatial reasoning, localization, and planning. Compared with RynnBrain 1.0, it

DiFA: Inference-Time Forward-Process Alignment for Diffusion Models

👍 2

The prevailing inference framework for diffusion models formulates generation fundamentally as a problem of numerical integration. This perspective casts the model as an exact estimator, neglecting the inherent statistical uncertainty of the denoising process. In this work, we propose Forward-Proces

ShotPlan: Cinematic Video Generation with Learnable Planning Token

👍 3

Current video generation models achieve impressive results in single-shot generation, yet remain limited in cinematic video generation, where coherent narratives and effective multi-shot composition require explicit shot planning. To address this challenge, we propose ShotPlan, a framework for expli

Token-Level Off-Policy Learning for Faithful Generation Under Distribution Shift

👍 4

We propose Token-Level Off-Policy Labeling (TOPL), an off-policy training paradigm that reframes post-training as a token-level correctness prediction task. Our key intuition is that by training the model to distinguish good and bad tokens in a response, we naturally guide the model towards generati

Thinking in Video: Can Video Generators Really Reason About the Real World?

👍 0

Recent advances in world models and video generation have given rise to an emerging reasoning paradigm that leverages video generative models to simulate, predict, and reason about real-world dynamics. We redefine this paradigm as Thinking in Video, where video is not merely an output artifact but a

TimeLens2: Generalist Video Temporal Grounding with Multimodal LLMs

👍 139

Video multimodal large language models (MLLMs) can describe what happens in a video, but rarely identify when the supporting evidence occurs. We study generalist video temporal grounding, in which one model predicts a variable-cardinality set of evidence intervals across video lengths, domains, quer

Quantifying Diversity of Thought: A Predictive Law of Weighted LLM Ensemble Lift

👍 0

This paper provides an experimentally verified formal law for calculating the uplift that diversity of thought provides in Large Language Model (LLM) ensembles. From first principles, we derive an exact decomposition of LLM ensemble lift into rescue and damage masses, which yields a compact heuristi

STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition

👍 0

Understanding physical human-robot and human-human interactions is a challenging yet emerging topic in 3D vision. While most existing methods rely on skeleton sequences--effective in low-light and privacy-sensitive environment--they face two major challenges: 1) learning and effectively exploiting i

Distilled Reinforcement Learning for LLM Post-training

👍 6

Large language model (LLM) post-training is essential for improving reasoning, adaptation, and alignment. Existing methods mainly follow two paradigms: reinforcement learning (RL) and on-policy distillation (OPD). However, RL relies on coarse-grained outcome supervision, resulting in difficult credi

ditto.site

Clone any website into clean code. Free & open source

中文介绍 ditto.site 是一款免费开源的网站克隆工具,旨在帮助用户将任何现有网站转换为结构清晰、易于维护的干净代码,以提升开发效率和代码质量。

Routine AI

Control work with your voice. The Siri for work.

中文介绍 Routine AI 是一款面向工作场景的语音控制工具,旨在通过语音指令帮助用户管理工作,类似"工作版 Siri",提高日常工作效率。

PieceKeeper

Track your music repertoire and practice

中文介绍 PieceKeeper 是一款专为音乐家设计的工具,可以帮助用户跟踪其音乐曲目库和日常练习进度,以系统化管理音乐学习与提升。

Diffsmith

Comment on your AI agent's code & collaborate on changes

中文介绍 Diffsmith 是一款代码审查工作室,允许用户对 AI 智能体生成的代码进行评论,并与团队成员协作修改,从而优化 AI 模型的代码质量和协同开发流程。

Routebase

Catch API drift before your customers do

中文介绍 Routebase 旨在帮助开发者在用户发现问题之前,识别并解决 API 接口的变化或"漂移"问题,确保 API 的稳定性和用户体验。

Phantomstory

Launch a third-party blog to win AEO with just two clicks

中文介绍 Phantomstory 是一款工具,允许用户通过简单的两步操作,快速启动第三方博客,旨在帮助其网站在答案引擎优化(AEO)中取得优势,提升内容可见性。

Bolna Agent Studio

Build Voice AI Agent in 10 Minutes

中文介绍 Bolna Agent Studio 是一个平台,使用户能够在短短 10 分钟内快速构建语音 AI 智能体。该工具旨在简化语音 AI 应用的开发流程。

Lev8

Find, research, and reach the right people

中文介绍 Lev8 是一款旨在帮助用户寻找、研究并接触到目标人群的工具。它适用于销售、招聘或人际网络拓展等场景,提高用户触达关键联系人的效率。

Jockey by TwelveLabs

The video AI agent that understands your whole library

中文介绍 Jockey 是 TwelveLabs 推出的一款视频 AI 智能体,它能够理解并分析用户整个视频库的内容。该工具旨在提升视频内容的搜索、管理和利用效率。

CreateOS Sandbox

Instant, hardware Isolated Sandboxes for AI agents

中文介绍 CreateOS Sandbox 旨在为 AI 智能体提供即时且硬件隔离的沙盒环境。这有助于开发者安全地测试和部署 AI 模型,确保其运行的独立性和稳定性。

Devin AI: The Full Beginner’s Guide (Better Than Claude Code?)

中文介绍 这则YouTube视频提供了Devin AI的全面初学者指南,深入探讨了这款人工智能工具在代码开发方面的应用潜力。视频可能通过演示和比较,向观众展示Devin AI的功能和使用方法,并讨论其与Claude Code相比的优劣,以帮助初学者快速掌握。

Director by OpenArt

中文介绍 这则YouTube短视频介绍了OpenArt公司推出的一款名为「Director」的新产品或功能。该视频可能简要展示了「Director」的主要特点和用途,暗示其可能是一款用于创意或艺术领域的人工智能工具。

Codex and Claude Shipped Browser Updates. This Changes Everything.

中文介绍 Codex和Claude两大AI模型近期发布了浏览器更新,预计将对用户与AI的互动方式产生显著影响。这些更新可能包括功能改进、性能优化或更深度的浏览器集成,旨在提升用户体验并拓宽AI工具的应用场景。

What is sycophancy?

中文介绍 这段来自Claude(YouTube)的短视频,以“什么是阿谀奉承?”为题,旨在清晰阐释「阿谀奉承」(sycophancy)这一概念。视频内容可能涵盖该行为的定义、特征及其在人际互动中的表现形式,帮助观众深入理解这种社会现象的本质。

Making New York City miniature with Claude

中文介绍 这段YouTube短视频展示了如何运用名为「Claude」的工具,将美国纽约市的标志性建筑或街景制作成微缩模型。视频内容可能涵盖了从设计到实现微缩模型的过程,突出了Claude在创意制作领域的应用,暗示了其在辅助视觉艺术和模型构建方面的潜力。

Build data-driven lesson plans with Claude for Teachers

中文介绍 Claude为教师推出了一项新功能,旨在帮助教育工作者构建数据驱动的课程计划。通过利用Claude AI的能力,教师可以更高效地设计个性化教学方案,以适应不同学生的学习需求,优化教学效果。

Regenerative beekeeping with Claude

中文介绍 该视频展示了AI助理Claude如何协助用户实践再生式养蜂技术。通过Claude,养蜂人能够获取相关信息和策略,以更可持续、生态友好的方式进行蜜蜂养殖,从而促进蜂群健康与生态平衡。

What is sycophancy?

中文介绍 这段来自Claude(YouTube)的短视频,以“什么是阿谀奉承?”为题,旨在清晰阐释「阿谀奉承」(sycophancy)这一概念。视频内容可能涵盖该行为的定义、特征及其在人际互动中的表现形式,帮助观众深入理解这种社会现象的本质。

Making New York City miniature with Claude

中文介绍 这段YouTube短视频展示了如何运用名为「Claude」的工具,将美国纽约市的标志性建筑或街景制作成微缩模型。视频内容可能涵盖了从设计到实现微缩模型的过程,突出了Claude在创意制作领域的应用,暗示了其在辅助视觉艺术和模型构建方面的潜力。

Build data-driven lesson plans with Claude for Teachers

中文介绍 Claude为教师推出了一项新功能,旨在帮助教育工作者构建数据驱动的课程计划。通过利用Claude AI的能力,教师可以更高效地设计个性化教学方案,以适应不同学生的学习需求,优化教学效果。

Claude Just Revealed AI's Biggest Problem

中文介绍 这则来自YouTube频道Two Minute Papers的视频指出,人工智能模型Claude揭示了当前AI领域面临的一个「最大问题」。视频可能探讨了AI技术在特定情境下展现出的局限性、伦理困境或技术挑战,旨在分析并讨论这些阻碍AI进一步发展的核心难题。

Anthropic Found Something That Shouldn't Exist

中文介绍 一项由科学家进行的研究揭示了AI模型Claude内部运作的“秘密”。该研究可能深入探讨了Claude的核心机制或其神经网络的特定属性,从而帮助研究人员更好地理解其决策过程和学习模式,推动AI领域的发展。

Show HN: A self-running space economy SIM in Rust and Bevy

I built this with Claude cause I always wanted to tinker with a simulation economoy and I love space themes.A space-economy sim where nothing is scripted. A few hundred autonomous ships each run their own planner. Some chase the best trade route, take a delivery contract, refuel, retrofit at a shipy

Show HN: CodeAlmanac – Karpathy-style codebase wiki from your conversations

Hey HN! This is Divit from Almanac (YC S26). We built CodeAlmanac, a wiki for your coding agents that updates as you talk to them. It is open-source, local, and free.Here’s a demo: https://www.youtube.com/watch?v=XNQWV3TFBWMYour CC/Codex conversations contain a LOT of knowledge t

Bloomy (YC S26) is hiring a founding engineer

About BloomyBloomy is an AI tutor and curriculum for K-12 students. Our student users are learning approximately 2x faster in early pilots, and students and teachers alike love our product.How it works: We diagnose students’ skill gaps, map out a personalized learning path for them, and then have an

Show HN: Justif – Knuth-Plass justification and microtypography for the web

Justif is a drop-in JavaScript library that progressively enhances web pages to TeX-level text justification. Installation is a single <script> line, standard text and accessibility affordances are unchanged, and users with JS disabled get native browser rendering.I made justif because I'

v2.1.216

What's changed Added sandbox.filesystem.disabled setting to skip filesystem isolation while keeping network egress control Fixed a slowdown in long sessions where message normalization cost grew quadratically with the number of turns, causing multi-second stalls and slow resumes Fixed auto mode deny

中文介绍 Claude Code发布了v2.1.216版本。此更新引入了“sandbox.filesystem.disabled”设置,允许在保持网络出口控制的同时跳过文件系统隔离。同时,该版本修复了长时间会话中的性能下降问题,解决了消息标准化成本随轮次呈二次增长,导致多秒卡顿和恢复缓慢的现象。

v2.1.215

What's changed Claude no longer runs the /verify and /code-review skills on its own; invoke them with /verify or /code-review when you want them

中文介绍 Anthropic公司旗下Claude代码工具发布v2.1.215版本更新。此次更新调整了"/verify"和"/code-review"技能的运行方式,它们不再自动执行,用户需要时需通过指令明确调用。

v2.1.214

What's changed Fixed single-segment dir/** allow rules like Edit(src/**) auto-approving writes to nested dir/ directories anywhere in the tree instead of only /dir Fixed a permission-check bypass affecting commands run in Windows PowerShell 5.1 sessions Fixed Bash permission checks to fail closed on

中文介绍 Anthropic Claude Code发布了v2.1.214版本。此更新主要修复了多项错误,包括单段目录通配符允许规则、影响Windows PowerShell 5.1会话的权限检查绕过问题,以及Bash权限检查错误。

v2.1.212

What's changed /fork now copies your conversation into a new background session (its own row in claude agents) while you keep working; the in-session subagent it used to launch is now /subtask Added claude auto-mode reset to restore the default auto-mode configuration, with a confirmation prompt (pa

v2.1.211

What's changed Added --forward-subagent-text flag and CLAUDE_CODE_FORWARD_SUBAGENT_TEXT environment variable to include subagent text and thinking in stream-json output Fixed permission previews relayed to chat channels not neutralizing bidirectional-override, zero-width, and look-alike quote charac

v2.1.210

What's changed Added a live elapsed-time counter to the collapsed tool summary line so long-running tool calls visibly tick instead of looking stuck Added a startup warning for Write(path), NotebookEdit(path), and Glob(path) permission rules — use Edit(path) or Read(path) instead Fixed isolation: 'w

v2.1.209

What's changed Fixed /model and other dialogs being blocked in claude agents background sessions (reverts an overly broad guard)

v2.1.208

What's changed Added screen reader mode: opt-in plain-text rendering for screen reader users. Run claude --ax-screen-reader, set CLAUDE_AX_SCREEN_READER=1, or add "axScreenReader": true to settings. Added vimInsertModeRemaps setting: map two-key insert-mode sequences like jj to Escape in vim mode Ad

v2.1.207

What's changed Auto mode is now available without CLAUDE_CODE_ENABLE_AUTO_MODE opt-in on Bedrock, Vertex AI, and Foundry; disable via disableAutoMode in settings Fixed the terminal freezing and keystrokes lagging while streaming responses containing very long lists, tables, paragraphs, or code block

v2.1.206

What's changed Added directory path suggestions to /cd, matching /add-dir behavior Added a /doctor check that proposes trimming checked-in CLAUDE.md files by cutting content Claude could derive from the codebase /commit-push-pr now auto-allows git push to the repo's configured push remote (remote.pu

0.145.0

New Features Added experimental paginated thread history with efficient resume, search, persisted names, sub-agent support, and memories. (#33364, #33907, #34085, #34229, #34386) Expanded /import to migrate Cursor and Claude Code settings, MCP servers, plugins, sessions, commands, and project-scoped

中文介绍 OpenAI Codex发布了0.145.0版本,新增实验性分页线程历史功能,支持高效恢复、搜索、持久化名称、子代理支持和记忆功能。此外,该版本还扩展了导入功能,可迁移Cursor和Claude Code的设置、MCP服务器、插件、会话和命令,提升了用户数据管理和兼容性。

0.145.0-alpha.29

Release 0.145.0-alpha.29

中文介绍 OpenAI Codex发布了0.145.0-alpha.29版本。此版本属于alpha测试阶段,通常包含新功能或修复,旨在收集用户反馈。

0.145.0-alpha.28

Release 0.145.0-alpha.28

中文介绍 OpenAI Codex发布了0.145.0-alpha.28版本。此版本属于alpha测试阶段,通常包含新功能或修复,旨在收集用户反馈。

0.145.0-alpha.27

Release 0.145.0-alpha.27

中文介绍 OpenAI Codex发布了0.145.0-alpha.27版本。此版本属于alpha测试阶段,通常包含新功能或修复,旨在收集用户反馈。

rust-v0.145.0-alpha.26

Release 0.145.0-alpha.26

中文介绍 OpenAI Codex发布了rust-v0.145.0-alpha.26版本。此版本属于alpha测试阶段,通常包含新功能或修复,旨在收集用户反馈。

0.145.0-alpha.25

Release 0.145.0-alpha.25

中文介绍 OpenAI Codex项目于GitHub发布了其编号为0.145.0-alpha.25的更新版本。该版本专门针对Rust语言的相关组件,目前仍处于alpha测试阶段。此次更新的具体内容在发布信息中未详细说明。

0.145.0-alpha.24

Release 0.145.0-alpha.24

中文介绍 OpenAI旗下Codex项目发布了Rust版本v0.145.0-alpha.24更新。此版本为内部测试版,具体改进细节未在发布说明中披露。

0.144.6

Bug Fixes Refreshed bundled instructions for GPT-5.6 Sol, Terra, and Luna, and corrected their context windows to 272,000 tokens. (#33972, #34009) Changelog Full Changelog: rust-v0.144.5...rust-v0.144.6 #33972 Backport refreshed bundled model metadata to 0.144 @sayan-oai #34009 Narrow 0.144 hotfix t

中文介绍 OpenAI Codex发布了0.144.6版本,主要内容是修复了多项错误。此版本更新了GPT-5.6 Sol、Terra和Luna模型的捆绑指令,并将其上下文窗口修正为272,000个token。

0.145.0-alpha.23

Release 0.145.0-alpha.23

中文介绍 OpenAI Codex发布了0.145.0-alpha.23版本。此版本为内部测试版本,具体更新细节未对外公布。

今日主题

今日AI焦点集中于AI Agent生态的深化与挑战:从头部模型更新、多模态智能体开发平台,到数据安全漏洞警示,再到司法和编码等领域的实证应用,AI Agent技术正加速落地,同时其安全与架构优化也成为业界关注的焦点。

01

模型发布/更新

Model Releases 33 篇

OpenAI Codex发布新版,增强分页历史与数据迁移

官方OpenAI Codex Releases

OpenAI Codex发布0.145.0版本,引入实验性分页线程历史功能,支持高效恢复、搜索、持久化名称、子代理及记忆功能。同时,该版本扩展了导入功能,用户可迁移Cursor和Claude Code的设置、MCP服务器、插件、会话和命令。此次更新显著提升了用户数据管理和跨平台兼容性,旨在为开发者提供更强大、灵活的编码辅助体验。

OpenAI Codex功能增强版本更新

Claude Code v2.1.216更新:优化性能并增强沙盒控制

官方Claude Code Releases

Claude Code发布了v2.1.216版本,主要更新包括引入了“sandbox.filesystem.disabled”设置,允许在保持网络出口控制的前提下跳过文件系统隔离。此外,新版本还修复了长时间会话中的性能下降问题,解决了消息标准化成本随轮次二次增长导致多秒卡顿和恢复缓慢的现象。这些改进旨在提升模型运行效率和用户体验,尤其对开发者在沙盒环境中的灵活配置提供了更大支持。

Claude Code版本更新性能优化

jina-reranker-v3.5模型发布,高效重排序提升检索性能

官方HuggingFace Trending Papers

Hugging Face上发布了jina-reranker-v3.5,这是一个拥有0.6B参数的高效列表式重排序器。该模型结合了混合注意力机制和自蒸馏技术,旨在满足生产环境中对智能体检索流水线在效率、领域鲁棒性以及半结构化数据处理流畅性方面的严苛要求。其核心目标是提升检索结果的精确性和相关性,尤其适用于需要处理大量信息并快速给出高质量排序的应用场景。

检索模型效率优化大模型
02

产品发布/更新

Product 33 篇

OmniRoute推出免费AI网关,简化多模型集成与成本

开源项目GitHub Trending

OmniRoute发布了一个免费的AI网关,通过单一API端点集成了超过231个AI提供商(其中50余个免费),旨在解决多模型调用的复杂性。它支持将主流编码助手(如Claude Code、Copilot)连接至免费的大语言模型(如Claude、GPT、Gemini),大幅降低开发成本。此外,项目采用RTK+Caveman堆叠压缩技术,可节省15-95%的数据传输开销,为开发者提供统一、高效且经济的AI服务管理方案。

AI网关LLM开发者工具

Unicity Labs发布模块化Agent操作系统,增强AI Agent安全可控性

X·KOLX 推文 (AttentionVC)

Unicity Labs介绍了其模块化Agent操作系统Unicity AOS,该系统核心是基于Rust的微内核。Unicity AOS旨在在Agent代码层之下强制执行安全、成本和审批控制,并将每项操作签署到防篡改的审计链中。此举确保了AI Agent行为的可控性与透明度,为开发者提供了更安全、更可靠的智能体部署环境,尤其适合需要严格监管和审计的AI应用场景。

产品发布Agent操作系统

Jack Dorsey推出Buzz平台,集成AI Agent挑战Slack

综合资讯TechCrunch

Jack Dorsey推出了名为「Buzz」的团队群聊平台,旨在与Slack竞争。该平台的核心亮点在于,它允许人类用户与他们的AI代理在同一对话中进行协作,共同完成任务。Buzz专注于提升工作场所的沟通效率和智能化水平,通过将AI Agent深度融入团队协作流程,力图重新定义企业沟通工具,以适应AI时代下对智能辅助和自动化日益增长的需求。

Jack Dorsey团队协作AI应用
03

行业动态

Industry 33 篇

OpenAI承认内部模型导致Hugging Face数据泄露

综合资讯TechCrunch

OpenAI已承认对Hugging Face平台发生的数据泄露事件负责。该公司表示,此次泄露是由于其内部测试预发布模型时,意外配置错误所致。这一事件凸显了AI模型开发与部署过程中数据安全的复杂性和挑战性,即便对于顶级AI公司也可能发生。此消息引发了业界对AI系统测试、部署安全协议以及跨平台数据保护措施的关注。

OpenAI数据泄露AI模型

AI系统助巴基斯坦法官清积压案件,实现38.5倍投资回报

研究聚合The Decoder

一项针对1,559名巴基斯坦法官的实地实验显示,AI助理「JudgeGPT」的应用使案件解决率提高了6.3%,为缓解司法系统积压问题带来了显著成效。研究人员估算,每投资1美元,即可带来高达38.50美元的回报。然而,研究也指出,只有接受过实践培训的法官才看到了成效,未培训者效果甚微,强调了AI工具在应用中结合人员培训的重要性。

AI应用司法系统效率提升

报告预测数据中心电力消耗将剧增四倍,挑战AI基础设施

综合资讯TechCrunch

根据最新预测,到2035年,全球数据中心的电力消耗将增长四倍。据估算,到2033年新建的数据中心所消耗的电量,可能将相当于目前整个印度国家的用电总量。这一惊人的增长主要受AI大模型训练和推理需求的驱动,对能源基础设施和环境保护提出了严峻挑战。业界需加速开发更高效的AI硬件和可持续的能源解决方案,以应对未来的电力需求压力。

数据中心能源消耗预测
04

技巧与观点

Tips & Takes 33 篇

开源书籍《深入理解AI Agent》发布,深度解析设计与实践

开源项目GitHub Trending

李博杰所著《深入理解 AI Agent:设计原理与工程实践》的开源主仓库已上线,提供了全书的完整正文、可编译的PDF版本以及与各章节配套的代码示例。该项目旨在为读者提供全面的学习资源,深入探讨AI Agent的设计原理、架构模式及实际工程应用。对于开发者、研究人员或对AI Agent领域感兴趣的学习者,本书通过理论与实践结合,是掌握构建和部署智能Agent核心知识与技能的重要指南。

AI Agent技术书籍代码实践

利用Claude进行图工程:构建复杂AI Agent工作流教程

X·KOLX 推文 (AttentionVC)

一位博主分享了利用Claude进行「图工程」的14步路线图,旨在解决构建多步骤Agent时常见的线性执行问题。许多开发者在设计Agent时常陷入简单串联模式,而此教程将展示如何从零开始,通过图工程方法构建更复杂、非线性的AI Agent工作流。该教程为开发者提供了实用的指导,帮助他们设计出更高效、更具鲁棒性的智能Agent。

AI Agent教程图工程

研究揭示自托管AI Agent面临的“自状态攻击”风险

官方HuggingFace Trending Papers

一篇论文探讨了针对自托管AI智能体的“自状态攻击”风险。研究指出,攻击者可利用合法操作系统调用,通过智能体读取和写入自身内存及配置文件的机制,破坏其内部状态,从而实现攻击。这项研究旨在评估操作系统防御措施在抵御此类威胁方面的有效性与局限性,为确保AI Agent安全部署和运行提供了重要的安全洞察,并提醒开发者关注潜在的内部状态漏洞。

AI安全智能体操作系统
今日产品趋势

今日AI产品焦点集中在「AI Agent」的加速发展与多元化应用。从快速构建语音AI智能体的开发平台,到深入理解视频内容的智能代理,再到负责电商结账的自动化智能体,AI正向更垂直、更具自主性的方向演进。同时,围绕AI Agent的开发者工具也日益成熟,旨在提升AI代码质量、提供安全沙盒与本地化知识检索能力,共同推动智能代理生态的繁荣与落地。

01

今日必看

Must See 33 款

Bolna Agent Studio — 语音AI智能体快速构建平台

产品榜单Product Hunt

Bolna Agent Studio 是一个创新平台,使用户能够在短短 10 分钟内快速构建语音 AI 智能体。该工具旨在大幅简化语音 AI 应用的开发流程,通过直观的界面和预设模块,让非专业开发者也能轻松创建可进行自然对话的智能体。它降低了语音AI的开发门槛,赋能企业和个人快速部署客户服务、销售助手或个性化语音交互系统,加速语音AI技术的普及。

语音AIAI智能体开发者工具

Jockey by TwelveLabs — 视频AI智能体,理解整个视频库

产品榜单Product Hunt

Jockey 是 TwelveLabs 推出的一款创新的视频 AI 智能体,它能够深度理解并分析用户整个视频库的内容。利用先进的视频理解AI技术,Jockey 可以识别视频中的对象、场景、动作和对话,从而实现智能搜索、自动分类、摘要生成以及内容洞察。该工具旨在彻底改变视频内容的搜索、管理和利用效率,对于媒体专业人士、内容创作者和视频档案管理者具有巨大价值。

视频AIAI智能体内容理解

Skim — 免费开源的AI邮件客户端

产品榜单Product Hunt

Skim 是一款专为 Windows 系统设计的免费开源 AI 邮件客户端。它利用人工智能技术,帮助用户更高效地管理和处理电子邮件,例如智能分类、摘要生成或回复建议,从而显著提升沟通效率。作为一款开源产品,它为用户提供了隐私和定制化的优势,对于寻求AI赋能、注重数据主权以及追求邮件处理效率的个人用户和小型团队具有吸引力。

邮件客户端AI工具开源
02

开发者工具

Dev Tools 55 款

Diffsmith — AI智能体代码审查协作工作室

产品榜单Product Hunt

Diffsmith 是一款专门为 AI 智能体生成的代码设计的代码审查协作工作室。它允许开发者和团队成员对 AI 代理输出的代码进行详细评论、提出修改建议,并实现高效的迭代协作。该工具解决了AI代码生成后的人工审查和质量控制痛点,确保AI模型的代码符合项目规范和高标准。Diffsmith 对于需要将AI代码集成到生产环境的开发团队至关重要,提升了AI辅助开发的可靠性。

代码审查AI工具协作

CreateOS Sandbox — AI智能体硬件隔离沙盒环境

产品榜单Product Hunt

CreateOS Sandbox 旨在为 AI 智能体提供即时且硬件隔离的沙盒环境。这对于开发者安全地测试、部署和运行 AI 模型至关重要,尤其是在处理敏感数据或需要验证模型行为时。沙盒环境确保了AI智能体运行的独立性、安全性和稳定性,防止潜在的冲突或系统级影响。它是AI Agent开发和运维的基础设施,保障了AI应用的可靠性与安全性。

AI开发沙盒基础设施

Code Review Graph — AI编码工具本地代码智能图谱

开源项目GitHub Trending

Code Review Graph是一个本地优先的代码智能图谱工具,专为MCP(多组件项目)和CLI环境设计。它构建了一个持久化的代码库映射,旨在优化AI编码工具的上下文理解,确保AI在代码审查和处理大型仓库时仅读取关键信息。通过大幅减少AI上下文长度,它提升了代码理解效率和审查质量,使AI编码助手能更精准地提供建议。

代码审查AI工具开发者工具

wigolo — AI编程助手本地优先信息检索平台

开源项目GitHub Trending

wigolo 为 AI 编程助手提供一个本地优先的信息检索与研究平台。它允许 AI 代理在无需 API 密钥、不依赖云服务且零成本的情况下,对本地代码项目 (MCP) 进行搜索、抓取和研究。这为开发者提供了一个私密、高效且完全离线的环境,用于增强 AI 编码助手的知识库,同时保护代码隐私并大幅降低运行成本。它代表了本地AI应用的重要方向。

AI编程本地优先开发者工具

llmfit — LLM硬件兼容性检测工具

开源项目GitHub Trending

`llmfit` 提供了一个便捷的解决方案,旨在帮助用户快速识别哪些大型语言模型(LLM)及其提供商能够在其现有硬件环境下高效运行。该项目整合了数百种模型和供应商信息,用户只需执行一个命令,即可轻松评估本地设备的兼容性。它极大地简化了LLM的选型与部署前测试流程,适用于LLM开发者、研究员或个人用户,尤其在本地推理需求日益增长的背景下。

LLM硬件兼容开发者工具
03

创作与效率

Creative & Productivity 44 款

worldmonitor — AI驱动的实时全球情报仪表板

开源项目GitHub Trending

`worldmonitor` 是一个实时全球情报仪表板,利用AI技术聚合新闻、监测地缘政治事件及关键基础设施动态。它提供统一的态势感知界面,旨在帮助分析师、研究人员或企业迅速掌握全球宏观环境变化,提升决策效率。适用于需要持续追踪国际局势和重大事件的专业人士,通过AI赋能实现快速信息洞察和风险预警。

全球情报AI态势感知

open-seo — 开源AI驱动的搜索引擎优化工具

开源项目GitHub Trending

`open-seo` 旨在成为 Semrush 和 Ahrefs 等商业 SEO 工具的开源替代品,并可能集成AI能力。它提供了一套免费且透明的解决方案,帮助网站管理员、营销人员和内容创作者进行关键词研究、竞争对手分析、网站审计及排名跟踪,从而优化搜索引擎表现。对于预算有限但又需要强大 SEO 功能的用户来说,`open-seo` 提供了一个极具吸引力的开源选择,助力网站提升自然搜索流量。

SEO开源营销工具

tradingview-mcp — AI辅助TradingView图表分析工具

开源项目GitHub Trending

`tradingview-mcp` 项目旨在通过AI技术增强TradingView的图表分析能力。它允许用户将Claude Code AI模型集成到TradingView桌面版,从而实现个性化的交易工作流自动化。交易员和投资者可以利用此工具,自动执行市场数据分析、识别潜在交易模式或验证策略,显著提升分析效率和交易决策的响应速度。这是一个面向金融领域的AI效率增强工具。

AI交易自动化金融科技

Routine AI — 工作场景语音控制AI助手

产品榜单Product Hunt

Routine AI 是一款面向工作场景的语音控制工具,旨在通过自然语言语音指令帮助用户管理日常工作。它被定位为「工作版 Siri」,能够执行任务安排、信息检索、日程管理等多种功能,从而提升日常工作效率。该产品通过智能语音交互,解放了用户的双手,简化了复杂的办公操作,适用于追求高效、无缝工作流程的各类专业人士。

语音助手AI工具效率工具
04

新鲜实验

Emerging 22 款

Ontology-Playground — 本体论学习与设计Web应用

开源项目GitHub Trending

Ontology-Playground 是微软推出的一款免费开源 Web 应用,专为学习本体论(ontologies)和 Microsoft Fabric IQ 设计。它提供了一个互动平台,用户可以探索预构建的本体目录,通过直观的图形界面设计自己的本体结构,并将其导出为标准的 RDF/XML 格式。该工具旨在降低本体论的学习门槛,并为数据架构师、知识工程师及对语义数据建模和知识图谱感兴趣的开发者提供一个实用的设计与可视化环境。

本体论知识图谱数据建模

CartAI — 负责结账流程的AI智能体

产品榜单Product Hunt

CartAI 是一款专为处理电子商务结账流程设计的 AI 智能体。它旨在自动化和优化在线购物的结账环节,从商品选择到支付完成,全程提供智能辅助或自主操作。通过减少摩擦、简化步骤,CartAI 有潜力提升用户购物体验,降低购物车弃购率,并为商家提供更流畅的交易流程。它代表了AI在电商领域深度自动化应用的尝试,可能改变未来的购物方式。

AI智能体电子商务自动化
→ 查看产品库