Latent Space · 08/05 02:20
一份外部报告重构并分析了ChatGPT Work中「记忆」、「主动性」、「调度」、浏览器使用、插件、技能和工具等核心运作方式,揭示其作为通用Agent的潜在能力与设计理念。
推荐理由:报告深入剖析了ChatGPT Work的复杂架构,对于理解和设计大型AI Agent系统具有极高的参考价值和启发意义。
Latent Space · 08/05 02:20
一份外部报告重构并分析了ChatGPT Work中「记忆」、「主动性」、「调度」、浏览器使用、插件、技能和工具等核心运作方式,揭示其作为通用Agent的潜在能力与设计理念。
推荐理由:报告深入剖析了ChatGPT Work的复杂架构,对于理解和设计大型AI Agent系统具有极高的参考价值和启发意义。
Claude (YouTube) · 08/04 23:55
Claude官方视频详细介绍了其大模型在处理代码任务时“自动模式”的工作原理,演示了如何通过自动化流程辅助用户进行代码生成、调试和优化,提升编程效率。
推荐理由:官方教程直接展示了Claude在代码领域的强大功能,对于开发者深入了解和利用Claude进行编程有重要指导意义。
TechCrunch · 08/05 04:36
SpaceX上市后首份季度财报显示,营收同比翻番,主要得益于与AI公司Anthropic和Google达成的计算服务协议,以及Starlink业务的持续增长,凸显其在商业航天和AI基础设施领域的双重影响力。
推荐理由:SpaceX的营收增长表明其在商业航天和AI算力服务领域的强大实力,反映了科技巨头间日益紧密的合作趋势。
GitHub Trending
TencentDB Agent Memory为AI Agents提供本地化长效记忆解决方案。它采用四层渐进式管道设计,无需外部API依赖,解决AI Agent对长期记忆的依赖,提升数据隐私和系统性能。
推荐理由:该项目提供了一个实用的本地化AI Agent记忆解决方案,对于构建独立、高性能AI Agent的开发者具有高参考价值和可行动性。
Hacker News · 08/05 02:36
EdotEnv推出自改进型强化学习环境,模拟量化交易工作流,旨在为LLMs提供教学与研究平台,解决现有评估工具饱和问题,促进LLM在复杂决策任务中的研究进展。
推荐理由:该平台为LLM在金融量化交易领域的应用及研究提供了创新环境,对于希望探索LLM实际决策能力的开发者和研究者具有启发意义。
The Verge · 08/05 04:57
AMD最新财报显示,在人工智能需求推动下,其数据中心业务营收同比翻番,增长107%至67亿美元。游戏业务退居次席,凸显AI算力市场蓬勃发展。
推荐理由:AMD财报揭示了AI算力需求的爆发式增长,反映了AI对芯片产业的深远影响,对于关注科技行业投资和趋势的人士具有参考价值。
Ars Technica · 08/05 04:34
德州暂停数据中心接入电网申请,以应对AI驱动下大量数据中心对能源造成的超负荷压力。此举揭示了AI发展对电力基础设施的巨大挑战,曾将德州誉为AI“中心”的州长面临现实问题。
推荐理由:这一事件凸显了AI产业在电力基础设施方面的巨大挑战,为AI大规模部署的可持续性敲响警钟,值得政策制定者和行业关注。
The Decoder · 08/05 00:38
谷歌正与博通等合作方建立数十亿美元融资结构,为Anthropic提供AI芯片和数据中心,同时将大部分相关风险从谷歌自身资产负债表中转移,此举旨在优化财务结构并支持AI发展。
推荐理由:谷歌此举反映了AI芯片投资的巨大规模和风险,以及科技巨头通过金融手段优化资产负债表的策略,值得商业和金融界关注。
Product Hunt · 08/05 04:59
「Hey Noah」是一款主动式AI行政助理,专为创业创始人设计,通过自动化管理、日程安排和关键信息提醒等功能,帮助创始人高效处理行政事务,专注于核心业务发展。
推荐理由:这款AI助理产品直击创业者痛点,通过自动化提升效率,对于寻求效率工具的创业人士或AI应用开发者具有参考价值。
X 推文 (AttentionVC) · 08/04 03:03
推文深入探讨在AI时代,「品味」(识别卓越)与「判断力」(在风险下承诺)作为人类核心特质的重要性,暗示这些是AI难以完全取代的价值基石,对思考人机协作有启发。
推荐理由:这篇推文从哲学层面探讨了AI时代人类特质的价值,为我们思考AI如何增强而非取代人类能力提供了独特视角。
HuggingFace Trending Papers · 08/03 08:00
论文探讨了如何仅从运行轨迹中实时检测并修复LLM智能体的循环、工具错误等常见故障,旨在开发更具成本效益的修复方法,避免昂贵第二个LLM的逐步判断。
推荐理由:该研究提供了LLM Agent故障检测与修复的新思路,对于提高Agent鲁棒性和降低运营成本具有重要理论和实践价值。
Driven by demand for AI capacity, AMD's data center revenue more than doubled year-over-year in its latest earnings report, reaching $6.7 billion. That's up from $5.8 billion in Q1, and jumping 107 percent from the $3.2 billion it reported for the same period a year ago. At the same time, AMD's gami
中文介绍 AMD最新财报显示,在人工智能需求推动下,其数据中心业务营收同比翻番,增长107%至67亿美元。这相比去年同期32亿美元和上一季度58亿美元均大幅提升,而游戏业务则相对退居次席。
SpaceX's AI revenue grew more than three times to $2.6 billion from the year before, mostly because of deals that the company made to provide compute to other AI companies, according to SpaceX's quarterly earnings. The AI division, which the company said in its documents to go public was the source
中文介绍 SpaceX最新季度财报显示,其人工智能业务营收同比增长逾三倍,达到26亿美元,主要得益于公司向其他人工智能企业提供算力服务所达成的交易。
SpaceX doubled its revenue compared to last year, according to its first quarterly earnings since going public in June.
中文介绍 SpaceX在6月上市后的首份季度财报显示,公司营收同比增长一倍,主要得益于与Anthropic和Google达成的计算服务协议,以及Starlink业务的增长。
Governor who touted Texas as AI “epicenter” pauses data center grid connections.
中文介绍 曾将德州誉为人工智能“中心”的州长,现已暂停数据中心接入电网的申请。此举旨在应对对电力需求的巨大压力,因为大量数据中心对能源造成了超负荷的负担。
New findings by the Electronic Frontier Foundation aim to warn app developers that some of the third-party code they place in their apps may also collect their users' location data when they grant permission to the app.
中文介绍 电子前沿基金会(EFF)的最新研究发现,Android应用开发者可能在不知情的情况下,通过应用内嵌入的第三方代码,将用户的地理位置数据分享给广告商,即便用户已授予应用相关权限。
Electronic Arts has officially become a private company. Last September, EA announced that an investor group led by Saudi Arabia's Public Investment Fund (PIF), Silver Lake, and Affinity Partners would be taking the company private in a $55 billion deal, and on Tuesday, EA said the deal successfully
中文介绍 电子艺界(EA)已正式完成私有化。由沙特公共投资基金(PIF)、银湖资本和Affinity Partners组成的投资者财团,去年9月宣布以550亿美元的交易额收购EA,并于本周二确认交易已完成。
A new SaferAI report finds Z.ai's open-weight GLM-5.2 approaches frontier AI capabilities while lacking key safety mitigations, renewing concerns that powerful open models could outpace governance and safeguards.
中文介绍 SaferAI的一份新报告指出,Z.ai的开源大模型GLM-5.2已接近前沿AI能力,但缺乏关键安全缓解措施。这重新引发了人们对强大开源模型可能超越现有治理和安全保障的担忧。
Anthropic has been on a cloud partnership spree in recent months, and its latest move is reportedly a $10 billion deal with AI cloud startup Volta.
中文介绍 Anthropic公司近期持续推进云合作,最新消息称其已与人工智能云初创公司Volta签署了一项高达100亿美元的协议。
Wrinkles, available on both iOS and Android, essentially acts as an AI-powered audio tour guide that reveals hidden history and local stories.
中文介绍 新应用「Wrinkles」已上线iOS和Android平台,它是一款由AI驱动的音频导游,能揭示用户周边地点的隐藏历史和当地故事。
The week-old Open Secure AI Alliance, spearheaded by Nvidia and grown to over 120 companies, already has proposals out for defending against AI agents.
中文介绍 由英伟达牵头、拥有逾120家公司的「开放安全人工智能联盟」成立仅一周,便已提出防御AI智能体的提案,展现出迅速的进展。
Telegram CEO Pavel Durov blames an extortionist for planting child sexual abuse material (CSAM) in a public chat to get the app temporarily removed from Apple's App Store on Monday night. "Apple removed Telegram from the App Store before contacting us," Durov says in a post on X. "This creates a pot
中文介绍 Telegram首席执行官Pavel Durov表示,一名勒索者在公开聊天中植入了儿童性虐待材料(CSAM),导致苹果公司周一晚在未事先联系的情况下,将Telegram从App Store暂时下架。
An external reconstruction of how Memory, Proactivity, Scheduling, Browser Use, Plugins, Skills and Tools work in the new ChatGPT Work.
中文介绍 一份外部报告重构并分析了ChatGPT Work中「记忆(Memory)」、「主动性(Proactivity)」、「调度(Scheduling)」、浏览器使用、插件、技能和工具的运作方式。
The brand trip is a right of passage for influencers. It's a mark of legitimacy that a sponsor wants to invite them on an all-expenses-paid vacation, often with luxurious freebies and activities. Trips can also spur hard feelings from uninvited influencers, trigger criticism from the public, and pro
中文介绍 OpenAI近期组织了一次网红品牌之旅,但此次营销活动适得其反,引发了未受邀网红的不满,并招致了批评,凸显了人工智能营销的复杂性。
Lenovo’s Legion Go S with SteamOS. | Photo by Sean Hollister / The Verge Memory and storage prices will be inflated for the foreseeable future, so we’re always happy to find a good deal on capable gaming hardware, like this discount on the Lenovo Legion Go S with a Z2 Go processor and SteamOS. Norma
中文介绍 联想(Lenovo)搭载SteamOS和Z2 Go处理器的Legion Go S掌机目前售价跌至历史最低点。鉴于未来内存和存储价格可能上涨,此次折扣为游戏硬件市场提供了良好购买机会。
Tesla's Shanghai factory is busier than ever but might be cut loose.
中文介绍 尽管特斯拉上海工厂目前异常繁忙,为公司带来巨额利润,但报道质疑中国市场作为特斯拉「摇钱树」的地位能维持多久,并暗示该工厂未来可能面临调整。
TypeScript · ★ 13,403 · 🍴 1,264 · 📈 1,138 stars today
TencentDB Agent Memory is a team-level memory hub for AI Agents — turning conversations, docs, and code into four reusable memory assets (Chat Memory, Skill, LLM-Wiki, Code-Graph) that are governed, shared, and equipped across agents and frameworks.
中文介绍 TencentDB Agent Memory 为 AI Agents 提供本地化的长效记忆解决方案。它采用四层渐进式管道设计,旨在实现无需外部 API 依赖的完全本地化记忆存储与检索,解决了 AI Agent 在需要长期记忆和上下文感知时对外部服务的依赖问题。该项目通过内建机制管理记忆,增强了数据隐私性和系统性能。适用于需要为 AI Agent 构建稳定、独立且具备丰富记忆能力的开发者,例如开发智能客服、个人助理或具备学习能力的自动化系统。
PowerShell · ★ 17,734 · 🍴 2,440 · 📈 2,310 stars today
Reverse Engineering / Authorized Penetration Testing / Security Research Skill Router Pack AI-powered routing + On-demand toolchain bootstrapping + Self-evolving knowledge base Supports Claude Code, Kiro, Cursor, Cline, and other AI coding clients 逆向/渗透/安全技能路由包 - AI 自动路由 + 按需自举工具链 + 自动进化经验库 | 支持 Cla
中文介绍 reverse-skill 是一个面向逆向工程、授权渗透测试和安全研究的智能技能路由包。它利用 AI 实现工具和知识的智能路由,并支持按需启动工具链,结合自进化的知识库,大大简化了安全分析流程。该项目旨在提升安全专家在漏洞挖掘、恶意软件分析等场景下的效率,并支持集成 Claude Code 等高级 AI 辅助能力。
Rust · ★ 9,844 · 🍴 648 · 📈 2,524 stars today
Fast Rust library for PDF inspection, classification, and text extraction. Intelligently detects scanned vs text-based PDFs to enable smart routing decisions.
中文介绍 firecrawl/pdf-inspector 是一个高性能的 Rust 库,专为 PDF 文件提供快速检查、分类及文本提取功能。它能智能区分扫描版与文本版 PDF,支持开发者基于内容类型做出智能路由决策,例如决定是否进行 OCR 识别。对于需要自动化处理海量 PDF 文档、实现高效数据提取或构建智能文档工作流的后端服务和应用程序非常有用。
Python · ★ 640 · 🍴 66 · 📈 140 stars today
ADR secures enterprise AI agents through observability, security benchmarking, and threat detection. Deployed at Uber.
中文介绍 Uber 的 ADR 项目致力于保障企业级 AI agent 的安全性。它通过提供可观测性、进行安全基准测试以及实施威胁检测等功能,确保部署在生产环境中的 AI 系统免受潜在攻击和漏洞的侵害。该工具旨在解决企业在应用 AI 技术时面临的安全挑战,尤其适用于那些对数据安全和系统稳定性有高要求的组织,由 Uber 内部实践验证并对外开源,帮助开发者构建更安全的 AI 应用。
Shell · ★ 266,392 · 🍴 23,819 · 📈 617 stars today
An agentic skills framework & software development methodology that works.
中文介绍 obra/superpowers 提供一个结合了智能 Agent 能力框架与软件开发方法的项目,旨在有效构建和部署基于 AI Agent 的复杂系统。它定义了一套结构化的方法论,用于组织、管理和编排 Agent 的“技能”,使其能够协同完成复杂的任务。该项目解决了在 Agent 驱动型软件开发中,如何系统化地设计、实现和测试 Agent 能力的问题,帮助开发者和团队更高效地将 AI Agent 集成到实际应用中,从而加速智能系统的迭代与交付。
Jupyter Notebook · ★ 116,207 · 🍴 61,543 · 📈 784 stars today
21 Lessons, Get Started Building with Generative AI
中文介绍 该项目是微软推出的一套生成式 AI 入门课程,包含 21 节课。它旨在帮助初学者快速掌握生成式 AI 的核心概念与开发实践,通过实际构建应用来学习相关技术。适合对生成式 AI 感兴趣的开发者、学生或研究人员,是系统学习 AI 应用开发的优秀起点。
TypeScript · ★ 50,756 · 🍴 3,627 · 📈 6 stars today
Fast, easy and reliable testing for anything that runs in a browser.
中文介绍 `cypress-io/cypress` 提供了一个快速、简单且可靠的端到端(E2E)测试框架,专为在浏览器中运行的现代 Web 应用程序设计。它解决了传统测试工具在测试执行速度、可靠性和开发体验上的痛点,允许开发者在实际浏览器环境中编写和运行测试,实时查看测试结果。前端开发人员和质量保证(QA)工程师可利用 Cypress 确保 Web 应用的用户界面和核心功能稳定无误,并轻松集成到持续集成/持续部署(CI/CD)流程中。
Jupyter Notebook · ★ 28,255 · 🍴 3,050 · 📈 1,716 stars today
AirLLM 70B inference with single 4GB GPU
中文介绍 AirLLM 致力于解决大型语言模型 (LLM) 推理的硬件限制问题,使得 700 亿参数级别的模型能够在仅有 4GB 显存的单张 GPU 上高效运行。它通过优化模型加载、量化和计算方法,显著降低了 LLM 推理的资源门槛。这对于在本地设备、低成本硬件或边缘设备上部署复杂 AI 应用的开发者和研究人员极为有用。
JavaScript · ★ 65,918 · 🍴 9,528 · 📈 8 stars today
A bundler for javascript and friends. Packs many modules into a few bundled assets. Code Splitting allows for loading parts of the application on demand. Through "loaders", modules can be CommonJs, AMD, ES6 modules, CSS, Images, JSON, Coffeescript, LESS, ... and your custom stuff.
中文介绍 webpack 是一个功能强大的 JavaScript 模块打包器,旨在解决现代前端应用中复杂模块依赖和性能优化的问题。它能将多个 JavaScript 模块及其关联资源(如 CSS、图片)打包成少量优化过的输出文件,显著提升网页加载效率。通过代码分割 (Code Splitting) 功能,应用程序的特定部分可以按需加载,进一步优化用户体验。利用 "loaders",webpack 支持处理 CommonJS、AMD 等多种模块规范,是前端项目构建流程中不可或缺的工具。
C++ · ★ 29,365 · 🍴 5,372 · 📈 9 stars today
Fast C++ logging library.
中文介绍 spdlog 是一个专为 C++ 应用程序设计的高性能日志库。它解决了在需要记录大量运行时信息时,传统日志系统可能带来的性能开销问题。spdlog 以其出色的速度和低延迟著称,支持异步日志、多种日志目标(如文件、控制台、网络)以及自定义格式化。对于开发高性能的 C++ 应用,如游戏引擎、实时系统或大型后端服务,spdlog 能够提供高效且可靠的日志记录能力,帮助开发者进行调试、监控和故障排查。
Rust · ★ 108,043 · 🍴 6,306 · 📈 27 stars today
A modern runtime for JavaScript and TypeScript.
中文介绍 Deno 是一个现代化的 JavaScript 和 TypeScript 运行时环境,由 Node.js 的创建者开发,旨在提供更安全、更现代的开发体验。它解决了 Node.js 时代的一些痛点,如默认的沙盒安全性、内置的 TypeScript 支持和对 Web 标准的广泛遵循。Deno 允许开发者无需额外的转换步骤即可直接运行 TypeScript 代码,并提供开箱即用的工具链。它适用于构建高性能的后端服务、命令行工具、Web API 以及各种服务器端应用,为开发者提供了更简洁高效的开发范式。
TypeScript · ★ 7,237 · 🍴 579 · 📈 565 stars today
🎯 All you need. Nothing you don't. Open source project management that works for you, not against you.
中文介绍 Kaneo 是一个开源的项目管理工具,其核心理念是提供必要功能,去除冗余复杂性,确保工具能够真正服务于用户,而非增加负担。它旨在优化团队协作效率,简化任务分配、进度跟踪和项目规划等管理环节。Kaneo 特别适合那些寻求轻量级、直观且高度可定制的项目管理解决方案的团队和个人,帮助他们在不被工具束缚的情况下高效推进项目。
Python · ★ 12,346 · 🍴 3,472 · 📈 432 stars today
A framework for building realtime voice AI agents 🤖🎙️📹
中文介绍 livekit/agents 是一个专注于构建实时语音 AI 代理的开发框架。它为开发者提供了一整套工具和抽象,以简化集成语音识别、自然语言处理和语音合成等关键技术,实现高效、低延迟的人机语音交互。该框架旨在赋能开发者快速创建客户服务机器人、虚拟助手、交互式教育应用或游戏 AI 等需要实时语音与视频(🎙️📹)能力的应用。
TypeScript · ★ 100,798 · 🍴 27,399 · 📈 8 stars today
Deliver web apps with confidence 🚀
中文介绍 Angular 是一个由 Google 维护的开源前端开发框架,旨在帮助开发者“自信地交付 Web 应用”。它提供了一套完整的工具和最佳实践,用于构建高性能、可扩展的单页应用 (SPA) 和复杂企业级应用。Angular 强调使用 TypeScript 进行开发,并基于组件化架构,提供强大的数据绑定、依赖注入和路由功能,极大地提高了代码的可维护性和可测试性。对于寻求结构化、规模化开发大型前端项目的团队而言,Angular 是一个成熟且全面的选择。
TypeScript · ★ 96,420 · 🍴 5,533 · 📈 30 stars today
A utility-first CSS framework for rapid UI development.
中文介绍 Tailwind CSS 是一个“工具优先”的 CSS 框架,专为快速 UI 开发而设计。它解决了传统 CSS 框架带来的样式重复和定制限制问题,通过提供大量低级别的功能类 (utility classes),让开发者直接在 HTML 中构建复杂的用户界面,无需编写自定义 CSS。这种方法极大提升了开发效率和设计灵活性,使得维护和修改样式变得更加直观。Tailwind CSS 特别适合那些需要高度定制化界面、追求开发速度和精细控制视觉表现的前端项目。
Python · ★ 19,226 · 🍴 2,401 · 📈 306 stars today
Edit videos with coding agents
中文介绍 `video-use` 是一个探索通过“编码代理”来编辑视频的创新项目。它旨在颠覆传统的图形界面视频编辑模式,允许用户通过编写代码或使用智能代理来自动化和执行复杂的视频剪辑、特效添加及内容生成等任务。该项目解决了传统视频编辑软件操作繁琐、难以批量处理的问题,为开发者、内容创作者和研究人员提供了一种全新的、更具编程性和自动化潜力的视频制作方式,尤其适合需要进行程序化视频生成、自动化后期处理或实验新颖交互模式的场景。
Go · ★ 30,728 · 🍴 1,980 · 📈 924 stars today
DeepSeek-native AI coding agent for your terminal. Engineered around prefix-cache stability — leave it running.
中文介绍 `esengine` 推出的 `DeepSeek-Reasonix` 是一个专为终端用户设计的 DeepSeek 原生 AI 编码代理。它旨在为开发者在命令行界面提供智能编程辅助,例如代码生成、补全或问题解答。该项目特别强调了其“前缀缓存稳定性”工程优化,确保代理可以长时间运行并保持高效,减少重复计算。这使得开发者能够无缝地在终端内获取 AI 协助,从而提升编码效率和开发体验。
TypeScript · ★ 23,840 · 🍴 1,955 · 📈 33 stars today
Official Compound Engineering plugin for Claude Code, Codex, Cursor, and more
中文介绍 EveryInc 的 `compound-engineering-plugin` 是一个官方开发的插件,旨在增强主流 AI 代码助手的功能。它解决了单一 AI 模型在复杂工程任务中可能存在的局限性,通过集成如 Claude Code、Codex 和 Cursor 等多种代码 AI 工具,为开发者提供更强大、更全面的代码生成、补全及重构能力。该插件特别适用于依赖 AI 辅助编程的工程师,希望利用不同 AI 的优势,提升编码效率、解决复杂技术挑战,并在开发过程中获得更智能、更集成的工程支持。
@fridayresearch_ · 1.9K 粉丝 · 1.6M 阅 · 597 赞 · 451 转
Your taste is scattered across forty companies that each own a piece and answer to advertisers. FRIDAY is building the version you own — a personal shopping intelligence that lives on your device and
中文介绍 FRIDAY 正构建一款设备端个人购物智能工具,旨在整合用户分散在四十家公司中的购物偏好数据,将其归还给用户。这款工具将帮助用户管理自有品味数据,摆脱广告商影响,实现更自主的购物体验。
@wayne_liang_ · 1.5K 粉丝 · 999.9K 阅 · 637 赞 · 279 转
For eight weeks, a clone of me ran our sales front line: 300+ prospect calls a week, 132 new paying customers, 37 enterprise opportunities worth ~$3M. It also made up a price, emailed internal notes
中文介绍 博主分享育儿假期间其AI销售代理的卓越表现。该代理8周内每周处理超300个客户电话,带来了132个新付费客户和37个价值约300万美元的企业商机,并能自动报价、发送内部邮件。帖子还提供了相关代码,展示了AI在销售自动化和营收增长方面的潜力。
@addyosmani · 407.9K 粉丝 · 363.3K 阅 · 510 赞 · 45 转
Taste is recognizing quality and greatness in the absence of all the evidence. Judgment is committing to it in the presence of some risk. It’s the ultimate foundation of great work. When you look at a
中文介绍 博主深入探讨了「品味」与「判断力」对伟大工作的重要性,尤其是在AI时代。他指出,品味是在缺乏证据时识别优质与卓越的能力,而判断力则是在面临风险时做出承诺的勇气。文章强调了这些人类核心特质,可能暗示它们是AI无法完全取代的价值基石。
@IBuzovskyi · 3.8K 粉丝 · 76.2K 阅 · 505 赞 · 34 转
Buzz launched July 21, 2026. Block open-sourced it under Apache-2.0. Desktop builds for macOS, Windows, and Linux shipped the same day. The pitch: Slack + GitHub + AI agents in one window. Built on
中文介绍 博主提供了由 Jack Dorsey 创立的 Buzz 平台的完整设置指南,并提及 HERMES AGENT。Buzz 已于2026年7月21日开源,并发布了 macOS、Windows、Linux 桌面版。该平台旨在整合 Slack、GitHub 与 AI 代理,打造一站式协作工具。帖子分享了其全面设置步骤。
@ashpreetbedi · 20.5K 粉丝 · 73.1K 阅 · 501 赞 · 50 转
Today I'm going to show you how to recursively improve your agents. We'll build an agent that starts at 7/10, then run a recursive auto-improvement loop until every probe passes. Here's how it works:
中文介绍 博主分享如何递归地提升AI代理性能的教程。他将演示如何构建一个初始表现为7/10的代理,并通过运行一个递归式的自动改进循环,使其持续优化,直至所有测试探针 (probe) 均顺利通过。这提供了一种实用的AI代理自我优化方法。
@MiniMax_AI · 107.4K 粉丝 · 42.3K 阅 · 696 赞 · 103 转
Today, we're launching MiniMax H3, a general-purpose multimodal generation model. H3 understands unified context across text, images, video, and audio, generating video with native stereo sound, up to
中文介绍 MiniMax 推出 H3 通用多模态生成模型,该模型能理解文本、图像、视频、音频的统一上下文,并能生成带有原生立体声音频的视频内容,旨在打破任务与模态之间的界限。
@AITECHio · 455.4K 粉丝 · 32.6K 阅 · 512 赞 · 110 转
ChatGPT Can Now Talk While Running Your Computer OpenAI has taken AI agents another step forward. You can now have a natural voice conversation with ChatGPT while it operates your computer in the
中文介绍 OpenAI 推出 ChatGPT 新功能,用户可与模型进行自然语音对话,同时让它操作电脑。这标志着 AI 智能体技术又向前迈进了一步,增强了人机交互的深度和广度,预示了更高级别自动化应用的可能。
@moonpay · 421.1K 粉丝 · 32.0K 阅 · 547 赞 · 62 转
MoonPay, the global financial technology company powering the movement of value across fiat and digital assets, has launched PayBox, the first payment vault built for AI that lets a person's AI agent
中文介绍 金融科技公司MoonPay推出PayBox,这是首个专为AI设计的支付保管库,旨在让用户的AI代理管理和执行支付,实现法币与数字资产的无缝价值转移,进一步推动AI在金融领域的应用。
@Hi_Mrinal · 22.2K 粉丝 · 20.2K 阅 · 528 赞 · 41 转
The best way to learn from AI is to really reverse the whole process like to use ai for deep understanding rather than just "getting the answer" revert the typical workflow, instead of asking the AI
中文介绍 博主Hi_Mrinal围绕「利用AI进行学习」这一主题展开分享。推文简要提及AI在学习过程中的应用潜力,可能涉及如何有效整合AI工具、提升学习效率或获取新知识的方法。具体内容预期会探讨AI作为辅助学习工具的各种可能性。
@ActionModelAI · 57.6K 粉丝 · 6.8K 阅 · 521 赞 · 390 转
It sounds like the plot of a dystopian film. But according to recently released court documents, internal company communications, and a reported $1.5 billion settlement, it's something that has
中文介绍 报告指出,Anthropic 被曝购买稀有书籍用于AI训练后销毁,这涉及内部文件和15亿美元的和解金。帖子揭示了AI公司数据获取方式引发的争议,探讨了版权、伦理及数据所有权问题。
@addyosmani · 407.9K 粉丝 · 363.3K 阅 · 7d 曝光 363.3K
Taste, Judgment and AI
中文介绍 博主深入探讨了「品味」与「判断力」对伟大工作的重要性,尤其是在AI时代。他指出,品味是在缺乏证据时识别优质与卓越的能力,而判断力则是在面临风险时做出承诺的勇气。文章强调了这些人类核心特质,可能暗示它们是AI无法完全取代的价值基石。
@wayne_liang_ · 1.5K 粉丝 · 999.9K 阅 · 7d 曝光 999.9K
I went on paternity leave. My agent built a $3M pipeline from 2,741 conversations. Here's the code.
中文介绍 博主分享育儿假期间其AI销售代理的卓越表现。该代理8周内每周处理超300个客户电话,带来了132个新付费客户和37个价值约300万美元的企业商机,并能自动报价、发送内部邮件。帖子还提供了相关代码,展示了AI在销售自动化和营收增长方面的潜力。
@ashpreetbedi · 20.5K 粉丝 · 73.1K 阅 · 7d 曝光 73.1K
How to Recursively Improve Your Agents
中文介绍 博主分享如何递归地提升AI代理性能的教程。他将演示如何构建一个初始表现为7/10的代理,并通过运行一个递归式的自动改进循环,使其持续优化,直至所有测试探针 (probe) 均顺利通过。这提供了一种实用的AI代理自我优化方法。
@IBuzovskyi · 3.8K 粉丝 · 76.2K 阅 · 7d 曝光 76.2K
HERMES AGENT + BUZZ BY JACK DORSEY. FULL SETUP GUIDE
中文介绍 博主提供了由 Jack Dorsey 创立的 Buzz 平台的完整设置指南,并提及 HERMES AGENT。Buzz 已于2026年7月21日开源,并发布了 macOS、Windows、Linux 桌面版。该平台旨在整合 Slack、GitHub 与 AI 代理,打造一站式协作工具。帖子分享了其全面设置步骤。
@Formulasearch · 8.2K 粉丝 · 529.3K 阅 · 7d 曝光 529.3K
零基础怎么做 FDE ?附能力路径&经验分享
中文介绍 博主针对零基础学习者,分享了成为 FDE(可能指 Feature Development Engineer 或 Frontend Development Engineer)的能力发展路径及个人经验。内容涵盖如何从头构建所需技能树,并提供了实用的学习策略和职场建议,旨在帮助初学者有效规划职业发展方向。
@lemire · 36.7K 粉丝 · 48.1K 阅 · 7d 曝光 48.1K
How fast is C++26’s std::hive?
中文介绍 博主lemire探讨了C++26新特性std::hive的性能表现。推文标题直接提出了「C++26的std::hive有多快?」这一问题,表明内容将针对这一标准库组件进行速度测试或性能分析,为开发者提供关于其效率的深入数据和见解。
@moonpay · 421.1K 粉丝 · 32.0K 阅 · 7d 曝光 32.0K
PayBox 101
中文介绍 金融科技公司MoonPay推出PayBox,这是首个专为AI设计的支付保管库,旨在让用户的AI代理管理和执行支付,实现法币与数字资产的无缝价值转移,进一步推动AI在金融领域的应用。
@Hi_Mrinal · 22.2K 粉丝 · 20.2K 阅 · 7d 曝光 20.2K
Using AI to learn
中文介绍 博主Hi_Mrinal围绕「利用AI进行学习」这一主题展开分享。推文简要提及AI在学习过程中的应用潜力,可能涉及如何有效整合AI工具、提升学习效率或获取新知识的方法。具体内容预期会探讨AI作为辅助学习工具的各种可能性。
@jinchenma_ai · 22.7K 粉丝 · 181.5K 阅 · 7d 曝光 181.5K
看完这篇文章,你就知道如何去掉那该死的AI味了
中文介绍 博主jinchenma_ai分享了如何消除AI生成内容中「AI味」的方法或技巧。该推文暗示其文章将提供具体策略,帮助用户使AI文本更自然、更具人性化。这篇分享旨在解决AI内容同质化、缺乏个性的痛点。
@BLKMDL3 · 93.4K 粉丝 · 108.0K 阅 · 7d 曝光 108.0K
FSD v14.3.7: My review
中文介绍 博主对特斯拉FSD (Full Self-Driving) 自动驾驶系统的最新版本v14.3.7进行了深度评测,分享了该版本在实际驾驶场景中的表现、功能改进及个人使用体验。
👍 30
Controllable video generation models are increasingly being developed as world models. Accordingly, evaluating them in this role extends beyond the apparent appearance of generated videos to the inherent reactivity of the worlds they depict: the ability to infer from the scene state how the world sh
中文介绍 论文提出「WorldExam」基准,用于评估可控视频生成模型作为世界模型的能力。该基准超越了传统对生成视频表观的评价,更侧重于衡量模型所描绘世界内在的反应性,即从场景状态进行推断的能力。这有助于更全面地理解和提升世界模型的性能。
👍 0
Language remains an outlier in generative modeling: while images, video, and audio are increasingly modeled in continuous latent spaces, text generation still relies predominantly on discrete tokens. Existing continuous language models either inherit embedding spaces not designed for joint generatio
中文介绍 鉴于语言模型在生成式建模中仍主要依赖离散 token,与其他模态的连续潜在空间建模不同,论文提出「AURORA-LM」模型。它通过自动编码统一表示,实现了连续潜在扩散语言建模,旨在弥合文本生成与其他多媒体生成在连续空间建模上的差距,以提升语言生成的效率和质量。
👍 1
Captions serve as a primary supervision signal for both multimodal understanding and text-to-image generation. However, previous evaluations treat the caption quality as a single scalar objective, which conflates two distinct properties: (1) how much visual information a caption covers and (2) how r
中文介绍 图像描述在多模态理解和文本到图像生成中至关重要。鉴于现有评估方法将描述质量视为单一标量目标,混淆了其在理解与生成中的不同属性,论文提出了「CAPEval」评估框架。该框架实现了描述质量的解耦评估,能够更细致地衡量描述在不同任务中的表现,提升评估的准确性。
👍 21
Optimization-based latent reasoning improves large language model outputs by optimizing instance-specific continuous states at test time while keeping model parameters frozen. Existing methods, however, typically connect these states to the reasoning trajectory through decoded tokens, making sequenc
中文介绍 优化驱动的潜在推理通过在测试时优化实例特定连续状态来改进大型语言模型(LLM)的输出。然而,现有方法在连接这些状态与推理轨迹上存在局限。论文提出了「GradCuit」方法,利用信用分配的梯度流,实现了鲁棒且可解释的测试时潜在推理,旨在提升LLM的推理能力和透明度。
👍 41
Sparse retrieval underpins modern search systems, from web search to retrieval-augmented generation. Existing work has introduced Learned Sparse Retrieval (LSR) to push beyond exact lexical matching toward richer semantics. Yet LSR has so far remained tied to encoder-style bidirectional architecture
中文介绍 稀疏检索是现代搜索系统(如网络搜索、检索增强生成)的基础。现有学习型稀疏检索(LSR)超越了精确词汇匹配,但仍受限于编码器。论文提出了「UEmbed」方法,旨在统一稀疏和稠密多模态嵌入,以克服现有LSR的局限性,实现更丰富语义的检索能力,提升多模态检索系统的性能。
👍 0
An isolated final user message is often treated as the query in evaluations of AI systems. In a conversation, however, the actionable request may be distributed across preceding turns. We directly test whether that omitted within-conversation context changes answers. For each of 180 English multi-tu
中文介绍 现有的AI系统评估通常仅将最终的用户消息视为查询,忽略了对话内部的上下文。论文直接测试了这种被忽略的对话上下文是否会改变AI的回答,指出可操作的请求可能分布在对话的多个轮次中。研究结果强调了在评估AI时考虑完整对话语境的重要性。
👍 22
Real-world software development requires coding agents to operate in shared workspaces where users may inspect and modify code during an ongoing task, yet existing repository-level benchmarks typically evaluate agents working alone or restrict user participation to messages. This leads us to ask: ho
中文介绍 真实软件开发中,编程智能体需在用户可检查和修改代码的共享工作区中运行。然而,现有基准通常只评估独立工作的智能体。论文提出了「SWE-Touch」基准,旨在评估当用户在进行任务时实际触碰和修改代码时,编程智能体的性能表现,更贴近实际协作场景。
👍 0
LLM agents fail mid-episode -- they loop, cascade tool errors, drift off goal, fabricate results, or silently absorb corrupted content -- and the standard remedy, judging every step with a second LLM, costs more than the agent itself. We ask how much detection is achievable from observable step tele
中文介绍 大语言模型(LLM)智能体在任务中常出现循环、工具错误、偏离目标等故障,而使用第二个LLM进行逐步判断的传统修复方法成本过高。论文探讨了仅从智能体运行轨迹中能实现多少故障检测,旨在开发一种更具成本效益的实时检测和修复LLM智能体故障的方法。
👍 0
Single-image feed-forward 3D Gaussian Splatting (3DGS) aims to directly generate a renderable 3D scene representation from one input image, avoiding the cost of multi-view capture and per-scene optimization. However, existing methods are often constrained by a pixel-aligned representation, where Gau
中文介绍 单图像前向3D高斯泼溅(3DGS)旨在从单张输入图像直接生成可渲染的3D场景表示。鉴于现有方法常受像素对齐表示的限制,论文提出了「InfiniSplat」,通过隐式高斯解码实现大基线单目视图合成。此方法克服了传统3DGS的局限,提升了单图像3D重建的效率和质量。
👍 9
To operate robustly in open-world environments, autonomous agents should be able to infer the behavior of unfamiliar systems through interaction alone, even in the absence of documentation. However, existing tool-use benchmarks expose semantic tool schemas in static environments, allowing agents to
中文介绍 为了让自主智能体能在开放世界中稳健运行,它们应仅通过交互推断陌生系统的行为。然而,现有工具使用基准在静态环境中暴露语义工具模式。论文提出了「ScrambleToolBench」基准,即便智能体的内部地图已指示下一步,它们仍需进行穷尽搜索,以此挑战智能体通过交互学习的能力。
👍 1
Geospatial foundation models aim to learn representations that transfer across regions and sensors, yet evaluating them on specific tasks requires large, high-quality, multi-modal benchmarks that measure how well such models extract value from data. Concerning flood mapping, existing datasets rarely
中文介绍 地理空间基础模型需要高质量、大规模的多模态基准进行评估。鉴于现有洪水测绘数据集的局限性,论文引入了「GEOID-Flood」,这是一个用于洪水分割的大规模多模态基准数据集。它提供了丰富的数据,旨在促进跨区域和传感器的数据提取模型开发,从而提升洪水监测和预警能力。
👍 27
Agent skills have become an important mechanism for equipping language-model agents with reusable procedural knowledge. However, providing skills alone does not guarantee that current models can effectively identify, apply, and coordinate them. To improve skill-use capabilities, we introduce SKT, a
中文介绍 智能体技能为语言模型智能体提供了可复用的过程知识,但模型难以有效识别、应用和协调这些技能。论文提出了「SKT」(大规模技能使用训练),通过可验证的合成数据生成来改进智能体的技能使用能力。此方法有望提升语言模型智能体在复杂任务中的自主决策和执行效率。
👍 0
Scientific poster construction compresses a long multimodal paper into a readable, editable canvas. Existing systems hide request-level failures by scoring only completed outputs; direct image generation is not element-editable, while coding-agent workflows are costly. PosterMELD is a template-condi
👍 116
Speech and audio generation is often needed in animation dubbing, audio drama, movies, advertising, games, podcasts, and short-video production. In these scenarios, creators may need to design voices without reference recordings, control speaker styles with natural language, support acoustic scenes
👍 16
Existing indoor layout generators produce globally plausible layouts yet may retain local violations such as collisions, out-of-bounds placements, obstructed openings, and blocked circulation. Most prior work focuses on full-scene synthesis or scene-level optimization, with limited support for ident
👍 124
Large language model (LLM) agents increasingly undertake long-horizon tasks that require sustained reasoning, tool use, and revision across many interdependent steps. However, existing agent harnesses maintain task execution, task state, and completion assessment within a growing context, making the
👍 0
Ship detection in Synthetic Aperture Radar (SAR) images plays an important role for maritime situational awareness, especially with respect to different illegal activities at sea such as illegal fishing, smuggling or border violations. Modern ship detection methods using neural networks usually requ
👍 12
Fixed-layout indoor furniture styling requires selecting assets that form a coherent room without changing the prescribed furniture categories, positions, orientations, or scales. Existing approaches typically retrieve each asset independently or rely on static local relations, making them prone to
👍 0
Vision-Language Models (VLMs) perform well on commonsense reasoning tasks but struggle with visual spatial reasoning. Most existing solutions introduce extra 3D prior inputs or external spatial encoders, which increase complexity and degrade the underlying VLMs' general-purpose capabilities after sp
👍 3
Enterprise question answering requires models to acquire proprietary knowledge without discarding general capabilities. We present Wnuan, a three-stage pipeline that constructs task-oriented supervision from documents, performs supervised fine-tuning with general-data replay, and applies reinforceme
👍 0
Large language model agents have shown strong potential in complex interactive tasks, yet their reinforcement learning (RL) is often hindered by sparse rewards, as a long multi-turn trajectory may receive only a single outcome-level signal. On-policy self-distillation (OPSD) provides dense token-lev
👍 15
Multimodal large language models (MLLMs) have advanced visual understanding and reasoning, yet their static parametric knowledge limits their ability to address knowledge-intensive and dynamically evolving open-world problems. To move beyond this limitation, multimodal deep search has emerged as a k
👍 0
Intelligent document processing (IDP) with vision-language models (VLMs) hinges on confidence scores trustworthy enough to route extractions between automation and human review. Existing document benchmarks are dominated by clean, high-quality samples, leaving low accuracy regions too sparse for cal
👍 28
Recent Vision-Language-Action (VLA) models for autonomous driving (AD) increasingly utilize chain-of-thought (CoT) supervision to enhance the reasoning capabilities of their Vision-Language Model (VLM) components, yet existing annotation pipelines commonly expose the teacher model to the logged grou
👍 54
On-policy (self) distillation (OPSD) is increasingly adopted for language-model post-training. It strengthens the teacher with privileged information but can induce a privilege illusion: the student learns privilege-dependent behavior it cannot reproduce from its inference-time context, yet behaves
👍 0
Recent reinforcement learning methods for diffusion large language models (dLLMs) commonly rely on on-policy rollouts generated by the target dLLM itself. When successful on-policy rollouts are scarce, however, on-policy training may receive little positive reward and make only limited progress. To
👍 1
A benchmark score means nothing without knowing what a trivial method achieves and what the best possible method could achieve. We construct both bounds for a task with a rare kind of ground truth: predicting which sentences a crowd of readers -- highlighting for their own purposes, unpaid, uninstru
👍 49
Existing skill generation methods largely rely on heuristics or pipeline-style consolidation, which must be specially designed for different evidence sources. In contrast, learning-based approaches offer a more unified way to model skill generation across heterogeneous sources. However, learning-bas
👍 3
DeepSeek Sparse Attention (DSA) enables efficient long-context modeling through its Lightning Indexer. However, practical deployment remains constrained by the indexer's expensive O(L^2) scoring overhead and the hardware-inefficient, discontinuous memory-access patterns induced by its outputs. To ad
👍 20
Video motion transfer aims to animate a target object using dynamics from a reference video. Existing formulations largely rely on fixed structural correspondence, which becomes ill-defined when reference and target objects differ substantially in morphology, articulation, or deformation mechanisms.
A proactive AI executive assistant for founders
中文介绍 「Hey Noah」是一款面向创业创始人的主动式人工智能行政助理。它旨在通过自动化管理、日程安排和关键信息提醒等功能,帮助创始人高效处理行政事务,从而节省时间并专注于核心业务发展。
Duolingo for learning anything
中文介绍 「Wondering」是一款学习工具,其设计理念是像多邻国(Duolingo)一样,支持用户学习任何主题的内容,提供互动式学习体验。
Open-source local voice assistant for your desktop
中文介绍 「SpeakoFlow」是一款开源的桌面本地语音助手。它允许用户在本地设备上使用语音控制功能,为桌面操作提供便捷的交互方式。
Visualize your revenue on a 3D globe
中文介绍 「Dashi Metrics」是一款数据可视化工具,能将用户的收入数据呈现在一个3D地球仪上。它通过直观的视觉方式,帮助企业更好地理解和分析其全球营收分布。
One memory for every AI you use
中文介绍 「Atlaso」旨在为用户使用的每一个AI工具提供统一的“记忆”功能。它致力于整合不同AI应用中的信息,创建连贯的用户体验,解决多AI协同的记忆碎片化问题。
The trusted AI investment agent, from insight to action
中文介绍 「Driven」是一款基于人工智能的投资代理,旨在为用户提供从市场洞察到实际操作的全方位投资服务。它利用AI分析数据,辅助用户做出投资决策并执行。
Build and customize your own calendar agent you can text
中文介绍 「Domo」是一个基于Claude模型构建的日历代理工具。它允许用户定制自己的日历助手,并通过文本消息与之互动,实现日程管理和提醒功能。
Send big files and get paid on download
中文介绍 「FileFlippers」是一个文件传输服务平台,用户可以通过该平台发送大文件,并有机会在文件被下载时获得报酬。它结合了文件分享与变现功能。
Hardware for AI coding
中文介绍 「Vibe Buddy」是一款专为AI编程设计的硬件产品。它旨在为开发者提供优化AI模型训练和开发过程的物理设备,以提升AI编程效率和性能。
Japanese for the life you're actually living in Japan
中文介绍 「Yokoso」是一款日语学习应用,其特色是教授在日本实际生活中使用的日语。它专注于日常对话和实用短语,帮助用户更好地融入日本当地生活。
中文介绍 YouTube博主Riley Brown发布了一期60分钟的视频教程,旨在帮助用户高效学习AI编程工具Cursor。该教程声称能将超过1000小时的学习内容浓缩呈现,覆盖从初学者到专业水平,使观看者能在短时间内全面掌握Cursor工具的使用技巧。
中文介绍 YouTube博主Riley Brown(通过Buzz AI)发布视频,探讨了人工智能模型Claude Code与Codex现已能够协同工作。该视频内容可能关注如何整合并利用这两种AI模型,以实现更强大的编程辅助功能或解决复杂的编码问题,标志着AI工具协作能力的新进展。
中文介绍 由Riley Brown制作发布的这份YouTube视频教程,旨在为初学者提供一份完整指南,详细讲解如何有效利用人工智能模型Claude来辅助和优化Excel电子表格的操作。该视频内容将聚焦于演示Claude在数据处理、分析等方面的实际应用技巧,帮助用户掌握将AI工具与Excel结合使用的基本方法。
中文介绍 YouTube 视频指出,「Opus 5」已推出,但新的 Claude 语音功能「Claude Voice」被认为是更重要的进展。视频强调,虽然「Opus 5」已发布,但这一全新的 Claude 语音技术被认为具有更大的影响力。
中文介绍 OpenAI 发布了其名为 Codex Voice 的新产品。该产品被描述为类似电影中「贾维斯」(Jarvis)的人工智能系统,暗示它可能具备先进的语音交互或智能助手功能,代表了AI在自然语言处理和人机互动方面的新进展。
中文介绍 这段由 Claude 官方发布的 YouTube 视频详细介绍了其大模型在处理代码任务时“自动模式”的工作原理。视频旨在演示 Claude 模型如何通过自动化流程,辅助用户进行代码生成、调试或优化,展示了该功能在实际编程场景中的应用方式与操作逻辑。
中文介绍 该YouTube视频的标题显示,内容主要展示了如何使用AI助手Claude来「记录一项技能」。这可能是一个教程或演示,旨在教授用户如何训练Claude执行特定任务,或展示Claude学习和掌握新能力的过程。鉴于信息有限,摘要重点关注其功能演示。
中文介绍 这段由 Claude 官方发布的 YouTube 视频详细介绍了其大模型在处理代码任务时“自动模式”的工作原理。视频旨在演示 Claude 模型如何通过自动化流程,辅助用户进行代码生成、调试或优化,展示了该功能在实际编程场景中的应用方式与操作逻辑。
中文介绍 该YouTube视频的标题显示,内容主要展示了如何使用AI助手Claude来「记录一项技能」。这可能是一个教程或演示,旨在教授用户如何训练Claude执行特定任务,或展示Claude学习和掌握新能力的过程。鉴于信息有限,摘要重点关注其功能演示。
中文介绍 由“Two Minute Papers”频道发布的视频标题《Another DeepSeek Moment Has Arrived》暗示,DeepSeek(很可能是一个AI模型或研究项目)取得了新的突破或发布了重要成果。该视频预计将分析和介绍DeepSeek所带来的最新技术进展。
中文介绍 英伟达(NVIDIA)的人工智能研究指出,仅模仿人类行为不足以实现某些高级AI目标。该研究可能探讨了AI在复杂任务中,需要超越简单模仿,发展更深层次的学习或决策机制。这揭示了AI发展中,对智能自主性的更高要求。
中文介绍 中文AI模型Kimi的K3版本据称「颠覆了AI经济学」。标题表明Kimi K3在人工智能领域可能带来了成本效益或性能上的重大突破,对AI行业的经济模式产生了显著影响。
8 回复 · 程序员 节点
21 回复 · 程序员 节点
11 回复 · 程序员 节点
17 回复 · Apple 节点
12 回复 · Apple 节点
15 回复 · Apple 节点
11 回复 · Linux 节点
21 回复 · Apple 节点
7 回复 · Apple 节点
17 回复 · Apple 节点
该源今日无内容。
20 points · 7 comments
286 points · 14 comments
We are Rui and Michael and we’re building EdotEnv (https://edotenv.com): self-improving RL environments from Quant Trading workflows.With all the benchmaxxing around, evals saturate and become meaningless for model comparison. Useful benchmarks should increase in difficulty as models advan
124 points · 117 comments
148 points · 66 comments
18 points · 2 comments
112 points · 99 comments
52 points · 27 comments
43 points · 10 comments
76 points · 50 comments
1 points · 0 comments
137 points · 42 comments
31 points · 14 comments
55 points · 58 comments
42 points · 11 comments
260 points · 199 comments
Hello HN!I found that picking out plausible but diverse skin tones for my digital art and game development projects was kind of difficult, and I got curious about if there was a way to define a color space that made it easy.I've built a color picker and procedural generation algorithm based on
27 points · 1 comments
193 points · 67 comments
501 points · 544 comments
118 points · 31 comments
89 points · 92 comments
208 points · 107 comments
338 points · 86 comments
109 points · 91 comments
274 points · 58 comments
321 points · 357 comments
8 points · 2 comments
100 points · 68 comments
14 points · 0 comments
What's changed [VSCode] Added Focus view: a chat-menu toggle that hides tool activity behind an expandable per-turn summary with a live running-tool indicator, toggled with Ctrl+Alt+F or the "Claude Code: Toggle Focus view" command Added mode: "mask" for sandbox credential files on Linux and WSL — s
What's changed Bug fixes and reliability improvements
中文介绍 Anthropic 旗下的 Claude Code 项目发布了 v2.1.220 版本。此次更新主要内容为错误修复和可靠性改进,旨在提升软件的稳定性和用户体验。
What's changed Added Claude Opus 5 (claude-opus-5), now the default Opus model — 1M context, fast mode at $10/$50 per Mtok Added sandbox.network.strictAllowlist setting to deny non-allowlisted hosts for sandboxed commands without prompting Added DirectoryAdded hook that fires after /add-dir or the S
What's changed Changed /code-review to run as a background subagent, so review work no longer fills your conversation and keeps stacked slash commands as its review target Added screen-reader announcements of deleted text for word and line deletions (Option+Delete, Ctrl+W, Cmd+Backspace, Ctrl+U, Ctr
What's changed Added emoji shortcode autocomplete in the prompt input: type :heart: to insert ❤️, or :hea for suggestions — disable with the emojiCompletionEnabled setting Added warnings when transcript writes are failing (e.g. disk full) or when session saving is off due to an inherited environment
What's changed Added sandbox.filesystem.disabled setting to skip filesystem isolation while keeping network egress control Fixed a slowdown in long sessions where message normalization cost grew quadratically with the number of turns, causing multi-second stalls and slow resumes Fixed auto mode deny
What's changed Claude no longer runs the /verify and /code-review skills on its own; invoke them with /verify or /code-review when you want them
What's changed Fixed single-segment dir/** allow rules like Edit(src/**) auto-approving writes to nested dir/ directories anywhere in the tree instead of only /dir Fixed a permission-check bypass affecting commands run in Windows PowerShell 5.1 sessions Fixed Bash permission checks to fail closed on
What's changed /fork now copies your conversation into a new background session (its own row in claude agents) while you keep working; the in-session subagent it used to launch is now /subtask Added claude auto-mode reset to restore the default auto-mode configuration, with a confirmation prompt (pa
What's changed Added --forward-subagent-text flag and CLAUDE_CODE_FORWARD_SUBAGENT_TEXT environment variable to include subagent text and thinking in stream-json output Fixed permission previews relayed to chat channels not neutralizing bidirectional-override, zero-width, and look-alike quote charac
Release 0.147.0-alpha.6.4
中文介绍 OpenAI Codex 发布了针对 Rust 编程语言的 v0.147.0-alpha.6.4 版本更新。
Release 0.147.0-alpha.6.3
中文介绍 OpenAI Codex 发布了针对 Rust 编程语言的 v0.147.0-alpha.6.3 版本更新。
Release 0.147.0-alpha.6.2
中文介绍 OpenAI Codex 发布了针对 Rust 编程语言的 v0.147.0-alpha.6.2 版本更新。
Release 0.147.0-alpha.8
中文介绍 OpenAI Codex 发布了针对 Rust 编程语言的 v0.147.0-alpha.8 版本更新。
Release 0.147.0-alpha.6.1
中文介绍 OpenAI Codex 发布了针对 Rust 编程语言的 v0.147.0-alpha.6.1 版本更新。
Release 0.147.0-alpha.7
中文介绍 OpenAI Codex 发布了针对 Rust 编程语言的 v0.147.0-alpha.7 版本更新。
Release 0.147.0-alpha.6
中文介绍 OpenAI Codex 项目宣布发布其针对 Rust 编程语言的新版本 0.147.0-alpha.6。该版本属于早期开发阶段的阿尔法(alpha)更新,通常包含最新的功能迭代和错误修复,旨在为开发者提供测试和反馈的平台,以持续改进代码生成能力。
Release 0.147.0-alpha.5
中文介绍 OpenAI Codex 项目发布了其针对 Rust 编程语言的最新版本 0.147.0-alpha.5。作为阿尔法(alpha)测试版本,此次更新通常意味着引入了新的功能特性或解决了已发现的问题,鼓励社区开发者进行试用并提供宝贵的反馈意见。
Release 0.147.0-alpha.1.2
中文介绍 OpenAI Codex 项目发布了针对 Rust 编程语言的版本更新 0.147.0-alpha.1.2。此版本为阿尔法(alpha)阶段的发布,表明它仍在积极开发中,可能包含最新的实验性功能或关键的优化调整,旨在收集用户反馈以进一步完善。
Release 0.147.0-alpha.4
中文介绍 OpenAI Codex发布了其Rust组件的0.147.0-alpha.4预览版本更新。这是该项目在GitHub上的一个新发行版,属于alpha测试阶段。
今日AI领域亮点纷呈,AI Agent技术在编程辅助、实时交互和业务自动化中展现深度应用与优化路径;同时,大模型研究持续探索多模态和推理新范式。行业层面,数据中心电力瓶颈凸显,但AI芯片与云服务市场合作热络,显示出AI基础设施需求旺盛,促使巨头加速构建生态与安全标准。
OpenAI Codex 项目针对 Rust 编程语言发布了多个阿尔法(alpha)版本更新,其中包括最新的 0.147.0-alpha.6 版本。这些迭代通常包含最新的功能特性和错误修复,旨在为开发者提供测试平台,以持续改进其代码生成能力,并完善对 Rust 语言的理解和支持。这表明OpenAI正积极提升其编程AI工具在多语言环境下的性能和稳定性。
AirLLM 是一款开源项目,致力于突破大型语言模型(LLM)推理的硬件限制,使得 700 亿参数级别的模型能够在仅有 4GB 显存的单张 GPU 上高效运行。它通过精细的模型加载、量化和计算优化,显著降低了 LLM 部署的资源门槛。这对于在本地设备、低成本硬件或边缘设备上开发和部署复杂 AI 应用的开发者和研究人员而言,提供了重要的技术支持,促进了AI的普及化应用。
esengine 推出的 DeepSeek-Reasonix 是一个专为终端用户设计的 DeepSeek 原生 AI 编码代理。它旨在为开发者在命令行界面提供智能编程辅助,包括代码生成、补全和问题解答。该项目特别强调其「前缀缓存稳定性」工程优化,确保代理可以长时间高效运行并减少重复计算。这使得开发者能够无缝在终端内获取 AI 协助,从而显著提升编码效率和开发体验,尤其适用于需要持续编程支持的场景。
鉴于当前语言模型在生成式建模中仍主要依赖离散 token,与图像、音频等模态的连续潜在空间建模存在差异,论文提出「AURORA-LM」模型。该模型通过自动编码统一表示,实现了连续潜在扩散语言建模,旨在弥合文本生成与其他多媒体生成在连续空间建模上的技术差距。此创新有望提升语言生成的效率和质量,为跨模态生成任务奠定基础。
博主分享了由 Jack Dorsey 创立的 Buzz 平台的完整设置指南,该平台已于2026年7月21日开源,并发布了 macOS、Windows、Linux 桌面版。Buzz 旨在整合 Slack、GitHub 与 AI 代理,打造一站式协作工具,以提升团队工作效率。帖子详细介绍了其全面设置步骤,帮助用户快速部署并体验AI辅助的协作新模式,特别提及 HERMES AGENT 的集成能力。
「Hey Noah」是一款面向创业创始人的主动式人工智能行政助理。它旨在通过自动化管理、日程安排和关键信息提醒等功能,帮助创始人高效处理行政事务。这款工具旨在节省创始人宝贵的时间,使其能够更专注于核心业务发展和战略规划,从而提升创业公司的运营效率和决策质量,是专为高压快节奏的创业环境设计的AI解决方案。
新应用「Wrinkles」已上线 iOS 和 Android 平台,它是一款由 AI 驱动的音频导游。该应用能够根据用户当前位置,揭示周边地点的隐藏历史和当地故事,提供沉浸式的文化体验。Wrinkles 解决了传统旅游指南内容单一、缺乏互动性的痛点,为游客和本地居民提供了一种全新且个性化的探索方式,通过人工智能技术丰富了用户对物理世界的认知。
曾被誉为人工智能“中心”的德州,如今面临巨大的电力压力,州长已宣布暂停新的数据中心接入电网的申请。此举旨在应对数据中心对能源造成超负荷的负担,反映出AI产业高速发展背后对基础设施,特别是能源供应的巨大挑战。这一决策将对未来数据中心选址和AI算力布局产生深远影响,促使行业关注可持续能源解决方案。
Anthropic 公司在云合作方面持续发力,最新宣布与人工智能云初创公司 Volta 签署了一项高达 100 亿美元的协议。这一重大合作进一步巩固了 Anthropic 在大模型领域的生态布局,确保其 AI 模型拥有充足的计算资源支持。此举也突显了大型 AI 公司对高性能、可扩展云算力需求的紧迫性,以及AI云服务市场日益激烈的竞争与合作态势。
AMD 最新财报显示,在人工智能需求的强劲推动下,其数据中心业务营收同比翻番,飙升 107% 至 67 亿美元。这一数据相比去年同期 32 亿美元和上一季度 58 亿美元均大幅提升,标志着 AI 芯片市场正在经历爆发式增长。与此同时,AMD 的游戏业务则相对退居次席,凸显了公司战略重心向高利润的 AI 和数据中心领域倾斜的趋势。
微软发布了一套生成式 AI 入门课程,包含 21 节课,旨在帮助初学者快速掌握生成式 AI 的核心概念与开发实践。课程通过实际构建应用来学习相关技术,是系统学习 AI 应用开发的优秀起点。此举为对生成式 AI 感兴趣的开发者、学生或研究人员提供了宝贵的学习资源,有助于降低技术门槛,推动生成式 AI 技术的普及和应用。
一份外部报告对 ChatGPT Work 的内部运作机制进行了重构与深入分析。报告详细探讨了其中「记忆(Memory)」、「主动性(Proactivity)」、「调度(Scheduling)」、浏览器使用、插件、技能和工具的协同工作方式。这一解析有助于开发者和研究者更全面地理解大型语言模型如何作为智能代理处理复杂任务,为未来 AI Agent 的设计与优化提供了重要的参考框架。
一位博主分享了其 AI 销售代理在博主育儿假期间的惊人表现。该代理在 8 周内每周处理超过 300 个客户电话,成功带来了 132 个新付费客户和 37 个价值约 300 万美元的企业商机,并且能够自动报价和发送内部邮件。博主还提供了相关代码,展示了 AI 在销售自动化和营收增长方面的巨大潜力,为企业提供了自动化销售的新思路。
Claude 官方发布的 YouTube 视频详细介绍了其大模型在处理代码任务时「自动模式」的工作原理。视频旨在演示 Claude 模型如何通过自动化流程,辅助用户进行代码生成、调试或优化。这展示了该功能在实际编程场景中的应用方式与操作逻辑,为开发者提供了直观的参考,以更好地利用 Claude 提升编码效率和解决技术难题。
今日AI产品发布聚焦于AI Agent生态的深化与拓展。从解决AI记忆碎片化、提升垂直领域效率的AI助理,到赋能开发者构建实时语音代理和高效本地化LLM推理的工具,都预示着AI Agent正从概念走向更精细化和落地化的应用。安全与可编程性也成为Agent开发的关键考量。
「Atlaso」旨在为用户使用的每一个AI工具提供统一的“记忆”功能。它致力于整合不同AI应用中的信息,创建连贯的用户体验,解决多AI协同的记忆碎片化问题。当前随着AI工具的激增,用户常面临信息上下文无法跨工具流转的困境,Atlaso 提供了一个创新的解决方案,让AI的利用效率大大提升。它适合所有重度AI用户和追求无缝智能体验的个人。
「Hey Noah」是一款面向创业创始人的主动式人工智能行政助理。它旨在通过自动化管理、日程安排和关键信息提醒等功能,帮助创始人高效处理行政事务,从而节省时间并专注于核心业务发展。这款AI助理的“主动式”特性是其亮点,能预判需求并提供支持,而非仅仅被动响应指令。对于时间宝贵、事务繁杂的创业者而言,它提供了定制化的智能解决方案,大幅提升日常运营效率。
「Driven」是一款基于人工智能的投资代理,旨在为用户提供从市场洞察到实际操作的全方位投资服务。它利用AI分析海量金融数据,辅助用户做出明智的投资决策并执行交易。该产品区别于传统投资工具之处在于其端到端的Agent能力,不仅提供分析报告,还能直接转化为投资行动。对于希望利用AI提升投资效率、做出数据驱动决策的个人投资者或小型机构而言,Driven 提供了一个强大的自动化和智能化平台。
AirLLM 致力于解决大型语言模型 (LLM) 推理的硬件限制问题,使得 700 亿参数级别的模型能够在仅有 4GB 显存的单张 GPU 上高效运行。它通过优化模型加载、量化和计算方法,显著降低了 LLM 推理的资源门槛。这对于在本地设备、低成本硬件或边缘设备上部署复杂 AI 应用的开发者和研究人员极为有用,极大地提升了LLM的普及性和可访问性,使更多小型团队和个人能够进行大模型实验与部署。
`esengine` 推出的 `DeepSeek-Reasonix` 是一个专为终端用户设计的 DeepSeek 原生 AI 编码代理。它旨在为开发者在命令行界面提供智能编程辅助,例如代码生成、补全或问题解答。该项目特别强调了其「前缀缓存稳定性」工程优化,确保代理可以长时间运行并保持高效,减少重复计算。这使得开发者能够无缝地在终端内获取 AI 协助,从而提升编码效率和开发体验,尤其适合偏爱命令行工作流的工程师。
livekit/agents 是一个专注于构建实时语音 AI 代理的开发框架。它为开发者提供了一整套工具和抽象,以简化集成语音识别、自然语言处理和语音合成等关键技术,实现高效、低延迟的人机语音交互。该框架旨在赋能开发者快速创建客户服务机器人、虚拟助手、交互式教育应用或游戏 AI 等需要实时语音与视频(🎙️📹)能力的应用,大大降低了开发复杂实时AI语音应用的门槛。
Uber 的 ADR 项目致力于保障企业级 AI agent 的安全性。它通过提供可观测性、进行安全基准测试以及实施威胁检测等功能,确保部署在生产环境中的 AI 系统免受潜在攻击和漏洞的侵害。该工具旨在解决企业在应用 AI 技术时面临的安全挑战,尤其适用于那些对数据安全和系统稳定性有高要求的组织,由 Uber 内部实践验证并对外开源,帮助开发者构建更安全的 AI 应用,推动AI Agent在企业中的可靠落地。
`video-use` 是一个探索通过「编码代理」来编辑视频的创新项目。它旨在颠覆传统的图形界面视频编辑模式,允许用户通过编写代码或使用智能代理来自动化和执行复杂的视频剪辑、特效添加及内容生成等任务。该项目解决了传统视频编辑软件操作繁琐、难以批量处理的问题,为开发者、内容创作者和研究人员提供了一种全新的、更具编程性和自动化潜力的视频制作方式,尤其适合需要进行程序化视频生成、自动化后期处理或实验新颖交互模式的场景。
「SpeakoFlow」是一款开源的桌面本地语音助手。它允许用户在本地设备上使用语音控制功能,为桌面操作提供便捷的交互方式。相较于云端语音助手,SpeakoFlow强调数据隐私和离线可用性,让用户的数据保留在本地,无需上传至外部服务器。它适用于重视个人数据安全、希望定制语音交互体验,或在无网络环境下依然需要语音助手功能的桌面用户。
TencentDB Agent Memory 为 AI Agents 提供本地化的长效记忆解决方案。它采用四层渐进式管道设计,旨在实现无需外部 API 依赖的完全本地化记忆存储与检索,解决了 AI Agent 在需要长期记忆和上下文感知时对外部服务的依赖问题。该项目通过内建机制管理记忆,增强了数据隐私性和系统性能。适用于需要为 AI Agent 构建稳定、独立且具备丰富记忆能力的开发者,例如开发智能客服、个人助理或具备学习能力的自动化系统。
reverse-skill 是一个面向逆向工程、授权渗透测试和安全研究的智能技能路由包。它利用 AI 实现工具和知识的智能路由,并支持按需启动工具链,结合自进化的知识库,大大简化了安全分析流程。该项目旨在提升安全专家在漏洞挖掘、恶意软件分析等场景下的效率,并支持集成 Claude Code 等高级 AI 辅助能力。它代表了AI在高度专业化且复杂安全领域的实验性应用,展现了AI对传统安全工作流程的赋能潜力。