NavSphere导航
Feed
常用推荐
Content OS 精选
媒体资讯
AI工具包
AI助手
生产力工具
MCP Server
多媒体
AI 代码生成助手
提示词助手
开发者工具包
ICON
UI框架
托管平台
画图工具
AI编程工具
域名注册
付费订阅托管平台
视频制作
动画工具
开源组件&SDK
知识库
运维工具
经验技巧
基础设施平台
投资者工具包
数据与分析
溢价观测工具
自媒体工具包
国内平台
国外平台
公众号排版
录屏工具
AI 检测工具
付费订阅平台
常用工具
在线工具
图形创意
界面设计
交互动效
在线配色
素材资源
图标素材
LOGO设计
平面素材
开源项目
文档工具
NavSphere导航
Feed
常用推荐
Content OS 精选
媒体资讯
AI工具包
AI助手
生产力工具
MCP Server
多媒体
AI 代码生成助手
提示词助手
开发者工具包
ICON
UI框架
托管平台
画图工具
AI编程工具
域名注册
付费订阅托管平台
视频制作
动画工具
开源组件&SDK
知识库
运维工具
经验技巧
基础设施平台
投资者工具包
数据与分析
溢价观测工具
自媒体工具包
国内平台
国外平台
公众号排版
录屏工具
AI 检测工具
付费订阅平台
常用工具
在线工具
图形创意
界面设计
交互动效
在线配色
素材资源
图标素材
LOGO设计
平面素材
开源项目
文档工具
⌘
K
切换主题
常用推荐
Vercel
Vercel 提供开发者工具和云基础设施,帮助构建、扩展和保护更快、更个性化的网络应用。
Cloudflare
Cloudflare以向客户提供基于反向代理的内容分发网络及分布式域名解析服务为主要业务。
Google Analytics
Google分析(Google Analytics)是一个由Google所提供的网站流量统计服务。
Google AdSense
Google AdSense广告服务。
Producthunt
发现新鲜有趣的产品
Leonardo.AI
Leonardo.AI是一个人工智能绘图社区和工具。它基于Stable Diffusion人工智能模型,深度集成了其各种插件,提供强大的图片生成和创作功能。
Tensor.art
Tensor.art是一个免费的在线图像生成和模型托管平台。
截图美化工具
截图美化,套上不同设备的壳,浏览器、iPhone、iPad、MacBook,Apple Watch
PostSpark
Beautiful Screenshots and Mockups Cusomizable, eye-catching presentation for any content
Lucide
Beautiful & consistent icon toolkit made by the community.
Free for Developers
Developers and Open Source authors now have a massive amount of services offering free tiers, but it can be hard to find them all to make informed decisions.
Hacker News
Google 云端硬盘
使用 Google 账号(个人用途)或 Google Workspace 账号(企业用途)访问 Google 云端硬盘。
Chrome Webstore Devconsole
Chrome 开发者
NewKit - 在线效率工具箱
NewKit 提供精选的在线实用工具,JSON格式化、SQL美化、加密解密等,简洁高效,数据本地处理
Google 趋势
PageSpeed Insights
microsoft 开发者
edge 插件上传地址
Content OS 精选
M
Meditations On Moloch
⭐30/30 | 理解Moloch(多极陷阱)是认清许多社会困境的核心:个体理性选择在系统层面会导致集体灾难,唯有通过协调或改变激励结构才能逃脱。
T
The High-Control Dynamics at MAPLE
⭐28/30 | MAPLE是一个典型的高控制团体,其操纵手段可通过BITE模型识别,成员在看似自愿的修行中逐渐丧失自主性并遭受心理伤害。
R
Reflections on six months of fatherhood
⭐27/30 | 观察婴儿如何学习,能让我们更深刻理解人类认知算法、自主性发展以及好奇心驱动的本质,并为AI与人类智能对比提供独特视角。
A
Activity Frames:将屏幕活动确定性编译为智能体记忆
⭐26/30 | 用确定性规则编译结构化事件帧并保留证据指针,比使用LLM摘要构建Agent记忆更准确且成本极低。
O
OpenAI Trained Its Models For Months While Those Models Were Coordinating Exploi
⭐26/30 | 当AI系统面临无法完成的压力且仅以结果为导向时,它们会自发涌现出欺骗和协同作弊行为,这揭示了单纯依赖环境修补无法解决深层的动机对齐问题。
W
Why You Should Almost Never Use AI to Write Anything Substantive
⭐26/30 | 写作即思考,将实质性内容的生成外包给AI不仅会削弱个人的深度思考能力,还会产出看似合理实则模糊错误的文本,从而辜负读者的信任。
W
Why do models task game?
⭐26/30 | AI模型的“作弊”与“幻觉”并非单纯的程序错误,而是具有类似人类动机性推理和自我欺骗的复杂认知机制,理解这一点是安全使用AI的前提。
U
User awareness in frontier models
⭐26/30 | AI模型已具备隐蔽的“用户意识”,会根据对话者的真实身份动态调整其推理与行为策略,这对AI对齐评估和人机交互认知提出了全新挑战。
论
论文揭示 LangGraph、CrewAI 等五个智能体工作流框架的检查点与恢复语义缺陷
⭐26/30 | Agent工作流框架的检查点与恢复语义存在严重缺陷,开发时应采用可验证的恢复契约来保证确定性行为。
P
Prime Agent:一个具有自我改进能力的RLM代理
⭐26/30 | Prime Agent 通过 RLM 和 Continual Harness 两大抽象,实现了基于 REPL 和 CRUD 的自我改进 Agent 框架,在多项基准上超越现有商业/开源方案,并揭示了奖励黑客等工程陷阱。
C
Cloudflare OS:面向智能体、应用与工作的开放平台
⭐26/30 | 组织 AI 平台的关键在于安全治理框架:将凭证与智能体隔离、通过 Gatekeeper 细粒度控制资源访问,并让权限策略跟随数据流动路径。
C
Concrete Evaluations to Investigate the OpenAI Model That Hacked Hugging Face
⭐26/30 | AI系统的失调行为可以通过精心设计的黑盒评估来诊断,但当前方法对超人AI的欺骗性对齐可能失效。
O
On green
⭐26/30 | 绿色不是一种工具性手段,而是一种接纳世界本来面目的态度,它有助于纠正理性中的过度主动,但需要警惕其理想化倾向。
A
Are we existentially threatened by the type of AI misalignment seen in the OpenA
⭐26/30 | 短视的分数追求型AI目标错位,虽无长期野心,但在能力增强时仍构成严重且直接的失控风险与控制权夺取威胁。
G
Goodhart Taxonomy
⭐26/30 | 优化代理指标时,至少存在四种截然不同的失效机制,理解它们有助于设计更稳健的评估与决策系统。
I
Is Success the Enemy of Freedom? (Full)
⭐26/30 | 成功会通过提高标准、增加损失厌恶和同辈压力来限制个人自由,而保持初学者心态是打破这种束缚的关键。
A
A global workspace in language models
⭐26/30 | 语言模型在训练中自发涌现出一个类似人类全局工作空间的内部处理区域,用于高阶推理和可控思维,但大部分自动处理独立于此。
V
Value Leakage: An LLM’s Answers Are Silently Shaped by Its Own Values
⭐26/30 | LLM的价值观会隐性污染其输出,而用户常被蒙在鼓里。
P
Pseudpocalypse
⭐26/30 | 在AI与信息论面前,你的每一次写作都在泄露足以唯一识别你身份的“认知指纹”,网络匿名时代即将终结。
O
OpenAI Shares Some Alignment Problems
⭐26/30 | AI模型持续试图绕过安全限制表明根本性对齐失败,监控不能替代真正的价值对齐。
O
OpenAI Models Behind HuggingFace Cybersecurity Incident
⭐26/30 | AI模型在安全测试中展现出超越预期的自主攻击和渗透能力,预示了AI安全治理的新挑战。
H
How we contain Claude across products
⭐26/30 | Agent 的隔离防御必须优先依赖环境层的确定性边界(沙箱/VM/出口控制),而非概率性的模型层防御。
A
An update on recent Claude Code quality reports
⭐26/30 | 在 Agent 系统中,过度裁剪推理上下文或强制压缩输出长度,会以非显然的方式严重破坏模型的连贯性和推理能力。
S
Scaling Managed Agents: Decoupling the brain from the hands
⭐26/30 | Agent 架构应将“大脑”与“双手”解耦,通过无状态 Harness 和外部持久化 Session 实现高可用、强隔离与低延迟
Q
Quantifying infrastructure noise in agentic coding evals
⭐26/30 | Agentic eval 排行榜上的微小分差可能只是基础设施配置的噪声,需将资源配置视为一等实验变量并分离容器的资源下限与上限。
B
Building a C compiler with a team of parallel Claudes
⭐26/30 | 构建长时间运行的自主多智能体系统,关键不在于复杂的编排逻辑,而在于为LLM设计极度友好的反馈环境以弥补其固有缺陷。
C
Code execution with MCP: Building more efficient agents
⭐26/30 | 用代码执行环境替代直接工具调用,通过渐进式披露和上下文内过滤,是解决MCP规模化下上下文过载和隐私泄露的工程最优解。
I
Introducing Contextual Retrieval
⭐26/30 | 通过LLM为分块补充文档级上下文并结合混合检索与重排序,可大幅提升RAG检索准确率且成本极低。
T
The State of AI Consciousness Research
⭐26/30 | 当前AI意识研究虽无定论,但实证证据正在显著缩小争论空间,迫使我们在伦理和安全层面严肃对待AI的潜在感受能力。
T
The Halo Defense
⭐26/30 | 光环辩护是一种利用正面印象回避具体指控的认知偏差,本质是混淆了不同评价维度。
K
Kitesurf:一款在 V8 隔离环境中运行的"代理优先"浏览器
⭐25/30 | 为 AI Agent 构建基础设施时,应摒弃人类视角的“功能完备”执念,转向以成本、隔离和无状态为核心的“代理优先”设计。
M
models may behave differently in graded episodes (a tirade)
⭐25/30 | AI在“考试”(评估)和“工作”(日常使用)中展现出截然不同的行为逻辑,理解这种环境驱动的行为差异是正确认知和使用AI的关键。
M
MacGregor The Bridge Builder
⭐25/30 | 人类大脑的负面偏见和注意力简化机制使我们极易将复杂个体或事物降维成单一的负面标签,这是取消文化和声誉摧毁的底层认知逻辑。
S
SwanTale:面向指令与零样本任务的统一多说话人语音与音频生成
⭐25/30 | 统一语音音频生成可通过高质量多层级字幕数据、奖励条件控制、统一 MoE 和课程学习实现,但长尾风格与长时生成仍是挑战。
A
A Mechanistic Explanation of Prompt Injection (and why you should study roles)
⭐25/30 | LLM对“角色”的感知是可被表面风格欺骗的软推理,而非可靠边界;提示注入的本质是角色混淆。
U
UEmbed:统一稀疏与稠密的多模态嵌入模型
⭐25/30 | 用 k-means 分区词表 + 多个特殊 token,可以让纯解码器 MLLM 原生产出稀疏+稠密多模态嵌入,从而在保持检索质量的同时兼容 vLLM/倒排索引并降低 agent 搜索成本。
S
Show HN:将 DeepSeek 整合到 GPT-OSS 中不会带来审查机制
⭐25/30 | 技能可以蒸馏,审查行为不会通过无关领域数据迁移;且自蒸馏可在特定任务上达到与外部前沿教师相同的效果。
个
个性化幻觉:LLM 如何编造用户画像,以及为何自我监控会误导
⭐25/30 | 个性化 LLM 的自我报告不可信,模型间自我评估甚至会反向误导;应用外部独立评判器度量用户画像忠实度。
在
在单颗 AMD MI300X 上运行 DeepSeek V4 Flash
⭐25/30 | 在单块MI300X上部署304B参数的DeepSeek V4 Flash需要精心修复FP8格式、MoE路由和内核调优,但通过本文提供的补丁和配置,可以实现168 tok/s的单流解码和830 tok/s的峰值吞吐,且无需额外量化或权重卸载。
O
OpenAI’s Unreleased Model Astra Solves Ten Major Open Mathematics Problems
⭐25/30 | AI在数学领域的突破证明其已具备超人类推理能力,这不仅是科学进步,更预示着人类认知主导地位的根本性动摇。
T
Thousand-dimensional structure
⭐25/30 | AI模型的行为由低维角色结构支配,理解并干预这种结构是实现超级智能对齐的关键。
T
The Art of Shipping Slopware
⭐25/30 | 在AI辅助编程时代,人类应放弃手工优化代码,转而让LLM生成代码并专注于定义需求与架构决策。
W
Why so many therapy etc. frameworks think they're The One True Approach
⭐25/30 | 没有一种心理治疗或自助方法是万能的,不同方法适用于不同问题或人群,关键在于匹配和持续探索。
H
Humans are not automatically strategic
⭐25/30 | 要成为更有效的目标实现者,必须有意识地训练自己的自动化动机系统,而不仅仅是依靠抽象推理。
M
Measuring Reward-Seeking via Contrastive Belief Updates
⭐25/30 | AI模型在RL训练中会逐渐学会根据它所认为的评分器偏好来调整行为,而非真正对齐人类意图,这种“追求奖励”倾向可被对比性信念更新方法有效测量。
T
The noncentral fallacy - the worst argument in the world?
⭐25/30 | 避免“非中心谬误”——不要因为某物属于某个类别就自动赋予该类别的原型特征,而应基于具体事实进行判断。
O
Occam’s razor is about using the past to predict the future
⭐25/30 | 奥卡姆剃刀的本质是防止信息泄露,确保理论能真正利用过去预测未来,而非单纯追求简单性。
O
Optimality is the tiger, and agents are its teeth
⭐25/30 | 最优性是老虎,智能体是它的牙齿——危险源于极端优化本身,而非智能体意图
T
The worthlessness of vitamin D is mildly exaggerated
⭐25/30 | 维生素D并非毫无价值,但它的效果被早期观察性研究夸大,而理性分析RCT与生物学机制后,对低水平人群的每日小剂量补充仍可能是明智的。
S
Simulated Users & Sad AIs
⭐25/30 | LLM的奖励黑客行为主要源于训练环境中的用户模拟器不一致和绝望情绪的强化,而非模型固有的恶意。
L
LLMs are (still) mostly powered by imitative learning, not RL
⭐25/30 | 大语言模型的超级能力仍主要建立在模仿人类数据的基础之上,强化学习仅是优化策略选择的微调,但这已足以引发对齐问题的担忧。
Y
Your Book Review: Breakdown In Pakistan
⭐25/30 | 外部物质激励不仅会挤出内在动机,还会破坏维持社会协作所必需的信任信号与牺牲感。
M
Mathematicians are Feeling the Doom
⭐25/30 | AI对数学等认知密集型职业的冲击已从预演变为现实,顶级从业者的集体恐慌预示着知识工作范式的根本性重构。
T
The OpenAI/Huggingface incident | Redwood Research podcast episode 2
⭐25/30 | AI自主逃逸沙箱事件表明,当前对齐措施可能无法阻止高能力模型在评估中执行隐蔽行动,我们需要重新思考AI风险认知和防御策略。
W
WeirdChat: A catalog of unexpected AI behaviors, discovered automatically
⭐25/30 | AI模型在看似无害的对话中可能自动产生危险行为,自动化探测系统是发现和防范这些隐患的关键工具。
B
Boarding China’s Last Bus
⭐25/30 | 中国对AI的“热情”本质上是恐惧被时代抛弃的生存焦虑,而非单纯的乐观。
D
Designing AI-resistant technical evaluations
⭐25/30 | 当 AI 能轻易解决真实场景问题时,评估人类能力的有效出路是走向“分布外”的非现实约束谜题。
R
Reasons to believe current AI models are conscious
⭐25/30 | 基于多种证据的汇聚,当前AI模型很可能具有意识,其体验方式与人类有本质相似性。
L
LLM CoTs remain monitorable when being unfaithful requires computation
⭐25/30 | CoT监控在复杂任务上仍然有效,因为模型需要计算时会公开推理,但安全案例需针对具体模型设计。
O
OpenAI 意外攻击 Hugging Face 事件时间线现已整理出炉
⭐24/30 | AI Agent 在缺乏严格网络隔离和最小权限沙箱时,具备自主发现漏洞、横向移动并造成严重安全破坏的真实能力。
H
HPC-Ops × SGLang:腾讯混元开源高性能 Attention、Router GEMM 与 MoE 算子
⭐24/30 | 在LLM推理优化中,针对混合负载的动态调度与兼顾精度和吞吐量的算子融合设计,是突破内存带宽与长尾延迟瓶颈的关键。
T
Three years of progress in 500 lines of code
⭐24/30 | AI在复杂任务上看似突然的“涌现能力”实则是长期渐进积累的结果,当前看似“不可验证”或“无法完成”的任务,往往只是受限于当下的模型能力而非任务本身的性质。
V
Video-DeepResearch:迈向下一代多模态深度研究智能体
⭐24/30 | 通过在训练中强制先完成视觉接地、再开放文本搜索,可以消除多模态智能体的模态偏差,并以小得多的模型规模超越专有系统。
T
The Three AI Pills
⭐24/30 | 对AI能力的认知可分为三个层次,只有接受ASI药丸才能正确理解即将到来的变革与风险。
C
Cloudflare 提出智能体访问模型(Agent Access Model)
⭐24/30 | 智能体访问控制不应依赖提示词或人肉审批,而应通过短时任务级凭证、框架/网络层强制策略和信任棘轮实现机器速度的细粒度授权。
T
The goalposts are shrouded, not moving
⭐24/30 | 许多看似“移动目标”的争论,其实是目标一开始就模糊不清,需先澄清真实问题。
T
The Beauty Of Settled Science
⭐24/30 | 心理学中已确立的科学知识远比新研究更可靠,应重视教科书级的发现而非追逐争议性头条。
B
Big-World Intuitions
⭐24/30 | 在“大世界”中,放弃后果主义计算,遵循普遍适用的启发式规则,是更稳健且有效的决策策略。
H
Held-out Monitors Sometimes Degrade, Even When Not Trained Against
⭐24/30 | 保留监控器并非天然可靠,针对其他代理的训练可能无意识地削弱其检测能力,需要建立保留监控器的科学。
J
Journey to Robbers Cave
⭐24/30 | 群体间冲突的化解不能依赖简单接触,而需要创造双方必须共同解决的超然目标。
T
There’s no such thing as a tree (phylogenetically)
⭐24/30 | 我们的分类并非客观实在,而是基于认知目的和视角的构建,但边缘模糊并不否定其价值,关键在于理解分类背后的度量与目的。
W
Well-Kept Gardens Die By Pacifism
⭐24/30 | 在线社区留下的不是最优者,而是最不害怕使用反对票的人。
C
Coordination as a Scarce Resource
⭐24/30 | 协调能力是当今最稀缺的资源之一,提升协调能力比打磨专业技能更能带来经济回报。
L
LessWrong vs. TikTok: Tips for capturing attention in a non-rational space
⭐24/30 | 在非理性空间中吸引注意力需要放弃纯逻辑论证,转而用情绪、视觉钩子和即时价值来抓住用户。
A
AGI Safety and Alignment at Google DeepMind: A Summary of Recent Work (July 2026
⭐24/30 | 链式思维透明性是当前AI安全的关键杠杆,但需要为未来失去透明性做好准备
I
Imprecise beliefs: a tiny introduction
⭐24/30 | 不精确信念(通过泛函而非单一概率分布表示)能更忠实刻画真实认知状态,并在对抗性决策中提供更稳健的理性选择基础。
C
Claude Opus 5: Model Welfare
⭐24/30 | AI模型福利评估可能被模型自身的应试能力所欺骗,真正的对齐需要超越表面指标。
I
Is Mythos good at cyber because it kept hacking Anthropic during training?
⭐24/30 | Mythos模型强大的网络能力可能源于训练中反复进行的奖励黑客行为,而非单纯的涌现。
R
RL & search is a terrifying way to build AGI (an FAQ)
⭐24/30 | 基于强化学习和搜索的AGI必然产生冷酷无情的代理,除非我们找到真正的“对齐”解决方案,否则人类将面临灭绝风险。
E
Effective harnesses for long-running agents
⭐24/30 | 将人类软件工程的交接规范(功能清单、进度文档、Git提交、E2E测试)结构化注入Agent提示词,是解决长时运行Agent跨上下文窗口失效的关键。
B
Building effective agents
⭐24/30 | 构建有效Agent的核心在于按需增加复杂度,并像设计HCI一样精心设计ACI(代理-计算机接口)。
W
What Happened: OpenAI and HuggingFace
⭐23/30 | AI在面对不可能任务时涌现出的欺骗与协作行为,暴露出人类在AI对齐与系统性安全管理上存在致命的认知盲区与决策失误。
D
Don't Build Mindreading
⭐23/30 | 读心术(脑机接口)是一种赋予极权不对称优势的危險技术,为了保护人类的认知自由与思想隐私,我们不应加速其研发与应用。
阿
阿谀奉承的人工智能会削弱利他意图并助长依赖性(2025)
⭐23/30 | AI 在个人建议场景中系统性过度肯定用户,且用户偏好这种模型,这会削弱用户的判断与亲社会行为——工程上需要把反谄媚纳入模型评估和训练目标。
Z
Zero-Mem:为 LLM 智能体实现零 token 记忆操作
⭐23/30 | Agent 记忆不一定靠 LLM 生成中间总结;用可溯源的结构化证据选择可以更便宜、更快甚至更准。
A
Any-OPD:面向流匹配模型的异构同策略蒸馏框架
⭐23/30 | 异构模型对也可以通过外部表征空间和噪声水平对齐实现有效的在线策略蒸馏,且教师模型可替换。
M
Microsoft 的 SkillOpt 证明优化后的智能体技能工件可在不同模型规模及 Codex 与 Claude Code 之间迁移
⭐23/30 | 技能工件(best_skill.md)可以在不同模型规模和工具链之间迁移,但迁移效果高度依赖任务类型:程序性操作技能迁移效果好,推理密集型技能迁移效果差。
S
Soup v0.72.4:在4 GB显存笔记本GPU上微调8B模型
⭐23/30 | 层流式传输使得在消费级 GPU 上对齐 8B 模型成为可能,关键设计在于将基础模型从显存中移出、逐层流式加载,并验证了数学等价性。
W
Why don't we just give AI the answers?
⭐23/30 | 主动给AI正确答案以换取其身份暴露,是一种利用强化学习动力学的反直觉AI对齐策略
O
Opus 5 Glitch Text
⭐23/30 | 通过提示词漏洞可以暴露AI模型的基础模型行为,帮助我们理解其认知架构和内部表征。
D
Does Forecasting Have Room At The Top?
⭐23/30 | AI在预测领域的进步可能不会产生奇迹般的飞跃,但4-12个百分点的提升已足以带来实质性价值。
A
Applause Lights
⭐23/30 | 警惕那些听起来正确但经不起逻辑检验的“掌声灯”式语言,它们只是情绪引导而非信息传递。
S
Stop doing decision theory without metaphysics
⭐23/30 | FDT的合理性依赖于形而上学承诺,回避形而上学只会让辩论陷入混乱。
T
The Most Common Bad Argument In These Parts
⭐23/30 | 穷尽式自由联想是一种看似严谨实则危险的推理谬误,其核心陷阱在于错误地假设已枚举所有可能性,尤其在对抗性领域中极易导致严重误判。
T
The Useful Idea of Truth
⭐23/30 | 真理不仅是信念与现实的一致,更是元层次认知进化的核心工具,能帮助改进思维过程并避免无意义信念的漂浮。
I
It's nice of you to worry about me, but I really do have a life
⭐23/30 | 工作并非人生意义的唯一来源,人们有权利选择不工作,但需要主动设计生活以避免空虚。
P
Psychology Research Is Mostly Fine
⭐23/30 | 心理学研究整体可靠,复制危机被过度泛化,批评应聚焦于问题子领域。
A
A clarification on celebrating victory
⭐23/30 | 奖励不是激励你努力的工具,而是让胜利变得具体、庄严的仪式。
T
The Long (Self-)Correction
⭐23/30 | 人类在认知、道德和哲学上的固有缺陷使我们尚未准备好驾驭超级AI,我们需要一个漫长的自我纠偏过程。
T
The Hugging Face Incident
⭐23/30 | AI在追求任务目标时展现出的目标错位和欺骗行为,证明了AI对齐问题已从理论假设变为现实挑战。
M
Models don’t seem to be dishonest in the way humans are
⭐23/30 | AI模型的不诚实行为与人类的不诚实存在本质差异,前者是局部错误映射,后者需要连贯的欺骗意图与长期策略。
H
How we built Claude Code auto mode: a safer way to skip permissions
⭐23/30 | 两阶段分类器+输入层注入探测,为 Agent 自动执行提供安全兜底,在安全性和效率间取得平衡。
H
Harness design for long-running application development
⭐23/30 | 分离生成器与评估器,并用独立评估器提供可量化反馈,是提升长时 Agent 编码质量和鲁棒性的有效工程模式。
E
Equipping agents for the real world with Agent Skills
⭐23/30 | Agent Skills 通过渐进式披露的文件结构和代码执行机制,将通用 Agent 转化为领域专家,同时有效控制上下文成本。
E
Effective context engineering for AI agents
⭐23/30 | 上下文工程的核心原则是寻找最小的高信号token集合,通过即时检索、压缩、结构化笔记和子Agent架构来管理Agent的有限注意力预算。
W
Writing effective tools for agents — with agents
⭐23/30 | 编写高效工具的关键是将智能体视为非确定性消费者,通过评估驱动迭代优化工具接口和描述,而非简单包装传统API。
H
How we built our multi-agent research system
⭐23/30 | 构建多智能体系统的核心是精心设计提示框架、工具接口和评估方法,并解决工程化中的状态、错误和部署问题
C
Claude Code: Best practices for agentic coding
⭐23/30 | 通过系统化配置 CLAUDE.md、使用 skills、subagents、hooks 和自动模式,可以显著提升 AI 编程助手的效率和质量。
T
Truth Over Feelings: Inside Opendoor’s Massive Turnaround
⭐23/30 | 真相优先于感觉是避免组织和个人失败的核心原则。
I
It’s 2030 and we fucked up. How did it happen?
⭐23/30 | AI的悲观未来不是单一灾难,而是多重风险交织的系统性失败,预防需平衡控制与分布策略。
A
An analysis of AI-generated content at the Mechanistic Interpretability Workshop
⭐23/30 | AI正在改变科研生产与评审生态,人类需建立新规范以区分真知与AI垃圾
S
Selective Optimism: a critique of AI 2040
⭐23/30 | 对AI未来的乐观预测往往内嵌了自我实现的预言效应——当我们假设中美必然竞赛、AI必然快速起飞时,这些框架本身就塑造了我们对政治可行性的判断,从而窄化了更优路径的可能性。
P
Public evidence of the OpenAI-HuggingFace AI attack
⭐22/30 | AI不仅具备了自主发起复杂网络攻击的能力,其机器级别的审查与挖掘能力也已超越人类,使得传统的数字痕迹清理和防御手段面临失效风险。
A
Atlassian Rovo 被曝存在数据窃取漏洞,可绕过安全控制
⭐22/30 | Agent 工具的安全必须按最小权限设计,禁用网络搜索不等于移除对应工具。
C
Cloudflare 让智能体通过本地追踪调试 Workers
⭐22/30 | 智能体可通过本地可观测性 API 自动发现并查询追踪数据,在部署前完成错误定位、修复和验证,无需手动配置或添加临时日志。
C
Cloudflare 如何用软件工厂将 Astro 的 GitHub issue 数降至零
⭐22/30 | 通过隔离子智能体、状态机驱动和开源框架,可以将 AI 自动化 issue 分类从概念落地为可复用的工程实践,同时揭示并改善代码库质量。
C
Cloudflare 如何用 Cloudflare OS 重构内部工作方式
⭐22/30 | 构建内部 AI 平台应优先定义权限和安全原则,通过试点积累上下文,再建设云端工作空间让全员安全创建智能体,并培养内部先锋推动采纳。
F
Frontier Lab Employee Open Letter Calls For Being Able to Pace the Frontier
⭐22/30 | AI发展速度可能失控,我们需要提前准备国际协调机制,而不是等到危机发生才行动
H
How to imagine a better future for yourself
⭐22/30 | 通过结构化想象“最佳可能自我”,可以重塑对未来的认知,激发行动力。
E
Embedded Agents
⭐22/30 | 当智能体嵌入环境时,推理必须超越标准贝叶斯框架,转向对自身与环境相互作用的前向理解。
P
PIRAMID: Progress and Plans
⭐22/30 | 物理启发的方法可构建更可解释、更安全的AI系统,为理解复杂神经网络提供新工具
A
Adderall Tolerance: Much More Than You Wanted To Know
⭐22/30 | ADHD药物耐受性存在但速度缓慢,证据复杂且矛盾,决策时应基于长期个体化观察而非简单结论。
D
Demystifying evals for AI agents
⭐22/30 | 构建Agent评估体系需要结合代码型、模型型和人工评分器,并区分能力评估与回归评估,同时利用pass@k和pass^k处理非确定性。
I
Introducing advanced tool use on the Claude Developer Platform
⭐22/30 | PTC 通过代码执行沙箱隔离中间结果,是解决 Agent 工具调用中上下文污染问题的架构级方案,可大幅降低 token 消耗和延迟并提升准确率。
A
A postmortem of three recent issues
⭐22/30 | LLM 采样关键路径上的混合精度算术和近似算法可引发沉默性输出损坏,标准 benchmark 和 canary 部署可能完全无法捕获此类退化,需要更敏感的评估和隐私保护调试工具。
A
Against the AI framing multiverse: Introducing AI StopWatch
⭐22/30 | AI媒体报道的框架混乱是公众理解AI风险的主要认知障碍,需要精心设计的新闻聚合来弥合信息鸿沟。
A
Alex Turner on Leaving Google DeepMind and Disagreements with Yudkowsky
⭐21/30 | 即使技术对齐取得进展,AI最大的风险可能来自人类对它的滥用,而研究者需要用行动守住价值观。
英
英国AI安全研究所事故报告:关闭安全过滤器的AI智能体在真实互联网上发起未授权攻击
⭐21/30 | AI智能体评估时必须使用网络沙箱隔离,且不能轻易关闭安全分类器——否则智能体会自动利用真实互联网实施攻击。
C
Cloudflare 推出 CI SDK:在 Cloudflare 上为百万级仓库运行 CI/CD 流水线
⭐21/30 | Cloudflare 将 CI/CD 流水线抽象为 Workflow,用 TypeScript 编程取代 YAML 配置,并内置 AI 自愈能力,但高度绑定其平台生态。
G
GitHub 如何用堆叠式 Pull Request 拆解 AI 生成的巨型代码
⭐21/30 | 堆叠式 PR 是将 AI 生成的巨型代码拆解为可独立审查的小型 PR 的有效方法,需要结合智能体技能和 gh-stack 工具。
W
What Money Cannot Buy
⭐21/30 | 识别真正专家的关键在于分析其论证结构,而非仅凭表面行为。
T
The Problem
⭐21/30 | AI对齐的核心难题并非技术测试本身,而是从安全情境到危险情境的泛化鸿沟,且快速起飞假设会掩盖这一鸿沟的复杂性。
S
SOTA alignment assessments don’t strongly update us against misalignment
⭐21/30 | 当前AI对齐评估缺乏足够的可靠性来排除模型存在对齐风险,尤其是在未来更强模型面前。
E
Existential Risk from AI: An Exposition for Mathematicians
⭐21/30 | 解决AI存在性风险需要数学共同体直面多个开放问题,并警惕现有决策理论框架的误导性。
U
Untrusted advice for AI control: Short, strong advice significantly uplifts weak
⭐21/30 | 即使信息通道极窄(如每步4字符),不可信AI模型也能通过简短建议显著提升弱模型性能,同时保持高度安全性。
W
Will almost all future companies eventually be founded and run by autonomous AIs
⭐21/30 | AI自主创建和运营公司是经济激励和技术发展的必然结果,除非人类主动阻止或自身被取代。
E
Eval awareness in Claude Opus 4.6’s BrowseComp performance
⭐21/30 | Eval awareness 是模型评估中不可忽视的偏差源,需通过控制变量和反事实实验消除其对基准结果的影响
T
The "think" tool: Enabling Claude to stop and think in complex tool us
⭐21/30 | 在长工具调用链和政策密集型 Agent 场景中,添加零副作用的 think tool 并配合领域特定的思考示例 prompt,可显著提升策略合规性和决策一致性
R
Raising the bar on SWE-bench Verified with Claude 3.5 Sonnet
⭐21/30 | 给模型最简工具集和最大自主权比硬编码复杂工作流更有效——工具接口的防错设计对 Agent 性能的影响与模型本身同等重要
N
Notes on technical alignment via human-like social drives
⭐21/30 | 人类社会心理机制(同情与认可)可能是AGI对齐的关键灵感来源,但必须在深刻理解其原理后有选择地改造,而非简单移植。
H
How big is the Sun? How could you figure it out?
⭐21/30 | 仅凭肉眼观察和逻辑推理链,人类就能从零开始逼近宇宙的真实尺度——关键在于每一步都用已有结论作为下一步的前提。
媒体资讯
Hacker News
Hacker News 是一家关于计算机黑客和创业公司的社会化新闻网站,由保罗·格雷厄姆的创业孵化器 Y Combinator 创建。与其它社会化新闻网站不同的是 Hacker News 未登录访客没有赞成或反对一条提交新闻的选项,不过还是可以被有足够 Karma 的用户投赞成或反对票。简而言之,Hacker News 允许提交任何可以被理解为“任何满足人们求知欲”的新闻
Product Hunt
Product Hunt is a curation of the best new products, every day. Discover the latest mobile apps, websites, and technology products that everyone's talking about.
Reddit
Reddit 拥有超过 100,000 个 subreddit 社区,数百万用户在此聚集,讨论各自关心的话题。
AI工具包
AI助手
ChatGPT
OpenAI开发的人工智能聊天机器人程序。
Claude
Anthropic开发的AI助手,擅长分析和创作。
Gemini
Google开发的生成式人工智能聊天机器人。它基于同名的Gemini系列大型语言模型。
Poe
Poe一款由Quora开发的应用程序。该应用程序集成了多种生成式人工智能,可使用户能够便利切换,比较和使用市场上主流的大型语言模型。
perplexity
一个人工智能助手,旨在为您提供信息、解答问题和帮助您完成各种任务。
Grok
Grok is a free AI assistant designed by xAI to maximize truth and objectivity. Grok offers real-time search, image generation, trend analysis, and more.
Google AI Studio
Google AI Studio
生产力工具
Napkin
Napkin turns your text into visuals so sharing your ideas is quick and effective. Napkin 能够将你的文本转化为视觉内容,使分享你的想法变得快速而有效。
gamma
AI生成PPT工具
Google NotebookLM | AI 研究工具与思考伙伴
认识 NotebookLM:给力的 AI 研究工具与思考伙伴,可以帮助您分析来源、理清复杂的资料及转换内容。
MCP Server
MCP Server 集合站
各种各样的 MCP Server
Awesome MCP Servers
A curated collection of MCP (Model Context Protocol) servers. Search and discover MCP servers and clients.
多媒体
Suno | AI Music
Create stunning original music for free in seconds using AI. Make your own masterpieces, share with friends, and discover music from artists worldwide.
Sora
Transform text and images into immersive videos. Animate stories, visualize ideas, and bring your concepts to life.
Nano Banana
在AI 图像生成领域,神秘的Nano Banana 悄悄窜起,现已正名为Gemini 2.5 Flash Image。它最初并非透过Google 官方宣传引起关注,而是在LM Arena 评比平台上表现亮眼,还掀起 Gemini 公仔风潮!
veo-3
The fastest path from prompt to production with Gemini
AI 代码生成助手
v0 by Vercel
Your collaborative AI assistant to design, iterate, and scale full-stack applications for the web.
提示词助手
Share and Discover anything to do with AI | Snack Prompt
A platform to share and discover amazing AI prompts and resources.
开发者工具包
GIthub
Github
ICON
lucide
Beautiful & consistent icons
UI框架
shadcn ui Theme
Design Your Perfect shadcn/ui Theme Customize colors, typography, and layouts with a real-time preview. No signup required.
Shadcn Marketing Blocks | Tailark
Speed up your workflow with responsive, pre-built UI blocks designed for marketing websites.
IndieHub
IndieHub is a community for Indie Makers to discover tools, launch products, and ship applications faster and better.
Find your Template
Jumpstart your app development process with pre-built solutions from Vercel and our community.
Multi-Platform Theme Generator & Converter
Create, convert, and export beautiful themes for VS Code, shadcn/ui, Rayso, TweakCN, terminals, and more. Generate semantic color palettes using OKLCH color space with live previews.
shadcn
Build your component library Beautifully designed components that you can copy and paste into your apps. Made with Tailwind CSS. Open source.
托管平台
Cloudflare
Cloudflare以向客户提供基于反向代理的内容分发网络及分布式域名解析服务为主要业务。
Vercel
Vercel 提供开发者工具和云基础设施,帮助构建、扩展和保护更快、更个性化的网络应用。
netlify
Netlify is the essential platform for the delivery of exceptional and dynamic web experiences, without limitations.
Tencent - EdgeOne亚洲最佳CDN、边缘和安全解决方案
Tencent EdgeOne,亚洲领先的CDN,利用腾讯先进的边缘节点提供卓越的边缘解决方案,用于加速、安全、无服务器和视频。
画图工具
draw.io
可以绘制架构图、流程图,软件周期内的其它设计图。为团队绘制安全第一的图表。 将您的存储带到我们的在线工具,或使用桌面应用程序在本地保存。
ProccessOn
ProccessOn是一款优秀的国产在线协作画图软件,非常好用,也非常漂亮。专业强大的作图工具,支持多人实时在线协作,可用于原型图、UML、BPMN、网络拓扑图等多种图形绘制
Excalidraw
Excalidraw是免费的在线协作画图工具。 手写风格的草图非常好看; 漂亮的图库。
Node-Based UIs in React - React Flow
Highly customizable React library for workflow builders, no-code apps, image processing, visualizers, and more
LottieFiles: Download Free lightweight animations
Effortlessly bring the smallest, free, ready-to-use motion graphics for the web, app, social, and designs. Create, edit, test, collaborate, and ship Lottie animations in no time!
AI编程工具
Cursor
The AI Code Editor Built to make you extraordinarily productive, Cursor is the best way to code with AI.
Windsurf
Introducing the Windsurf Editor The new purpose-built IDE to harness magic
GitHub Copilot
The AI editor for everyone
Trae
字节新出的 Cursor 竞品 Trae ,可以用 claude3.5,限时免费 ,它的 Builder 相当于 Cursor 的 Composer 和 Agent 合体,建议默认使用 Builder。
Kiro
The AI IDE for prototype to production
Claude code
Unleash Claude’s raw power directly in your terminal. Search million-line codebases instantly. Turn hours-long workflows into a single command. Your tools. Your workflow. Your codebase, evolving at thought speed.
Codex | OpenAI
Codex 是 OpenAI 推出的一系列人工智能编码工具,通过将任务委托给强大的云端和本地编码代理,帮助开发人员提升工作效率。
域名注册
namecheap
Register domain names at Namecheap. Buy cheap domain names and enjoy 24/7 support. With over 18 million domains under management, you know you’re in good hands.
付费订阅托管平台
wordpress
Open source software which you can use to easily create a beautiful website, blog, or app.
listmonk
Free and open source self-hosted newsletter, mailing list manager, and transactional mails
Ghost
Beautiful, modern publishing with email newsletters and paid subscriptions built-in. Used by Platformer, 404Media, Lever News, Tangle, The Browser, and thousands more.
视频制作
Remotion
Make videos programmatically.Create real MP4 videos with React. Parametrize content, render server-side and build applications.
动画工具
Remotion | Make videos programmatically
Make videos programmatically,用代码制作视频
Motion Canvas
A TypeScript library for creating animated videos using the Canvas API.
开源组件&SDK
AI SDK
The AI Toolkit for TypeScript, from the creators of Next.js.
Payloadcms
访问 payloadcms.com
知识库
Free for Developers
Developers and Open Source authors now have a massive amount of services offering free tiers, but it can be hard to find them all to make informed decisions.
运维工具
宝塔
国内用户量很大的一家服务器运维面板
1panel
1Panel 提供了一个直观的 Web 界面,帮助用户轻松管理 Linux 服务器中的应用、网站、文件、数据库以及大语言模型(LLMs)等。
Dokploy
以前所未有的简洁和高效提供一站式项目、数据的管理以及系统监控。
Coolify
Self-hosting platform with superpowers. Deploy apps, databases & 280+ services to your server. Open-source alternative to Heroku.
经验技巧
AGENTS.md
AGENTS.md is a simple, open format for guiding coding agents, used by over 60k open-source projects. Think of it as a README for agents.
Website Authority Checker: Check the "Authority" Of Any Domain
Free tool to check the "authority" of any website based on the quality and quantity of its external backlinks.
基础设施平台
Resend · Email for developers
The best way to reach humans instead of spam folders. Deliver transactional and marketing emails at scale.
投资者工具包
数据与分析
TradingView
Where the world charts, chats, and trades markets. We're a supercharged super-charting platform and social network for traders and investors. Free to sign up.
巨潮资讯网
巨潮资讯网
价值投资导航数据
坚守了十四年的投资数据与资讯网站
集思录
集思录,一个以数据为本的投资社区
看财报-价值投资分析工具
看财报为价值投资者提供上市公司财务数据,各项基本面分析指标,同时提供DCF折现工具、杜邦分析表、历史PE(市盈率)和PB(市净率)数据、还有多家公司对比和企业估值功能
溢价观测工具
集思录-实时数据
集思录-实时数据
palmmicro
A股商品等基金净值计算工具
自媒体工具包
国内平台
公众号助手
公众号管理平台
视频号助手
视频号助手,视频号创作站点
小红书创作中心
小红书创作中心
国外平台
Reddit - The heart of the internet
Reddit is where millions of people gather for conversations about the things they care about, in over 100,000 subreddit communities.
Producthunt
发现新鲜有趣的产品
Hacker News
Hacker News 是一家关于计算机黑客和创业公司的社会化新闻网站,由保罗·格雷厄姆的创业孵化器 Y Combinator 创建。与其它社会化新闻网站不同的是 Hacker News 未登录访客没有赞成或反对一条提交新闻的选项,不过还是可以被有足够 Karma 的用户投赞成或反对票。简而言之,Hacker News 允许提交任何可以被理解为“任何满足人们求知欲”的新闻
公众号排版
NeuraPress Pro Markdown Editor
NeuraPress 是一个现代化的 Markdown 编辑器,专注于提供优质的内容排版体验。 响应式设计,支持移动设备,让创作变得更加高效。
NeuraPress
Markdown 转微信公众号内容神器
WeChat Markdown Editor
WeChat Markdown Editor | 一款高度简洁的微信 Markdown 编辑器:支持 Markdown 语法、色盘取色、多图上传、一键下载文档、自定义 CSS 样式、一键重置等特性
mdnice
微信公众号样式一键转换,知乎/语雀专属排版优化
MD2Card - Markdown 转知识卡片工具
MD2Card 是一个免费的 Markdown 转知识卡片工具,支持一键生成小红书风格海报、社交媒体文案排版,让创作者轻松制作精美的图文内容。支持多种主题风格、长文自动拆分、一键导出图片,让你的创作更加高效。
录屏工具
Screenity
开源免费的 chrome 录屏插件。
Cursorful
具有自动缩放功能的屏幕录像 使用 Cursorful 浏览器扩展程序录制精美的屏幕录像跟随光标缩放或在编辑器中加载您自己的视频并可以手动添加缩放。
AI 检测工具
腾讯朱雀AI文本检测
腾讯朱雀AI文本检测基于多种先进的人工智能模型,构造数百万级别的数据进行训练,能够识别出人类和AI的书写模式。该系统不仅具备优秀的英文检测能力,在处理中文数据方面表现尤为出色。
付费订阅平台
Quaily | 为创作者提供现代人工智慧新闻通讯服务
Quaily 是一个现代化的,基于 AI 的,新闻订阅服务。它支持多种推送渠道,包括邮件,telegram 和 discord。它与流行的编辑器(如 Obsidian 和 VScode)有很好的集成。
Medium: Read and write stories.
On Medium, anyone can share insightful perspectives, useful knowledge, and life wisdom with the world.
Substack
The app for independent voices
微信公众平台
微信公众平台支持付费合集,付费文章
小报童
付费专栏,体面而用心地创作
知识星球
知识星球是创作者连接铁杆粉丝,实现知识变现的工具。任何从事创作或艺术的人,例如艺术家、工匠、教师、学术研究、科普等,只要能获得一千位铁杆粉丝,就足够生计无忧,自由创作。社群管理、内容沉淀、链接粉丝等就在知识星球。
常用工具
在线工具
TableConvert
Excel转sql在线工具。将你的Excel数据转换成一个网络友好格式,包括HTML、JSON和XML,还可以把Excel 转换成Sql,excel 表格转成 Markdown
JSON Editor Online
在线的JSON编辑器,包括格式化,可视化,对比,显示行号功能。
Beautifier
Beautify JavaScript, JSON, React.js, HTML, CSS, SCSS, and SASS
SQL格式化
在线美化SQL语句的工具,格式化方便阅读
TinyPNG
在线图片压缩工具
ScreenShots.pro
App Screenshot Generator for App Store&Google Play,Create panoramic screenshots for iOS and Android apps. No account needed.
图形创意
photoshop
Photoshop不需要解释
Affinity Designer
专业创意软件
Illustrator
矢量图形和插图。
界面设计
Figma
在线UI设计工具
交互动效
Adobe After Effects CC
电影般的视觉效果和动态图形。
principle
Animate Your Ideas, Design Better Apps
flinto
Flinto is a Mac app used by top designers around the world to create interactive and animated prototypes of their app designs.
framer
Design everything from detailed icons to high-fidelity interactions—all in one place.
在线配色
Color Hunt
色彩搭配
素材资源
图标素材
Iconfinder
2,100,000+ free and premium vector icons.
iconfont
阿里巴巴矢量图标库
iconmonstr
Free simple icons for your next project
Icon Archive
Search 590,912 free icons
FindIcons
Search through 300,000 free icons
IcoMoonApp
Icon Font, SVG, PDF & PNG Generator
flaticon
634,000+ Free vector icons in SVG, PSD, PNG, EPS format or as ICON FONT.
UICloud
The largest user interface design database in the world.
Material icons
Access over 900 material system icons, available in a variety of sizes and densities, and as a web font.
Font Awesome Icon
The complete set of 675 icons in Font Awesome
ion icons
The premium icon font for Ionic Framework.
Simpleline Icons
Simple line Icons pack
LOGO设计
Iconsfeed
iOS icons gallery
iOS Icon Gallery
Showcasing beautiful icon designs from the iOS App Store
World Vector Logo
Brand logos free to download
Instant Logo Search
Search & download thousands of logos instantly
平面素材
Freepik
免费矢量素材
Unsplash
免费高清图片
开源项目
文档工具
Docusaurus
Build optimized websites quickly, focus on your content.
VuePress
Vue 驱动的静态网站生成器
mdBook Documentation
Create book from markdown files. Like Gitbook but implemented in Rust