| 类型 | 标题 | 来源 | 日期 | 标签 | 操作 |
|---|---|---|---|---|---|
| RedEvoAgent: Automatic Red-Teaming Agent with Experience-Driven Skill Evolution 当前保存的是来源摘要,不代表论文全文。请以原始来源为准。 | ARXIV | 08-291min | |||
| Spreading the load: How Salesforce met Multi-AZ HA with SageMaker Inference Components Salesforce 在使用 SageMaker 推理组件部署模型时,通过 API 中的 **SchedulingConfig** 参数对副本在多个可用区之间的放置进行细粒度控制,以满足自身的多可用区高可用合规要求。 | BLOGS_PODCASTS | 08-2911min | |||
| [AINews] OpenAI shuts off Cursor 当前保存的是 RSS 或来源节选,不代表原文全文。请以原始来源为准。 | BLOGS_PODCASTS | 08-2913min | |||
| AI 生成页面全是紫粉渐变?我用 ui-ux-pro-max-skill 重构了整个产品页 核心结论 ui-ux-pro-max-skill 是一套面向 AI 编程助手的设计推理引擎,通过内置的行业 UI 知识弥补大模型的行业认知短板。它不提供现成组件,而是输出“这个行业该怎么设计”的推理结果,使 AI 生成的页面从“像网页”变为“像某个行业的网页”。 | JUEJIN | 08-291min | |||
| From Static to Dynamic: Benchmarking Real-World Code Review with MCR-Bench 该内容介绍了一个面向真实多轮代码审查的评测基准,覆盖五种常用编程语言,包含两千余条真实审查任务,并为每条任务标注了缺陷的细粒度属性和跨轮次状态。 | ARXIV | 08-292min | |||
| I accidentally turned LLM memory into program analysis 当前只保存了标题与来源元数据,未抓取外链全文。请以原始来源和 Hacker News 讨论为准。 | HACKER_NEWS | 08-291min | |||
| Batch write and discover records in Amazon SageMaker Feature Store 当前保存的是 RSS 或来源节选,不代表原文全文。请以原始来源为准。 | BLOGS_PODCASTS | 08-2911min | |||
| StemDeck, a free, open-source and local AI stem separator 当前只保存了标题与来源元数据,未抓取外链全文。请以原始来源和 Hacker News 讨论为准。 | HACKER_NEWS | 08-291min | |||
| SWE-Prime: Fewer Trajectories, Better Performance SWE-Prime 是一种两阶段的有监督微调数据筛选方法。它先在轨迹层面依据过程质量、结果质量及数据代表性进行过滤,随后在段层面依据对最终方案的贡献度、可学习性和潜在风险进行细选,只让被选中的段参与损失计算。 | ARXIV | 08-292min | |||
| Autonomous Mathematical Discovery in an Open-World Multi-Agent Environment 当前只保存了标题与来源元数据,未抓取外链全文。请以原始来源和 Hacker News 讨论为准。 | HACKER_NEWS | 08-291min | |||
| How Decathlon runs demand forecasting at scale with Chronos-2 Decathlon 采用时间序列基础模型 Chronos-2 构建需求预测系统,替代原有的深度学习与传统统计方法混合方案,以更低运维成本实现跨区域、多品类的销量预测。 | BLOGS_PODCASTS | 08-2912min | |||
| WikiSkill: Compiling Agent Experience into Persistent Knowledge for Skill Evolution WikiSkill 把代理的原始执行经验、已积累的知识和可执行技能分层管理,并通过一个持久化的 Wiki 持续把经验写入其中,使后续技能更新能够直接在前人成果上构建,从而实现技能的逐步演化与复用。 | ARXIV | 08-292min | |||
| 用 AI 打造高品质 Web 应用 当前保存的是 RSS 或来源节选,不代表原文全文。请以原始来源为准。 | JUEJIN | 08-291min | |||
| Build agentic creative workflows with Amazon Quick and fal 当前保存的是 RSS 或来源节选,不代表原文全文。请以原始来源为准。 | BLOGS_PODCASTS | 08-2812min | |||
| CritICL: Inference-Time Weak-to-Strong Generalization from Small Language Model Failure Modes 当前保存的是来源摘要,不代表论文全文。请以原始来源为准。 | ARXIV | 08-281min | |||
| Terminal-Bench-Science: Evaluating AI agents on scientific research workflows 当前只保存了标题与来源元数据,未抓取外链全文。请以原始来源和 Hacker News 讨论为准。 | HACKER_NEWS | 08-281min | |||
| A Visual Dependence-Aware Framework for Multimodal Unsupervised Continual Post-Training 该研究提出一种在多模态大模型持续后训练中,利用视觉依赖信息来平衡旧任务保持与新任务学习的框架,包含视觉约束的最优传输和视觉调制的适应两部分。 | ARXIV | 08-282min | |||
| Looking beyond natural sequences 这条内容介绍了一种名为 PottsMPNN 的新型机器学习框架,它将支配蛋白质结构的物理原理整合进序列生成过程,从而更准确地评估序列能量关系并预测突变对稳定性的影响。 | BLOGS_PODCASTS | 08-284min | |||
| Nvidia Starts Pac as AI Chip Maker Builds DC Influence Force 当前只保存了标题与来源元数据,未抓取外链全文。请以原始来源和 Hacker News 讨论为准。 | HACKER_NEWS | 08-281min | |||
| [AINews] NVIDIA buys HuggingFace for $13B, as OpenAI publishes their HF incident retro 当前保存的是 RSS 或来源节选,不代表原文全文。请以原始来源为准。 | BLOGS_PODCASTS | 08-278min | |||
| CEO fired developers to make room for AI. Developers create open source AI CEO 当前只保存了标题与来源元数据,未抓取外链全文。请以原始来源和 Hacker News 讨论为准。 | HACKER_NEWS | 08-271min | |||
| VBVR-Pro: A Scalable and Verifiable Suite for Native Visual Reasoning VBVR-Pro 是一个闭环测试平台,旨在把视觉生成本身作为推理介质,实现视觉推理任务的可训练、可验证和可优化。平台提供可扩展的任务集、基于确定性规则的奖励评分器,并支持对多种生成模型进行机制分析。 | ARXIV | 08-272min | |||
| #501 – DHH: Future of Programming, AI, Agentic Engineering, Vibe Coding & Linux 当前保存的是 RSS 或来源节选,不代表原文全文。请以原始来源为准。 | BLOGS_PODCASTS | 08-272min | |||
| Automatic Model Card Generation Using an LLM 该研究提出两种基于语言模型的方案:一种将已有的模型卡片重新组织为统一模板,另一种直接从模型仓库数据生成新的模型卡片,旨在提升模型文档的结构一致性和可获取性。 | ARXIV | 08-272min | |||
| Serve Markdown to AI Agents with Accept Headers 当前只保存了标题与来源元数据,未抓取外链全文。请以原始来源和 Hacker News 讨论为准。 | HACKER_NEWS | 08-271min | |||
| Evaluate any agent framework with Amazon Bedrock AgentCore Evaluations 这段内容介绍了一种评估方案,它能够对使用不同构建框架的 AI 代理进行统一评分。该方案通过读取遵循 OpenTelemetry 标准的链路(trace)中的特定 span 角色,重建对话会话后交由一套与框架无关的评估器进行打分。 | BLOGS_PODCASTS | 08-2715min | |||
| It’s so hard to finish an idea that is not yours and is just suggested by AI 当前只保存了标题与来源元数据,未抓取外链全文。请以原始来源和 Hacker News 讨论为准。 | HACKER_NEWS | 08-271min | |||
| Structurally-bounded Agentic Graph Exploration for Evidence-Grounded Scholarly DeepSearch 该系统采用一次查询生成种子文献,再沿 1.5 跳引用网络扩展,并对缺乏 entailment 支持的引用边进行剪枝,最后用考虑新近度的随机游走对文献进行排序,从而在搜索前就把候选集合、保留理由和停止条件固定下来。 | ARXIV | 08-271min | |||
| Connect Amazon Bedrock AgentCore to cross-account knowledge bases 这是一篇关于在 Amazon Bedrock AgentCore 中实现跨账号访问知识库的技术实践,提供了代码化的 Strands agent 和声明式的 AgentCore harness 两种实现路径,并说明了它们在访问另一账号 Redshift Serverless 数据时的具体做法。 | BLOGS_PODCASTS | 08-269min | |||
| Strictly Causal Streaming Video Anomaly Detection with a Theoretically-Grounded State-Space Core 当前保存的是来源摘要,不代表论文全文。请以原始来源为准。 | ARXIV | 08-262min | |||
| WebMCP: Teaching Your Website to Talk to AI Agents 当前只保存了标题与来源元数据,未抓取外链全文。请以原始来源和 Hacker News 讨论为准。 | HACKER_NEWS | 08-261min | |||
| Fake US thinktank set up and funded by Israel sought to game AI for propaganda 当前只保存了标题与来源元数据,未抓取外链全文。请以原始来源和 Hacker News 讨论为准。 | HACKER_NEWS | 08-261min | |||
| MDTE: Minority-Aware Diffusion over Temporal Edge Events for Imbalanced Node Classification 当前保存的是来源摘要,不代表论文全文。请以原始来源为准。 | ARXIV | 08-261min | |||
| Bill Gates: The turbulent AI era is here 当前只保存了标题与来源元数据,未抓取外链全文。请以原始来源和 Hacker News 讨论为准。 | HACKER_NEWS | 08-261min | |||
| Constrained Entity Selection under Partial Knowledge for LLM-Based Knowledge Graph QA 当前保存的是来源摘要,不代表论文全文。请以原始来源为准。 | ARXIV | 08-262min | |||
| jeecgboot / jimureport 当前只保存了标题与来源元数据,未抓取外链全文。请以原始来源为准。 | GITHUB_TRENDING | 08-261min | |||
| A Dual-Dimensional LLM Framework for Automated Item Incidental Content Similarity Analysis in Large-Scale Assessments 这是一项研究,提出基于大型语言模型的双维度框架,用于自动评估测试项目中因表述或情境而产生的附带内容相似度,旨在解决传统文本相似度指标难以捕捉细微结构和语义冗余的问题。 | ARXIV | 08-261min | |||
| AI 漫剧角色一进分镜就变脸?把提示词升级成“角色 ID + 镜头合同” 核心结论 AI漫剧实现跨镜头稳定性,核心在于建立可执行的状态管理体系。该体系包含五个关键环节:角色ID管理身份、镜头合同表达意图、关键帧界定边界、两层验收保障连续性、版本哈希实现追溯。这一方法将抽象的“保持一致”转化为具体可执行的技术方案。 | JUEJIN | 08-261min | |||
| How loveholidays is making everyone a builder with Codex 当前保存的是 RSS 或来源节选,不代表原文全文。请以原始来源为准。 | BLOGS_PODCASTS | 08-261min | |||
| Reading Is Not Using: Retrieval, Judgment, and the Design of AI Financial Research Workflows 当前保存的是来源摘要,不代表论文全文。请以原始来源为准。 | ARXIV | 08-261min | |||
| Z.ai confirms Ox Alpha is a new GLM-series model and will release its weights 当前只保存了标题与来源元数据,未抓取外链全文。请以原始来源和 Hacker News 讨论为准。 | HACKER_NEWS | 08-261min | |||
| AI helps design new materials that work in the real world 该内容介绍了麻省理工学院研发的一种材料生成框架,在生成前加入价电子壳层约束,以提升生成材料的化学稳定性,并可在保持目标性能的同时显著降低不稳定材料的比例。 | BLOGS_PODCASTS | 08-266min | |||
| LAION-BVD: A 10-Million-Hour Open Video Dataset for Multimodal Pre-training 当前保存的是来源摘要,不代表论文全文。请以原始来源为准。 | ARXIV | 08-261min | |||
| RAG Is Simpler Than You Think 当前只保存了标题与来源元数据,未抓取外链全文。请以原始来源和 Hacker News 讨论为准。 | HACKER_NEWS | 08-261min | |||
| FedV-KGQA: Multi-Hop Question Answering over Vertically Partitioned Knowledge Graphs 它提出一种在垂直分区知识图谱上进行多跳问答的框架,各组织共享实体但保留各自的关系。框架利用本地图增强与嵌入技术,使三元组和关系参数不离开本地,并在无跨 silo 通信的情况下锚定问题对应的图区域。 | ARXIV | 08-261min | |||
| BrowserForge: Scaling Web Episode via Parallel Browser Sandboxes 该工作提出一种框架,利用并行浏览器沙箱在开放网络中批量生成网页交互轨迹,以获取大量多样化的训练数据。 | ARXIV | 08-262min | |||
| Learning Whom to Trust : Decision-Generated Credibility in Social Learning 这项研究把信息提供者的决策过程本身当作可信度来源,用强化学习智能体在二元选择任务中通过漂移‑扩散过程同时生成选择、决策时间和置信度,并把置信度映射为社会影响权重,考察其对社会学习动态的影响。 | ARXIV | 08-261min | |||
| Students prefer Gemini over ChatGPT and Claude for AI essays in blind tests 当前只保存了标题与来源元数据,未抓取外链全文。请以原始来源和 Hacker News 讨论为准。 | HACKER_NEWS | 08-261min | |||
| Parameterized Complexity of $L_p$-Lipschitz Constants for Input Convex Neural Networks and $L_p$-Norm Maximization over Zonotopes 当前保存的是来源摘要,不代表论文全文。请以原始来源为准。 | ARXIV | 08-262min | |||
| SPO++: Stream-Aligned Policy Optimization for Asynchronous Agentic RL 该研究提出一种改进的策略优化方法,修复了传统单流策略优化中终局优势在动作令牌空间的失配问题,并通过在策略事件层面组织提示信息来提升学习效率。 | ARXIV | 08-261min |