2648 条情报
排序:最新优先
2026年八月 50 篇
类型标题来源日期标签操作
自动[AINews] AMD buys Taalas

这是一份AI行业近期资讯汇总,涵盖芯片领域的并购动态、头部模型的性能进展以及开发者工具与基础设施的更新。

BLOGS_PODCASTS08-0717min
大语言模型 AI Agent 博客与播客
自动Control agent behaviors and cost beyond a single action: new capabilities in Amazon Bedrock AgentCore

Amazon Bedrock AgentCore 新增了**时间策略**和**网关速率限制**两项功能。时间策略由开源的 Dogwood 策略语言实现,能够在 agent 的整个执行序列上检查行为是否符合预设规则,而不只是对单次调用做判断。

BLOGS_PODCASTS08-078min
大语言模型 AI Agent Amazon Bedrock AgentCore
自动jina-reranker-v3.5:通过混合 Attention 和自蒸馏实现更快的 Listwise Reranking

当前保存的是 RSS 或来源节选,不代表原文全文。请以原始来源为准。

JUEJIN08-071min
AI 掘金 来源快报
自动The Bitter Lesson of Tool Calling

当前保存的是来源摘要,不代表论文全文。请以原始来源为准。

ARXIV08-072min
大语言模型 AI Agent cs.CL
自动AI 应用的统一流量门户:深度解析阿里云 AI 网关 Serverless 新架构与智能路由

核心结论 阿里云AI网关Serverless新版已完成架构升级,提供统一流量入口能力。该版本支持接入LLM API、Agent API和MCP Server,集成了路由、认证、限流、安全防护和用量观测功能。新版分为标准版和企业版两种形态:标准版0元起步、按用量付费,企业版提供独立入口和更高服务等级。

JUEJIN08-071min
掘金 工程实践 来源转写
自动Configure rate limits for AI traffic on AgentCore gateway

本文说明在托管 AI 网关上为流量设置速率限制的方案,支持按用户、目标或令牌维度进行细粒度管控。

BLOGS_PODCASTS08-0716min
大语言模型 AI Agent Advanced (300)
自动Humans missed 1 in 3 threats approving AI agent commands across 40k game runs

当前只保存了标题与来源元数据,未抓取外链全文。请以原始来源和 Hacker News 讨论为准。

HACKER_NEWS08-071min
AI Agent Hacker News 来源快报
自动Inside vLLM: Anatomy of a High-Throughput LLM Inference System (2025)

当前只保存了标题与来源元数据,未抓取外链全文。请以原始来源和 Hacker News 讨论为准。

HACKER_NEWS08-071min
大语言模型 Hacker News 来源快报
自动Predicting Brain Morphometry with MT-GNN: Mesh Evolution in Continuous Time with Graph-Based Metric Tensor Embeddings

该研究提出一种基于图神经网络的连续时间皮层下结构表面演化预测模型,模型通过预测每个顶点的一阶基本形式(度量张量)并利用可微分刚体保持求解器将其恢复为完整表面,实现从少量先前扫描直接推断未来几何形态。

ARXIV08-071min
计算机视觉 cs.CV ArXiv
自动Securing AI agents with temporal policies in Amazon Bedrock AgentCore

这是一种在网关层对 AI 代理的请求进行基于会话历史的授权检查的机制,通过评估当前请求在轨迹中的上下文来决定是否放行。

BLOGS_PODCASTS08-0715min
大语言模型 AI Agent Prompt 工程
自动使用AI编程开发鸿蒙应用:从环境搭建到实战示例

核心结论 鸿蒙应用开发可通过AI辅助工具提升效率,主要工具包括CodeGenie、DevEco Code和DevEco CLI。开发流程覆盖环境准备、需求描述、代码生成、编译预览、运行验证和错误修复等环节。CodeGenie能够根据自然语言描述生成符合ArkTS规范的代码,并支持直接应用到代码文件。

JUEJIN08-071min
掘金 工程实践 来源转写
自动Teaching Nemotron Greek: Mining a Corpus, Adapting Retrieval, and Grounding Generation for Modern Greek across Specialist Domains

该研究针对现代希腊语在检索增强生成(RAG)系统中的缺失,提出了一套从语料库挖掘、合成监督、检索模型训练、重排微调到阅读模型调优的完整适配方案,并发布了相应的评估基准。

ARXIV08-061min
RAG eess.AS ArXiv
自动Toward Skill-Native LLMs: Skill Entropy for Benchmarking and Training Long-Horizon Reasoning

该内容提出一种量化推理过程中技能切换难度的指标,并在此基础上构建了包含跨技能长时推理任务的评测基准,同时将该指标转化为强化学习训练信号,用于提升模型在复杂推理链中的技能切换能力。

ARXIV08-062min
大语言模型 cs.CL ArXiv
自动我用 Seed Evolving 做了个 AI 小说写作工具

核心结论 用大语言模型做长篇小说创作的核心瓶颈不在于模型能否生成文字,而在于生成后模型是否仍记得之前写过的内容,以及故事能否真正收尾。这一问题的根因是上下文和状态管理,而非模型本身的生成能力。

JUEJIN08-061min
掘金 工程实践 来源转写
自动[AINews] Jeff, Sanjay, Oriol, and Quoc depart DeepMind; Demis to Chair; Koray to SVP — what is going on at GDM???

该内容报道了Google DeepMind近期高层人事变动——包括Jeff Dean、Sanjay Ghemawat、Oriol Vinyals、Quoc Le等关键人物离职并共同创办面向自动化科研的初创公司Discovery Loop;同时概述了Meta在编程智能体方面推出的Muse Spark 1.2与Muse…

BLOGS_PODCASTS08-064min
大语言模型 AI Agent 机器学习
自动Born Against, or why hobby programming communities are against LLM usage

当前只保存了标题与来源元数据,未抓取外链全文。请以原始来源和 Hacker News 讨论为准。

HACKER_NEWS08-061min
大语言模型 Hacker News 来源快报
自动Codex 等 Agent 能写测试、跑流程,为什么回归测试还不能完全交给 AI?

核心结论 AI Agent(如Codex)不适合完全接管回归测试。AI Agent擅长理解目标和灵活探索,适合探索性测试和临时验证场景。回归测试的核心需求是稳定、可重复、可维护的测试流程,而非一次性的临场发挥。将AI Agent用于回归测试会面临结果不可复现、失败归因困难、用例无法积累、断言不明确等挑战。

JUEJIN08-061min
掘金 工程实践 来源转写
自动OctoLong: Mid-Training On Cross-Repository Code Contexts Enhances Long-Context Modeling

当前保存的是来源摘要,不代表论文全文。请以原始来源为准。

ARXIV08-061min
AI cs.AI ArXiv
自动Argus: A General-Purpose Agentic Runtime for Long-Horizon Reasoning

Argus 是一种持续、自我进化的智能体运行时,采用 Manager、Planner、Engineer、Reviewer 四类角色在项目状态上进行有界任务执行。它将用户意图与具体目标、约束及验证条件分离,在模型权重保持不变的前提下通过持久化的运行时状态和控制策略实现自我演化。

ARXIV08-062min
大语言模型 cs.AI ArXiv
自动LLMs won't break symmetric crypto

当前只保存了标题与来源元数据,未抓取外链全文。请以原始来源和 Hacker News 讨论为准。

HACKER_NEWS08-061min
大语言模型 Hacker News 来源快报
自动Run production AI agents in n8n with Amazon Bedrock AgentCore harness

该内容介绍如何通过 n8n 的社区节点 ,在可视化编辑器里直接使用 Amazon Bedrock AgentCore harness,快速为工作流添加具备持久记忆、工具调用和模型自由切换的 AI Agent。

BLOGS_PODCASTS08-0612min
大语言模型 AI Agent Prompt 工程
自动How we built an MCP bridge to give our AgentCore-hosted AI agent access to local MCP tools

这篇文章介绍了一种将云端托管的 AI 代理与本地 MCP 工具连接起来的桥接方案,通过浏览器扩展和本地代理组件转发消息,实现云端客户端对本地工具服务器的调用。

BLOGS_PODCASTS08-0614min
大语言模型 AI Agent Prompt 工程
自动Can Large Language Models Recover Semantic Optimization Opportunities That Compilers Miss?

当前保存的是来源摘要,不代表论文全文。请以原始来源为准。

ARXIV08-061min
大语言模型 cs.PL ArXiv
自动How Mobileye transformed support operations using Amazon Bedrock AgentCore

当前保存的是 RSS 或来源节选,不代表原文全文。请以原始来源为准。

BLOGS_PODCASTS08-068min
大语言模型 AI Agent 生成式 AI
自动Prime Agent: A self-improving RLM agent

当前只保存了标题与来源元数据,未抓取外链全文。请以原始来源和 Hacker News 讨论为准。

HACKER_NEWS08-061min
AI Agent Hacker News 来源快报
自动如何在Windows环境选择适合自己的 AI Agent

核心结论 在 Windows 环境下使用 Codex 这类 AI Agent 工具时,形态选择应基于任务类型。文档处理、文本审阅等需要反复阅读和接续会话的任务,Desktop App 形态更为合适;代码开发、项目构建等任务,CLI 形态能够与本地开发环境更好地衔接。

JUEJIN08-061min
掘金 工程实践 来源转写
自动Assessment of Conditional Diffusion Model for Synthetic Histopathology Image Generation

当前保存的是来源摘要,不代表论文全文。请以原始来源为准。

ARXIV08-062min
生成式 AI cs.LG ArXiv
自动Beating GPT-5.6 Sol on retrieval with 100x cheaper open models

当前只保存了标题与来源元数据,未抓取外链全文。请以原始来源和 Hacker News 讨论为准。

HACKER_NEWS08-061min
大语言模型 Hacker News 来源快报
自动From User Sequences to Scaling Laws: A Multi-Stage Architecture for Meta’s Ads Ranking

该内容介绍了一种将离线用户序列建模与在线广告排序分离的多阶段结构,并配合基于稠密标记化与目标感知注意力的学习方式,使模型能够直接从数据中捕获特征交互。

BLOGS_PODCASTS08-068min
大语言模型 Data Infrastructure ML Applications
自动Agogic: Performance-Timed Music Tokens for LLM-Native Text-to-Symbolic-Music Generation

该研究通过固定模型、数据、算力和解码方式,系统比较七种不同的音乐标记化方案对生成质量的影响,并提出一种以演奏时序为核心的标记流,实验表明该标记化方式在保持分布一致性的前提下显著提升音符时值与力度的表达。

ARXIV08-062min
大语言模型 cs.SD ArXiv
自动How LendingTree built a multi-agent mortgage assistant on Amazon Bedrock

该内容描述了 LendingTree 如何在 Amazon Bedrock 上构建一个包含监督、教育和匹配三个独立智能体的抵押贷款助理,以在对话中为借款人提供信息解释与个性化方案推荐。

BLOGS_PODCASTS08-0612min
大语言模型 RAG AI Agent
自动I'm Scared a Stranger Will Call My Novel AI, So I Built GitHub for Words

当前只保存了标题与来源元数据,未抓取外链全文。请以原始来源和 Hacker News 讨论为准。

HACKER_NEWS08-061min
AI Hacker News 来源快报
自动Circles powers telco personalization with OpenAI technology

当前保存的是 RSS 或来源节选,不代表原文全文。请以原始来源为准。

BLOGS_PODCASTS08-061min
AI 博客与播客 来源快报
自动Launch HN: HyperProbe (YC S26) – Agents that do read-only debugging in prod

当前只保存了标题与来源元数据,未抓取外链全文。请以原始来源和 Hacker News 讨论为准。

HACKER_NEWS08-061min
AI Agent Hacker News 来源快报
自动Test-Time Scaling in Reasoning LLMs: Inference Regimes, Evaluation, and Reproducibility

该研究把语言模型在推理阶段使用更多计算资源的方式划分为三种结构模式:单轨迹顺序扩展、叶级扩展以及前缀级扩展,并围绕这三类模式建立了计算核算、评估指标和实验可复现性的完整框架。

ARXIV08-062min
大语言模型 cs.LG ArXiv
自动Cloudflare OS: an open platform for agents, apps, and work

当前只保存了标题与来源元数据,未抓取外链全文。请以原始来源和 Hacker News 讨论为准。

HACKER_NEWS08-051min
AI Agent Hacker News 来源快报
自动How we built a realtime system for responsive voice AI in six months

当前保存的是 RSS 或来源节选,不代表原文全文。请以原始来源为准。

BLOGS_PODCASTS08-051min
大语言模型 Engineering 博客与播客
自动PAST-Bench: Benchmarking the Foundations of Recursive Self-Improvement in Personal Agents

当前保存的是来源摘要,不代表论文全文。请以原始来源为准。

ARXIV08-052min
AI Agent cs.CL ArXiv
自动Inside our 353,000-person vibe coding course

当前保存的是 RSS 或来源节选,不代表原文全文。请以原始来源为准。

BLOGS_PODCASTS08-051min
大语言模型 AI Agent Gemini models
自动Position: LLMs Can't Jump

当前只保存了标题与来源元数据,未抓取外链全文。请以原始来源和 Hacker News 讨论为准。

HACKER_NEWS08-051min
大语言模型 Hacker News 来源快报
自动TurnSight: Turn-Level Hindsight Self-Distillation for Tool-Integrated Reasoning

当前保存的是来源摘要,不代表论文全文。请以原始来源为准。

ARXIV08-051min
大语言模型 AI Agent cs.CL
自动Teaching AI to speak the language of pathology

当前保存的是 RSS 或来源节选,不代表原文全文。请以原始来源为准。

BLOGS_PODCASTS08-051min
AI Health 博客与播客
自动WorldCup Arena: Prospective, Leakage-Free Evaluation of Frontier LLMs on a Live Tournament

在2026年世界杯的赛期(39 天)里,六款具备扩展思考和服务器端搜索功能的前沿大语言模型在每场比赛开球前填写七市场预测卡,涵盖104场小组赛、12支小组冠军以及赛前全赛预测。提问时答案尚未出现,评估因此实现了无泄漏的前瞻性,冻结档案保留了4 494条已评分预测。

ARXIV08-052min
大语言模型 cs.CL ArXiv
自动SocietyBench: Forecasting Counterfactual Social-World Evolution

该基准把真实社交事件的新闻和社交媒体内容整合成时间线,并将其转化为去标识化的反事实情境,用以评估语言模型在**概率校准**和**时间准确性**两个维度上的预测表现。

ARXIV08-052min
大语言模型 AI Agent cs.CL
自动Unpacking ChatGPT Work: the Agent for a Billion Users

这是一篇对 OpenAI 近期发布的 ChatGPT Work 进行深度拆解的分析,阐述它作为知识工作代理的定位、底层云虚拟机、任务持久化机制以及与现有产品(Chat、Codex 等)的融合路线。

BLOGS_PODCASTS08-0515min
大语言模型 AI Agent Prompt 工程
自动Zero-Mem: Zero-Token Memory Operations for LLM Agents

当前只保存了标题与来源元数据,未抓取外链全文。请以原始来源和 Hacker News 讨论为准。

HACKER_NEWS08-051min
大语言模型 AI Agent Hacker News
自动[AINews] Megakernels are so dead and so back

当前保存的是 RSS 或来源节选,不代表原文全文。请以原始来源为准。

BLOGS_PODCASTS08-0513min
大语言模型 AI Agent Prompt 工程
自动ParVL: Parallel Scaling and Expandable Compute Allocation for Multimodal LLMs

ParVL 是一种多模态大语言模型的并行扩展方案。它在保持原有视觉编码器(ViT)和语言模型(LLM)主干参数不变的前提下,通过添加分支专属的 prefix 参数,让多个视觉和语言分支共享同一套主干,从而实现算力的并行增长并灵活调配视觉与语言之间的计算比例。

ARXIV08-051min
大语言模型 计算机视觉 cs.CV
自动Structured Memory for Edge Language Models: Persistent Context and Corpus Retrieval via O(1) SSM State Injection

当前保存的是来源摘要,不代表论文全文。请以原始来源为准。

ARXIV08-052min
大语言模型 RAG cs.LG
自动用 Seed-Evolving 当「脑洞合伙人」:我用 AI 搭了个想象力健身房

核心结论 Doubao-Seed-Evolving作为持续进化的深度思考模型,在创意内容生成场景中展现出规模化供给、打破思维惯性、降低创作门槛三项核心价值。创作者通过提示词精确控制输出风格,模型负责批量产出“离谱但自洽”的创意原料,实现人机协作的创意生产流程。

JUEJIN08-051min
掘金 工程实践 来源转写