03 / ARTICLE LEDGER
关联文章
按发布时间倒序
- 什么 AI 写 Android 最好用?官方做了一个基准测试排名 2026-03-09 · JUEJIN
- Skills 是什么?如何用于 Agent 开发? 2026-03-09 · JUEJIN
- 一天一个开源项目(第44篇):GitNexus - 零服务器的代码智能引擎,为 AI Agent 构建代码库知识图谱 2026-03-08 · JUEJIN
- AI 智能体如何重构开发工作流 2026-03-08 · JUEJIN
- LLM Writing Tropes.md 2026-03-08 · HACKER_NEWS
- xszyou/Fay 2026-03-07 · GITHUB_TRENDING
- LLM Doesn't Write Correct Code. It Writes Plausible Code 2026-03-07 · HACKER_NEWS
- AI提示词框架深度对比分析 2026-03-07 · JUEJIN
- Sarvam 105B, the first competitive Indian open source LLM 2026-03-07 · HACKER_NEWS
- 【从零手写 ClaudeCode:learn-claude-code 项目实战笔记】(3)TodoWrite (待办写入) 2026-03-07 · JUEJIN
- Show HN: 1v1 coding game that LLMs struggle with 2026-03-07 · HACKER_NEWS
- LLMs work best when the user defines their acceptance criteria first 2026-03-07 · HACKER_NEWS
- Towards Provably Unbiased LLM Judges via Bias-Bounded Evaluation 2026-03-06 · ARXIV
- POET-X: Memory-efficient LLM Training by Scaling Orthogonal Transformation 2026-03-06 · ARXIV
- Leveraging LLM Parametric Knowledge for Fact Checking without Retrieval 2026-03-06 · ARXIV
- Censored LLMs as a Natural Testbed for Secret Knowledge Elicitation 2026-03-06 · ARXIV
- 端侧RAG实战指南 2026-03-06 · JUEJIN
- LangGraph 框架完全指南:构建生产级 AI 工作流 2026-03-06 · JUEJIN
- LangChain 框架完全指南:从入门到精通 2026-03-06 · JUEJIN
- A tool that removes censorship from open-weight LLMs 2026-03-06 · HACKER_NEWS
- How Descript engineers multilingual video dubbing at scale 2026-03-06 · BLOGS_PODCASTS
- 一天一个开源项目(第42篇):OpenFang - 用 Rust 构建的 Agent 操作系统,16 层安全与 7 个自主 Hands 2026-03-06 · JUEJIN
- Splitter学习笔记(含RAG相关流程与代码实践) 2026-03-06 · JUEJIN
- AI 术语满天飞?90% 的人只懂名词,不懂为什么! 2026-03-06 · JUEJIN
- 🦐 PP-Claw(皮皮虾):用 Go 复刻一个轻量级 AI Agent 全栈解决方案 2026-03-06 · JUEJIN
- Robustness of Agentic AI Systems via Adversarially-Aligned Jacobian Regularization 2026-03-05 · ARXIV
- AI Agent框架探秘:拆解 OpenHands(11)--- Runtime主要组件 2026-03-05 · JUEJIN
- A Dual-Helix Governance Approach Towards Reliable Agentic AI for WebGIS Development 2026-03-05 · ARXIV
- Building custom model provider for Strands Agents with LLMs hosted on SageMaker AI endpoints | Amazon Web Services 2026-03-05 · BLOGS_PODCASTS
- The L in "LLM" Stands for Lying 2026-03-05 · HACKER_NEWS
- 当人类知识学会自己奔跑--skill 2026-03-05 · JUEJIN
- 003:RAG 入门-LangChain 读取图片数据 2026-03-05 · JUEJIN
- Monitoring Emergent Reward Hacking During Generation via Internal Activations 2026-03-05 · ARXIV
- Hindsight Quality Prediction Experiments in Multi-Candidate Human-Post-Edited Machine Translation 2026-03-05 · ARXIV
- A “ChatGPT for spreadsheets” helps solve difficult engineering challenges faster 2026-03-04 · BLOGS_PODCASTS
- AI 代码审查工具链搭建:用 AST 解析 + LLM 实现自动化 Code Review 的前端工程方案 2026-03-04 · JUEJIN
- Evaluating Performance Drift from Model Switching in Multi-Turn LLM Systems 2026-03-04 · ARXIV
- Compact Prompting in Instruction-tuned LLMs for Joint Argumentative Component Detection 2026-03-04 · ARXIV
- Beyond Task Completion: Revealing Corrupt Success in LLM Agents through Procedure-Aware Evaluation 2026-03-04 · ARXIV
- Symbol-Equivariant Recurrent Reasoning Models 2026-03-03 · ARXIV
- Multi-Head Low-Rank Attention 2026-03-03 · ARXIV
- Agent Skill 是什么?一文讲透 Agent Skill 的设计与实现 2026-03-03 · JUEJIN
- 用 SQL 调大模型?Hologres + 百炼,让数据开发直接“对话”AI 2026-03-03 · JUEJIN
- Java开发者的大模型入门:LangChain4j组件全攻略(一) 2026-03-03 · JUEJIN
- MC-Search: Evaluating and Enhancing Multimodal Agentic Search with Structured Long Reasoning Chains 2026-03-03 · ARXIV
- KVSlimmer: Theoretical Insights and Practical Optimizations for Asymmetric KV Merging 2026-03-03 · ARXIV
- Knowledge without Wisdom: Measuring Misalignment between LLMs and Intended Impact 2026-03-03 · ARXIV
- Evaluating AI Grading on Real-World Handwritten College Mathematics: A Large-Scale Study Toward a Benchmark 2026-03-03 · ARXIV
- Curvature-Weighted Capacity Allocation: A Minimum Description Length Framework for Layer-Adaptive Large Language Model Optimization 2026-03-03 · ARXIV
- CHIMERA: Compact Synthetic Data for Generalizable LLM Reasoning 2026-03-03 · ARXIV