03 / ARTICLE LEDGER

关联文章

按发布时间倒序

  1. 什么 AI 写 Android 最好用?官方做了一个基准测试排名 2026-03-09 · JUEJIN
  2. Skills 是什么?如何用于 Agent 开发? 2026-03-09 · JUEJIN
  3. 一天一个开源项目(第44篇):GitNexus - 零服务器的代码智能引擎,为 AI Agent 构建代码库知识图谱 2026-03-08 · JUEJIN
  4. AI 智能体如何重构开发工作流 2026-03-08 · JUEJIN
  5. LLM Writing Tropes.md 2026-03-08 · HACKER_NEWS
  6. xszyou/Fay 2026-03-07 · GITHUB_TRENDING
  7. LLM Doesn't Write Correct Code. It Writes Plausible Code 2026-03-07 · HACKER_NEWS
  8. AI提示词框架深度对比分析 2026-03-07 · JUEJIN
  9. Sarvam 105B, the first competitive Indian open source LLM 2026-03-07 · HACKER_NEWS
  10. 【从零手写 ClaudeCode:learn-claude-code 项目实战笔记】(3)TodoWrite (待办写入) 2026-03-07 · JUEJIN
  11. Show HN: 1v1 coding game that LLMs struggle with 2026-03-07 · HACKER_NEWS
  12. LLMs work best when the user defines their acceptance criteria first 2026-03-07 · HACKER_NEWS
  13. Towards Provably Unbiased LLM Judges via Bias-Bounded Evaluation 2026-03-06 · ARXIV
  14. POET-X: Memory-efficient LLM Training by Scaling Orthogonal Transformation 2026-03-06 · ARXIV
  15. Leveraging LLM Parametric Knowledge for Fact Checking without Retrieval 2026-03-06 · ARXIV
  16. Censored LLMs as a Natural Testbed for Secret Knowledge Elicitation 2026-03-06 · ARXIV
  17. 端侧RAG实战指南 2026-03-06 · JUEJIN
  18. LangGraph 框架完全指南:构建生产级 AI 工作流 2026-03-06 · JUEJIN
  19. LangChain 框架完全指南:从入门到精通 2026-03-06 · JUEJIN
  20. A tool that removes censorship from open-weight LLMs 2026-03-06 · HACKER_NEWS
  21. How Descript engineers multilingual video dubbing at scale 2026-03-06 · BLOGS_PODCASTS
  22. 一天一个开源项目(第42篇):OpenFang - 用 Rust 构建的 Agent 操作系统,16 层安全与 7 个自主 Hands 2026-03-06 · JUEJIN
  23. Splitter学习笔记(含RAG相关流程与代码实践) 2026-03-06 · JUEJIN
  24. AI 术语满天飞?90% 的人只懂名词,不懂为什么! 2026-03-06 · JUEJIN
  25. 🦐 PP-Claw(皮皮虾):用 Go 复刻一个轻量级 AI Agent 全栈解决方案 2026-03-06 · JUEJIN
  26. Robustness of Agentic AI Systems via Adversarially-Aligned Jacobian Regularization 2026-03-05 · ARXIV
  27. AI Agent框架探秘:拆解 OpenHands(11)--- Runtime主要组件 2026-03-05 · JUEJIN
  28. A Dual-Helix Governance Approach Towards Reliable Agentic AI for WebGIS Development 2026-03-05 · ARXIV
  29. Building custom model provider for Strands Agents with LLMs hosted on SageMaker AI endpoints | Amazon Web Services 2026-03-05 · BLOGS_PODCASTS
  30. The L in "LLM" Stands for Lying 2026-03-05 · HACKER_NEWS
  31. 当人类知识学会自己奔跑--skill 2026-03-05 · JUEJIN
  32. 003:RAG 入门-LangChain 读取图片数据 2026-03-05 · JUEJIN
  33. Monitoring Emergent Reward Hacking During Generation via Internal Activations 2026-03-05 · ARXIV
  34. Hindsight Quality Prediction Experiments in Multi-Candidate Human-Post-Edited Machine Translation 2026-03-05 · ARXIV
  35. A “ChatGPT for spreadsheets” helps solve difficult engineering challenges faster 2026-03-04 · BLOGS_PODCASTS
  36. AI 代码审查工具链搭建:用 AST 解析 + LLM 实现自动化 Code Review 的前端工程方案 2026-03-04 · JUEJIN
  37. Evaluating Performance Drift from Model Switching in Multi-Turn LLM Systems 2026-03-04 · ARXIV
  38. Compact Prompting in Instruction-tuned LLMs for Joint Argumentative Component Detection 2026-03-04 · ARXIV
  39. Beyond Task Completion: Revealing Corrupt Success in LLM Agents through Procedure-Aware Evaluation 2026-03-04 · ARXIV
  40. Symbol-Equivariant Recurrent Reasoning Models 2026-03-03 · ARXIV
  41. Multi-Head Low-Rank Attention 2026-03-03 · ARXIV
  42. Agent Skill 是什么?一文讲透 Agent Skill 的设计与实现 2026-03-03 · JUEJIN
  43. 用 SQL 调大模型?Hologres + 百炼,让数据开发直接“对话”AI 2026-03-03 · JUEJIN
  44. Java开发者的大模型入门:LangChain4j组件全攻略(一) 2026-03-03 · JUEJIN
  45. MC-Search: Evaluating and Enhancing Multimodal Agentic Search with Structured Long Reasoning Chains 2026-03-03 · ARXIV
  46. KVSlimmer: Theoretical Insights and Practical Optimizations for Asymmetric KV Merging 2026-03-03 · ARXIV
  47. Knowledge without Wisdom: Measuring Misalignment between LLMs and Intended Impact 2026-03-03 · ARXIV
  48. Evaluating AI Grading on Real-World Handwritten College Mathematics: A Large-Scale Study Toward a Benchmark 2026-03-03 · ARXIV
  49. Curvature-Weighted Capacity Allocation: A Minimum Description Length Framework for Layer-Adaptive Large Language Model Optimization 2026-03-03 · ARXIV
  50. CHIMERA: Compact Synthetic Data for Generalizable LLM Reasoning 2026-03-03 · ARXIV