Y
HN Search
Hacker News Search
new
|
comments
|
top
|
jobs
veryluckyxyz
searching PlanetScale…
1.
▲
2.
▲
3.
▲
4.
▲
5.
▲
6.
▲
5 ms
·
1.
▲
Scaling Laws for Agent Harnesses via Effective Feedback Compute
(arxiv.org)
1 points
by
veryluckyxyz
4mo ago
|
0 comments
2.
▲
by
veryluckyxyz
8mo ago
Consider fixing your “published date” on the site.
3.
▲
by
veryluckyxyz
8mo ago
The date is wrong. It is 2026, not 2025
4.
▲
Generalizing Test-Time Compute-Optimal Scaling as an Optimizable Graph
(huggingface.co)
2 points
by
veryluckyxyz
11mo ago
|
0 comments
5.
▲
Hidden drivers of HRM's performance on ARC-AGI
(arcprize.org)
31 points
by
veryluckyxyz
1y ago
|
2 comments
6.
▲
Set Block Decoding Is a Language Model Inference Accelerator
(arxiv.org)
4 points
by
veryluckyxyz
1y ago
|
0 comments
7.
▲
Deep Think with Confidence
(jiaweizzhao.github.io)
1 points
by
veryluckyxyz
1y ago
|
0 comments
8.
▲
A Batch Size and Token NUM- BER Agnostic Learning Rate Scheduler
(arxiv.org)
2 points
by
veryluckyxyz
1y ago
|
0 comments
9.
▲
Easily Understand Rdma Technology
(naddod.com)
1 points
by
veryluckyxyz
1y ago
|
1 comments
10.
▲
Model Merging in Pre-Training of Large Language Models
(arxiv.org)
2 points
by
veryluckyxyz
1y ago
|
0 comments
11.
▲
Understanding Perception and Reasoning Through Model Merging
(arxiv.org)
2 points
by
veryluckyxyz
1y ago
|
0 comments
12.
▲
Building and better understanding vision-language models (2024)
(huggingface.co)
2 points
by
veryluckyxyz
1y ago
|
0 comments
13.
▲
HF smolagents computer-agent demo
(huggingface.co)
1 points
by
veryluckyxyz
1y ago
|
0 comments
14.
▲
Do Reasoning Models Show Better Verbalized Calibration?
(arxiv.org)
2 points
by
veryluckyxyz
1y ago
|
0 comments
15.
▲
Robustly identifying concepts introduced during chat fine-tuning with crosscoder
(arxiv.org)
6 points
by
veryluckyxyz
1y ago
|
0 comments
16.
▲
Retrieval with Learned Similarities
(arxiv.org)
3 points
by
veryluckyxyz
2y ago
|
0 comments
17.
▲
The Curse of Depth in Large Language Models
(arxiv.org)
1 points
by
veryluckyxyz
2y ago
|
0 comments
18.
▲
by
veryluckyxyz
2y ago
https://pytorch.org/blog/hitchhikers-guide-speculative-decod... https://colab.research.google.com/github/sanchit-gandhi/note...
19.
▲
Looking Back at Speculative Decoding
(research.google)
36 points
by
veryluckyxyz
2y ago
|
5 comments
20.
▲
Long-Context GRPO
(unsloth.ai)
60 points
by
veryluckyxyz
2y ago
|
22 comments
21.
▲
HippoRAG: Neurobiologically Inspired Long-Term Memory for LLMs (2024)
(arxiv.org)
65 points
by
veryluckyxyz
2y ago
|
4 comments
22.
▲
Learning to Plan and Reason for Evaluation with Thinking-LLM-as-a-Judge
(arxiv.org)
1 points
by
veryluckyxyz
2y ago
|
0 comments
23.
▲
Process Reinforcement Through Implicit Rewards
(curvy-check-498.notion.site)
1 points
by
veryluckyxyz
2y ago
|
0 comments
24.
▲
Explaining Large Language Models Decisions Using Shapley Values
(arxiv.org)
89 points
by
veryluckyxyz
2y ago
|
19 comments
25.
▲
Phi-4 Technical Report
(arxiv.org)
2 points
by
veryluckyxyz
2y ago
|
0 comments
26.
▲
Alignment Faking in LLMs [pdf]
(assets.anthropic.com)
2 points
by
veryluckyxyz
2y ago
|
1 comments
27.
▲
What Makes Rotary Positional Encodings Useful?
(arxiv.org)
1 points
by
veryluckyxyz
2y ago
|
0 comments
28.
▲
Rethinking Softmax: Self-Attention with Polynomial Activations
(arxiv.org)
2 points
by
veryluckyxyz
2y ago
|
0 comments
29.
▲
Post-Training Layer Scaling Prevents Forgetting and Enhances Model Merging
(arxiv.org)
1 points
by
veryluckyxyz
2y ago
|
0 comments
30.
▲
Random Matrix Theory in Machine Learning Tutorial
(random-matrix-learning.github.io)
2 points
by
veryluckyxyz
2y ago
|
0 comments
More ›