[2505.15784] Large Language Models as Computable Approximations to Solomonoff Induction arxiv.org/abs/2505….
CSS Painting Order | Woohoo abandonedwig.info/blog/2020…
Designing Resilient Event-Driven Systems at Scale - InfoQ www.infoq.com/articles/…
プロダクト開発は実験の積み重ねだと個人的には思っているんだけど、ところで、実験とプロダクト開発を両立させるのって無理ゲーじゃね? (とくにビジネスが根本的にある程度以上の規模までスケールするか見るという段階について)
CopilotをAIコーディングに数えるのであれば、半分以上のコードをAIが書いていると言えるのかもしれないけど、実際のとこCopilotはAIコーディングというよりは、ただ単に打鍵を代わりにやらせているという感覚なので、自分でコードを書いていると感じる。しかし予測精度(=コピペ能力)は相当高いので、改めて、Copilotの出来は良いなと。
Claude Codeになると、これはもう書いてもらっているとしか言いようがないけど、たぶんプロダクションコードのアレさもあって、うまく作業してもらえるのか、まだあまり自信がない。とりあえず大嫌いなユニットテスト書きをかわりにやらせてる。だいぶ苦痛と時間を省略できており、ありがたい。たぶん細部を見ると変なテストダブルの作り方してたりとかあるかもしれないけど、まあ、うん。
Reward Hacking in Reinforcement Learning | Lil’Log
え?物の譲渡を禁止するなんていうことできるの?実効性なさそ。
このムックは、おそらく書いた人は技術的な内容についてちゃんとは理解しておらず、単にインタビューした伝聞をまとめただけなので、言ってしまえばLLMが生成した要約とそれほど違わないとも言える。きっと「ハルシネーション」も多分に含まれている。とはいえ、インタビューの内容自体は興味深いものなので、価値はある。