|
返事ありがとうございます。 > - どういうリクエストを送ったのか > - 環境 (Windows など) > - 何を実行したのか (telnet でやったとか perl で書いたとか) > - どの URL を試しても同じ結果になるのか > - 実際のコードは (perl と C 以外わかりませんけど) 環境:UNIX 言語:C言語でproxyサーバにはsocket通信でリクエストを送っています。 具体的には以下の内容をsendで送っています。 GET http://www.yahoo.co.jp/ HTTP/1.1 Host:www.yahoo.co.jp (空行) ※proxyサーバが社内のマシンしかアクセスできない設定になっているので、 実際にはwww.yahoo.co.jpの部分は社内のhost名を指定しています。 >> ヘッダしか取出せません。 この後、もうちょっと調べてみると、 一度目のrecvでレスポンスヘッダが送られてきて、 二度目のrecvでエンティティボディが取出されることがわかりました。 NetscapeProxyServerの仕様なのでしょうか。 あと、レスポンスヘッダ文字列の大文字小文字ですが、 本などでは"-"の後の文字は大文字なのですが、 上記の環境で行うと小文字になります。 (例)「Last-Modified」→「Last-modified」など。。。 これもNetscape Proxy Serverの仕様なのでしょうか。 御存知のことがあれば教えてください。 |
|
> 一度目のrecvでレスポンスヘッダが送られてきて、 > 二度目のrecvでエンティティボディが取出されることがわかりました。 十分な量のバッファを用意して、十分なサイズを指定したからといって、 一度の recv で全てのデータを取り出せるという保証はありません。 これは read でも同じです。 http://X68000.startshop.co.jp/~68user/net/c-open.html の最後には > もし指定したファイルの長さが 600 バイトなら、 > 1回目のループ: read_size == 256 > 2回目のループ: read_size == 256 > 3回目のループ: read_size == 88 > 4回目のループ: read_size == 0 と書きましたが、これは相手がファイルシステムだからであって、 ソケット経由だと、 char buf[1000]; read(socket,buf,sizeof(buf)); としても、 1回目のread: read_size == 10 2回目のread: read_size == 20 3回目のread: read_size == 1 4回目のread: read_size == 0 などとなる可能性があります (この例ではデータ量は31バイト)。 要は IP パケットが細切れに送られてきたとき、read(recv) すると 要求されたサイズのデータが届くまで待つのではなく、そのときまでに 受け取っているデータを返すわけです。例えば echo サーバで、 $|=1; print(SOCKET,"a"); sleep(5); print(SOCKET,"b"); sleep(5); print(SOCKET,"c"); sleep(5); とすると、細切れなデータが送られるわけです。 > (例)「Last-Modified」→「Last-modified」など。。。 Netscape Proxy Server がわざわざ変換しているのか、 WWW サーバがそういうヘッダを返すのかはわかりませんが、 規格上は大文字小文字は区別されません (RFC のどこかに書いてあるはず)。 Last-Modified/Last-modefied/LaSt-MODIfied は同じように 扱わないといけません。 ちょっと用事があり、今日の夜から数日間 返答できませんのでよろしく。 |
|
> 一度の recv で全てのデータを取り出せるという保証はありません。 あ、これは read_size = recv(s,buf,sizeof(buf),0); のことです。 read_size = recv(s,buf,sizeof(buf),MSG_WAITALL); なら、全データを待ちますので、recv は1回だけ実行すれば OK です。 ただし MSG_WAITALL を指定しても、シグナル受信・コネクション切断時は、 全データを待たずに recv から戻ります。 |
|
ども、初めまして。とほほWWW−ラウンジから来ました。 「ネットワークプログラミングの基礎知識」が大変ためになります。 同様な事は書籍(ラクダ青本)にも書かれていますが、こちらがずっと解かりやすいです。 コンテンツ制作御苦労様です & 有り難う御座います。 ------------------------------ すっごく勉強になる解説のため、繰り返し読む事になるのですが、ベージ配色が、テキストが黒系統なく白系統であるため目が少々付かれます、またバックカラーとテキストの明暗が近寄っているのでこれも目に付かれる要因のような気がします。まっここいらは個人的嗜好の部分だと思います。 そういう事で、バックカラーとテキストカラーの指定を外部スタイルシートで指定させようと思い、その為には取りあえずコンテンツの階層を含めてローカルにダウンし、その後ローカル内で階層を跨いだHTMLファイルの修正をPerlで行う事にしました。 そういう事で、今、再帰的ディレクトリエントリサーチスクリプトを制作中です。。。。。 #いつも本題の前に、「あれやる、これやる」と時間がかかる私でした(笑) #ところで、68userさんは、とほほラウンジでの「B-cus」さんと同一な方でしょうか?、、、まっいらぬ詮索の範疇なのですが(^^; |
|
cksumコマンドについて知りたいのですが、 ��cksumコマンドはファイルに対してどういったチェックを行うで しょうか? �■淡生譴�らcksumコマンドを実行かけた時に、正常に終了したか、 もしくは、異常終了したかの判断は行えるのでしょうか? もし、行えるのであれば、詳細なエラー情報はどういったものが あるのでしょうか。 |
|
> ベージ配色が、テキストが黒系統なく白系統であるため目が少々付かれます であれば perl -pi.bak -e 's/BGCOLOR="#575757" TEXT="#FFFFFF"/BGCOLOR=white TEXT=black/' *.html などがお手軽です。 > まっここいらは個人的嗜好の部分だと思います。 前に「背景が黒/文字が白で読みやすい」と言われたこともあります。 人によって好みが違うので難しいですね。 > �´� 丸付き数字は機種依存文字なので、使ってはいけません。 > cksumコマンドはファイルに対してどういったチェックを行うでしょうか? http://www.jp.FreeBSD.org/cgi/cvsweb.cgi/src/usr.bin/cksum/ を読んで下さい。なぜそういうコードになっているかを知ろうとすると ほとんど数学になってしまいますので、僕には説明できません。 > C言語からcksumコマンドを実行かけた時に、正常に終了したか、 > もしくは、異常終了したかの判断は行えるのでしょうか? system(3) の戻り値でわかります。0 なら正常、異常終了なら 戻り値を 8bit 右シフトしたものが終了ステータス (cksum が return したり exit した値)。 |
|
> cksum 日本語マニュアルを最初に紹介すべきでした。 http://www.jp.freebsd.org/cgi/mroff.cgi?subdir=man&man=cksum&dir=jpman-3.3.0%2Fman |
|
>> �´� > 丸付き数字は機種依存文字なので、使ってはいけません。 そうそう、これ、研究室のFreeBSD環境では見えませんでした。 |
|
うーん、ちょっとめんどくさいけど、掲示板をいじって 機種依存文字をはじくようにしようかな…。 |
|
テストがてら、書き込み。wwwboard.cgi をちょこっと書き換えました。 ��Windows 機種依存文字を表示時に変換するようにしました。 本来、書き込み時に変換するのがベストですが、正しく変換できてるか どうか自信がないので、しばらくこれで様子を見ます。 ��二度書き防止機能を追加。最新10発言の MD5 を保存し、 重複していたら書き込みできないようにしました。 …と、あえて機種依存文字を使ってみたり。 今後、この掲示板では Windows 機種依存文字の使用を推奨します(^^; スクリプトはこちら。http://X68000.startshop.co.jp/~68user/cgi-bin/view-script.cgi/wwwboard.cgi |
|
はじめまして、とほほさんのところからお伺いさせて 頂きました。はじめまして。 早速ですが、自動変換された、 �� の 「(機種依存文字なので自動変換しました)」 の部分、長くて本文が読みづらいので、たとえば変換した 部分を今の赤色のまま、このページの下の方とかその他の ページとかにリンクを張って、そこに (機種依存文字なので自動変換しました) とか書いていただければ、あっさりして見やすと思うの ですが、いかがでしょうか? ご検討頂ければ幸いです。 |
|
確かにおっしゃるとおり読みにくいので、こんなふうにしてみました。 いかがでしょうか。 |
|
# はじめましてが、引用符みたいになってしまって、むっちゃ恥ずかしい・・・ 早速直して頂いて、ありがとうございます。かなり見やすくなったと思います。 しかも、変換した場合だけ注釈が出る、というところが、かっこいいですね。 関係無いですが、目立たせたいがために、わざとWindows 機種依存文字を使う ことも出来そうですね。 あと、「HTTPクライアントを作ってみよう」の 「さらなる改善点・バーチャルホストに対応」について、質問があります。 http://www.host2.com/index.html に対して、 GET /index.html HTTP/1.0 host: www.host2.com:80 とリクエストする例がありますが、RFC2616の2045行近辺を当てはめると、 この例ではポート番号はいらないように思われますが、いかがでしょうか? HTTP/1.0では必要なのかな、と思ってRFC1945を読んでみたんですが、どう しても探し当れられなかったので、単なる私の勘違いかもしれませんが・・・ 宜しくお願いします。 |
|
ご意見ありがとうございます。ftp://ftp.iij.ad.jp/pub/RFC/rfc2616.txt には、 3.2.2 http URL If the port is empty or not given, port 80 is assumed. とあるので、「80 なら省略すべし」と決まっているわけではないです。なので :80 は付けても付けなくても構いません。 ただ、確かに「80の場合は省略してもよい」というのは書いておいた 方がよいと思うので、直しておきます。 # が、これは Host: に限ったことではなく、URL 一般の話なので、 # どこで解説したらいいのか悩むところだなぁ…。 |
|
御回答、ありがとうございます。 なるほど、無い場合は80が仮定されるんですね。 http://www.host2.com/ の、 www.host2.com と全く同じ文字を、 host: の後に書く必要があるんかな、と 思ったのですが、常に付けていても問題ないのですね。わかりました。 また分からないことがあったら、質問させて頂きますので、その時は宜しく お願い致します。 |
|
こんにちわ!このHPで最近勉強させてもらってます! ところで、FTPクライアントをC言語で書く予定は無いのでしょうか? 一応見よう見まねでこのHPのパールで書かれたソースから Cで書いてみたのですが、見事失敗! (具体的にいうと、getsocknameの使い方がmanでしらべても よくわからなかったのです(泣)できれば教えてください!) ですから、説明無しでもソースだけアップしてもらえたらな〜、 なんて自分勝手なことを思ってしまってます。(ごめんなさい) あるいは、CでかかれたFTPクライアントをアップしている HPがありましたら、ご紹介いただけると幸いです! |